Enfu Nan
収録論文 3本 ・ フィジカルAI/ロボット学習
ビデオ生成/物理推論世界モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PhyGround: 生成ワールドモデルにおける物理推論のベンチマークビデオ生成/物理推論2026/5/11
ビデオ生成モデルの物理法則遵守を評価するための、基準に基づいたベンチマークと自動評価器を提案した論文。
- 機械における人間の認知:世界モデルの統一的視点世界モデル2026/4/1
世界モデルの研究を認知機能の観点から分類し、人間のような認知能力を目指すための統一的枠組みを提案した論文。特に動機付けとメタ認知の研究不足を指摘し、今後の研究方向を示している。
- Moxin-VLMとMoxin-VLAを備えたオープンソースマルチモーダルMoxinモデルVLA2025/12/22
完全オープンソースのLLM「Moxin」を基に、視覚言語理解・視覚言語行動・中国語対応の3つの派生モデルを開発し、公開した。