Kun Feng
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 動画予測ポリシー2:より良く予測し、より良く行動するVLA2026/10/7
操作動画で基盤動画モデルを追加事前学習し、単段階の視覚プランナに蒸留、MoTで行動モジュールを統合することで、オープンエンドな操作タスクにおけるゼロショット汎化性能を大幅に向上させた世界行動モデル。
- BagelVLA: 視覚・言語・行動の交互生成による長期的マニピュレーションの強化VLA2026/2/1
言語計画と視覚予測を行動生成ループに交互に組み込み、長期的なロボット操作タスクの性能を高める統合モデルを提案した。