Liaoyuan Fan
収録論文 3本 ・ フィジカルAI/ロボット学習
ビデオ生成ナビゲーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AlayaWorld: 長時間・プレイ可能なビデオワールド生成ビデオ生成2026/7/7
ゲームワールドを自動生成するためのフルスタックのオープンソースフレームワークを提案し、リアルタイムでのインタラクションと多様なアクションを可能にする。
- ConsistNav: 意味的実行制御によるゼロショット物体ナビゲーションの行動一貫性ギャップ解消ナビゲーション2026/5/1
ゼロショット物体ナビゲーションにおいて、検出後に探索と追跡を繰り返したり、成功間近で放棄する「行動一貫性ギャップ」を特定し、訓練不要のフレームワークConsistNavを提案。有限状態実行制御、永続的候補メモリ、安定性考慮の行動制御の3モジュールで意味的証拠の一貫した活用を実現し、HM3D/MP3DでSOTAを達成。
- AIM: 空間価値マップを用いた意図認識型統合世界行動モデリングVLA2026/4/1
事前学習済みのビデオ生成モデルを基盤に、将来の観測と空間価値マップを共同で予測し、意図認識型の注意機構と自己蒸留強化学習によりロボットの行動生成を高精度化する手法を提案した。