Xili Dai
Juxi Tech
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAVLA/ツール使用ワールドモデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 見て、思い出して、行動する:並行身体ストリームにおける常時稼働ロボットVLA2026/9/23
常時稼働ロボット向けに、ライブ知覚・身体状態・自身の過去行動を非同期に統合するストリーミングポリシーARMSを提案し、両腕同時作業でのタスク成功率を向上させた。
- 視覚言語行動モデルをオンザフライツール使用エージェントへ進化させるVLA/ツール使用2026/8/14
VLAモデルにツール注入フレームワークを統合し、低次視覚・高次アフォーダンス・身体性を強化するエージェントARTを提案。ツール使用により行動解空間を縮小し、汎用性向上とデータ依存低減を実現。
- プリミティブ身体性ワールドモデルの学習:スケーラブルなロボット学習に向けてワールドモデル2025/8/1
動画生成ベースの身体性ワールドモデルを固定短時間のプリミティブ動作に限定し、言語と動作の細粒度対応・データ効率・推論速度を改善するPEWMを提案。VLMプランナとヒートマップ誘導で閉ループ制御と長期タスクへの組合せ汎化を実現する。