Zhihui Li
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーションナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 構造化プランナーとしてのワールドモデル:ロボット操作のための疎な未来予測マニピュレーション2026/3/1
密な未来予測の冗長性と誤差蓄積を避けるため、キネマティクスに基づく疎な構造化フレームを予測するワールドモデルを提案し、視覚プランニングと運動制御を橋渡しする。
- 見て、計画して、巻き戻す:進捗認識型視覚言語行動モデルによる堅牢なロボット操作マニピュレーション2026/3/1
ロボット操作のタスク進捗を明示的なマイルストーンで測定し、失敗時に回復可能な状態へ巻き戻すことで堅牢性を高める、進捗認識型の視覚言語行動フレームワークSPRを提案した。
- LatentPilot: 潜在視覚推論による先読みでシーンを理解する視覚言語ナビゲーションナビゲーション2026/3/1
未来の観測を訓練時に活用して行動条件付き視覚ダイナミクスを学習し、推論時には未来フレームを使わずに潜在トークンで先読み推論を行う新しいVLNパラダイムを提案し、ベンチマークと実ロボットでSOTAを達成した。