Kaihui Wang
収録論文 5本 ・ フィジカルAI/ロボット学習
全身動作追跡/基盤モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HoloMotion-1 技術報告書:ゼロショット全身動作追跡のための人型ロボット動作基盤モデル全身動作追跡/基盤モデル2026/5/1
大規模なハイブリッド動作データ(動画再構成・モーションキャプチャ等)で制御ポリシーを学習し、未見の動作や実機へゼロショットで汎化する人型ロボットの全身動作追跡基盤モデルを提案した。
- MapDream:視覚言語ナビゲーションのためのタスク駆動型地図学習VLA2026/2/1
視覚言語ナビゲーションにおいて、ナビゲーション目的に直接最適化されたBEV地図を自己回帰的に生成し、行動予測と統合学習するフレームワークを提案。
- Progress-Think: 視覚言語ナビゲーションのための意味的進捗推論VLA2025/11/1
視覚観測から指示文の進捗を意味的に推論し、ナビゲーション方策を導く三段階フレームワークを提案。R2R-CEとRxR-CEで最高性能を達成。
- MonoDream:パノラマドリーミングによる単眼視覚言語ナビゲーションVLA2025/8/1
単眼入力のみでパノラマRGB-D相当の空間表現を潜在空間で学習し、視覚言語ナビゲーションの性能を向上させる軽量VLAフレームワークを提案。
- Aux-Think: データ効率の良い視覚言語ナビゲーションのための推論戦略の探求VLA2025/5/1
視覚言語ナビゲーション(VLN)において推論戦略を体系的に評価し、推論時の推論崩壊問題を明らかにした上で、CoT教師あり学習で推論パターンを内部化しつつ直接行動予測を行うAux-Thinkを提案した。