Jiahao Jiang
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAロボット基盤モデルナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- InternVLA-A1.5: 理解・潜在予測・行動の統合による構成的汎化VLA2026/7/1
ロボット操作のための統一モデルで、事前学習済みVLMの意味理解とビデオ生成モデルの動的予測を活用し、将来予測を潜在コードのクエリ問題として再構成することで、実時間制御を維持しつつ構成的汎化を実現した。
- WSA$_1$: 3D中心の世界・空間・行動モデルによる汎用ロボット制御ロボット基盤モデル2026/7/1
ロボット基盤モデルに3D世界の物理ダイナミクスと行動の因果関係を学習させる新しいパラダイムを提案し、少ない実データで高い汎化性能を実現した。
- MiVLA: 人間とロボットの相互模倣事前学習による汎化可能な視覚-言語-行動モデルVLA2025/12/1
人間の手とロボットアームの動作類似性を利用し、人間とロボットの行動空間を双方向に整列させる相互模倣事前学習でVLAを訓練し、汎化性能を向上させた研究。
- BEVNav: 鳥瞰図表現の時空間コントラスト学習によるロボット自律ナビゲーションナビゲーション2024/9/1
点群の鳥瞰図(BEV)表現を時空間コントラスト学習で獲得し、強化学習と組み合わせることで、地図なし環境での歩行者密集下でも頑健に動作するナビゲーション手法を提案した。