Xiaoguang Ma
収録論文 8本 ・ フィジカルAI/ロボット学習
VLAナビゲーションヒューマノイド動作生成模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 理解しながら行動する:リアルタイム視覚言語行動モデルのための非同期意味・行動分離VLA2026/6/1
既存のVLAモデルを改造せず、意味理解と行動生成を非同期に分離し、低頻度で意味条件を更新しつつ高頻度で行動を出力することで、低遅延な閉ループ制御を実現する枠組みを提案した。
- PM-Nav: 事前地図誘導による機能建築物内の具現化ナビゲーションナビゲーション2026/3/1
機能建築物内での言語駆動ナビゲーションの課題に対し、環境地図をナビゲーション用の意味的事前地図に変換し、階層的思考連鎖プロンプトとマルチモデル協調行動出力機構を用いて経路計画と実行制御を行うPM-Navを提案した。
- PhyGile: 物理プレフィックス誘導による俊敏な汎用人型ロボット動作追従のための動作生成ヒューマノイド動作生成2026/3/1
物理誘導プレフィックスを用いて人型ロボットのネイティブ動作を直接生成し、汎用動作追従コントローラと組み合わせることで、実機で俊敏かつ安定した全身動作を実現するフレームワークを提案した。
- 平均流に基づく一段階視覚言語行動モデルVLA2026/3/1
フローマッチング型VLAの遅延問題を解決するため、ノイズ起因の問題を解消し一段階の行動生成を可能にする平均流ベースの手法を提案。実機実験で既存手法より大幅に高速な生成を実現した。
- SE-VLN: マルチモーダル大規模言語モデルに基づく自己進化型視覚言語ナビゲーションフレームワークVLA2025/7/1
マルチモーダルLLMを活用し、テスト中に経験から継続的に進化できる視覚言語ナビゲーションのフレームワークを提案。未見環境での成功率を大幅に向上させた。
- 潜在意識型ロボット模倣学習模倣学習2024/12/1
人間の潜在意識に着想を得て、認知オフロードと行動チャンクの履歴を組み合わせることで、ロボット模倣学習の推論遅延を削減し実行を高速化する手法を提案した。
- ロボット学習のための制約付き行動クローニング模倣学習2024/8/1
幾何学的・時間的制約を組み合わせた行動クローニング手法を提案し、シミュレーションと実機で成功率を大幅に改善した。
- DynPL-SVO: A Robust Stereo Visual Odometry for Dynamic Scenes2022/5/1