Xizhou Bu
収録論文 7本 ・ フィジカルAI/ロボット学習
ロボット学習模倣学習自動運転/VLAナビゲーションマニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット学習における潜在アクションの重要要素ロボット学習2026/8/20
ロボット操作のための潜在アクションモデル(LAM)の設計選択を体系的に比較し、41の設計選択肢を3次元で評価。VLMバックボーンの微調整が下流のポリシー学習に有効であることを示した。
- データ非対称潜在想像と再ランキングによる3Dロボット模倣学習模倣学習2026/5/1
低品質な軌跡データを活用するため、3D点群の潜在世界モデルによる想像ロールアウトとタスク完了スコアラによる再ランキングを組み合わせたフレームワークDALI-Rを提案し、模倣学習の成功率を向上させた。
- Xiaomi OneVL: ワンステップ潜在推論と視覚言語説明によるプランニング自動運転/VLA2026/4/1
自動運転のVLAモデルにおいて、潜在推論を視覚世界モデルで強化し、明示的CoTを超える精度を実現しつつ、推論速度を回答のみの予測と同等に高速化したフレームワークを提案した。
- 一緒に歩こう:人間中心の屋外支援のための長期的社会的ナビゲーションナビゲーション2026/4/1
高レベルの自然言語指示から屋外での長期的な社会的ナビゲーションを実現する、地図不要のフレームワークを提案。GPSと公開地図APIのPOIを用いて目的地を推定し、高レベルVLMと低レベルVLAを状況に応じて切り替えることで、安全で社会的に適切な移動を実現する。
- 適応的ワーキングメモリ再符号化によるロボットマニピュレーションの状態曖昧性解消マニピュレーション2025/12/1
人間のワーキングメモリ再符号化に着想を得て、適応的ワーキングメモリを備えた視覚運動ポリシーPAMを提案し、長い履歴窓でも高速推論を維持しながら状態曖昧性を解消する。
- 光学フロー制約によるロバストな潜在行動学習VLA2025/11/1
エージェントの光学フローを行動信号として活用し、妨害要素に強い潜在行動表現を学習する疑似教師ありフレームワークLAOFを提案。模倣学習と強化学習で既存手法を上回る性能を示した。
- Aligning Human Intent from Imperfect Demonstrations with Confidence-based Inverse soft-Q Learning2023/12/1