Jiayi Guan
収録論文 6本 ・ フィジカルAI/ロボット学習
VLAデータキュレーションVLA/操作自動運転/VLAマルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SpatioLM: 視覚言語モデルにおける汎用物理空間知能の実現VLA2026/8/3
視覚言語モデルに追加の3D入力や外部エンコーダを使わず、パラメータ効率的なモジュールと擬似深度・カメラ情報の教師信号で空間推論能力を強化し、汎用性能の低下を抑えつつ空間知能を向上させた。
- ATHENA: ロボットデータキュレーションのための高速マルチタスク異種影響関数データキュレーション2026/6/1
大規模VLAモデルの模倣学習において、各デモの影響を高速に計算する影響関数フレームワークATHENAを提案し、50%のデータで全データ学習と同等以上の性能を達成した。
- UniviewVLA:世界モデリングを備えた統合マルチビュー視覚言語行動モデルVLA/操作2026/6/1
標準的な2つのカメラ観測のみから、世界モデルを用いてマルチビューの未来シーンを生成し、遮蔽された情報を補完して行動予測を改善するVLAモデルを提案。推論高速化のためのトークン圧縮と、動的な視点選択手法も導入。
- Xiaomi OneVL: ワンステップ潜在推論と視覚言語説明によるプランニング自動運転/VLA2026/4/1
自動運転のVLAモデルにおいて、潜在推論を視覚世界モデルで強化し、明示的CoTを超える精度を実現しつつ、推論速度を回答のみの予測と同等に高速化したフレームワークを提案した。
- MiMo-Embodied: クロス身体性基盤モデル技術報告VLA2025/11/1
自動運転と身体性AIを統合した初のクロス身体性基盤モデルを開発し、両分野で最先端性能を達成した。
- 自動運転のためのマルチエージェント強化学習:サーベイマルチエージェント強化学習2024/8/1
自動運転と高度交通システムにおけるマルチエージェント強化学習の研究を、シミュレータの評価指標や環境モデリング、アルゴリズム設計の観点から整理したサーベイ論文。