Yuanqi Yao
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションVLAマルチエージェント
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UMI-Bench 1.0: UMIデータを用いた卓上ロボット操作のためのオープンで再現可能な実世界ベンチマークマニピュレーション2026/6/1
UMIスタイルの操作ポリシーを実世界で標準評価する初のベンチマークを提案し、データ収集から評価までの統一プロトコルを提供する。
- AR-VLA: 視覚言語行動モデルのための真の自己回帰型アクションエキスパートVLA2026/3/1
観測ごとに時間的文脈をリセットする従来のVLAや拡散ポリシーと異なり、長期記憶で履歴を保持し連続的な因果系列として行動を生成する自己回帰型アクションエキスパートを提案。再アンカリング機構で非同期な視覚・言語・行動を同期させ、滑らかで文脈認識型の行動生成を実現した。
- マルチエージェントロボットシステム(MARS)チャレンジの進歩と革新マルチエージェント2026/1/1
NeurIPS 2025ワークショップで開催されたMARSチャレンジを紹介し、VLMを用いたマルチエージェントの計画とロボットマニピュレーションの制御という2領域での取り組みを概説した論文。
- Hume:視覚-言語-行動モデルにシステム2思考を導入VLA2025/5/1
価値誘導型の熟考(システム2)と軽量な反応型ポリシー(システム1)を組み合わせた二重システムVLAモデルを提案し、器用なロボット制御を実現した。
- 小さく考え、大きく行動する:生涯ロボットマニピュレーションのためのプリミティブプロンプト学習マニピュレーション2025/4/1
スキル間で共有されるプリミティブをプロンプトとして学習し、生涯にわたるロボットマニピュレーションを実現する手法を提案。
- SpatialVLA:視覚-言語-行動モデルのための空間表現の探求VLA2025/1/1
ロボット操作における空間理解の重要性に着目し、3D位置エンコーディングと適応的行動グリッドを導入した視覚-言語-行動基盤モデルSpatialVLAを提案。110万件の実世界ロボットデータで事前学習し、ゼロショットでの操作や新環境への適応を実現した。
- The RoboDepth Challenge: Methods and Advancements Towards Robust Depth Estimation2023/7/1