Guanzhi Wang
収録論文 13本 ・ フィジカルAI/ロボット学習
VLAスキル発見/継続学習タスク計画マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット学習と制御のための世界行動モデル:サーベイVLA2026/9/13
未来の世界予測と実行可能な行動生成を統合したWorld-Action Models(WAMs)について、ロボティクス視点で分類・応用・評価・課題を整理したサーベイ。
- ASPIRE: ロボットのためのエージェント的スキル発見スキル発見/継続学習2026/7/1
ロボット制御プログラムを自律的に作成・改善し、再利用可能なスキルライブラリを構築する継続学習システムASPIREを提案。シミュレーションと実世界で高い性能とゼロショット汎化を示した。
- GaP: 変動的オートメーションタスクのためのグラフとしてのポリシーを用いたマルチエージェント自己学習ハーネスタスク計画2026/7/1
ロボットの信頼性を高めるため、エージェント型コーディングと解釈可能なロボットプログラミングを組み合わせ、タスクをグラフ構造で表現して自己学習する手法を提案した。
- CaP-X: ロボットマニピュレーションのためのコーディングエージェントのベンチマークと改善フレームワークマニピュレーション2026/3/1
コードを方策として使うエージェントを体系的に評価する環境CaP-GymとベンチマークCaP-Benchを構築し、テスト時計算の拡張で人間レベルの信頼性を達成する手法を提案した。
- 世界行動モデルはゼロショット方策であるVLA2026/2/1
動画拡散モデルを基盤に未来の世界状態と行動を予測するWorld Action Model「DreamZero」を提案し、実機でVLAを上回る汎化性能と7Hzのリアルタイム閉ループ制御を実現した。
- FLARE: 暗黙的世界モデリングによるロボット学習VLA2025/5/1
将来の観測の潜在表現を予測する世界モデリングを拡散トランスフォーマーポリシーに組み込み、模倣学習の性能と汎化を大幅に向上させた手法。
- DreamGen:動画世界モデルでロボット学習の汎化を解き放つVLA2025/5/1
画像から動画を生成するモデルでロボットの疑似行動データを作り、1つのテレオペデータから多様な行動・環境への汎化を実現する4段階パイプラインを提案。
- GR00T N1: 汎用人型ロボットのためのオープン基盤モデルVLA2025/3/1
視覚言語モジュールと拡散トランスフォーマを組み合わせた二重システム構成のVLA基盤モデルを提案し、実機・人間動画・合成データで学習して人型ロボットの両手マニピュレーションを実現した。
- Eureka: Human-Level Reward Design via Coding Large Language Models2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- VIMA: General Robot Manipulation with Multimodal Prompts2022/10/1
- SECANT: Self-Expert Cloning for Zero-Shot Generalization of Visual Policies2021/6/1
- iGibson 1.0: a Simulation Environment for Interactive Tasks in Large Realistic Scenes2020/12/1