Jiagang Zhu
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VAG: 身体化データ合成のためのデュアルストリーム動画-行動生成VLA2026/4/1
ロボットの基盤モデル学習用に、動画と行動を同時生成する統一フレームワークVAGを提案。動画と行動の整合性を高め、合成データでポリシーの汎化性能を向上させる。
- DriveDreamer-Policy: 幾何学的基盤を持つ世界行動モデルによる生成と計画の統合自動運転2026/4/1
運転タスク向けに、深度生成・将来ビデオ生成・動作計画を単一アーキテクチャで統合した世界行動モデルを提案し、閉ループ計画と世界生成の両方で高性能を達成した。
- GigaWorld-0:世界モデルをデータエンジンとして具現化AIを強化VLA2025/11/1
視覚・言語・行動(VLA)学習のためのデータ生成エンジンとして、動画生成と3D生成を統合した世界モデルフレームワークを提案し、実世界データなしでロボットの汎化性能とタスク成功率を向上させた。
- GigaBrain-0: ワールドモデルを活用した視覚-言語-行動モデルVLA2025/10/1
ワールドモデルで生成した多様なデータを活用し、実機データへの依存を抑えつつ汎化性能を高めたVLA基盤モデルを提案。RGBD入力と身体性Chain-of-Thoughtで長期的・移動を伴う器用な操作タスクの実世界性能を向上させた。