Zihan Gao
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA/操作VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- M²-VLA: 層混合とメタスキルによる汎用操作のための視覚言語モデル強化VLA/操作2026/4/1
視覚言語モデルをロボット操作のバックボーンとして直接活用し、層混合戦略とメタスキルモジュールを導入して、高次意味理解と精密制御のギャップを埋める新しいVLAモデルを提案した。シミュレーションと実環境で有効性とゼロショット汎化を実証した。
- RoboWheel: 実世界の人間デモンストレーションから異形態ロボット学習用データを生成するデータエンジンVLA2025/12/1
人間の手と物体のインタラクション動画から、接触を考慮した軌道を再構成し、多様なロボット形態へ再ターゲティングして学習データを生成するデータエンジンを提案。VLAや模倣学習でテレオペ並みの性能を実証。