Dake Zhong
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Open-UniMo: オープンワールドにおける動作と言語の統合的理解と生成に向けてVLA2026/9/13
動作と言語を同一のトークン空間で扱う大規模動作言語モデルを提案し、CoT推論と強化学習で双方向の生成・理解精度を高めた。
- M²-VLA: 層混合とメタスキルによる汎用操作のための視覚言語モデル強化VLA/操作2026/4/1
視覚言語モデルをロボット操作のバックボーンとして直接活用し、層混合戦略とメタスキルモジュールを導入して、高次意味理解と精密制御のギャップを埋める新しいVLAモデルを提案した。シミュレーションと実環境で有効性とゼロショット汎化を実証した。