Guoqing Ma
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HiWE: 視覚キーポイント強化による階層的ワールド知識モデルを用いたゼロショット3D経路計画VLA2026/9/30
視覚的グラウンディングと言語ベースの計画を点ベースのインターフェースで結び、ゼロショットで3D操作経路を計画する階層的フレームワークを提案。
- ZimaBlue: スケーラブルなビデオ事前学習による汎化可能な世界行動モデルの進化VLA2026/8/31
大規模な一人称視点ビデオからロボット制御のための世界行動モデルを学習するフレームワークを提案し、実機ゼロショット評価で成功率を大幅に向上させた。
- GeneralVLA-2: 幾何認識再構成と管理されたメモリによるロボット計画VLA2026/6/16
ロボットの軌道計画のための視覚言語行動モデルを改善し、3D再構成の精度向上と長期メモリの品質管理を実現した。
- JoyAI-Image: 統一マルチモーダル理解と生成における空間知能の覚醒VLA2026/5/5
視覚理解・テキストからの画像生成・指示による画像編集を統合したマルチモーダル基盤モデルを提案し、空間認識能力を強化した。
- GeneralVLA:知識誘導型軌道計画による汎化可能な視覚-言語-行動モデルVLA2026/2/1
基盤モデルの汎化能力を活かし、アフォーダンス認識・3D軌道計画・制御を階層化したVLAモデルを提案。実機データや人間の実演なしでゼロショットのマニピュレーションを実現する。