Yueen Ma
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 3D-MoE:Rectified Flowによる姿勢拡散を備えた3D視覚・空間推論向けMixture-of-ExpertsマルチモーダルLLMVLA2025/1/1
既存の密活性化LLMをMixture-of-Experts化し、Rectified Flow拡散ヘッド(Pose-DiT)を組み合わせることで、3D質問応答と身体性タスク計画を少ない活性パラメータで高精度に実行するフレームワークを提案した。
- Astra: 身体性指示追従のための効率的Transformerアーキテクチャと対照的ダイナミクス学習VLA2024/8/1
異なるモダリティのセグメントからなる軌跡を効率的に処理する新しいTransformerと、環境ダイナミクス理解を深める対照的学習目的を提案し、ロボット操作ベンチマークで性能を大幅に向上させた。
- 身体性AIのための視覚-言語-行動モデルに関するサーベイVLA2024/5/1
身体性AI向けの視覚-言語-行動(VLA)モデルについて、構成要素・制御ポリシー・タスクプランナーの3系統に分類し、データセットやベンチマークも含めて初めて体系的にまとめたサーベイ。