Zhenlong Yuan
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット操作は視覚から幾何への写像である:言語・ビデオモデルを超えた視覚幾何バックボーンマニピュレーション2026/4/1
ロボット操作を視覚から3次元幾何への写像と捉え、言語やビデオのバックボーンではなく事前学習済み3次元表現を用いたVGAモデルを提案し、シミュレーションと実機で優れた性能を示した。
- Reasoning-VLA:自動運転向けの高速で汎用的な視覚-言語-行動推論モデルVLA2025/11/1
学習可能な行動クエリと推論強化された視覚言語特徴を並列に用いて連続行動軌道を生成するVLAフレームワークを提案し、8つの自動運転データセットを統合して学習・強化学習微調整を行い、最先端の性能と汎化性、高速推論を実現した。
- 純粋な視覚言語行動(VLA)モデル:包括的サーベイVLA2025/9/1
視覚言語行動(VLA)モデルの研究を体系的に整理し、自己回帰・拡散・強化学習などのパラダイム分類やデータセット・ベンチマークを概観したサーベイ論文。
- AutoDrive-R²: 自動運転VLAモデルの推論と自己反省能力を強化VLA2025/9/1
自動運転向けVLAモデルに思考連鎖と強化学習を導入し、推論と自己反省を促すことで軌道計画の精度と解釈性を向上させた研究。