Yang Zhong
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA/基盤モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- XEmbodied: 大規模具現環境向けに幾何・物理的手がかりを強化した基盤モデルVLA/基盤モデル2026/4/1
クラウド側でVLMに3次元幾何認識と物理的手がかりを統合し、空間推論や具現化タスクの性能を向上させる基盤モデルを提案した。
- 自動運転のための視覚-言語-行動モデルに関するサーベイVLA2025/6/1
自動運転向けの視覚・言語・行動を統合したVLAモデルについて、アーキテクチャや20以上の代表モデル、データセット、課題を初めて体系的にまとめたサーベイ。
- AgentThink:自動運転向け視覚言語モデルにおけるツール拡張型思考連鎖推論の統合フレームワークVLA2025/5/1
自動運転向けに、思考連鎖推論と動的なツール呼び出しを統合したフレームワークAgentThinkを提案し、DriveLMM-o1ベンチマークで推論スコアを53.91%向上させた。