Xiaomeng Yang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- イベント整合型視覚行動推論によるワールドアクションモデルVLA2026/10/7
タスク上重要なインタラクションイベントに視覚予測を整合させ、行動生成を導くフレームワークを提案し、DOMINOで成功率を10.26ポイント改善した。
- VOTE: 軌道アンサンブル投票による視覚-言語-行動モデルの最適化VLA2025/7/1
VLAモデルの推論遅延と学習コストを削減するため、少ない行動トークンで並列生成する学習フレームワークと、過去と現在の予測を投票で統合する推論最適化を提案し、成功率と推論速度を大幅に向上させた。
- Nocturne: a scalable driving benchmark for bringing multi-agent learning one step closer to the real world2022/6/1