Yuliang Wei
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA/評価ベンチマークVLA/データ選択VLA/空間知能/3D認識VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボセマンティックベンチ:VLAモデルの行動予測における意味的接地の診断VLA/評価ベンチマーク2026/6/1
VLAモデルが複雑な指示の意味を理解して正しい物体を操作できるかを診断するベンチマークを提案し、多くのモデルが物体把握はできるが意味的に正しい選択がランダム以下であることを示した。
- FrameSkip: VLAトレーニングにおける少数だが情報量の多いフレームからの学習VLA/データ選択2026/5/1
ロボットのデモ軌道から全フレームを均等に使う代わりに、動作変化や視覚-動作の整合性などに基づいて重要フレームを選び、その割合を増やして学習するフレーム選択手法を提案。データローダのみを変更し、VLAアーキテクチャはそのままに、3つのベンチマークで成功率を向上させた。
- 3D-Mix for VLA: VGGTベースの3D情報を視覚言語行動モデルに統合するプラグアンドプレイモジュールVLA/空間知能/3D認識2026/3/1
VLAモデルの空間知能を向上させるため、VGGTによる3D情報をタスク文脈に応じて適応的に融合するプラグアンドプレイモジュール「3D-Mix」を提案し、複数のVLAアーキテクチャとベンチマークで一貫した性能向上を実証した。
- TwinBrainVLA: 非対称Mixture-of-Transformersによる汎用VLMの身体化タスクへの活用VLA2026/1/1
凍結した汎用VLM(左脳)と学習可能な専門家(右脳)を非対称Mixture-of-Transformersで統合し、汎用知識を保ちながら操作タスクを高精度に実行するVLAモデルを提案。