Chenwei Wang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 行動履歴メモリと二重エキスパートノイズ除去による長期的視覚言語行動ポリシーVLA2026/9/29
凍結したVLAにMambaベースのメモリと軽量PreAction Expertを追加し、行動履歴を活用して長期的タスクの知覚的曖昧性を解消する手法を提案。
- ReWeight: 実演検索とサンプル重み付けによる人間データを活用したVLAポストトレーニングVLA2026/9/12
一人称視点の人間実演をロボット実演と行動類似度で照合し、重み付けしてVLAモデルの追加学習に活用することで、実機タスクの成功率を大幅に向上させた研究。
- 必要な時だけ考える:視覚言語行動操作における選択的スローパス介入のためのプロンプト権限制御VLA/操作2026/8/24
凍結された視覚言語行動(VLA)ポリシーに検索テキストを追加すると、プロンプト形式の変化が実行を支配し成功率が大幅に低下する「プロンプト形式崩壊」を特定し、候補生成とポリシー入力変更の許可を分離するプロンプト権限インターフェースTOWN-VLAを導入。これにより、シミュレーションと実機で成功率が向上した。
- Pointing-VLA: 視覚言語行動操作のための型付き空間接地インターフェースVLA/操作2026/8/24
VLAモデルの空間接地をテキスト座標ではなく型付きヘッドで直接予測し、実行契約によりPICKとPLACEを分離。Bridge/WidowXでSOTAを達成し、実ロボット成功率を52.7%から80.7%に向上させた。
- Align-Then-stEer:統一潜在ガイダンスによる視覚-言語-行動モデルの適応VLA2025/9/1
VLAモデルを下流タスクに適応させる際、事前学習との行動分布のずれを統一潜在空間でのアライメントと生成過程のガイダンスで解消し、少ないデータで効率的に微調整する手法を提案。