Yanyan Zhang
Case Western Reserve University
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/ロボットマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WHEREを正し、HOWを保つ:参照誘導によるVision-Language-Actionモデルの組合せ的一般化VLA2026/9/29
VLAモデルが視覚的ショートカットに依存して組合せ的一般化に失敗する問題に対し、学習不要のラッパーReGuideを提案し、対象物の位置情報を用いて意味的・幾何的に再結合することで成功率を大幅に改善した。
- 想像による回復:推論時カウンターファクチュアル再調整による視覚言語行動モデルの復旧VLA/ロボットマニピュレーション2026/8/14
視覚言語行動モデルがオンラインの外乱(目標変更や物理的摂動)に直面した際、失敗データや再学習なしに、推論時に「もしも」の継続を想像してロボットと環境を最小限に再調整する訓練不要の回復フレームワークを提案した。
- 動力学ブラインドネスの克服:VLAモデルのための学習不要のペース・経路補正VLA2026/5/1
単一フレーム観測に基づくVLAモデルが動的環境で性能劣化する問題に対し、学習不要で閉形式の推論時補正演算子を提案し、動的環境での成功率を最大28.8%向上させた。
- NEBULA: 視覚言語行動エージェントを正しく評価できているか?VLA2025/10/1
VLAエージェントの評価のための統一エコシステムNEBULAを提案し、細粒度の能力テストと系統的ストレステストを組み合わせた二軸評価プロトコルを導入した。