Yu Yin
Case Western Reserve University
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA自動運転VLA/ロボットマニピュレーション探索/ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WHEREを正し、HOWを保つ:参照誘導によるVision-Language-Actionモデルの組合せ的一般化VLA2026/9/29
VLAモデルが視覚的ショートカットに依存して組合せ的一般化に失敗する問題に対し、学習不要のラッパーReGuideを提案し、対象物の位置情報を用いて意味的・幾何的に再結合することで成功率を大幅に改善した。
- GeoWAM: 自動運転のための視覚幾何学ワールドアクションモデル自動運転2026/8/24
自動運転におけるワールドアクションモデルを、ピクセルではなく点群の幾何学的表現で学習し、将来のシーン幾何学を予測することで運転ポリシーの性能を向上させた。
- 想像による回復:推論時カウンターファクチュアル再調整による視覚言語行動モデルの復旧VLA/ロボットマニピュレーション2026/8/14
視覚言語行動モデルがオンラインの外乱(目標変更や物理的摂動)に直面した際、失敗データや再学習なしに、推論時に「もしも」の継続を想像してロボットと環境を最小限に再調整する訓練不要の回復フレームワークを提案した。
- 動力学ブラインドネスの克服:VLAモデルのための学習不要のペース・経路補正VLA2026/5/1
単一フレーム観測に基づくVLAモデルが動的環境で性能劣化する問題に対し、学習不要で閉形式の推論時補正演算子を提案し、動的環境での成功率を最大28.8%向上させた。
- GSMem: 3Dガウススプラッティングを永続的空間記憶として用いたゼロショット身体化探索と推論探索/ナビゲーション2026/3/1
3Dガウススプラッティングを永続的な空間記憶として活用し、エージェントが初期観察で見逃した対象を後から再観察できるようにする、ゼロショットの身体化探索・推論フレームワークを提案した。
- NEBULA: 視覚言語行動エージェントを正しく評価できているか?VLA2025/10/1
VLAエージェントの評価のための統一エコシステムNEBULAを提案し、細粒度の能力テストと系統的ストレステストを組み合わせた二軸評価プロトコルを導入した。