Yue Yang
University of North Carolina at Chapel Hill
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Spotter: 身体性モデルを主導させ、VLMに内省させるVLA2026/9/29
身体性モデルが連続実行を主導し、VLMが並行して監視・エラー検出時のみ介入して内省・修正する枠組みを提案し、RoboCasaやRoboTwin 2.0で成功率を改善した。
- 長期自律マニピュレーション評価のためのグラフベース自動リセットシステムHALTERマニピュレーション2026/9/16
学習済みの原子リセットスキルをグラフ探索で組み合わせ、LLMが採点・リセット計画・検証を行うことで、長期タスクのロボット評価を人手なしで再現性高く実行する。
- どのモダリティが重要かを感知する:ロバストなVLAポリシーのための証拠ゲート正則化VLA2026/9/2
VLAポリシーが複数センサー入力の融合時に生じる「モダリティ絡み合い」問題を解決するため、センサーごとのタスク関連性に基づいて正則化を適応的に適用するEvidence-Gated Regularization (EGR)を提案した。シミュレーションと実ロボットで成功率を大幅に向上させた。
- FurnitureVLA: 視覚言語行動モデルによる長期的両腕家具組立の学習VLA/両腕操作2026/7/1
実規模の両腕ロボットによる家具組立を、視覚言語行動モデル(VLA)を用いて初めて体系的に研究し、進捗信号を統合したVLAを提案してシミュレーション成功率を大幅に向上させた。
- DenseReward: 失敗合成によるロボット操作のための高密度報酬学習操作2026/7/1
ロボット操作の強化学習を改善するため、シミュレーションで物理的に現実的な失敗軌道を自動生成し、視覚と言語からフレーム単位の高密度報酬を予測する報酬モデルDenseRewardを提案した。
- PlatonicNav: プラトニック位相マップによるナビゲーションの意味的対応の解明ナビゲーション2026/6/1
視覚のみで構築した位相マップを用いて、言語目標をペアデータなしで接地する訓練不要のナビゲーションフレームワークを提案し、シミュレーションと実機で有効性を示した。
- WatchAct: 行動に基づくロボット操作のベンチマーク操作/ベンチマーク2026/6/1
人間の行動ビデオと言語指示を組み合わせた、ロボット操作のための新しいベンチマークを提案し、シミュレーションと実機で評価した。
- LiLo-VLA: 物体中心ポリシー連携による長期的マニピュレーションの構成VLA2026/2/1
物体中心のVLAポリシーをモジュール化して連結し、未学習の長期的マニピュレーション課題にゼロショットで汎化するフレームワークを提案。
- 視覚が言語を上書きするとき:VLAにおける反事実的失敗の評価と緩和VLA2026/2/1
VLAモデルが言語指示ではなく視覚的ショートカットに従ってしまう「反事実的失敗」を評価するベンチマークLIBERO-CFを提案し、言語条件付けを正則化する二分岐推論手法CAGで改善する。
- EMMA: 生成的視覚転送による実世界ロボットマニピュレーションの汎化VLA2025/9/1
拡散Transformerでロボット操作動画を生成し、実データと混合してVLAポリシーを訓練することで、未知の視覚環境へのゼロショット汎化を実現した。
- ReBot: 実機からシミュレーションを経て実機へ戻るロボット動画合成によるロボット学習のスケーリングsim2real2025/3/1
実機のロボット軌道をシミュレーションで再生して対象物体を多様化し、実背景と合成することで物理的にリアルで時間的一貫性のあるロボット動画を生成し、VLAモデルを対象領域に適応させる手法を提案。
- BOSS: 長期的タスクにおける観測空間シフトのベンチマーク模倣学習2025/2/1
階層的ロボット学習で生じる観測空間シフト(OSS)を検証するベンチマークBOSSを提案し、既存模倣学習手法がOSSにより性能低下することを示した。
- ARCADE: 拡張現実による模倣学習のためのスケーラブルなデモ収集と生成模倣学習2024/10/1
ARを使って手で日常作業をするだけでデモを収集し、1つの人間デモから合成デモを自動生成することで、模倣学習のデモ収集を効率化するフレームワークを提案。実機Fetchロボットで複数タスクの学習と水注ぎタスク80%成功を達成。
- DivScene: 多様なシーンにおける大規模視覚言語モデルによるオープンボキャブラリ物体ナビゲーション物体ナビゲーション2024/10/1
81種類のシーンと5,707種類の物体を含む大規模データセットDivSceneを構築し、視覚言語モデルを微調整することでオープンボキャブラリ物体ナビゲーションの成功率をGPT-4oより20%以上向上させた。
- トライプレーン把持: 単一RGB画像による効率的な6自由度把持マニピュレーション2024/10/1
単一のRGB画像からトライプレーン・ガウス表現で物体を再構成し、6自由度の把持姿勢を高速に決定する手法を提案。
- StraightTrack:経皮的Kワイヤ挿入のための複合現実ナビゲーションシステム手術ナビゲーション2024/10/1
軟組織によるワイヤの曲がりを防ぐカニューレとMRヘッドセットを組み合わせ、経皮的Kワイヤ挿入の精度を向上させるシステムを開発した。
- Embodied-RAG: 具現化エージェントのための汎用ノンパラメトリック記憶検索生成VLA2024/9/1
ロボットの探索で得たマルチモーダルな知識を階層的な「意味の森」として記憶し、ナビゲーションや言語生成に活用するRAGフレームワークを提案した。
- 機械学習を用いた倉庫ロボットの自動ピッキングシステム最適化マニピュレーション2024/8/1
深層学習と強化学習を組み合わせて倉庫ロボットのピッキング効率・精度を高め、ピーク時の処理や複雑環境への適応を改善する手法を実証的に示した研究。
- 拡張現実によるロボット模倣学習のためのスケーラブルなデモンストレーション模倣学習2024/3/1
HoloLens 2などのARデバイスを使い、専門知識のないユーザーでもロボットの模倣学習用デモを収集できるフレームワークを提案し、到達・押し・ピックアンドプレースの3タスクで実機検証した。
- Holodeck: Language Guided Generation of 3D Embodied AI Environments2023/12/1
- Safe Inverse Reinforcement Learning via Control Barrier Function2022/12/1
- An improved FastEuler-DLKF small-UAV AHRS algorithm2020/2/1
- An Intelligent Quaternion SVDCKF AHRS Estimation with Variable Adaptive Methods in Complex Conditions2020/2/1
- An improved nonlinear FastEuler AHRS estimation based on the SVDCKF algorithm2020/2/1