Wenhao Yu
Tsinghua University
収録論文 72本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 離散フォーシング:連続デノイジングに離散ガイダンスを注入する少数ステップ行動エキスパートVLA2026/9/30
VLAモデルにおいて、離散行動トークンで粗い行動構造を予測し、それを連続行動の精緻化のガイダンスとして用いるフローマッチング手法を提案。パラメータ数を抑えつつ高精度・高速推論を実現した。
- FocusDrive:視覚的フォーカスを用いた自動運転の推論自動運転2026/9/27
自動運転の計画推論に、注視すべき物体とその位置を画像パッチ参照で明示する視覚フォーカス表現を導入し、注視予測とend-to-end計画性能を向上させた研究。
- READ: エンドツーエンド自動運転のためのリスク情報に基づく場の学習自動運転2026/9/11
幾何学的・行動的制約から計画に整合した明示的なリスク表現を学習し、候補軌道に沿って微分可能に評価することで、エンドツーエンド自動運転の安全性を向上させるフレームワークを提案。
- より安全なエンドツーエンド自動運転のためのデータ駆動型リスクフィールド自動運転2026/9/9
ルールベースの安全事前分布をペアワイズなリスク順序ラベルに変換し、相対的なリスク順序を保つリスクフィールドを学習することで、エンドツーエンド自動運転の安全性を向上させる手法DRiFを提案した。
- DriftingVLA: 次元別時間ドリフトによるネイティブ一段階視覚言語行動生成VLA2026/8/30
フローベースのVLAモデルの多段階推論による遅延を解消するため、分布ドリフト目的関数を用いてノイズから行動チャンクへの直接マッピングを学習する一段階VLAモデルを提案した。行動次元ごとに時間的ドリフトを適用することで、制御性能を保ちつつ3.36倍の高速化を実現した。
- DRIFT: ドリフトと集約によるモーションプランニングモーションプランニング2026/7/1
エンドツーエンドの軌道プランナーにおいて、潜在空間でのワンステップドリフトとシーン認識型の提案集約を組み合わせ、複数の運転行動を表現しつつ単一の実行可能な軌道を生成する手法を提案。
- CAC-VLA: 視覚言語行動モデルのための文脈ゲート型行動条件付けVLA2026/7/1
VLAモデル内に軽量な潜在行動インターフェースを導入し、文脈ゲートで行動エキスパートへの影響を調整することで、ロボット操作の成功率を向上させた。
- CLEAR: エンドツーエンド自動運転のための認知と潜在評価による適応ルーティング自動運転2026/6/1
拡散モデルの反復処理による遅延を避け、VAE潜在空間での単一ステップ生成と大規模言語モデルによるシーン理解を組み合わせた高速な自動運転プランニング手法を提案。NAVSIMベンチマークで最高性能を達成。
- DynaHMRC: 大規模言語モデルによる動的タスクのための分散型異種マルチロボット協調群制御2026/6/1
各ロボットが役割認識を持つLLMエージェントとして動作する分散型フレームワークを提案し、動的タスクにおける異種マルチロボット協調のスケーラビリティと適応性を向上させた。
- 運転リスクは二次元の回避加速度から生じる自動運転/リスク評価2026/4/1
衝突回避の二次元的性質を考慮した新しいリスク指標「回避加速度(EA)」を提案し、実データで従来のTTCより早期かつ高精度に衝突リスクを評価できることを示した論文。
- ドリフトベース方策最適化:オンラインロボット制御のためのネイティブ一段階方策学習ロボット制御2026/4/1
多段階生成方策の推論コストを削減するため、固定点ドリフト目的で訓練時に反復精錬を内部化した一段階生成方策(DBP)と、そのオンラインRLフレームワーク(DBPO)を提案した。
- MISTY: ミキサーベース単一ステップドリフトによる高スループット動作計画自動運転/動作計画2026/4/1
拡散モデルによる反復推論の遅さを解消するため、単一ステップ推論で高品質な軌道生成を実現する新しい動作プランナーMISTYを提案した。潜在空間でのドリフト損失により訓練時に複雑な分布変化を吸収し、能動的な追い越しなどの新しい行動を生成できる。
- VeoワールドシミュレータによるGeminiロボティクスポリシーの評価sim2real2025/12/1
最先端の動画生成モデルVeoを基盤とした生成評価システムを構築し、ロボットポリシーの通常性能から分布外汎化、物理・意味的安全性までをシミュレーションで評価できることを示した。
- Modified-Emergency Index (MEI): 横方向の衝突における自動運転の危険度指標自動運転安全性評価2025/10/1
自動運転の横方向の衝突リスクを定量化する新指標MEIを提案し、既存指標より高精度に危険度を評価できることを示した。
- Gemini Robotics 1.5:高度な身体性推論・思考・動作転移で汎用ロボットの最前線を押し広げるVLA2025/10/1
異種ロボットデータから学ぶ動作転移機構と自然言語での多段階推論を組み合わせたVLAモデルと、身体性推論に特化したモデルを発表し、複雑な多段階タスクの実行と解釈性を向上させた。
- Human2LocoMan: 人間データの事前学習による多様な四足歩行ロボットのマニピュレーション学習マニピュレーション2025/6/1
人間と四足ロボットLocoManのデータを統合した遠隔操作・データ収集パイプラインとモジュール型アーキテクチャを構築し、人間データでの事前学習により実世界タスクの成功率を大幅に向上させた。
- S2R-Bench: 自動運転のためのSim-to-Real評価ベンチマークsim2real2025/5/1
実世界の多様な道路・天候・照明条件で収集したセンサ異常データを用い、自動運転の知覚アルゴリズムのロバスト性を評価する初の実環境ベースの腐敗ロバスト性ベンチマークを提案した。
- LocoTouch:触覚センシングによる動的四足歩行運搬の学習触覚2025/5/1
四足ロボットの背中全体を覆う高密度触覚センサと高忠実度シミュレーションを組み合わせ、固定されていない円筒物体を長距離運搬する触覚対応歩容ポリシーを学習させ、実機へゼロショット転移した。
- Chain-of-Modality: マルチモーダル人間動画と視覚言語モデルによる操作プログラムの学習VLA2025/4/1
筋電アームバンドやマイクなどで計測した人間の操作動画から、視覚言語モデルがタスク計画と力などの制御パラメータを抽出し、ロボットに操作タスクを実行させる手法を提案した。
- STDArm: 静的データ学習の視覚運動ポリシーを動的ロボットマニピュレーションへ転移マニピュレーション2025/4/1
静的環境で学習した視覚運動ポリシーを、移動ロボット上でもそのまま使えるよう、リアルタイムの行動補正・安定化・遅延推定を組み合わせて動的マニピュレーションを実現したシステム。
- Gemini Robotics:AIを物理世界へVLA2025/3/1
Gemini 2.0を基盤に、ロボットを直接制御できる汎用VLAモデル「Gemini Robotics」と、空間・時間理解を強化した推論モデル「Gemini Robotics-ER」を提案した論文。
- QuietPaw: 多様なノイズ選好に適応する四足歩行の学習歩行2025/3/1
ノイズ低減レベルを条件として与えることで、単一の四足歩行ポリシーが再学習なしに機敏さと足音の静かさのトレードオフを連続的に調整できる学習手法を提案し、実機で検証した。
- ヒューマノイドの移動と操作:制御・計画・学習の現状と課題ヒューマノイド2025/1/1
ヒューマノイドロボットの移動と操作に関する研究を、モデルベース手法と学習ベース手法の両面から包括的にサーベイし、触覚や基盤モデル統合の可能性と課題を整理した。
- 六脚ロボットの多様な移動スキル歩行2024/12/1
深度カメラとVIOを搭載した六脚ロボットが、階段昇降・障害物回避・テーブル下のすり抜けをシミュレーションのみで学習し、実機で高い成功率を達成した。
- 長期的な四足歩行ロボットの押し操作のためのマルチエージェント移動マニピュレーション学習マニピュレーション2024/11/1
複数の四足歩行ロボットが障害物を避けながら長期的な押し操作を行うための階層型マルチエージェント強化学習フレームワークを提案し、実機で成功を実証した。
- 視覚言語モデルは文脈内価値学習器であるVLA2024/11/1
視覚言語モデルにシャッフルした動画フレームの時系列順序を予測させることで、ロボットやタスク固有の訓練なしに300以上の実世界タスクの進捗を推定できる汎用価値関数を実現した。
- MHRC: 大規模言語モデルによる分散型マルチ異種ロボット協調VLA2024/9/1
大規模言語モデルを活用し、移動ロボット・マニピュレーションロボット・移動マニピュレーションロボットが分散協調して探索・運搬・整理タスクを遂行するフレームワークを提案。
- 不連続地形における俊敏な連続跳躍歩行2024/9/1
四足歩行ロボットが階段や飛び石などの不連続地形で、高さ予測・強化学習・モデルベース制御を組み合わせて俊敏かつ連続的に跳躍できる階層型フレームワークを開発した。
- LDP: 効率的なロボットナビゲーションと衝突回避のための局所拡散プランナナビゲーション2024/7/1
多様なエージェントによるデータ生成と軽量なグローバル観測の統合により、複雑な実環境での局所ナビゲーションと衝突回避を実現する拡散モデルベースのプランナを提案する。
- Mobility VLA:長文脈VLMとトポロジカルグラフによるマルチモーダル指示ナビゲーションナビゲーション/VLA2024/7/1
デモ動画と自然言語・画像の指示を入力とし、長文脈VLMで目標フレームを特定、トポロジカルグラフに基づく低レベル方策で実環境をナビゲートする階層型VLAを提案した。
- 学習ベースの脚式移動:最新技術と今後の展望歩行2024/6/1
深層学習やシミュレーション技術の発展により進歩した学習ベースの脚式移動研究を、四足歩行と二足歩行(ヒューマノイド)に分けて概観し、未解決課題と社会的影響を論じたサーベイ。
- ゲームプレイフィルタ:敵対的想像によるロバストなゼロショット安全性安全フィルタ/四足歩行/sim2real2024/5/1
シミュレーションで訓練した安全戦略と最悪ケースを引き起こす仮想敵を継続的に対戦させ、将来の失敗を防ぐ予測型安全フィルタを提案。四足歩行ロボットの全身動力学に適用し、大きな外乱下でもゼロショットで安全を確保できることを実機で示した。
- LocoMan: 軽量ロコ・マニピュレータによる四足歩行ロボットの器用な操作能力の向上マニピュレーション2024/3/1
四足歩行ロボットの前脚に軽量な3自由度グリッパを取り付け、脚の移動能力と操作能力を統合した全身制御フレームワークを提案し、狭い空間でのドア開けやコンセント挿しなどの器用な作業を実現した。
- CoNVOI: 視覚言語モデルを用いた屋内・屋外環境における文脈認識ナビゲーションナビゲーション2024/3/1
視覚言語モデルを活用し、周囲の状況をゼロショットで分類して文脈に応じた行動指示を生成し、障害物のない領域を番号で注釈した画像から経路を選択することで、屋内・屋外での自律ナビゲーションを実現する手法。
- 安全で信頼性の高い自動運転に向けて:動的占有集合予測予測2024/2/1
軌道予測ネットワークと占有集合予測モジュールを組み合わせ、交通参加者の将来の取り得る占有領域を予測する手法を提案した論文。
- PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs2024/2/1
- 言語モデル予測制御による人間フィードバックからの高速学習VLA2024/2/1
人間との対話履歴を遷移モデルとしてLLMに微調整し、モデル予測制御と組み合わせることで、ロボットの教示効率と成功率を向上させるフレームワークLMPCを提案。
- RT-Trajectory: Robotic Task Generalization via Hindsight Trajectory Sketches2023/11/1
- PathRL: An End-to-End Path Generation Method for Collision Avoidance via Deep Reinforcement Learning2023/10/1
- Creative Robot Tool Use with Large Language Models2023/10/1
- A Unified Perspective on Multiple Shooting In Differential Dynamic Programming2023/9/1
- Legal Decision-making for Highway Automated Driving2023/7/1
- Transforming a Quadruped into a Guide Robot for the Visually Impaired: Formalizing Wayfinding, Interaction Modeling, and Safety Mechanism2023/6/1
- CAJun: Continuous Adaptive Jumping using a Learned Centroidal Controller2023/6/1
- SayTap: Language to Quadrupedal Locomotion2023/6/1
- Language to Rewards for Robotic Skill Synthesis2023/6/1
- Datasets and Benchmarks for Offline Safe Reinforcement Learning2023/6/1
- IndoorSim-to-OutdoorReal: Learning to Navigate Outdoors without any Outdoor Experience2023/5/1
- Barkour: Benchmarking Animal-level Agility with Quadruped Robots2023/5/1
- Continuous Versatile Jumping Using Learned Action Residuals2023/4/1
- Constrained Decision Transformer for Offline Safe Reinforcement Learning2023/2/1
- Zero-Shot Retargeting of Learned Quadruped Locomotion Policies Using Hybrid Kinodynamic Model Predictive Control2022/9/1
- Versatile Real-Time Motion Synthesis via Kino-Dynamic MPC with Hybrid-Systems DDP2022/9/1
- PI-ARS: Accelerating Evolution-Learned Visual-Locomotion with Predictive Information Representations2022/7/1
- Learning Semantics-Aware Locomotion Skills from Human Demonstration2022/6/1
- Road Traffic Law Adaptive Decision-making for Self-Driving Vehicles2022/4/1
- Adversarial Motion Priors Make Good Substitutes for Complex Reward Functions2022/3/1
- Safe Reinforcement Learning for Legged Locomotion2022/3/1
- Robot Learning from Randomized Simulations: A Review2021/11/1
- Unlocking Pixels for Reinforcement Learning via Implicit Attention2021/2/1
- Protective Policy Transfer2020/12/1
- COCOI: Contact-aware Online Context Inference for Generalizable Non-planar Pushing2020/11/1
- Policy Transfer via Kinematic Domain Randomization and Adaptation2020/11/1
- Learning Human Search Behavior from Egocentric Visual Inputs2020/11/1
- Learning Fast Adaptation with Meta Strategy Optimization2019/9/1
- Sim-to-Real Transfer for Biped Locomotion2019/3/1
- Policy Transfer with Strategy Optimization2018/10/1
- Learning Symmetric and Low-energy Locomotion2018/1/1
- Multi-task Learning with Gradient Guided Policy Specialization2017/9/1
- Learning Human Behaviors for Robot-Assisted Dressing2017/9/1
- Learning to Navigate Cloth using Haptics2017/3/1
- Preparing for the Unknown: Learning a Universal Policy with Online System Identification2017/2/1