Yue Gao
Shanghai Jiao Tong University
収録論文 30本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ZeroGAR: ゼロショットグラフモデルの敵対的ロバスト性ベンチマークグラフニューラルネットワーク/敵対的ロバスト性2026/9/27
未見のターゲットグラフに適用されるゼロショットグラフモデル(ZGM)の敵対的ロバスト性を評価する初の系統的ベンチマークZeroGARを提案し、13モデル・8データセットで構造・テキスト・ノード注入攻撃への脆弱性を分析した。
- アフォーダンス条件付き意思決定:ゼロショット階層横断Vision-and-Languageナビゲーションにおける意味空間ギャップの橋渡しVLA2026/9/26
ゼロショット意味プランナに、遷移可能なアフォーダンス姿勢を予測し行動生成を条件付ける局所実行モジュールPACEを追加し、失敗を考慮した選好学習で階層横断ナビゲーションの成功率を改善した。
- DWMP:双対世界モデルによるヒューマノイドの障害物踏破歩行2026/9/11
固有感覚と視覚の特性の違いに着目し、Koopmanベースの動力学世界モデルとRSSMベースの視覚世界モデルを組み合わせてヒューマノイドの障害物踏破を実現する手法を提案した。
- ActSafeGuard:フローマッチング方策のための微分可能で訓練整合型の制約強制VLA2026/9/10
フローマッチングベースの方策に微分可能な安全層を組み込み、学習段階から硬い物理制約を満たす行動を生成させる手法を提案。複数タスクで100%のステップ安全性を保ちつつ成功率も維持・向上させた。
- 疲労を考慮したキャラクター制御キャラクターアニメーション2026/8/1
物理シミュレーションで人間らしい動きを再現するため、疲労を有限なエネルギー源の代理として導入し、疲労状態に応じた一般的な動作模倣ポリシーを獲得した。
- P3: VAEベースロボット学習のための確率的方策伝播強化学習2026/7/1
VAEベースの方策とPPOの理論的不整合を指摘し、分布を考慮した最適化フレームワークP^3を提案。データ効率と収束速度を大幅に改善した。
- エントロピーフィードバックによる決定論的MPPIの情報理論的適応冷却最適制御2026/7/1
決定論的MPPI制御において、重要度重みのシャノンエントロピーをオンラインのフィードバック信号として用い、温度を適応的に調整する冷却スケジュール手法を提案した。
- GeoAlign: セマンティクスを超えた状態誘導による空間的位置合わせをVLAモデルに導入VLA2026/6/1
VLAモデルにロボットの状態情報を利用した幾何学的特徴の位置合わせ機構を導入し、操作タスクの成功率を向上させた。
- ヒューマノイド知覚歩行のための地形符号化におけるグローバル・ローカル注意分解歩行2026/6/1
ヒューマノイドの強化学習歩行において、広域の地形把握と正確な足場選択を分離するため、粗密エンコーダと注意機構を組み合わせたGLADを提案し、実機で頑健な歩行を実現した。
- PolyFlow: 制約埋め込みと射影不要更新による安全かつ効率的な多面体制約フローマッチング生成モデル/制約付き生成2026/6/1
フローベース生成モデルを安全重視の物理システムに適用するため、多面体制約を直接モデルに組み込み、射影不要の離散時間フローで厳密な制約充足を実現するフレームワークを提案した。
- UniLab: GPU中心パラダイムを超えたロボット強化学習のためのヘテロジニアスアーキテクチャ強化学習/システムアーキテクチャ2026/5/1
CPUシミュレーションとGPU学習を分離したヘテロジニアスな強化学習システムUniLabを提案し、GPUシミュレーションに依存せずに3〜10倍の学習効率向上を実証した。
- HierKick: 視覚誘導サッカーロボット制御のための階層的強化学習階層的強化学習2026/3/1
サッカーロボット制御のための二周波数階層型強化学習フレームワークを提案し、高レベル方策で戦術選択、低レベル制御で精密な関節動作を実現。シミュレーションと実機で高い成功率を達成した。
- HiWET: 長期的なヒューマノイド移動操作のための階層型ワールドフレームエンドエフェクタ追従移動操作2026/2/1
ヒューマノイドの移動操作をワールド座標系でのエンドエフェクタ追従問題として再定式化し、高レベル方策がサブゴールを生成、低レベル方策が安定性制約下で実行する階層型強化学習フレームワークを提案。運動学的マニフォールド事前分布により探索を効率化し、実機へのゼロショット転移も実証した。
- FocusNav: ウェイポイント誘導による空間選択的注意を用いたヒューマノイドのローカルナビゲーション歩行2026/1/1
ヒューマノイドロボットのローカルナビゲーションにおいて、ウェイポイント誘導の空間クロスアテンションと安定性に応じた選択的ゲーティングで知覚を適応制御し、動的環境での衝突回避と安定歩行を実現した。
- 人間のように操作する:敵対的モーションプライアによるタスク指向操作スキルの学習マニピュレーション2025/10/1
人間の動作データを敵対的学習で模倣し、ハンマー作業などの操作スキルをロボットに獲得させる手法HMAMPを提案し、実機実験で有効性を示した。
- 対称性同変強化学習による協調的なヒューマノイドロボットの歩行制御歩行2025/8/1
ヒューマノイドロボットの強化学習に左右対称性を組み込み、アクターに同変性、クリティックに不変性を持たせることで、時空間的に協調した歩行を実現し速度追従精度を最大40%向上させた。
- ロバストトランスフォーマによる分布外状況下での汎化ロコモーション歩行2025/7/1
脚型ロボットの分布外状況でのロコモーションを、ボディトークン化と一貫性ドロップアウトを導入したトランスフォーマモデルROLTで実現し、四足・六足ロボットで既存手法より高いロバスト性を示した。
- 歩みを止めず:選択的敵対的訓練による頑健なヒューマノイド運動スキルの学習歩行2025/7/1
脆弱な状態と行動を選択的に攻撃する敵対的訓練手法を提案し、ヒューマノイドの長期運動・全身体制御の頑健性を向上させた。
- DyNaVLM: 動的視点と自己洗練グラフメモリを備えたゼロショット視覚言語ナビゲーションシステムVLA2025/6/1
VLMを用いて、固定間隔に縛られず自由にナビゲーション目標を選べる視覚言語ナビゲーションを実現し、物体位置をトポロジカル関係として記憶する自己洗練グラフメモリで性能を高めた。
- 静音歩行の実現:屋内環境における四足ロボットの騒音低減歩行2025/6/1
四足ロボットの歩行時に発生する騒音を、歩容設計と制御戦略の最適化により平均約8dBA低減する手法を提案した。
- 適応型支援カリキュラム力によるヒューマノイドロボットの運動スキル学習歩行2025/6/1
乳幼児やアスリートが外部サポートを利用する仕組みに着想を得て、支援力エージェントが状態依存の力を加えながら徐々に支援を減らす二重エージェント強化学習手法A2CFを提案し、二足歩行・ダンス・バク宙の学習を高速化・高成功率化した。
- 脚式ロボットのための外乱認識型適応補償を備えたハイブリッド力・位置移動ポリシー歩行2025/6/1
強化学習による脚式ロボットの移動ポリシーにおいて、目標関節位置とフィードフォワードトルクを組み合わせた行動空間と、外乱推定に基づくトルク補償を導入し、ペイロード変化や外乱への適応性を向上させた。
- 適応的勾配マスク敵対攻撃によるロボティクスにおける堅牢な深層強化学習強化学習2025/3/1
深層強化学習エージェントの脆弱性を狙う新しい敵対攻撃手法AGMRを提案し、重要な状態次元を動的に特定して摂動を集中させることで攻撃性能を高め、防御機構を通じてエージェントの堅牢性も向上させる。
- 行動前に選択せよ:連続制御のための空間的に分離された行動反復連続制御/強化学習2025/2/1
強化学習において、行動の各次元ごとに独立して「行動するか反復するか」を閉ループで選択する新フレームワークSDARを提案し、行動の持続性と多様性のバランスを改善した。
- t-READi: 自動運転向けTransformer駆動の堅牢で効率的なマルチモーダル推論マルチモーダル融合2024/10/1
マルチモーダルセンサのデータ分布や可用性の変動に適応する推論システムを提案し、欠損モダリティを補償しつつ精度と効率を向上させた。
- 敵対的制約付き方策最適化:バジェット適応による制約付き強化学習の改善制約付き強化学習2024/10/1
報酬最大化と制約予算の適応を敵対的な2段階で交互に最適化する制約付き強化学習手法を提案し、Safety Gymnasiumと四足歩行タスクで有効性を示した。
- Terrain-adaptive Central Pattern Generators with Reinforcement Learning for Hexapod Locomotion2023/10/1
- CoBigICP: Robust and Precise Point Set Registration using Correntropy Metrics and Bidirectional Correspondence2023/1/1
- GATER: Learning Grasp-Action-Target Embeddings and Relations for Task-Specific Grasping2021/11/1
- Capability Iteration Network for Robot Path Planning2021/4/1