Haoyu Wang
Shanghai Jiao Tong University
収録論文 20本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DexPolicy: 軌道誘導型巧みな操作のためのスケジュール探索マニピュレーション2026/9/30
強化学習による巧みな操作において、探索ノイズを訓練ステップに応じて徐々に減衰させるスケジュールを導入し、PPO・GRPO・FPOの3手法で成功率を大幅に向上させた。
- SEES: 失敗から自己進化するVLAポリシー適応システムVLA2026/9/26
長期的タスクで失敗するVLAポリシーを、専門家の追加デモなしに自己改善するシステム。失敗した原子スキルを自動検出し、シミュレーションでRL学習してポリシーを進化させる。
- 人類が最後に作るAI:真の再帰的自己改善に向けて再帰的自己改善2026/9/10
再帰的自己改善(RSI)の概念と発展ロードマップを提示し、科学発見・身体知能・ソフトウェア工学などのシナリオでの要件を検討して、実用的なシステムとの接続や課題を整理した論文。
- Chat2Scenic: 自動運転シナリオ生成のための反復RAGベースフレームワーク自動運転/シナリオ生成2026/7/1
規制文書から自動運転テスト用のシナリオスクリプトを自動生成する、反復型RAGフレームワークを提案。チャットインターフェースで対話的にシナリオを洗練でき、既存手法より高い成功率を達成。
- ExToken: 効率的なVision-Language-Action強化学習のための構造化探索VLA/強化学習2026/7/1
VLAモデルの強化学習における探索停滞問題を分析し、軌跡の多様性がサンプル効率に重要であることを示した上で、オフラインのデモから得た離散的な行動プリミティブに基づいて探索を構造化するExTokenフレームワークを提案した。
- GeneralVLA-2: 幾何認識再構成と管理されたメモリによるロボット計画VLA2026/6/16
ロボットの軌道計画のための視覚言語行動モデルを改善し、3D再構成の精度向上と長期メモリの品質管理を実現した。
- エコー・メモリ:行動世界モデルにおける記憶の制御研究世界モデル2026/6/8
行動条件付き世界モデルにおける記憶機構を制御された条件下で比較し、記憶の容量・圧縮・読み出し・再帰の各軸が性能に与える影響を明らかにした研究。
- フィッシャー装飾子:局所輸送写像によるフローポリシーの精緻化オフライン強化学習2026/4/1
オフライン強化学習におけるフローポリシーの最適化を、局所輸送写像として再定式化し、フィッシャー情報行列に基づく異方性最適化を導入して、従来の等方性近似による最適性ギャップを改善した。
- タスクレベル意思決定から歩容制御へ:四脚ナビゲーションのための階層型ポリシーアプローチ四脚歩行/ナビゲーション/階層型制御2026/3/1
四脚ロボットのナビゲーションにおいて、高レベルのタスク意思決定と低レベルの歩容実行のスケール不整合を解決するため、階層型ポリシーアーキテクチャを提案し、シミュレーションから実機への転送を強化した。
- KCFRC: 脚式移動のための運動学的衝突を考慮した足場到達可能性基準歩行2026/2/1
脚式ロボットが足場を選ぶ際に、衝突しない脚の振り軌道が存在するかを高速に判定する手法KCFRCを提案し、900候補を平均2msで検証できることを示した。
- ヒューマノイド占有:汎用マルチモーダル占有知覚システムの実現占有知覚2025/7/1
ヒューマノイドロボット向けに、マルチモーダル融合と時系列統合を用いた占有グリッド知覚システムを構築し、専用のパノラマ占有データセットを整備した。
- 階層最適化による脚式移動の全身制約学習歩行2025/6/1
強化学習にハード・ソフト制約を組み込んだ階層最適化ベースの全身追従制御を提案し、六脚ロボットの屋外環境での安全性と走破性を実証した。
- ブラウン橋拡張サロゲートシミュレーションと地質CO2貯留のための注入計画シミュレーション最適化2025/5/1
地質CO2貯留において、ブラウン橋を用いたサロゲートシミュレーションと注入計画の枠組みを提案し、シミュレーション精度と計画効率を向上させた。
- Quattro: Transformerで高速化するiLQR軌道最適化フレームワーク軌道最適化2025/4/1
iLQRの中間フィードバック・フィードフォワード行列をTransformerで予測し、FPGA上で並列計算することで、リアルタイム軌道最適化を大幅に高速化した研究。
- ExACT: Transformerによる行動チャンキングを用いたエンドツーエンド自律ショベルシステム模倣学習/建設機械2024/5/1
LiDAR・カメラ・関節位置から直接バルブを制御するエンドツーエンドの自律ショベルシステムを提案し、Transformerによる行動チャンキングと模倣学習で掘削・運搬などの作業を少ない実演データで実現した。
- 重力補償で強化された柔らかい足と指を持つヤモリ模倣壁登りロボットの性能壁登りロボット2024/5/1
ヤモリに着想を得た四足壁登りロボットにおいて、脚の剛性低下による姿勢ずれをフィードフォワード重力補償で補正し、天井歩行時の吸着安定性と成功率を大幅に向上させた。
- 車輪脚ロボットの移動操作のためのアーム制約付きカリキュラム学習移動操作2024/3/1
車輪脚ロボットにマニピュレータを搭載し、アーム制約付き強化学習と報酬対応カリキュラム学習で動的把握タスクを実現した。
- 協調運動制御のための部分同変強化学習フレームワーク強化学習2024/3/1
物理の部分同変原理を利用し、関節間の複雑な依存関係を考慮した強化学習アーキテクチャCoordiGraphを提案。多様な環境での実験で汎化性能とサンプル効率が向上することを示した。
- CODA: A Real-World Road Corner Case Dataset for Object Detection in Autonomous Driving2022/3/1
- REGNet: REgion-based Grasp Network for End-to-end Grasp Detection in Point Clouds2020/2/1