Haoyi Niu
収録論文 16本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HiRE: 後知恵報酬編集による方策ファインチューニング強化学習2026/9/22
成功・失敗軌跡を後知恵で対比し、基盤表現モデルの報酬を制御中心に校正する訓練不要の枠組みを提案。
- ODEWorld: 物理時間の流れに基づく連続予測アーキテクチャ世界モデル2026/7/1
物理世界の連続的な時間を捉えるため、常微分方程式(ODE)を用いた連続時間の潜在世界モデルを提案し、離散時間モデルの限界を克服した。
- Action QFormer: 行動監視下での構造化表現形成による視覚言語行動モデルの性能向上VLA2026/7/1
視覚言語行動モデルにおいて、行動監視が継承したマルチモーダル表現を形成する役割を分析し、クエリベースのインターフェースを導入して行動に適した表現を再構成することで、ゼロショットsim-to-realナビゲーションの成功率を大幅に向上させた。
- オンライン模倣事前学習付きワールドモデルによるマニピュレーションの効率的なSim-to-Real転移レシピsim2real2025/10/1
ロボットシミュレータでのオンライン模倣学習と実機データでのオフライン微調整を組み合わせたワールドモデルベースの枠組みを提案し、限られた実機専門家データでもsim-to-real転移の成功率を大幅に改善した。
- PhysiAgent: 実世界で動作する身体性エージェントフレームワークVLA2025/9/1
VLMとVLAを監視・記憶・自己反省機構とツールボックスで統合し、VLAの能力を最大限に引き出す身体性エージェントフレームワークを提案。複雑な実世界ロボットタスクでの性能向上を実証した。
- 潜在空間後方計画による効率的なロボット政策学習ロボット計画2025/5/1
最終目標から逆算して潜在空間で中間サブゴールを予測する後方計画手法を提案し、長期的なタスクにおけるリアルタイム制御を効率化した。
- パラメータ空間におけるスキル拡張と合成強化学習2025/2/1
スキルをLoRAモジュールとして管理し、パラメータ空間で合成・動的選択することで、新たなタスクに効率的に適応する強化学習フレームワークPSECを提案。
- xTED: 拡散モデルによる軌道編集を用いたクロスドメイン適応クロスドメイン適応2024/9/1
拡散モデルで軌道を編集し、データレベルでドメインギャップを橋渡しするクロスドメイン適応フレームワークを提案。
- デュアルエンコーダによる多目的軌道計画軌道計画2024/3/1
デュアルエンコーダ型Transformerで初期軌道を生成し、逐次二次計画法で洗練することで、時間-ジャーク最適軌道計画を高速化する手法を提案した。
- 身体性エージェントのためのクロスドメイン方策転移に関する包括的サーベイsim2real2024/2/1
シミュレーションや実験室など異なるドメイン間でロボットの方策を転移する手法を体系的に整理し、ドメインギャップの分類や主要手法、今後の課題をまとめたサーベイ論文。
- DecisionNCE: 暗黙的選好学習による身体性マルチモーダル表現VLA2024/2/1
視覚軌跡と言語指示の対応を暗黙的選好として扱い、Bradley-Terryモデルを再パラメータ化することで、タスク進捗と時間的一貫性、言語接地を同時に学習する統合表現学習フレームワークを提案した。
- Continual Driving Policy Optimization with Closed-Loop Individualized Curricula2023/9/1
- H2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps2023/9/1
- Stackelberg Driver Model for Continual Policy Improvement in Scenario-Based Closed-Loop Autonomous Driving2023/9/1
- A Versatile and Efficient Reinforcement Learning Framework for Autonomous Driving2021/10/1
- DR2L: Surfacing Corner Cases to Robustify Autonomous Driving via Domain Randomization Reinforcement Learning2021/7/1