Hongkai Dai
収録論文 18本 ・ フィジカルAI/ロボット学習
ロボット学習マニピュレーションシーン生成VLA制御理論制御/安定性
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OGPO: 生成制御ポリシーのサンプル効率的な完全ファインチューニングロボット学習2026/5/1
拡散やフローベースの生成制御ポリシーを、オフポリシーな批判ネットワークとPPO目的関数を用いて効率的にファインチューニングする手法OGPOを提案し、操作タスクで最先端の性能を達成した。
- マルチタスク巧みな操作のための大規模行動モデルの慎重な検証マニピュレーション2025/7/1
大規模行動モデル(LBM)をシミュレーションと実世界で厳密に評価し、マルチタスク事前学習が単一タスクより成功率・堅牢性・データ効率を高めることを統計的に示した。
- 後学習と推論時探索による操作可能なシーン生成シーン生成2025/5/1
拡散モデルで物体配置とSE(3)姿勢を生成し、強化学習による後学習や推論時探索で下流タスクに合わせてシーンを制御する手法を提案。
- 拡散方策の政策最適化VLA2024/9/1
拡散モデルベースの方策を強化学習の政策勾配法でファインチューニングするDPPOを提案し、ロボット操作タスクで高い性能と安定性を示した。
- 制御リアプノフ関数と制御バリア関数の両立性検証と合成制御理論2024/6/1
制御バリア関数(CBF)と制御リアプノフ関数(CLF)が両立するための必要十分条件を導出し、SOS計画による検証とノミナル制御器に依存しない合成手法を提案した。
- 状態フィードバックと出力フィードバックのためのリアプノフ安定なニューラル制御:新たな定式化制御/安定性2024/4/1
高速な反例探索と戦略的正則化を用いて、リアプノフ証明付きのニューラル制御器を学習する枠組みを提案し、GPU上で効率的に検証する。出力フィードバック制御への拡張も示す。
- Fighting Uncertainty with Gradients: Offline Reinforcement Learning via Diffusion Score Matching2023/6/1
- Approximate Optimal Controller Synthesis for Cart-Poles and Quadrotors via Sums-of-Squares2023/4/1
- AdaptSim: Task-Driven Simulation Adaptation for Sim-to-Real Transfer2023/2/1
- Certified Polyhedral Decompositions of Collision-Free Configuration Space2023/2/1
- Convex synthesis and verification of control-Lyapunov and barrier functions with input constraints2022/10/1
- Finding and Optimizing Certified, Collision-Free Regions in Configuration Space for Robot Manipulators2022/5/1
- Lyapunov-stable neural-network control2021/9/1
- Dexterous Manipulation Primitives for the Real Robot Challenge2021/1/1
- Simultaneous Contact, Gait and Motion Planning for Robust Multi-Legged Locomotion via Mixed-Integer Convex Optimization2019/4/1
- A Convex-Combinatorial Model for Planar Caging2018/9/1
- Application of Wrench based Feasibility Analysis to the Online Trajectory Optimization of Legged Robots2017/12/1
- The Actuation-consistent Wrench Polytope (AWP) and the Feasible Wrench Polytope (FWP)2017/12/1