Haitong Ma
収録論文 13本 ・ フィジカルAI/ロボット学習
ベンチマーク操作学習/強化学習/Sim-to-Real強化学習模倣学習医療ロボティクスsim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RLE-Bench:ロボット学習エンジニアとしてのコーディングエージェントの適性試験ベンチマーク2026/9/28
コーディングエージェントのロボット開発能力を評価するため、制御・方策学習・知覚・機械設計の4ワークフローにまたがるベンチマークRLE-Benchを提案し、RLE指数で能力を比較した。
- ゼロショットSim-to-Real転送を備えたマルチタスクブロック押し操作のための単一拡散ポリシーコントローラ操作学習/強化学習/Sim-to-Real2026/7/1
強化学習を用いて、複数の形状のブロックを押すマルチタスク操作を単一の拡散ポリシーで学習し、実世界へゼロショット転送できることを示した論文。
- 適応学習:表現ベース強化学習によるマルチタスクスキル転移強化学習2026/6/1
スペクトルMDP分解を用いてタスク非依存のコアとタスク固有の調整に価値関数を構造化し、マルチタスク強化学習の効率的な知識共有と新タスクへの転移を実現するフレームワークRepMT-SACを提案した。
- 任意のデモンストレーションによるオフライン模倣学習:ダイナミクス表現の事前学習模倣学習2025/8/1
遷移ダイナミクスの分解からダイナミクス表現を事前学習し、限られた専門家データでもオフライン模倣学習を高精度化する手法を提案。非専門家データを再利用でき、MuJoCoや実機四足歩行で少数デモからの学習を実現。
- 拡散ポリシーのための効率的なオンライン強化学習強化学習2025/2/1
拡散ポリシーをオンライン強化学習で効率的に学習するため、損失関数を再重み付けしたReweighted Score Matchingを提案し、DPMDとSDACの2アルゴリズムを開発した。
- 肝臓フォローアップ診断のための自律型ロボット超音波システム:ファントムによるパイロット研究医療ロボティクス2024/5/1
CT画像と3D超音波の位置合わせおよび深層学習セグメンテーションを用いて、肝臓のフォローアップ超音波検査を自律的に行うロボットシステムを提案し、ファントム実験でその有効性を確認した。
- 表現学習によるSim-to-Realスキル転移と発見sim2real2024/4/1
MDPのスペクトル分解に基づくスキル表現をシミュレータから実機へ転移し、実世界データから新スキルを発見して性能を最大30.2%改善する手法を提案。
- Safe Model-Based Reinforcement Learning with an Uncertainty-Aware Reachability Certificate2022/10/1
- Synthesize Efficient Safety Certificates for Learning-Based Safe Control using Magnitude Regularization2022/9/1
- Reachability Constrained Reinforcement Learning2022/5/1
- Learn Zero-Constraint-Violation Policy in Model-Free Constrained Reinforcement Learning2021/11/1
- Integrated Decision and Control: Towards Interpretable and Computationally Efficient Driving Intelligence2021/3/1
- Model-based Constrained Reinforcement Learning using Generalized Control Barrier Function2021/3/1