Xiaomeng Huang
収録論文 3本 ・ フィジカルAI/ロボット学習
ビデオ世界モデルモデルベース強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboAlign-R1: ロボットビデオ世界モデルのための蒸留型マルチモーダル報酬アライメントビデオ世界モデル2026/5/1
ロボットビデオ世界モデルの訓練を、再構成損失などの低レベル目的ではなく、指示追従や操作成功などの意思決定に重要な能力に合わせるため、報酬アライメントと長期推論安定化を組み合わせたフレームワークを提案した。
- 計画としての時空間予測:生成的世界モデルを用いたモデルベース強化学習アプローチモデルベース強化学習2025/10/5
時空間予測をモデルベース強化学習の問題として捉え、生成的世界モデルとビーム探索による計画で非微分な評価指標を報酬として活用し、極端事象の捕捉精度を高める手法を提案した。
- RMBench: Benchmarking Deep Reinforcement Learning for Robotic Manipulator Control2022/10/1