Maxime Sabbah
収録論文 3本 ・ フィジカルAI/ロボット学習
制御逆強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- COSMIK-MPPI:近接動的人間環境における衝突回避への制約付きモデル予測制御の拡張制御2026/4/1
MPPI制御に制約違反を終端事象として扱う手法を組み合わせ、人間の動作予測に依存せずに衝突回避を保証するフレームワークを提案し、実機で検証した。
- 逆強化学習による人間動作のグローバル意図推定に向けて逆強化学習2026/3/1
単一の統一コスト関数で人間の到達動作を説明・予測できるかを、逆強化学習を用いて検証し、時間変化するコスト重みが軌道再構成を大幅に改善することを示した論文。
- 最小観測逆強化学習による人間の到達運動の最適性原理の学習逆強化学習2025/10/1
最小観測逆強化学習(MO-IRL)を用いて、人間の腕到達運動を時変コスト重みでモデル化し、少ないデモンストレーションで効率的に学習・予測できることを示した。