Lenart Treven
収録論文 8本 ・ フィジカルAI/ロボット学習
強化学習モデルベースRL強化学習/制御安全強化学習sim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 時間変動ダイナミクス下での制御のためのモデルベース強化学習強化学習2026/4/1
システムダイナミクスが時間とともに変化する環境で、古いデータの影響を制限する適応バッファ機構を持つ楽観的モデルベース強化学習アルゴリズムを提案し、非定常な連続制御ベンチマークでの性能向上を示した。
- 連続時間強化学習におけるサンプル効率とスケーラビリティの両立モデルベースRL2025/10/1
連続時間の未知ダイナミクスを確率的モデルで学習し、報酬と不確実性を組み合わせて探索するモデルベース強化学習手法COMBRLを提案。理論的な後悔・サンプル複雑度保証と実験での優位性を示した。
- TARC: 時間適応型ロボット制御強化学習/制御2025/10/1
強化学習により、ロボットが状況に応じて制御周波数を自律的に調整し、制御動作とその持続時間を同時に選択する手法を提案。RCカーと四足歩行ロボットで実機検証し、固定周波数制御と同等以上の性能を保ちつつ制御周波数を大幅に削減。
- ActSafe: 安全制約付き強化学習のための能動的探索安全強化学習2024/10/1
未知のダイナミクスに対する不確実性を考慮しつつ安全制約を守りながら探索するモデルベース強化学習手法を提案し、学習中の安全性と高性能を両立できることを示した。
- ベイズ推論によるSim-to-Realギャップの橋渡しsim2real2024/3/1
低忠実度の物理シミュレータを事前分布として活用し、ニューラルネットワークによるロボットダイナミクス学習を正則化するSIM-FSVGDを提案。RCレースカーでのドリフト駐車を少ないデータで実現。
- Efficient Exploration in Continuous-time Model-based Reinforcement Learning2023/10/1
- Optimistic Active Exploration of Dynamical Systems2023/6/1
- Learning Stabilizing Controllers for Unstable Linear Quadratic Regulators from a Single Trajectory2020/6/1