Tyler Han
収録論文 7本 ・ フィジカルAI/ロボット学習
模倣学習/安全性逆強化学習模倣学習/計画sim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 安全な模倣学習のための識別バリア関数模倣学習/安全性2026/7/1
逆強化学習の報酬関数を制御バリア関数に制約し、専門家の観察から直接バリア関数を学習して安全な制御を実現する手法を提案した。
- オンライン世界モデリングによる観察からの実世界逆強化学習逆強化学習2026/2/1
オンライン世界モデルを用いて、実世界のロボットが観察(動画)のみから視覚的マニピュレーションを逆強化学習で学習する手法を提案し、ピックアンドプレースを40分未満で82%の成功率まで達成した。
- 観測からの計画のためのモデル予測敵対的模倣学習模倣学習/計画2025/7/1
逆強化学習のポリシーをモデル予測制御に置き換え、観測のみのデモから計画器をエンドツーエンドで学習する手法を提案し、サンプル効率や汎化性能の向上を示した。
- Wheeled Lab:低コスト・オープンソース車輪型ロボティクスのためのモダンなSim2Realsim2real2025/2/1
オープンソースの車輪型ロボットとIsaac Labを統合したエコシステムを構築し、ドリフト制御・起伏走行・視覚ナビゲーションのゼロショット方策を実現した。
- アグレッシブなオフロード走行領域におけるダイナミクスモデルsim2real2024/5/1
オフロード自律走行の高速・過酷な運転領域で、複雑さの異なる3つのダイナミクスモデルの予測精度をシミュレーションと実世界データで評価し、攻撃性が増すと精度が低下することを示した。
- Deep Learning for Koopman-based Dynamic Movement Primitives2023/12/1
- Model Predictive Control for Aggressive Driving Over Uneven Terrain2023/11/1