Rodrigue de Schaetzen
収録論文 5本 ・ フィジカルAI/ロボット学習
自動運転強化学習ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- エンドツーエンド運転のためのセルフプレイのスケーリング自動運転2026/6/1
シミュレーション内で大規模なセルフプレイを用いてエンドツーエンド運転モデルを訓練する手法を提案し、実世界への転移を可能にする。
- 制約付きグループ相対方策最適化強化学習2026/2/1
GRPOをラグランジュ緩和で拡張し、制約違反率を直接最適化する制約付き方策学習手法を提案。アドバンテージのスカラー化で安定した制約制御を実現し、ロボティクスタスクでの成功率向上も示した。
- Poutine: 視覚-言語-軌道の事前学習と強化学習による堅牢なエンドツーエンド自動運転自動運転2025/6/1
3Bパラメータの視覚言語モデルを視覚・言語・軌道トークンで自己教師あり事前学習し、GRPOで微調整することで、長尾シナリオを含むWaymoベンチマークで最高性能を達成した。
- AUTO-IceNav: 砕氷海域における自律航行船の局所ナビゲーション戦略ナビゲーション2024/11/1
氷片が浮かぶ海域を航行する船舶のための自律ナビゲーション手法を提案し、衝突による運動エネルギー損失を最小化する経路計画をシミュレーションと実機で検証した。
- Real-Time Navigation for Autonomous Surface Vehicles In Ice-Covered Waters2023/2/1