Pranav Desai
収録論文 3本 ・ フィジカルAI/ロボット学習
自動運転/VLA/強化学習自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MAPLE: 潜在マルチエージェントプレイによるエンドツーエンド自動運転自動運転/VLA/強化学習2026/5/1
VLAモデルを閉ループで訓練するため、潜在空間でマルチエージェントのロールアウトを行い、強化学習で安全・進捗・多様性を最適化するフレームワークを提案。外部シミュレータ不要でスケーラブルな閉ループ訓練を実現し、Bench2DriveでSOTAを達成。
- BridgeSim: 自動運転エンドツーエンドにおけるオープンループとクローズドループのギャップの解明自動運転2026/4/1
オープンループ評価で高得点でもクローズドループ運用で失敗する原因を分析し、テスト時適応でギャップを緩和する手法を提案した論文。
- 対話型自動運転のための生成エージェント行動モデルの事後学習とテスト時スケーリング自動運転2025/12/1
自動運転の対話行動モデルに対し、強化学習による事後学習(GRBO)とテスト時サンプリング(Warm-K)を提案し、安全性と一貫性を向上させた。