Oleg Sinavski
収録論文 5本 ・ フィジカルAI/ロボット学習
自動運転/VLAsim2real自動運転VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SimLingo: 言語と行動を整合させた視覚のみの閉ループ自動運転自動運転/VLA2025/3/1
カメラ映像のみを使う視覚言語モデルで、閉ループ運転・視覚言語理解・言語と行動の整合を同時に実現し、CARLAのBench2Driveで最高性能を達成した研究。
- 裏庭でロボット学習:オープンソース部品によるニューラルシミュレータsim2real2024/10/1
単一の動画からフォトリアルな仮想環境を生成し、強化学習による視覚ナビゲーション方策の訓練を可能にするオープンソースのニューラルシミュレータSplatGymを提案。
- CarLLaVA:カメラのみの閉ループ自動運転のための視覚言語モデル自動運転VLA2024/6/1
LLaVAの視覚エンコーダとLLaMAをバックボーンに用い、カメラ入力のみでCARLA自動運転チャレンジ2.0のセンサートラックで1位を獲得した視覚言語モデルを提案。
- LingoQA: Visual Question Answering for Autonomous Driving2023/12/1
- Driving with LLMs: Fusing Object-Level Vector Modality for Explainable Autonomous Driving2023/10/1