Elahe Arani
収録論文 9本 ・ フィジカルAI/ロボット学習
3D車線検出/自動運転自動運転/VLAワールドモデル自動運転VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Depth3DLane:自己教師あり単眼深度推定を融合した単眼3D車線検出3D車線検出/自動運転2025/7/1
自己教師あり単眼深度推定を組み合わせた二経路フレームワークにより、高価な深度センサや正解深度データなしで3D車線を検出し、カメラパラメータもフレームごとに推定する手法を提案した。
- SimLingo: 言語と行動を整合させた視覚のみの閉ループ自動運転自動運転/VLA2025/3/1
カメラ映像のみを使う視覚言語モデルで、閉ループ運転・視覚言語理解・言語と行動の整合を同時に実現し、CARLAのBench2Driveで最高性能を達成した研究。
- GAIA-2: 自動運転のための制御可能なマルチビュー生成ワールドモデルワールドモデル2025/3/1
自動運転向けに、自車挙動やエージェント配置、環境要因、道路意味論などの構造化入力で制御可能な、マルチカメラで時空間的に一貫した高解像度動画を生成する潜在拡散ワールドモデルを提案。
- CarLLaVA:カメラのみの閉ループ自動運転のための視覚言語モデル自動運転VLA2024/6/1
LLaVAの視覚エンコーダとLLaMAをバックボーンに用い、カメラ入力のみでCARLA自動運転チャレンジ2.0のセンサートラックで1位を獲得した視覚言語モデルを提案。
- LingoQA: Visual Question Answering for Autonomous Driving2023/12/1
- Multimodal Scale Consistency and Awareness for Monocular Self-Supervised Depth Estimation2021/3/1
- Practical Auto-Calibration for Spatial Scene-Understanding from Crowdsourced Dashcamera Videos2020/12/1
- Monocular Vision based Crowdsourced 3D Traffic Sign Positioning with Unknown Camera Intrinsics and Distortion Coefficients2020/7/1
- Crowdsourced 3D Mapping: A Combined Multi-View Geometry and Self-Supervised Learning Approach2020/7/1