Amirhosein Chahe
Drexel University
収録論文 6本 ・ フィジカルAI/ロボット学習
ナビゲーション自動運転VLA3Dセグメンテーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 単調計画コストを備えた潜在世界モデルによる画像目標ナビゲーションナビゲーション2026/8/1
画像目標ナビゲーションのための潜在世界モデルを提案し、計画コストの順序性を改善する単調コストランキング損失を導入して、サンプリングベースのプランナーの性能を向上させた。実ロボットでのゼロショット展開も実証した。
- 隠れたものこそ重要:視覚言語モデルを用いた計画に重要な遮蔽エージェントの特定自動運転2026/7/1
自動運転車の計画に影響を与える隠れたエージェントを、視覚言語モデルと計画KLダイバージェンスを用いて特定・ランク付けするフレームワークを提案し、データ選択戦略により性能を大幅に向上させた。
- 言語条件付き視覚ナビゲーションのためのポリシー誘導型ワールドモデルプランニングナビゲーション2026/3/1
学習済みナビゲーションポリシーと潜在ワールドモデルプランニングを組み合わせた二段階フレームワークPiJEPAを提案し、言語指示に基づく視覚ナビゲーションの性能を向上させた。
- ReasonDrive: 推論強化型小型視覚言語モデルによる自動運転向け効率的視覚質問応答VLA2025/4/1
GPT-4oで生成した推論連鎖を用いて小型VLMをファインチューニングし、自動運転の意思決定タスクにおける精度と説明性が向上することを示した研究。
- Query3D: 言語埋め込み3DガウシアンとLLMによるオープンボキャブラリ3Dシーンセグメンテーション3Dセグメンテーション2024/8/1
自動運転向けに、Language Embedded 3D GaussianとLLMを組み合わせ、任意のテキストクエリで3Dシーンをセグメンテーションする手法を提案。GPT-3.5で学習データを生成し小型LLMをファインチューニングしてオンデバイス展開を可能にした。
- Dynamic Adversarial Attacks on Autonomous Driving Systems2023/12/1