Kangan Qian
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA/基盤モデル自動運転/VLMVLA自律走行/VLM自己位置推定交通分析自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- XEmbodied: 大規模具現環境向けに幾何・物理的手がかりを強化した基盤モデルVLA/基盤モデル2026/4/1
クラウド側でVLMに3次元幾何認識と物理的手がかりを統合し、空間推論や具現化タスクの性能を向上させる基盤モデルを提案した。
- MTRDrive: 記憶とツールの協調推論によるコーナーケースに頑健な自動運転自動運転/VLM2025/9/1
運転経験の記憶検索と動的ツールキットを組み合わせた閉ループ型フレームワークMTRDriveを提案し、OODシナリオでのゼロショット汎化と計画精度を向上させた。
- 自動運転のための視覚-言語-行動モデルに関するサーベイVLA2025/6/1
自動運転向けの視覚・言語・行動を統合したVLAモデルについて、アーキテクチャや20以上の代表モデル、データセット、課題を初めて体系的にまとめたサーベイ。
- AgentThink:自動運転向け視覚言語モデルにおけるツール拡張型思考連鎖推論の統合フレームワークVLA2025/5/1
自動運転向けに、思考連鎖推論と動的なツール呼び出しを統合したフレームワークAgentThinkを提案し、DriveLMM-o1ベンチマークで推論スコアを53.91%向上させた。
- FASIONAD++:適応的フィードバックによる自律走行の安全性向上を目指した高速・低速融合システムへの高レベル指示と情報ボトルネックの統合自律走行/VLM2025/3/1
「速い思考と遅い思考」に着想を得て、高速なエンドツーエンド計画器とVLM推論モジュールを組み合わせた二重システムを提案し、不確実性に応じて切り替えることで自律走行の安全性と効率を高めた。
- RAVE: ラスタライズ・ベクター化HDマップを用いたエンドツーエンド階層型視覚自己位置推定自己位置推定2025/3/1
周囲画像とHDマップを統合し、ラスタマップによる粗推定とベクタマップによるTransformerベースの精緻化を組み合わせたエンドツーエンドの視覚自己位置推定システムを提案。
- 車はどう動くか:安全な都市交通のための運転ダイナミクス分析交通分析2024/12/1
都市交通の時空間パターンを分析するデータ統合フレームワークPriorMotionを提案し、交通パターン分析の精度向上と長期予測誤差の低減を実現した。
- FASIONAD:適応的フィードバックを備えた人間らしい自動運転のための高速・低速融合思考システム自動運転2024/11/1
「ファスト&スロー」思考に着想を得て、高速なデータ駆動型経路計画と低速なLLM推論を動的に切り替える自動運転フレームワークを提案し、nuScenes由来の新ベンチマークで最先端性能を達成した。