Zhigang Sun
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA自動運転VLA自動運転/プランニング自動運転/予測・計画自動運転/VLA軌道予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HiST-VLA:階層的時空間視覚言語行動モデルによるエンドツーエンド自動運転VLA2026/2/1
3D空間認識と時系列推論を強化した階層的VLAモデルを提案し、動的トークン統合と階層的プランナーで軌道生成を高精度化、NAVSIM v2で最高性能を達成した。
- DiffVLA++:メトリック誘導アラインメントによる認知推論とエンドツーエンド運転の橋渡し自動運転VLA2025/10/1
VLAモデルの認知推論とE2Eモデルの物理的実現可能性を、メトリック誘導の軌道スコアラで統合した自動運転フレームワークを提案。
- FlowDrive: エンドツーエンド自動運転のためのエネルギーフローフィールド自動運転/プランニング2025/9/1
リスクポテンシャルと車線引力場という物理的に解釈可能なエネルギーフローフィールドをBEV空間に導入し、拡散プランナで軌道生成する自動運転フレームワーク。NAVSIM v2でEPDMS 86.3のSOTAを達成。
- IRL-VLA:逆強化学習報酬ワールドモデルによる視覚言語行動ポリシーの訓練VLA2025/8/1
逆強化学習で軽量な報酬ワールドモデルを構築し、PPOによる閉ループ強化学習でVLAポリシーを訓練する手法を提案。NAVSIM v2ベンチマークで最先端性能を達成。
- DiffSemanticFusion: オンラインHDマップ拡散による自動運転向けセマンティックラスタBEV融合自動運転/予測・計画2025/8/1
ラスタ表現とグラフ表現の長所を組み合わせ、オンラインHDマップの拡散モジュールで安定性と表現力を高めるBEV融合フレームワークを提案し、軌道予測と計画タスクで性能を改善した。
- DiffVLA: 視覚言語モデルが導く拡散プランニングによる自動運転自動運転/VLA2025/5/1
視覚言語モデルを活用したハイブリッドなスパース・デンス拡散ポリシーを提案し、効率的で多様な運転行動と軌道生成の改善を実現した自動運転手法。
- SemanticFormer: 知識グラフを用いた軌道予測のための全体論的・意味的交通シーン表現軌道予測2024/4/1
交通参加者や道路構造、標識などの意味関係を知識グラフで表現し、メタパスと注意機構を組み合わせてマルチモーダルな軌道予測を行う手法を提案。
- nuScenes Knowledge Graph -- A comprehensive semantic representation of traffic scenes for trajectory prediction2023/12/1