Tong Zhan
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA自動運転/軌道計画/VLM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Less is More: 自動運転のための軽量かつ強力な視覚言語モデルVLA2025/10/1
自動運転を言語問題として捉え、視覚言語モデルを用いて前視カメラ入力から直接軌道を予測する一段階エンドツーエンドフレームワークMax-V1を提案。nuScenesで30%以上の性能向上を達成。
- BEV-VLM: 統合BEV表現による軌道計画自動運転/軌道計画/VLM2025/9/1
カメラとLiDARを融合したBEV特徴マップを視覚入力としてVLMに与え、自動運転の軌道計画を高精度化する手法を提案。nuScenesで視覚のみの最先端手法より計画精度が53.1%向上し、衝突回避も達成。