Haoxiang Gao
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 自動運転における歩行者行動とシーン理解への視覚言語モデルの応用VLA2025/1/1
大規模視覚言語モデルの知識を効率的な視覚ネットワークに蒸留し、歩行者の行動予測とシーン理解に適用することで、多様で包括的な意味属性の生成と予測精度の向上を実現した。
- 自動運転における基盤モデルに関するサーベイ自動運転2024/2/1
自動運転分野における基盤モデルの活用を40本以上の論文を通じて整理し、LLM・視覚基盤モデル・マルチモーダルモデルの役割と課題、今後の研究方向をまとめたサーベイ。