Haiming Zhang
収録論文 4本 ・ フィジカルAI/ロボット学習
自動運転/VLA自動運転/シーン生成自動運転知覚自動運転/自己教師あり学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MindVLA-U1: 統合ストリーミングアーキテクチャによる自動運転向けVLAがVAを凌駕自動運転/VLA2026/5/1
自動運転向けに、言語トークンと連続アクション軌道を単一の共有表現で生成する初の統合ストリーミングVLAアーキテクチャを提案し、従来のVAモデルを上回る性能を実現した。
- AnyScene: 任意の場所とその先における高制御性運転シーン生成に向けて自動運転/シーン生成2026/5/1
BEVレイアウトからセマンティック占有シーケンスを生成し、それを基にマルチビュー運転ビデオを合成する統一的な占有中心フレームワークを提案。クロスデータセットやユーザー定義のレイアウトに対して高精度な制御と長期的生成を実現する。
- SQS: 自動運転におけるクエリベーススプラッティングによるスパース知覚モデルの強化自動運転知覚2025/9/1
スパースクエリから3Dガウシアンを予測する自己教師ありスプラッティング事前学習を導入し、占有予測や3D物体検出などの自動運転知覚タスクの性能を向上させた研究。
- VisionPAD: 自動運転のための視覚中心の事前学習パラダイム自動運転/自己教師あり学習2024/11/1
画像のみを教師信号に3Dガウシアンスプラッティングで多視点表現を再構成し、ボクセル速度推定と多フレーム測光整合性で自動運転向け視覚モデルを自己教師あり事前学習する手法。