Zhijian Huang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA/操作自動運転/VLAVLA自動運転VLMベンチマーク自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniviewVLA:世界モデリングを備えた統合マルチビュー視覚言語行動モデルVLA/操作2026/6/1
標準的な2つのカメラ観測のみから、世界モデルを用いてマルチビューの未来シーンを生成し、遮蔽された情報を補完して行動予測を改善するVLAモデルを提案。推論高速化のためのトークン圧縮と、動的な視点選択手法も導入。
- Xiaomi OneVL: ワンステップ潜在推論と視覚言語説明によるプランニング自動運転/VLA2026/4/1
自動運転のVLAモデルにおいて、潜在推論を視覚世界モデルで強化し、明示的CoTを超える精度を実現しつつ、推論速度を回答のみの予測と同等に高速化したフレームワークを提案した。
- MiMo-Embodied: クロス身体性基盤モデル技術報告VLA2025/11/1
自動運転と身体性AIを統合した初のクロス身体性基盤モデルを開発し、両分野で最先端性能を達成した。
- DSBench:車外・車内リスクを評価する包括的ベンチマーク自動運転VLMベンチマーク2025/11/1
自動運転向けVLMの安全性評価のため、車外環境リスクと車内運転行動安全を10カテゴリ28サブカテゴリで統合評価する初のベンチマークDSBenchを構築し、98Kデータでの微調整が安全性を向上させることを示した。
- RoboTron-Sim: シミュレーションによる難ケースで実世界運転を改善自動運転2025/8/1
高リスクな稀ケースを網羅したシミュレーションデータセットHASSと、環境・ハードウェア差に適応する手法を提案し、実世界の自動運転性能を約50%向上させた。
- RoboTron-Drive:自動運転のためのオールインワン大規模マルチモーダルモデルVLA2024/12/1
画像や多視点動画を入力とし、知覚・予測・計画を含む多様な自動運転タスクを単一モデルで実行する汎用大規模マルチモーダルモデルを提案し、複数ベンチマークで最先端性能を達成した。