Sicheng Zuo
収録論文 6本 ・ フィジカルAI/ロボット学習
自動運転自動運転/トークン化3D再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DVGT-2: 大規模自動運転のためのビジョン・ジオメトリ・アクションモデル自動運転2026/4/1
自動運転のための新しいVGAパラダイムを提案し、オンライン推論可能なストリーミング型のDVGT-2を導入。密な3Dジオメトリと軌道計画を同時に出力し、多様なカメラ設定で微調整なしに適用可能。
- DriveTok: 3D運転シーンのトークン化による統一的な多視点再構成と理解自動運転/トークン化2026/3/19
多視点の運転シーンを効率的にトークン化する3Dシーン・トークナイザーを提案し、画像再構成やセマンティックセグメンテーション、深度予測、3D占有予測を統一的に扱えることを示した。
- Vega: 自然言語指示による自動運転学習自動運転2026/3/1
多様な運転指示と軌道を含む大規模データセットを構築し、視覚と言語を統合して指示に従った軌道生成と計画を行う統一モデルVegaを提案した。
- 運転視覚幾何Transformer3D再構成2025/12/1
自動運転向けに、カメラパラメータ不要で多視点画像列からメートルスケールの密な3D点群と自車姿勢を推定するTransformerモデルを提案。
- GaussianAD: 3Dガウシアン中心のエンドツーエンド自動運転自動運転2024/12/1
3Dセマンティックガウシアンで周囲シーンを表現し、視覚入力から知覚・予測・軌道計画をエンドツーエンドで行う自動運転フレームワークを提案。
- GPD-1: 自動運転のための生成的事前学習自動運転2024/12/1
自車・エージェント・地図をトークン化し、自己回帰トランスフォーマで統一的に生成することで、追加学習なしにシーン生成・交通シミュレーション・地図予測・運動計画など多様な運転タスクをこなすモデルを提案。