Shuchang Zhou
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA視覚グラウンディング3D編集自動運転シミュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GroundingPI:視覚プリミティブで物理知能に挑むグラウンディング基盤モデルVLA2026/9/30
点やボックスを量子化座標として生成する4Bのグラウンディング基盤モデルを提案し、ロボット操作や自動運転の視覚バックボーンとして性能を向上させた。
- GroundAnything: 並列デコーディングと高精度視覚グラウンディングをフラッシュ速度で両立視覚グラウンディング2026/9/30
拡散モデルによる並列デコーディングで視覚グラウンディングを高速化し、4Bモデルで同規模の最先端性能を達成した研究。
- Chat-Edit-3D++: 大規模言語モデルによる対話型3D・4Dシーン編集3D編集2026/8/29
大規模言語モデルを中心に対話で3D/4Dシーンを編集する手法を提案。2Dアトラス画像への変換で編集と再構成を分離し、多様な視覚ツールを自動的に呼び出す。
- HybridWorldSim:自動運転向けのスケーラブルで制御可能な高忠実度シミュレータ自動運転シミュレーション2025/11/1
静的背景のニューラル再構成と動的エージェントの生成モデルを統合し、大視点変化でも幾何一貫性を保つ自動運転シミュレータを提案。新データセットMIRRORも公開。