Jiawei Yang
University of Southern California
収録論文 3本 ・ フィジカルAI/ロボット学習
自動運転/世界モデルVLA3D認識
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PhysWAM: 自動運転のための物理的に整合した世界行動モデル自動運転/世界モデル2026/9/29
マルチビュー動画・深度・自車運動を単一のフローマッチングTransformerで同時生成し、生成した深度と運動をLiDAR点群に整合させる幾何制約CPPを導入した自動運転向け世界行動モデル。
- FiberTune: 視覚言語行動モデルの微調整における行動ファイバー視覚残差の保持VLA2026/6/7
VLAポリシーの行動教師あり微調整で生じる視覚表現の崩壊を防ぐため、行動予測方向を除いた視覚残差を教師モデルに整合させる訓練手法FiberTuneを提案し、シミュレーションと実機で性能向上を確認した。
- DistillNeRF: 単眼画像からニューラル場と基盤モデル特徴を蒸留して3Dシーンを認識3D認識2024/6/1
単一フレームの多視点カメラ画像から、NeRFの蒸留とCLIP/DINOv2などの2D基盤モデル特徴の蒸留を組み合わせて、自己教師ありで3Dシーン表現を学習する手法を提案。