Vincent Sitzmann
Massachusetts Institute of Technology
収録論文 8本 ・ フィジカルAI/ロボット学習
ナビゲーションVLAロボット制御生成モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 重要視覚手がかりで動画計画を誘導する汎用ロボットナビゲーションナビゲーション2026/9/15
鳥瞰図と自己身体視点を視覚手がかりとして動画生成モデルによるナビゲーション計画を誘導し、逆動力学モデルで精密な行動に変換するフレームワークを提案。迷路や狭路での成功率を大幅に向上させ、異なるロボットへのゼロショット展開も示した。
- ビデオモデルを汎用ロボットポリシーへ変換するVLA2026/5/1
ビデオ生成モデルをそのまま使い、逆動力学モデル(IDM)を個別に学習してビデオ計画を行動に変換する手法を提案。シミュレーションと実世界で高い性能を示した。
- 大規模動画プランナーによる汎用ロボット制御VLA2025/12/1
インターネット規模の人間活動動画で生成的なロボット計画モデルを基盤モデル規模で学習し、新しい場面やタスクに対してゼロショットで動画計画を生成して実機の行動に変換する手法を提案した。
- 深層ネットワークによるヤコビアン場推定で多様なロボットを制御ロボット制御2024/7/1
カメラ映像からロボットの視覚運動ヤコビアン場を深層学習で推定し、単一カメラのみで多様なロボットを閉ループ制御する手法を提案。
- 拡散強制:次トークン予測と全系列拡散の融合生成モデル2024/7/1
各トークンに独立なノイズレベルを与えて拡散モデルを訓練する新手法を提案し、次トークン予測と全系列拡散の長所を組み合わせて可変長生成や計画タスクで性能を向上させた。
- DittoGym: Learning to Control Soft Shape-Shifting Robots2024/1/1
- Neural Descriptor Fields: SE(3)-Equivariant Object Representations for Manipulation2021/12/1
- 3D Neural Scene Representations for Visuomotor Control2021/7/1