Yu Zeng
Toyota Research Institute
収録論文 7本 ・ フィジカルAI/ロボット学習
自動運転自動運転シミュレーションsim2realVLA世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NavSafe-∞:フォトリアル環境における閉ループ運転安全性のベンチマーク自動運転2026/9/22
280のシナリオからなるフォトリアルな閉ループ運転ベンチマークを提案し、20のE2Eポリシーを評価して、開ループ性能が閉ループ安全性に必ずしも移行しないことを示した。
- DreamStream: エンドツーエンド運転ポリシー向け生成的シミュレーション自動運転シミュレーション2026/9/22
大規模動画モデルを蒸留し、ポリシーが依存するシーン特徴を保つ生成的閉ループシミュレータDreamStreamを提案。新指標FDπで評価し、既存手法より高精度にポリシー知覚を再現、敵対的運転を含むベンチマークNavhard-CLも構築。
- 位相保存拡散による構造整合生成sim2real2025/12/1
拡散過程のノイズを位相保存型に再定式化し、構造を保った画像・動画生成やsim2real転移を可能にした手法を提案。
- DualVLA: 推論と行動の部分的デカップリングによる汎用身体性エージェントの構築VLA2025/11/1
ロボット実演で訓練したVLAモデルにマルチモーダル推論を追加すると行動性能が劣化する「行動退化」を解決するため、二層データ選別と二重教師適応蒸留を提案し、推論能力を保ちつつ行動精度を向上させた。
- Cosmos-Transfer1:適応的マルチモーダル制御による条件付きワールド生成sim2real2025/3/1
セグメンテーション・深度・エッジなど複数モダリティの空間制御入力を場所ごとに重み付けして世界シミュレーションを生成するモデルを提案し、ロボティクスのSim2Realや自動運転データ拡張への応用とリアルタイム推論を実証した。
- 物理AIのためのCosmos世界基盤モデルプラットフォーム世界モデル2025/1/1
物理AI開発者向けに、カスタマイズ可能な世界モデルを構築するための基盤モデル・動画キュレーション・トークナイザを提供するオープンソースプラットフォーム。
- ワンステップ拡散方策:拡散蒸留による高速視覚運動方策VLA2024/10/1
事前学習済み拡散方策を蒸留して1ステップで行動を生成する手法を提案し、推論速度を1.5Hzから62Hzへと大幅に高速化した。