Wei-Cheng Tseng
収録論文 8本 ・ フィジカルAI/ロボット学習
評価VLA世界モデルマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SC3-Eval: 自己整合的なビデオ生成によるロボット基盤モデルの評価評価2026/6/1
ロボット操作ポリシーの実世界評価を、アクション条件付きビデオ世界モデルを用いてスケーラブルに代替する手法を提案。前方・逆方向ダイナミクス整合性、クロスビュー整合性、テスト時整合性の3つの整合性を課すことで、正確なポリシー評価を実現する。
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- DreamDojo: 大規模人間動画から学ぶ汎用ロボット世界モデル世界モデル2026/2/1
44,000時間の一人称視点人間動画から汎用的なロボット世界モデルを学習し、連続潜在行動を代理ラベルとして活用することで、巧みな操作の物理理解と精密な行動制御を実現した研究。
- ビデオ世界モデルによるスケーラブルな方策評価世界モデル2025/11/1
行動条件付き動画生成モデルを世界モデルとして用い、ロボットマニピュレーション方策の実機評価を代替するスケーラブルな評価手法を提案した。
- 物理AIのための動画基盤モデルによる世界シミュレーション世界モデル2025/11/1
テキスト・画像・動画から世界を生成する動画基盤モデルCosmos-Predict2.5と、Sim2Real/Real2Real変換を行うCosmos-Transfer2.5を発表し、ロボティクス向けの合成データ生成やシミュレーションを可能にした。
- 物理AIのためのCosmos世界基盤モデルプラットフォーム世界モデル2025/1/1
物理AI開発者向けに、カスタマイズ可能な世界モデルを構築するための基盤モデル・動画キュレーション・トークナイザを提供するオープンソースプラットフォーム。
- ガウススプラッティングによる粒状体操作のための視覚的モデル予測制御マニピュレーション2024/10/1
シーンをガウススプラッティングで表現し、その上で視覚的ダイナミクスモデルを学習してモデル予測制御を行うことで、豆やナッツなどの粒状体の山を効率的に操作する手法を提案した。
- CLA-NeRF: Category-Level Articulated Neural Radiance Field2022/2/1