Kaicheng Yu
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA動画世界モデル自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 行動は1パッチに値する:PatchWAMによる統合的世界-行動モデリングVLA2026/9/22
連続行動を固定マッピングでパッチとして表現し、専用の行動ヘッドや専門家なしに単一の生成モデルで視覚予測と行動生成を同時に行うPatchWAMを提案。LIBERO-Plusで91.8%、RoboTwin 2.0で96.12%の成功率を達成。
- StrucPhysVideo: 構造化キャプションとロボット行動から物理ダイナミクスを学習する動画世界モデル動画世界モデル2026/9/16
物体の動きや相互作用を記述した構造化キャプションとロボットの行動を条件として、物理的に妥当な動画を生成・予測する動画世界モデルを提案し、Physics-IQで最高性能を達成した。
- DriveMRP: 合成モーションデータによる視覚言語モデルのモーションリスク予測強化自動運転2025/7/1
BEVベースのシミュレーションで高リスクな運転モーションデータを合成し、視覚言語モデルのリスク予測性能を大幅に向上させるフレームワークを提案した。
- FusionAD: Multi-modality Fusion for Prediction and Planning Tasks of Autonomous Driving2023/8/1