Yuhan Rui
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAビデオ生成/推論自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Token-World: 視覚言語モデルのトークン空間におけるロボット操作のための世界モデリングVLA2026/9/30
VLAモデルの視覚トークンを圧縮した状態空間で未来のダイナミクスを予測する世界モデルを提案し、操作ベンチマークで予測精度と方策整合性を向上させた。
- OpenWAM: 体系的な世界行動モデル事前学習に向けたオープンでモジュール型の探求VLA2026/9/7
世界行動モデルの設計空間をモジュール化し、制御実験を通じて設計原則を抽出・検証するオープンな研究基盤を構築した。
- 多段階視覚推論のための階層的デノイジングビデオ生成/推論2026/7/16
因果的ビデオ生成に階層的潜在変数を統合し、粗い推論から細かい推論へと段階的に進めることで、複雑な多段階視覚推論タスクを効率的に解決するフレームワークを提案した。
- ProDrive: 自己と環境の共進化による自動運転のためのプロアクティブ計画自動運転2026/4/1
現在の観測のみに依存する反応的な自動運転計画の問題を解決するため、自己と環境の共進化を可能にするワールドモデルベースのプロアクティブ計画フレームワークを提案した。