Xindi Wu
収録論文 4本 ・ フィジカルAI/ロボット学習
ビデオ生成自動運転シミュレーション動画生成VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ビデオワールドモデルのためのアドレス可能なメモリビデオ生成2026/8/7
インタラクティブなビデオワールドモデルで、長いロールアウト中に過去のフレームを正確に参照できない問題を解決するため、トレーニング不要のメモリフレームワークWorldTraceを提案。圧縮メモリに仮想位置を割り当ててアドレス可能性を保ち、新しいベンチマークLoopBenchで性能を検証した。
- NVIDIA OmniDreams: 閉ループ自動運転シミュレーションのためのリアルタイム生成ワールドモデル自動運転シミュレーション2026/6/1
自動運転の閉ループシミュレーション向けに、拡散モデルを基盤としたリアルタイム生成ワールドモデルOmniDreamsを提案し、運転行動に応じたセンサ映像を自己回帰的に生成することで、従来の再構成ベースのシミュレータでは困難な長尾シナリオを合成可能にした。
- 動画生成のための動き帰属分析動画生成2026/1/1
動画生成モデルにおいて、どの微調整クリップが時間的動きを改善・悪化させるかを特定する、動き中心の勾配ベースデータ帰属フレームワークを提案し、データ選別による動きの品質向上を実現した。
- 行動を言語として扱う:壊滅的忘却なしにVLMをVLAへ微調整する手法VLA2025/9/1
ロボットの遠隔操作データを自然言語で表現することで、VLMの基盤能力を損なわずにLoRAのみでVLAへ微調整する手法を提案し、実世界実験でゼロショット汎化を実証した。