Olga Russakovsky
収録論文 4本 ・ フィジカルAI/ロボット学習
ビデオ生成動画生成VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ビデオワールドモデルのためのアドレス可能なメモリビデオ生成2026/8/7
インタラクティブなビデオワールドモデルで、長いロールアウト中に過去のフレームを正確に参照できない問題を解決するため、トレーニング不要のメモリフレームワークWorldTraceを提案。圧縮メモリに仮想位置を割り当ててアドレス可能性を保ち、新しいベンチマークLoopBenchで性能を検証した。
- 動画生成のための動き帰属分析動画生成2026/1/1
動画生成モデルにおいて、どの微調整クリップが時間的動きを改善・悪化させるかを特定する、動き中心の勾配ベースデータ帰属フレームワークを提案し、データ選別による動きの品質向上を実現した。
- 行動を言語として扱う:壊滅的忘却なしにVLMをVLAへ微調整する手法VLA2025/9/1
ロボットの遠隔操作データを自然言語で表現することで、VLMの基盤能力を損なわずにLoRAのみでVLAへ微調整する手法を提案し、実世界実験でゼロショット汎化を実証した。
- Evolving Graphical Planner: Contextual Global Planning for Vision-and-Language Navigation2020/7/1