Zongze Wu
収録論文 2本 ・ フィジカルAI/ロボット学習
ビデオ生成/編集生成モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EditStream: 対話型ビデオ生成と編集のための統一オートリグレッシブフレームワークビデオ生成/編集2026/8/16
ビデオ生成と編集を単一のDiTベースモデルで統合し、高速な数ステップのオートリグレッシブモデルに変換するフレームワークを提案。テキストからビデオ、画像からビデオ、編集伝播など多様なタスクをサポートし、対話的なクリエイティブワークフローを実現する。
- 表現オートエンコーダによる改良ベースライン生成モデル2026/5/18
表現オートエンコーダ(RAE)の設計を改良し、再構成性能と収束速度を大幅に向上させた。特に、層の和を用いた表現、REPAとの相補性、CFGのための無料ガイダンスを実現した。