Christian Simon
収録論文 2本 ・ フィジカルAI/ロボット学習
動作生成動画音声生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Odoriko: 身体形状を考慮したマルチモーダル拡散による人間動作生成フレームワーク動作生成2026/6/1
性別や体型などの身体形状情報を動作生成に直接反映する、テキスト・音楽・動画を統合した初のマルチモーダル動作生成フレームワークを提案した。
- SoundReactor: フレーム単位のオンライン動画音声生成動画音声生成2025/10/2
未来のフレームを見ずに動画からリアルタイムで音声を自己回帰生成するフレーム単位オンラインV2Aタスクを提案し、因果的Transformerと拡散・一貫性微調整で低遅延・高品質なステレオ音声を実現した。