Jingyi Fa
収録論文 1本 ・ フィジカルAI/ロボット学習
video-to-audio
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WorldSonus: ワールドモデルに音を届けるvideo-to-audio2026/10/6
ワールドモデルが生成する映像に、リアルタイムで空間的なステレオ音声を合成する対話型のvideo-to-audioフレームワークを提案した論文。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
ワールドモデルが生成する映像に、リアルタイムで空間的なステレオ音声を合成する対話型のvideo-to-audioフレームワークを提案した論文。