Takashi Shibuya
Sony Group Corporation
収録論文 3本 ・ フィジカルAI/ロボット学習
全身マニピュレーション動作生成動画音声生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LYRIC: 言語駆動の物理ベース全身接触リッチ物体インタラクション制御全身マニピュレーション2026/9/17
自由形式の言語指示と目標物体位置から、物理シミュレーション上のキャラクタが全身で接触を伴う物体操作を行うフローマッチング制御器を提案。プランナと行動生成器に分解し、専門家軌道の追従と強化学習の微調整で高い成功率を達成した。
- Odoriko: 身体形状を考慮したマルチモーダル拡散による人間動作生成フレームワーク動作生成2026/6/1
性別や体型などの身体形状情報を動作生成に直接反映する、テキスト・音楽・動画を統合した初のマルチモーダル動作生成フレームワークを提案した。
- SoundReactor: フレーム単位のオンライン動画音声生成動画音声生成2025/10/2
未来のフレームを見ずに動画からリアルタイムで音声を自己回帰生成するフレーム単位オンラインV2Aタスクを提案し、因果的Transformerと拡散・一貫性微調整で低遅延・高品質なステレオ音声を実現した。