Antonio Cano
収録論文 2本 ・ フィジカルAI/ロボット学習
マルチモーダル対話予測対話システム
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 社会的ロボット仲介のためのマルチモーダル音声活動予測:期待される行動と展開制約マルチモーダル対話予測2026/9/23
音声と視覚の同期情報から会話のターンテイキングを予測し、ロボットが仲介者として取るべき行動(待機・傾聴・介入など)を導出する知覚レイヤーを提案。実時間推論やマルチモーダル同期などの展開制約も議論する。
- ソーシャルロボットのターンテイキングのためのマルチモーダル音声活動予測:音声活動関連事前学習エンコーダを用いたアプローチ対話システム2026/7/1
音声のみのVAPを拡張し、音声と映像の同期入力を用いてソーシャルロボットのターンテイキング予測を行うフレームワークを提案。事前学習済みの音声視覚バックボーンを低ランク適応で調整し、話者間注意機構と意味的一貫性損失を導入して性能を向上させた。