Ruben Janssens
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAHRI音声認識
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットとのマルチモーダルな社会的会話に向けて:視覚言語モデルの活用VLA2025/7/1
社会的ロボットが視覚情報を活用してマルチモーダルな会話を行うための要件を整理し、視覚言語モデルを適応させる方法と課題を論じた論文。
- ロボットはなぜ自分のミスに気づけないのか:人とロボットの対話における誤解検出の限界HRI2025/6/1
人とロボットの対話240件のマルチモーダルデータセットを用い、最先端の視覚モデルが会話の誤解を検出できるか評価した。その結果、性能はほぼランダムと変わらず、人間の評価者も誤解の約半数しか特定できず、ユーザーが誤解を感じてもロボットに伝えないという根本的な限界が明らかになった。
- 子ども音声認識は解決したのか?人間とロボットの相互作用における再評価音声認識2024/4/1
2017年の子ども音声認識研究を再検証し、OpenAI Whisperが商用サービスを上回り、特定フレーズでさらに精度が向上することを示した。