Zhouyin Wu
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット操作における視覚言語モデルのための混乱認識型インコンテキスト学習VLA2026/3/1
視覚言語モデルがロボット操作で混乱しやすい物体を誤認識する問題を、混乱要因を特定してプロンプトに反映する手法CAICLを提案し、VIMA-Benchで85.5%の成功率を達成した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
視覚言語モデルがロボット操作で混乱しやすい物体を誤認識する問題を、混乱要因を特定してプロンプトに反映する手法CAICLを提案し、VIMA-Benchで85.5%の成功率を達成した。