S Divakar Bhat
収録論文 1本 ・ フィジカルAI/ロボット学習
空間推論/VLM評価
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 一貫しているが誤っている:空間視覚言語モデルにおける証拠感度の欠如空間推論/VLM評価2026/6/1
空間推論のための視覚言語モデルが、視点を変えても一貫した回答をする一方で、実際には誤った距離推定を行うことを示し、その原因が視覚的証拠への依存ではなく事前知識への過剰適合であることを明らかにした。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
空間推論のための視覚言語モデルが、視点を変えても一貫した回答をする一方で、実際には誤った距離推定を行うことを示し、その原因が視覚的証拠への依存ではなく事前知識への過剰適合であることを明らかにした。