何が起きたか
米ジョージア工科大学は、家庭用ロボットでの利用を想定して、視覚言語モデルの記憶能力を測る新しいベンチマークを公開したと発表した。大学の発表によると、このベンチマークは60の課題で構成され、空間・時間・複数目標の3種類の評価を含む。
世界のフィジカルAIを、日本語で。
原典とのAI照合を通過 / 短報
Georgia Techの研究者が、視覚言語モデルの記憶能力を評価する新しいベンチマークを公開した。家庭内での物体の位置や時間の経過を扱う評価を含み、ロボットの性能向上を目指すという。記事では、Gemini 2.0-flashやGPT-4oも評価対象に含まれると伝えている。
米ジョージア工科大学は、家庭用ロボットでの利用を想定して、視覚言語モデルの記憶能力を測る新しいベンチマークを公開したと発表した。大学の発表によると、このベンチマークは60の課題で構成され、空間・時間・複数目標の3種類の評価を含む。
本記事の収集・日本語化・構成にはAIを使用しています。機械による照合と人による確認は区別して表示しています。企業が発表した性能・実績は発表元の主張であり、本紙による実機検証を意味しません。原典もあわせてご確認ください。
この記事のような一次情報ベースの解説を、週に1度まとめて。重要ニュース5本・日本/中国・Research Picks・今週の公募。無料、いつでも解除できます。