Md Rizwan Parvez
収録論文 1本 ・ フィジカルAI/ロボット学習
VLM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TimeSpot:実世界環境における視覚言語モデルの地理的・時間的理解を評価するベンチマークVLM2026/3/1
80カ国1455枚の地上画像を用いて、視覚言語モデルが季節・時刻・気候帯・緯度経度などの地理的・時間的属性を画像から推論できるかを評価するベンチマークを提案し、既存モデルの性能不足を明らかにした。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
80カ国1455枚の地上画像を用いて、視覚言語モデルが季節・時刻・気候帯・緯度経度などの地理的・時間的属性を画像から推論できるかを評価するベンチマークを提案し、既存モデルの性能不足を明らかにした。