Sania Waheed
収録論文 3本 ・ フィジカルAI/ロボット学習
視覚場所認識VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 既視感を打ち破る:視覚言語推論による視覚場所認識の独立監査視覚場所認識2026/7/14
視覚場所認識の結果を、視覚言語モデルを用いて独立に検証する新しい監査フレームワークを提案し、誤受理率を低減しつつ再現率を向上させた。
- VLM誘導による惑星規模の視覚的位置認識VLA2025/7/1
VLMで候補地域を絞り込み、検索ベースの視覚的位置認識と再ランキングを組み合わせることで、地球規模の画像ジオローカリゼーション精度を向上させたハイブリッド手法を提案。
- ロボティクス向け画像ベース地理推定:ブラックボックス視覚言語モデルは実用域に達したかVLA2025/1/1
ブラックボックス設定の生成型視覚言語モデルを単体のゼロショット地理推定システムとして評価し、プロンプトやクエリ画像の変動に対する精度と一貫性を調査した。