Varun Praveen
NVIDIA
収録論文 2本 ・ フィジカルAI/ロボット学習
VLMVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VANTAGE-Bench:視覚言語モデルにおけるインフラAIギャップの評価VLM2026/9/8
固定カメラ映像を用いたインフラAI(物流・交通・スマート空間)向けベンチマークを提案し、17モデルのゼロショット評価でイベント検証や時間定位に最大24点の性能不足があることを示した。
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。