Tomasz Kornuta
NVIDIA
収録論文 3本 ・ フィジカルAI/ロボット学習
VLMVLAコンピュータビジョン
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VANTAGE-Bench:視覚言語モデルにおけるインフラAIギャップの評価VLM2026/9/8
固定カメラ映像を用いたインフラAI(物流・交通・スマート空間)向けベンチマークを提案し、17モデルのゼロショット評価でイベント検証や時間定位に最大24点の性能不足があることを示した。
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- 第9回AIシティチャレンジコンピュータビジョン2025/8/1
交通・産業・公共安全分野におけるコンピュータビジョンとAIの実応用を推進する第9回AIシティチャレンジの概要。4つのトラックで245チームが参加し、3Dマルチカメラ追跡や交通安全のビデオQA、倉庫での空間推論、魚眼カメラの物体検出などが競われた。