Vineet Bhat
NVIDIA
収録論文 6本 ・ フィジカルAI/ロボット学習
VQA/操作計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PROBE: VLMエージェントによる操作基盤の視覚質問応答VQA/操作計画2026/8/17
ロボットが隠れた物体を探すために操作が必要な動的シーンでの視覚質問応答(MG-VQA)を提案し、シミュレータとベンチマークを構築、VLMエージェントの性能を評価・微調整する手法を示した。
- BOP-ASK: Object-Interaction Reasoning for Vision-Language Models2025/11/1
- MapleGrasp: Mask-guided Feature Pooling for Language-driven Efficient Robotic Grasping2025/6/1
- 3D CAVLA: Leveraging Depth and 3D Context to Generalize Vision Language Action Models for Unseen Tasks2025/5/1
- HiFi-CS: Towards Open Vocabulary Visual Grounding For Robotic Grasping Using Vision-Language Models2024/9/1
- Grounding LLMs For Robot Task Planning Using Closed-loop State Feedback2024/2/1