Jonathan Tremblay
NVIDIA
収録論文 40本 ・ フィジカルAI/ロボット学習
VQA/操作計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PROBE: VLMエージェントによる操作基盤の視覚質問応答VQA/操作計画2026/8/17
ロボットが隠れた物体を探すために操作が必要な動的シーンでの視覚質問応答(MG-VQA)を提案し、シミュレータとベンチマークを構築、VLMエージェントの性能を評価・微調整する手法を示した。
- Scale Up Strategically: Learning Compositional Generalization via Bias-Aware Evaluation and Data Collection for Robotic Manipulation2026/7/1
- Vesta: A Generalist Embodied Reasoning Model2026/6/1
- VoLo: A Physical Orchestrator for Open-Vocabulary Long-Horizon Manipulation2026/6/1
- RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies2026/4/1
- Tactile Modality Fusion for Vision-Language-Action Models2026/3/15
- Tactile Modality Fusion for Vision-Language-Action Models2026/3/1
- SpaceTools: Tool-Augmented Spatial Reasoning via Double Interactive RL2025/12/1
- BOP-ASK: Object-Interaction Reasoning for Vision-Language Models2025/11/1
- Robot Policy Evaluation for Sim-to-Real Transfer: A Benchmarking Perspective2025/8/1
- RoboArena: Distributed Real-World Evaluation of Generalist Robot Policies2025/6/1
- RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics2024/11/1
- GRS: Generating Robotic Simulation Tasks from Real-World Images2024/10/1
- Neural Fields in Robotics: A Survey2024/10/1
- FactorSim: Generative Simulation via Factorized Representation2024/9/1
- Neural Implicit Representation for Building Digital Twins of Unknown Articulated Objects2024/4/1
- Snap-it, Tap-it, Splat-it: Tactile-Informed 3D Gaussian Splatting for Reconstructing Challenging Surfaces2024/3/1
- Diff-DOPE: Differentiable Deep Object Pose Estimation2023/10/1
- HANDAL: A Dataset of Real-World Manipulable Object Categories with Pose Annotations, Affordances, and Reconstructions2023/8/1
- BundleSDF: Neural 6-DoF Tracking and 3D Reconstruction of Unknown Objects2023/3/1
- MegaPose: 6D Pose Estimation of Novel Objects via Render & Compare2022/12/1
- One-Shot Neural Fields for 3D Object Understanding2022/10/1
- Parallel Inversion of Neural Radiance Fields for Robust Pose Estimation2022/10/1
- RGB-Only Reconstruction of Tabletop Scenes for Collision-Free Manipulator Control2022/10/1
- ProgPrompt: Generating Situated Robot Task Plans using Large Language Models2022/9/1
- Keypoint-Based Category-Level Object Pose Tracking from an RGB Sequence with Uncertainty Estimation2022/5/1
- 6-DoF Pose Estimation of Household Objects for Robotic Manipulation: An Accessible Dataset and Benchmark2022/3/1
- Single-Stage Keypoint-Based Category-Level Object Pose Estimation from an RGB Image2021/9/1
- NViSII: A Scriptable Tool for Photorealistic Image Generation2021/5/1
- Multi-View Fusion for Multi-Level Robotic Scene Understanding2021/3/1
- Hierarchical Planning for Long-Horizon Manipulation with Geometric and Symbolic Scene Graphs2020/12/1
- Fast Uncertainty Quantification for Deep Object Pose Estimation2020/11/1
- Joint Space Control via Deep Reinforcement Learning2020/11/1
- Indirect Object-to-Robot Pose Estimation from an External Monocular RGB Camera2020/8/1
- Guided Uncertainty-Aware Policy Optimization: Combining Learning and Model-Based Strategies for Sample-Efficient Policy Learning2020/5/1
- Contextual Reinforcement Learning of Visuo-tactile Multi-fingered Grasping Policies2019/11/1
- Camera-to-Robot Pose Estimation from a Single Image2019/11/1
- Toward Sim-to-Real Directional Semantic Grasping2019/9/1
- Deep Object Pose Estimation for Semantic Robotic Grasping of Household Objects2018/9/1
- Synthetically Trained Neural Networks for Learning Human-Readable Plans from Real-World Demonstrations2018/5/1