Arjun Majumdar
収録論文 10本 ・ フィジカルAI/ロボット学習
ナビゲーションVLA/世界モデル3D位置推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボストラル・ナビゲート:単眼RGBのみで動作するスケーラブルな視覚言語ナビゲーションモデルナビゲーション2026/7/1
単眼RGB画像のみを入力とし、画像空間上でウェイポイントを予測することで、様々なロボット形態に再較正なしで適用可能な8B視覚言語モデルを提案。大規模シミュレーションデータと効率的な学習手法により、実世界データへの依存を低減しつつ高性能を実現した。
- DREAMSTEER: 潜在世界モデルによるVLAポリシーの展開時誘導(微調整不要)VLA/世界モデル2026/7/1
事前学習済みの視覚言語行動(VLA)ポリシーを、微調整なしで展開時に潜在世界モデルと価値モデルを用いて誘導し、分布シフト下での成功率と指示追従精度を大幅に向上させるフレームワークを提案した。
- Locate 3D: 自己教師あり学習による実世界3D物体位置推定3D位置推定2025/4/1
センサー点群に適用可能な自己教師あり学習手法3D-JEPAを提案し、言語指示に基づく3D物体位置推定を実現。新データセットも構築し、ロボットやARでの実世界展開を可能にした。
- Stretch with Stretch: Physical Therapy Exercise Games Led by a Mobile Manipulator2023/12/1
- What do we learn from a large-scale study of pre-trained visual representations in sim and real environments?2023/10/1
- Behavioral Analysis of Vision-and-Language Navigation Agents2023/7/1
- Where are we in the search for an Artificial Visual Cortex for Embodied Intelligence?2023/3/1
- ZSON: Zero-Shot Object-Goal Navigation using Multimodal Goal Embeddings2022/6/1
- Sim-to-Real Transfer for Vision-and-Language Navigation2020/11/1
- Beyond the Nav-Graph: Vision-and-Language Navigation in Continuous Environments2020/4/1