Vedant Dave
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA世界モデルデータセット
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- InfiNoVA: 視点不変なロボットポリシーのための無限新規視点拡張VLA2026/9/23
マルチカメラの実演を時間変化する3Dガウス表現として再構成し、任意の視点から幾何学的に一貫した新規視点画像を生成するデータ拡張手法を提案。未見視点での操作タスク成功率を大幅に向上させた。
- サンドイッチ残差:世界モデルのパラメータ効率的なテスト時適応世界モデル2026/9/18
事前学習済み世界モデルを凍結し、予測器周辺に小さな残差補正のみをオンライン学習させることで、テスト時適応をパラメータ効率的に実現する手法を提案。
- リアルタイム3D視覚言語埋め込みマッピングVLA2025/8/1
視覚言語モデルの2次元埋め込みを、実時間でメートル精度の3次元表現に統合する手法を提案し、自然言語による対象物の位置特定を可能にした。
- EnvoDat: 異種環境におけるロボットの空間認識と意味推論のための大規模マルチセンサデータセットデータセット2024/10/1
都市以外の多様で過酷な環境(地下トンネル、自然地形、屋内など)で収集した10種類のセンサモダリティ、1.9TB超、82クラス以上の注釈付き大規模マルチモーダルデータセットを構築し、SLAMや視覚モデルのベンチマークを可能にした。
- M2CURL: Sample-Efficient Multimodal Reinforcement Learning via Self-Supervised Representation Learning for Robotic Manipulation2024/1/1
- Multimodal Visual-Tactile Representation Learning through Self-Supervised Contrastive Pre-Training2024/1/1
- Orientation Probabilistic Movement Primitives on Riemannian Manifolds2021/10/1