Sergio Arnaud
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA/世界モデル触覚VLA3D位置推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DREAMSTEER: 潜在世界モデルによるVLAポリシーの展開時誘導(微調整不要)VLA/世界モデル2026/7/1
事前学習済みの視覚言語行動(VLA)ポリシーを、微調整なしで展開時に潜在世界モデルと価値モデルを用いて誘導し、分布シフト下での成功率と指示追従精度を大幅に向上させるフレームワークを提案した。
- 視触覚ワールドモデル触覚2026/2/1
視覚に触覚を組み合わせて接触の物理を学習するマルチタスクワールドモデルを提案し、接触の多い操作タスクでの想像・計画性能を向上させた。
- V-JEPA 2: 自己教師あり動画モデルによる理解・予測・計画VLA2025/6/1
大規模動画データで自己教師あり事前学習したV-JEPA 2を提案し、ロボット軌道で微調整した世界モデルにより、未知環境でのゼロショット物体操作を実現した。
- Locate 3D: 自己教師あり学習による実世界3D物体位置推定3D位置推定2025/4/1
センサー点群に適用可能な自己教師あり学習手法3D-JEPAを提案し、言語指示に基づく3D物体位置推定を実現。新データセットも構築し、ロボットやARでの実世界展開を可能にした。
- 2Dと3Dの視覚言語理解を統合するUniVLGVLA2025/3/1
2Dの事前学習モデルを活用し、2Dと3Dの視覚言語データで学習する統合アーキテクチャUniVLGを提案。3D視覚言語グラウンディングで最先端性能を達成した。
- What do we learn from a large-scale study of pre-trained visual representations in sim and real environments?2023/10/1
- ASC: Adaptive Skill Coordination for Robotic Mobile Manipulation2023/4/1
- Where are we in the search for an Artificial Visual Cortex for Embodied Intelligence?2023/3/1