Stefano Rosa
収録論文 11本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 身体性を活用した画像キャプション生成:空間的に一貫した説明のための自己教師あり学習エージェントVLA2025/4/1
エージェントが環境を探索して画像とキャプションのペアを収集し、大規模言語モデルによるコンセンサスで擬似キャプションを生成、コントラスティブ学習を加えてキャプションモデルを微調整することで、視点によらず一貫した物体説明を可能にする自己教師ありフレームワークを提案。
- 対話型指示エラー検出と位置特定による連続環境での視覚言語ナビゲーションVLA2024/6/1
連続環境での視覚言語ナビゲーションにおいて、ユーザーの指示エラーを検出し位置を特定して対話的に修正を求める手法を提案し、新しい評価指標SINを導入した。
- 指示エラーの検出と位置特定:視覚と言語によるナビゲーションにおける課題VLA2024/3/1
視覚と言語によるナビゲーション(VLN-CE)において、人間が与える指示に含まれる誤りを検出・位置特定するための新しいベンチマークと手法を提案し、既存手法の脆弱性を示した。
- Learning Semantic Segmentation of Large-Scale Point Clouds with Random Sampling2021/7/1
- Learning Selective Sensor Fusion for States Estimation2019/12/1
- DeepTIO: A Deep Thermal-Inertial Odometry with Visual Hallucination2019/9/1
- Selective Sensor Fusion for Neural Visual-Inertial Odometry2019/3/1
- Learning with Training Wheels: Speeding up Training with a Simple Controller for Deep Reinforcement Learning2018/12/1
- Defo-Net: Learning Body Deformation using Generative Adversarial Networks2018/4/1
- Dense 3D Object Reconstruction from a Single Depth View2018/2/1
- Fast Graph-Based Object Segmentation for RGB-D Images2016/5/1