Rita Cucchiara
収録論文 13本 ・ フィジカルAI/ロボット学習
画像編集ナビゲーションVLA軌道予測意味マッピング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- あらゆるものを一度に編集する画像編集2026/6/30
複数の画像編集指示を1回の推論で処理する新しい手法MICEを提案し、指示間の干渉を抑えて属性の混入を防ぎつつ、高品質な編集を実現した。
- 実環境におけるユーザー固有物体への個別インスタンスベースナビゲーションナビゲーション2024/10/1
ユーザー固有の物体を複数の類似物体の中から見分けて探索・到達する新タスクPINを提案し、写真リアルな3Dシーンに物体を追加したデータセットPInNEDを構築した。
- UNMuTe: ナビゲーションとマルチモーダル対話テキスト生成の統合VLA2024/8/1
GPT-2ベースの対話モデルと視覚言語ナビゲータを組み合わせ、迷ったときに自然言語で道を尋ねながら目的地へ進むエージェントを実現した研究。
- 低ランク適応による離散潜在コードを用いた軌道予測軌道予測2024/5/1
VQ-VAEのコードブックを低ランク更新で各事例に適応させ、拡散モデルと組み合わせることで、軌道予測の精度と多様性を両立させた。
- AIGeN: 敵対的生成による視覚言語ナビゲーションの指示文生成VLA2024/4/1
GANの枠組みでGPT-2とBERTを組み合わせ、視覚言語ナビゲーション用の合成指示文を生成してナビゲーション性能を向上させる手法を提案。
- 物体認識なしで屋内環境の高レベル意味領域をマッピング意味マッピング2024/3/1
視覚言語モデルと自律ナビゲーションを用いて、物体認識に頼らずに屋内環境の意味領域マップを生成する手法を提案し、フォトリアルシミュレータで既存手法を上回る性能を示した。
- Embodied Agents for Efficient Exploration and Smart Scene Description2023/1/1
- Spot the Difference: A Novel Task for Embodied Agents in Changing Environments2022/4/1
- Embodied Navigation at the Art Gallery2022/4/1
- Focus on Impact: Indoor Exploration with Intrinsic Motivation2021/9/1
- Out of the Box: Embodied Navigation in the Real World2021/5/1
- Explore and Explain: Self-supervised Navigation and Recounting2020/7/1
- SMArT: Training Shallow Memory-aware Transformers for Robotic Explainability2019/10/1