Giuseppe Averta
Politecnico di Torino
収録論文 9本 ・ フィジカルAI/ロボット学習
マニピュレーションシーングラフ/活動理解3Dシーングラフ/能動探索シーングラフ生成ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GORDON: グラフベースのオブジェクト中心報酬による長期的操作タスクの分解マニピュレーション2026/8/1
ビデオデモからオブジェクト中心のグラフ表現を学習し、密な報酬を生成することで、長期的な操作タスクを自動的にサブタスクに分解して学習する手法を提案した。
- シーンを進化させる学習:シーングラフによる人間活動の推論シーングラフ/活動理解2026/7/2
一人称視点動画から、人間と環境の相互作用を時空間シーングラフとして表現し、その時間的進化をモデル化するグラフベースモデルGLENを提案。活動に基づくグラフ編集予測という新タスクも導入し、複数のベンチマークで優れた性能を示した。
- 固定外部カメラを共通事前地図として用いた能動的3Dシーングラフ生成3Dシーングラフ/能動探索2026/5/1
ロボットの移動前に固定外部RGBカメラの観測を事前地図として活用し、ロボット搭載カメラと統合して能動的に3Dシーングラフを生成するフレームワークを提案した。
- RGBのみを用いた屋内移動ロボットのための能動的3Dシーングラフ生成シーングラフ生成2026/5/1
深度センサーを使わずRGBカメラのみで3Dシーングラフを能動的に構築するフレームワークを提案し、探索計画と認識を統合した。
- GAP: 幾何学的アンカー事前学習による操作タスクのデータ効率的視覚運動学習マニピュレーション2026/5/1
少数のデモンストレーションから視覚運動ポリシーを学習する際、事前学習済み視覚基盤モデルを凍結し、空間プーリング層を幾何学的アンカー生成タスクで事前学習することで、データ効率とロバスト性を向上させる手法を提案した。
- Select2Plan: VQAとメモリ検索による訓練不要のICLベース計画ナビゲーション2024/11/1
訓練済みの視覚言語モデル(VLM)を活用し、追加学習なしでロボットの高レベル経路計画を行うフレームワークを提案。単眼カメラのみで一人称・三人称視点のナビゲーションに対応する。
- Graph learning in robotics: a survey2023/10/1
- Domain Randomization for Robust, Affordable and Effective Closed-loop Control of Soft Robots2023/3/1
- Online vs. Offline Adaptive Domain Randomization Benchmark2022/6/1