Luciano Serafini
収録論文 9本 ・ フィジカルAI/ロボット学習
3Dシーングラフ生成ナビゲーション3D再構成世界モデル物体ナビゲーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 自己回帰拡散による3Dシーングラフの高レベル概念生成3Dシーングラフ生成2026/8/28
3Dシーングラフの構造と特徴を統一的に学習する自己回帰拡散モデルを提案し、観測された垂直平面から任意の階層深さで完全な3DSGをボトムアップに構築する。
- IMPRINT: 画像条件付きクエリ拡張によるロングテール物体ゴールナビゲーションナビゲーション2026/7/27
テキストのみのクエリに依存する既存の物体ゴールナビゲーション手法の限界を克服するため、ウェブから取得した画像でクエリを拡張し、視覚言語モデルを用いて意味マップと照合することで物体の位置特定精度を向上させるゼロショットフレームワークを提案した。
- VGGTが知る重なり: 幾何基盤モデルにおける共可視性の探査3D再構成2026/7/10
VGGTの内部表現が共可視性を暗黙に符号化していることを発見し、軽量なMixture-of-Expertsヘッドを追加してRGB画像のみから共可視性を高精度に分類する手法を提案した。
- 正則化による離散世界モデル学習世界モデル2026/3/2
再構成や対比学習を使わず、正則化のみでブール潜在表現の世界モデルを教師なし学習する手法を提案した。
- PersONAL: パーソナライズされた身体性エージェントのための包括的ベンチマーク物体ナビゲーション2025/9/1
家庭内で「リリーのリュックを探して」のような個人固有の物体を探索・特定するパーソナライズ身体性AIのベンチマークを提案し、既存手法と人間の性能差を明らかにした。
- TANGO: オープンワールドタスクのための訓練不要な身体性AIエージェントVLA2024/12/1
LLMに少数の例を与えて基本動作を組み合わせさせることで、追加学習なしに物体探索・生涯ナビゲーション・質問応答などの身体性AIタスクをゼロショットで解く手法を提案。
- Planning for Learning Object Properties2023/1/1
- Exploiting Proximity-Aware Tasks for Embodied Social Navigation2022/12/1
- Online Grounding of Symbolic Planning Domains in Unknown Environments2021/12/1