Federico Tombari
Technical University of Munich
収録論文 41本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ChronoGraph: 視覚言語モデルによる機能的な4Dシーングラフで相互作用理解と接地計画を実現VLA2026/9/30
行動によるシーンの変化を4Dシーングラフとして表現し、視覚言語モデルで理解と計画を統合する手法を提案。グラフを思考連鎖として学習させ、実世界の移動マニピュレーションにも応用した。
- GESTO: 動的シーンにおける推論のための人間中心の時空間メモリシーン理解2026/8/1
RGB-D観測から人間と物体のインタラクションを抽出し、永続的な4Dシーングラフに接地してイベント階層を構築する時空間メモリを提案。これにより、活動中心の時空間推論を実現する。
- SG2Loc: 3Dシーングラフを用いた逐次視覚位置推定位置推定2026/6/10
3Dシーングラフを環境表現に用いた軽量な逐次視覚位置推定手法を提案。パーティクルフィルタとセマンティック特徴マッチングにより、大規模な画像データベースや点群を必要とせずに位置推定を実現する。
- 3Dシーングラフ:未解決の課題と今後の方向性シーン理解2026/6/1
3Dシーングラフ(3DSG)の研究分野を統一的にレビューし、定義の整理、構築手法、応用、評価方法を解説するとともに、今後の課題と方向性を提示したサーベイ論文。
- 良いトークンの狩り方:視覚幾何学トランスフォーマーにおけるトークン選択の手引き3D再構成2026/5/1
視覚幾何学トランスフォーマーの計算コストを削減するため、フレーム間・フレーム内の2段階でトークンを選択する手法を提案し、精度を保ちつつ85%以上の高速化を実現した。
- SING3R-SLAM: 3D再構成事前分布を用いたサブマップベース屋内単眼ガウシアンSLAMSLAM2025/11/1
単眼カメラの屋内SLAMにおいて、グローバルなガウシアンマップとサブマップ単位の位置合わせを組み合わせ、ドリフトやスケール不整合を抑えつつ高精度な姿勢推定と3D再構成を実現した手法。
- RiemanLine: 因子グラフ最適化のための3次元直線のリーマン多様体表現SLAM2025/8/1
平行線群の構造を活かし、3次元直線をリーマン多様体上で最小パラメータ化する手法を提案し、因子グラフ最適化に統合して姿勢推定と直線再構成の精度を向上させた。
- SG-Tailor: シーングラフ操作のための物体間常識関係推論シーングラフ/常識推論2025/3/1
シーングラフのノード追加やエッジ変更時に生じる矛盾を解消し、常識的な関係を自己回帰的に予測するモデルを提案。シーン生成やロボット操作に組み込み可能。
- 自律走行車のためのニューラルセマンティックマップ学習マッピング2024/10/1
複数車両から集めた局所サブマップを、シーン特化型のニューラルSDFで統合し、走行可能領域や車線、障害物などを含む高精度な3Dメッシュ地図を生成する手法を提案した。
- LiLoc: 適応的サブマップ統合と自己中心因子グラフを用いた生涯ローカリゼーションローカリゼーション2024/9/1
中央セッションと補助セッション間のマルチモーダル因子を活用し、適応的サブマップ統合と自己中心因子グラフで高精度かつタイムリーな生涯ローカリゼーションを実現するフレームワークを提案。
- Physics-Encoded Graph Neural Networks for Deformation Prediction under Contact2024/2/1
- Open-Structure: Structural Benchmark Dataset for SLAM Algorithms2023/10/1
- SG-Bot: Object Rearrangement via Coarse-to-Fine Robotic Imagination on Scene Graphs2023/9/1
- Robust Monocular Depth Estimation under Challenging Conditions2023/8/1
- 3D Adversarial Augmentations for Robust Out-of-Domain Predictions2023/8/1
- NEWTON: Neural View-Centric Mapping for On-the-Fly Large-Scale SLAM2023/3/1
- IPCC-TP: Utilizing Incremental Pearson Correlation Coefficient for Joint Multi-Agent Trajectory Prediction2023/3/1
- Unsupervised Traffic Scene Generation with Synthetic 3D Scene Graphs2023/3/1
- Segmenting Known Objects and Unseen Unknowns without Prior Knowledge2022/9/1
- MonoGraspNet: 6-DoF Grasping with a Single RGB Image2022/9/1
- SC-Explorer: Incremental 3D Scene Completion for Safe and Efficient Exploration Mapping and Planning2022/8/1
- E-Graph: Minimal Solution for Rigid Rotation with Extensibility Graphs2022/7/1
- Time-to-Label: Temporal Consistency for Self-Supervised Monocular 3D Object Detection2022/3/1
- Occlusion-Aware Self-Supervised Monocular 6D Object Pose Estimation2022/3/1
- 3D-VField: Adversarial Augmentation of Point Clouds for Domain Generalization in 3D Object Detection2021/12/1
- Semantic Image Alignment for Vehicle Localization2021/10/1
- CertainNet: Sampling-free Uncertainty Estimation for Object Detection2021/10/1
- Semantic Dense Reconstruction with Consistent Scene Segments2021/9/1
- R4Dyn: Exploring Radar for Self-Supervised Monocular Depth Estimation of Dynamic Scenes2021/8/1
- TSDF++: A Multi-Object Formulation for Dynamic Object Tracking and Reconstruction2021/5/1
- SRH-Net: Stacked Recurrent Hourglass Network for Stereo Matching2021/5/1
- ManhattanSLAM: Robust Planar Tracking and Mapping Leveraging Mixture of Manhattan Frames2021/3/1
- SCFusion: Real-time Incremental Scene Reconstruction with Semantic Completion2020/10/1
- RGB-D SLAM with Structural Regularities2020/10/1
- Panoster: End-to-end Panoptic Segmentation of LiDAR Point Clouds2020/10/1
- Co-Planar Parametrization for Stereo-SLAM and Visual-Inertial Odometry2020/9/1
- Structure-SLAM: Low-Drift Monocular SLAM in Indoor Environments2020/8/1
- Quaternion Equivariant Capsule Networks for 3D Point Clouds2019/12/1
- A Summary of the 4th International Workshop on Recovering 6D Object Pose2018/10/1
- BOP: Benchmark for 6D Object Pose Estimation2018/8/1
- Fast and Accurate Semantic Mapping through Geometric-based Incremental Segmentation2018/3/1