Matteo Matteucci
Politecnico di Milano
収録論文 31本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 成功だけでは不十分?卓上マニピュレーションにおけるVLAの挙動に対する入力摂動の影響調査VLA2026/10/1
VLAモデルのロバスト性をタスク成功率だけでなく、成功軌道の動きの滑らかさや効率、グリッパ挙動といった振る舞いの観点から評価するフレームワークを提案し、LIBERO系ベンチマークで摂動が成功時の挙動を変化させることを示した。
- フローマッチングVLAにおけるタスク依存計算配分のための分離型アーリーイグジットVLA2026/9/24
フローマッチングVLAに軽量なExit Transformerを追加し、バックボーン・行動エキスパート・デノイジングの深さをタスクごとに調整可能にした。
- ArborSplat: 果樹園のためのオンライン意味論的ガウシアンスプラッティングSLAMSLAM2026/9/22
LiDARオドメトリで追跡しながら3Dガウシアンマップ上で直接意味論を最適化し、果樹園の幹や棚、果実などの細い構造を保つオンライン意味論SLAMを提案。
- MamMA: 占有地図と歩行者認識状態を考慮したMambaベースの歩行者軌跡予測アルゴリズム歩行者軌跡予測2026/9/7
LiDARによる占有地図とロボット搭載カメラの視点画像から得られる歩行者の認識状態を考慮し、Mambaモデルを用いて歩行者の将来軌跡を高精度に予測するアルゴリズムを提案した。
- 屋外ロボットのための障害物対応自律巡回・ナビゲーションナビゲーション2026/9/1
屋外での長時間巡回を実現するため、RTK-GNSSとEKFによる高精度位置推定、カバレッジプランナの改良、行動木によるミッション管理を統合したROS 2アーキテクチャを提案し、シミュレーションと実機で93〜96%の巡回率を達成した。
- EmbodiedLGR: ロボットエージェントのための軽量グラフ表現と検索を統合した意味空間メモリVLA/記憶/ナビゲーション2026/4/1
ロボットが環境の記憶を効率的に構築・検索できるよう、視覚言語モデルを用いて物体の位置情報をグラフに、シーンの高レベル記述を検索アーキテクチャに格納するハイブリッド手法を提案した。NaVQAデータセットで最先端の推論・問い合わせ時間を達成した。
- マルチモーダル行動木生成:ロボットタスク計画のための小型視覚言語モデルタスク計画2026/3/1
小型の視覚言語モデルを微調整し、視覚観察と指示から行動木を生成するロボットタスク計画手法を提案。大規模モデルを教師にしたデータセット構築とパラメータ効率的な微調整により、87%の成功率を達成。
- 行動・思考・棄権:VLAモデルのための複雑度適応型推論VLA2026/3/1
視覚言語行動モデルの推論を状態の複雑さに応じて「即実行・熟考・停止」に動的に振り分ける適応フレームワークを提案し、計算効率と異常検知性能を両立させた。
- 視覚入力の復元によるVision-Language-Actionモデルのロバスト性向上VLA2026/2/1
VLAモデルは画像ノイズやレンズ汚れなどのセンサー劣化に弱いため、劣化画像からクリーンな観測を復元するプラグアンドプレイ型Transformer(CRT)を提案し、性能低下を防いだ。
- BTGenBot-2: 小型言語モデルによる効率的なビヘイビアツリー生成VLA2026/2/1
自然言語のタスク指示とロボットの行動プリミティブから実行可能なビヘイビアツリーをXMLで直接生成する1Bパラメータのオープンソース小型言語モデルを提案し、標準ベンチマークを構築した。
- AgriGS-SLAM: マルチビューガウシアンスプラッティングSLAMによる季節を跨ぐ果樹園マッピングSLAM2025/10/1
LiDARオドメトリとマルチカメラ3Dガウシアンスプラッティングを統合し、季節変化や風による揺れがある果樹園でリアルタイムに3D再構成と自己位置推定を行うSLAMフレームワークを提案。
- 劣化に頑健な高精度マッピングのための大規模LiDAR慣性データセットSLAM2025/7/1
複雑な実環境でのLIOシステムの検証不足を解決するため、4つの実環境をカバーする大規模で高精度なLiDAR慣性オドメトリデータセットを構築し、高精度な正解軌道を提供した。
- 視覚言語モデルに対するユーザー信頼のマッピング:研究動向・課題・展望VLA2025/5/1
視覚言語モデル(VLM)とのユーザーインタラクションにおける信頼の動態に関する研究を、認知科学的能力・協働モード・エージェント行動の観点から整理し、今後の信頼研究の要件を提示したサーベイ。
- 不完全な軌跡入力に対応する時空間グラフネットワークによる歩行者軌跡予測歩行者軌跡予測2025/1/1
過去の軌跡が一部欠けていても歩行者の将来軌跡を予測できる時空間グラフネットワークSTGN-ITを提案し、静的障害物も考慮して精度を向上させた。
- アクティブビジョンとゼロショット学習による農業環境認識の強化農業ロボティクス2024/9/1
果実収穫ロボットのためのアクティブビジョンとゼロショット学習を組み合わせたROS 2パイプラインを提案し、動的な3D再構成と未知環境でのセグメンテーションを実現した。
- 継続的視覚オドメトリにおける忘却と転移の実証的影響継続学習2024/6/1
屋内環境間を移動するロボットの視覚オドメトリを継続学習させ、破壊的忘却と知識転移の影響を実証的に調査した。
- 軽量LLMによるロボットタスクのビヘイビアツリー生成VLA2024/3/1
70億パラメータ以下の軽量LLMをファインチューニングし、ロボットのビヘイビアツリーを生成する手法を提案。9種類のタスクで複数モデルを比較し、実機検証まで行った。
- Advancements in Radar Odometry2023/10/1
- RadarLCD: Learnable Radar-based Loop Closure Detection Pipeline2023/9/1
- Surgical fine-tuning for Grape Bunch Segmentation under Visual Domain Shifts2023/7/1
- A Map-Free LiDAR-Based System for Autonomous Navigation in Vineyards2023/7/1
- Extended Object Tracking in Curvilinear Road Coordinates for Autonomous Driving2022/2/1
- Two algorithms for vehicular obstacle detection in sparse pointcloud2021/9/1
- ART-SLAM: Accurate Real-Time 6DoF LiDAR SLAM2021/9/1
- Design of a prototypical platform for autonomous and connected vehicles2021/6/1
- Advances in centerline estimation for autonomous lateral control2020/2/1
- Towards Affordance Prediction with Vision via Task Oriented Grasp Quality Metrics2019/7/1
- Predicting the Next Best View for 3D Mesh Refinement2018/5/1
- Real-time CPU-based large-scale 3D mesh reconstruction2018/1/1
- Robust Moving Objects Detection in Lidar Data Exploiting Visual Cues2016/9/1
- Incremental Reconstruction of Urban Environments by Edge-Points Delaunay Triangulation2016/4/1