Manthan Patel
収録論文 14本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EgoHTR: 人間の地形移動の自己中心視点4Dデモンストレーション歩行2026/7/1
自己中心視点のウェアラブルと3Dスキャナを用いて、複雑な環境での人間の移動シーンを再構成するパイプラインとデータセットを構築し、これを活用して人型ロボットの移動ポリシーを訓練し実機で検証した。
- WildOS: 野外環境におけるオープンボキャブラリ物体探索ナビゲーション2026/2/1
地図や深度センサに頼らず、視覚言語モデルで探索方向を意味的に評価し、長距離のオープンボキャブラリ物体探索を実現するシステムを提案。
- 火山環境における大規模自律ガスモニタリング:エトナ山での脚式ロボット歩行2026/1/1
四足歩行ロボットANYmalに四重極質量分析計を搭載し、エトナ山の険しい地形で自律的に火山ガスを測定するシステムを開発・評価した。
- DeFM: 深度画像からロボティクスの基盤表現を学習基盤モデル2026/1/1
6000万枚の深度画像で自己蒸留により事前学習した基盤モデルDeFMを提案し、分類・セグメンテーション・ナビゲーション・歩行・マニピュレーションで最先端性能とsim-to-real汎化を実現した。
- VLD: 強化学習ナビゲーションのための視覚言語ゴール距離ナビゲーション2025/12/1
インターネット規模の動画で自己教師あり学習した目標までの距離予測器と、シミュレーションで訓練した強化学習方策を組み合わせ、画像・テキスト両方のゴール指定に対応するナビゲーション手法を提案。
- NaviTrace:視覚言語モデルの身体性ナビゲーション評価ベンチマークナビゲーション2025/10/1
視覚言語モデルに指示と身体タイプを与え、画像空間での2Dナビゲーション軌跡を出力させるVQAベンチマークを提案し、8つの最先端モデルを評価した。
- TartanGround: 地上ロボットの知覚とナビゲーションのための大規模データセットデータセット/知覚・ナビゲーション2025/5/1
多様な環境で動く地上ロボット向けに、360度ステレオカメラやLiDAR、占有マップなどを含む大規模マルチモーダルデータセットを構築し、知覚・SLAMタスクの汎化性能評価を可能にした。
- RoadRunner M&M:自律オフロードナビゲーションのためのマルチレンジ・マルチ解像度走行可能性マップ学習自律ナビゲーション2024/9/1
複数画像とLiDARボクセルマップから、50m/100mの距離と0.2m/0.8mの解像度で走行可能性・標高マップを直接予測する自己教師あり学習フレームワークを提案し、長距離推定精度と汎化性能を向上させた。
- GlORIE-SLAM: 大域最適化されたRGBのみの陰的エンコーディング点群SLAMSLAM2024/3/1
RGB画像のみを用いた高密度SLAMにおいて、ニューラル点群表現と単眼深度推定を組み合わせ、ループ閉じ込みとオンライン大域バンドル調整により高精度な追跡・マッピング・レンダリングを実現した。
- RoadRunner:自律走行オフロード走行のための走破性推定学習走破性推定2024/2/1
カメラとLiDARの入力を融合し、自己教師あり学習で地形の走破性と標高マップを直接予測するフレームワークを提案し、オフロード自律走行の低遅延化を実現した。
- COVINS-G: A Generic Back-end for Collaborative Visual-Inertial SLAM2023/1/1
- LiDAR-guided object search and detection in Subterranean Environments2022/10/1
- Collaborative Mapping of Archaeological Sites using multiple UAVs2021/5/1
- Design and Implementation of Path Trackers for Ackermann Drive based Vehicles2020/12/1