Matthew Johnson-Roberson
収録論文 55本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 接触前実行監視:行動条件付き潜在世界モデルによるコンタクトガード操作/監視2026/8/1
ロボットの接触を伴う操作において、接触前に失敗を予測して動作を中断する監視システムを提案。未ラベルの軌跡から潜在世界モデルを学習し、計画された行動の結果を予測して失敗を検出する。
- Rewind-IL: 模倣学習のためのオンライン故障検出と状態リスポーン模倣学習2026/4/1
模倣学習ポリシーの実行中に発生する故障を検出し、安全な中間状態に巻き戻して回復させる、トレーニング不要のオンライン安全フレームワークを提案した。
- 動画デモからの実行可能なロボット動作生成のための関節フロー軌道最適化模倣学習2025/9/1
人間の動画デモを物体中心のガイドとして扱い、把持姿勢選択・物体軌道生成・衝突回避を統合した微分可能な最適化により、ロボットの関節制約を満たす動作を生成するフレームワークを提案。
- 単一画像から陰的表面モデルを効率的に構築するFINSsim2real2025/9/1
単一または少数のRGB画像から高精度な陰的表面とSDF場を数秒で再構築する軽量フレームワークFINSを提案し、ロボットの表面追従タスクへの応用を示した。
- クロスモーダル指示によるロボット動作生成VLA2025/9/1
自由記述テキストなどの粗い注釈を指示として使い、視覚言語モデルと微調整モデルを組み合わせて3D動作軌道を生成するCrossInstructを提案し、強化学習と組み合わせて実機・シミュレーションで検証した。
- 単一画像から動画生成環境表現を介した運動方策へナビゲーション2025/5/1
1枚のRGB画像から動画生成モデルで多視点映像を作り、3D基盤モデルで点群を再構成して衝突回避運動を生成する枠組みVGERを提案。
- 双腕ロボットのカメラキャリブレーションとシーン表現の同時推定キャリブレーション2025/5/1
複数のロボットアームに搭載されたカメラの外部キャリブレーションと腕間の相対姿勢、共有作業空間の3D表現を、マーカーなしで同時に推定するフレームワークを提案。
- GraphSeg: グラフの辺追加と縮約によるセグメント化された3D表現3Dセグメンテーション2025/4/1
深度情報なしの少数の2D画像から、2Dの類似度と推定3D構造の二重対応グラフを構築し、辺の追加とグラフ縮約で一貫した3D物体セグメンテーションを生成する手法。
- 曖昧さのない空間基盤モデルに向けて:深度曖昧性の再考と分離空間理解2025/3/1
透明シーンなどで生じる深度曖昧性に対処するため、単一予測ではなく複数仮説を扱う空間基盤モデルを提案し、学習不要のラプラシアン視覚プロンプトで多層深度を推定する手法を開発した。
- 海の果てまで無限に続くリーグ:潜在フラクタル拡散モデルによるフォトリアルな3D海底地形生成3D生成/拡散モデル2025/3/1
海底探査ロボットの実画像から3D形状と意味情報を抽出し、フラクタル潜在表現で条件付けした拡散モデルでRGBD海底画像を生成、3DGSで統合することでフォトリアルな大規模海底シーンを生成する手法DreamSeaを提案。
- ノイズを含む動画からのロバストな自己運動推定と3D再構成のためのスケーラブルなベンチマークと学習3D再構成2025/1/1
ノイズの多い動画でも高精度な自己運動推定と3D再構成を実現するため、ノイズ合成パイプラインとベンチマークRobust-Ego3Dを構築し、テスト時適応手法CorrGSを提案した。
- ロバストベイズシーン再構成:検索拡張事前分布による精密把持と計画シーン再構成2024/11/1
単一RGBD画像から多物体シーンを再構成するため、既存メッシュデータベースから検索した事前分布をベイズ推論に組み込むBRRPを提案し、遮蔽部分の形状推定と不確かさの定量化を実現した。
- PhotoReg: 3Dガウシアンスプラッティングモデルのフォトメトリック位置合わせ3DGS2024/10/1
複数の3Dガウシアンスプラッティングモデルを、3D基盤モデルとフォトメトリック損失を用いてスケールを揃えながら統合するフレームワークを提案。
- SplaTraj: セマンティックGaussian Splattingによるカメラ軌道生成シーン表現/軌道生成2024/10/1
言語指示に基づき、Gaussian Splattingで再構成した環境内を映える形で巡るカメラ軌道を連続時間最適化で生成するフレームワーク。
- Embodied-RAG: 具現化エージェントのための汎用ノンパラメトリック記憶検索生成VLA2024/9/1
ロボットの探索で得たマルチモーダルな知識を階層的な「意味の森」として記憶し、ナビゲーションや言語生成に活用するRAGフレームワークを提案した。
- 3D基盤モデルによる把持物体の形状と姿勢の同時推定マニピュレーション2024/7/1
3D基盤モデルを活用し、外部カメラのキャリブレーションなしで、ロボットが把持した物体の形状と姿勢をRGB画像から同時に推定する手法を提案した。
- 完全からノイズ世界シミュレーションへ:SLAMロバスト性ベンチマークのためのカスタマイズ可能な身体性マルチモーダル摂動SLAM2024/6/1
RGB-D SLAMモデルのロバスト性評価のため、センサ・運動摂動を体系的に分類し合成するパイプラインと大規模ベンチマークNoisy-Replicaを提案した。
- 共有RGB-Dフィールドの学習:LiDAR-カメラ3D知覚のためのラベル効率の良い統一自己教師あり事前学習VLA2024/5/1
LiDARとカメラの3D知覚モデル向けに、NeRFを活用して両モダリティを統一的にマスク再構成する自己教師あり事前学習手法NS-MAEを提案し、ラベル効率の良いファインチューニングで従来手法を上回る性能を示した。
- 3D基盤モデルによるシーン表現とハンドアイキャリブレーションの統合キャリブレーション2024/4/1
マニピュレータ搭載RGBカメラの画像から、キャリブレーションマーカーなしで環境表現の構築とカメラ-エンドエフェクタ間のキャリブレーションを同時に行うJCR手法を提案。
- DarkGS: 暗闇でのロボット探査のためのニューラル照明学習と3Dガウシアン再照明3D再構成/再照明2024/3/1
移動する光源下の暗い環境で、カメラと光源の系をニューラルにモデル化し、再照明可能な3Dガウシアンシーンを構築して実時間で写実的な新視点画像を生成する手法を提案した。
- V-PRISM: 未知の卓上シーンの確率的マッピングシーン認識2024/3/1
セグメント済みRGB-D画像から卓上シーンの3D表現を確率的に構築する手法を提案し、占有・セグメンテーション・不確かさを同時に推定する。
- 人間のスケッチでロボットの行動場所と動作を教える:空間図式指示マニピュレーション2024/3/1
人間がカメラ画像上にスケッチした領域を3D空間に投影し、連続的な空間指示マップを学習してロボットの最適化問題に組み込む手法を提案。移動マニピュレータのベース配置問題に適用し、高品質な解と高速な実行を実現した。
- Customizable Perturbation Synthesis for Robust SLAM Benchmarking2024/2/1
- Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis2023/12/1
- Instructing Robots by Sketching: Learning from Demonstration via Probabilistic Diagrammatic Teaching2023/9/1
- Learning Orbitally Stable Systems for Diagrammatically Teaching2023/9/1
- Reasoning about the Unseen for Efficient Outdoor Object Navigation2023/9/1
- Beyond NeRF Underwater: Learning Neural Reflectance Fields for True Color Correction of Marine Imagery2023/4/1
- Towards Automated Sample Collection and Return in Extreme Underwater Environments2021/12/1
- Hybrid Visual SLAM for Underwater Vehicle Manipulator Systems2021/12/1
- Learning Cross-Scale Visual Representations for Real-Time Image Geo-Localization2021/9/1
- A Kinematic Model for Trajectory Prediction in General Highway Scenarios2021/3/1
- BiTraP: Bi-directional Pedestrian Trajectory Prediction with Multi-modal Goal Estimation2020/7/1
- Point Set Voting for Partial Point Cloud Analysis2020/7/1
- Pixel-Wise Motion Deblurring of Thermal Videos2020/6/1
- Off The Beaten Sidewalk: Pedestrian Prediction In Shared Spaces For Autonomous Vehicles2020/6/1
- Parametric Design of Underwater Optical Systems2020/4/1
- Reachable Sets for Safe, Real-Time Manipulator Trajectory Design2020/2/1
- Leveraging the Template and Anchor Framework for Safe, Online Robotic Gait Design2019/9/1
- On-Demand Trajectory Predictions for Interaction Aware Highway Driving2019/9/1
- Risk Assessment and Planning with Bidirectional Reachability for Autonomous Driving2019/9/1
- LiStereo: Generate Dense Depth Maps from LIDAR and Stereo Imagery2019/5/1
- Stochastic Sampling Simulation for Pedestrian Trajectory Prediction2019/3/1
- Towards Provably Not-at-Fault Control of Autonomous Robots in Arbitrary Dynamic Environments2019/2/1
- A constrained control-planning strategy for redundant manipulators2018/10/1
- Bio-LSTM: A Biomechanically Inspired Recurrent Neural Network for 3D Pedestrian Pose and Gait Prediction2018/9/1
- SilhoNet: An RGB Method for 6D Object Pose Estimation2018/9/1
- Bridging the Gap Between Safety and Real-Time Performance in Receding-Horizon Trajectory Design for Mobile Robots2018/9/1
- Occlusion-Aware Risk Assessment for Autonomous Driving in Urban Environments2018/9/1
- PedX: Benchmark Dataset for Metric 3D Pose Estimation of Pedestrians in Complex Urban Intersections2018/9/1
- Failing to Learn: Autonomously Identifying Perception Failures for Self-driving Cars2017/7/1
- Technical Report for Real-Time Certified Probabilistic Pedestrian Forecasting2017/6/1
- Safe Trajectory Synthesis for Autonomous Driving in Unforeseen Environments2017/5/1
- WaterGAN: Unsupervised Generative Network to Enable Real-time Color Correction of Monocular Underwater Images2017/2/1
- Driving in the Matrix: Can Virtual Worlds Replace Human-Generated Annotations for Real World Tasks?2016/10/1