Daniel Cremers
収録論文 42本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VkVIO: VulkanによるクロスプラットフォームGPU加速視覚慣性オドメトリVIO2026/9/24
CUDAに依存せずVulkan APIを用いてGPU加速する初のクロスプラットフォーム視覚慣性オドメトリ(VIO)手法を提案し、ワークステーションから低価格シングルボードPCまで幅広い機器でCUDAベースを上回る精度とリアルタイム性能を実現した。
- MIVIFI:多視点魚眼画像生成モデルの訓練のための視点と魚眼ドメインの橋渡し画像生成2026/8/24
自動運転のための多視点魚眼画像生成を、等距離円筒投影を用いたクロスドメイン学習で実現し、データ不足を克服した。
- Stipple: 視覚慣性トラッキングによるリアルタイムインクリメンタルガウシアンスプラッティング3D再構成2026/8/1
3Dガウシアンスプラッティングの重い前処理を、視覚慣性オドメトリの情報を活用したインクリメンタル学習に置き換え、トラッキングと並行してリアルタイムに3D再構成を行う手法を提案した。
- ロボットの自己改善:人間のビデオからの力学モデルを用いてロボット学習2026/6/1
人間のビデオから学習した行動・力学・価値表現をロボットに転移し、失敗状態を修正するDGAC法を提案。7つの実世界操作タスクで成功率を40%から81%に向上させ、ロボットの自己改善を実証した。
- EgoFlow: 勾配誘導フローマッチングによる自己中心視6DoF物体動作生成動作生成2026/4/1
自己中心視映像から物体の6DoF動作を生成するフローマッチングフレームワークを提案し、物理的制約を勾配として組み込むことで衝突回避と滑らかな動作を実現した。
- SafeLand: ベイズ意味マッピングによる未知環境での安全な自律着陸自律着陸2026/3/1
カメラと軽量高度センサのみで未知環境の安全な着陸地点をオンラインで意味マッピングし、動的障害物にリアルタイム対応するUAV着陸システムを提案・実証した。
- GMT: 3Dシーンにおける6自由度物体軌道合成のための目標条件付きマルチモーダルトランスフォーマー操作計画2026/3/1
3Dシーン内で物体の6自由度操作軌道を生成するマルチモーダルトランスフォーマーモデルを提案し、3Dバウンディングボックス、点群、意味カテゴリ、目標姿勢を統合して高精度な軌道合成を実現した。
- Dream-SLAM: 動的環境における能動SLAMのための未観測領域の夢生成能動SLAM2026/2/1
部分的に観測された動的環境の時空間画像と意味構造を生成(夢見)し、実観測と融合することで、カメラ姿勢推定・3D地図生成・長期的な探索計画を改善する単眼能動SLAM手法を提案。
- ArtiBenchとArtiBrain:汎化可能な視覚言語による関節物体操作のベンチマークマニピュレーション2025/11/1
関節物体操作の汎化性能を評価する5段階ベンチマークArtiBenchと、VLM推論と拡散制御を組み合わせたモジュール型フレームワークArtiBrainを提案し、既存手法を上回る性能を示した。
- OrthoLoC: 正射地理データを用いたUAVの6自由度位置推定とキャリブレーション位置推定2025/9/1
UAV画像と正射地理データを対応付ける大規模データセットOrthoLoCを構築し、位置推定・キャリブレーションを分離評価できるベンチマークを提供。さらにマッチング精度を最大95%改善するAdHoPを提案。
- Monado SLAMデータセット:自己中心視覚慣性トラッキング向けSLAM2025/8/1
複数のVRヘッドセットで収録した実世界シーケンスを集めたSLAMデータセットを公開し、頭部装着型トラッキングの難場面に対応する研究を促進する。
- OPAL: 可視性を考慮したLiDAR-OpenStreetMap間の適応的放射状融合による場所認識場所認識2025/4/1
LiDARスキャンとOpenStreetMapの間のドメインギャップを可視性マスクと適応的放射状融合で橋渡しし、軽量な地図事前情報を用いた高精度・高速な場所認識を実現した。
- 平面を超えた路面形状の精密再構成:NURBSによる道路表面の平滑化道路表面再構成2025/4/1
航空画像や地理データから得た3D道路点群にNURBS曲面をフィッティングし、異常補正アルゴリズムで平滑で高精度な路面再構成を実現するFlexRoadを提案。
- HI-SLAM2: 高速単眼シーン再構成のための幾何認識ガウシアンSLAMSLAM2024/11/1
RGB入力のみで高精度な単眼シーン再構成を実現する3DガウシアンスプラッティングベースのSLAMシステム。単眼事前分布と学習ベース密SLAMを組み合わせ、ループ閉じ込み時の効率的なポーズグラフ最適化とガウシアン変形により高速かつ幾何学的に正確な再構成を可能にする。
- PG-SLAM: 動的環境におけるフォトリアルで幾何学的に正確なRGB-D SLAMSLAM2024/11/1
ガウススプラッティングを拡張し、動的な人や物体の変形・動きをモデル化しつつ、フォトリアルな前景と静的背景を同時に再構成してカメラ位置推定を行うRGB-D SLAM手法を提案。
- 非ランバート環境における物理ベースのフォトメトリックバンドル調整SLAM2024/9/1
非拡散反射を含む実環境でカメラ姿勢と3D形状を高精度に推定するため、材質・照明・光路に基づく物理的重みを導入したフォトメトリックバンドル調整法を提案し、非ランバートシーンのSLAM用データセットも構築した。
- TARGO: 遮蔽環境下でのターゲット駆動型物体把持のベンチマークマニピュレーション2024/7/1
遮蔽のある散らかった環境でのターゲット物体把持に焦点を当てた新ベンチマークTARGOを構築し、既存手法の限界を示すとともに、形状補完モジュールを備えたTransformerベースのTARGO-Netを提案した。
- VXP: ボクセル・クロス・ピクセルによる大規模画像-LiDAR位置認識位置認識2024/3/1
画像とLiDARスキャンの局所対応を自己教師ありで学習し、両モダリティを共有特徴空間に統合するクロスモーダル位置認識フレームワークVXPを提案。3つのベンチマークで最先端手法を大きく上回る精度を達成した。
- Deep Event Visual Odometry2023/12/1
- VoxNeRF: Bridging Voxel Representation and Neural Radiance Fields for Enhanced Indoor View Synthesis2023/11/1
- Robust Autonomous Vehicle Pursuit without Expert Steering Labels2023/8/1
- Multi Agent Navigation in Unconstrained Environments using a Centralized Attention based Graphical Neural Network Controller2023/7/1
- Multi-Vehicle Trajectory Prediction at Intersections using State and Intention Information2023/1/1
- PRISM: Probabilistic Real-Time Inference in Spatial World Models2022/12/1
- E-NeRF: Neural Radiance Fields from a Moving Event Camera2022/8/1
- The Probabilistic Normal Epipolar Constraint for Frame-To-Frame Rotation Optimization under Uncertain Feature Positions2022/4/1
- DM-VIO: Delayed Marginalization Visual-Inertial Odometry2022/1/1
- TANDEM: Tracking and Dense Mapping in Real-time using Deep Multi-view Stereo2021/11/1
- Towards Robust Monocular Visual Odometry for Flying Robots on Planetary Missions2021/9/1
- Vision-Based Mobile Robotics Obstacle Avoidance With Deep Reinforcement Learning2021/3/1
- PrimiTect: Fast Continuous Hough Voting for Primitive Detection2020/5/1
- From Planes to Corners: Multi-Purpose Primitive Detection in Unorganized 3D Point Clouds2020/1/1
- Efficient Derivative Computation for Cumulative B-Splines on Lie Groups2019/11/1
- Multi-Frame GAN: Image Enhancement for Stereo Visual Odometry in Low Light2019/10/1
- Towards Generalizing Sensorimotor Control Across Weather Conditions2019/7/1
- Visual-Inertial Mapping with Non-Linear Factor Recovery2019/4/1
- Modular Vehicle Control for Transferring Semantic Information Between Weather Conditions Using GANs2018/7/1
- Direct Sparse Visual-Inertial Odometry using Dynamic Marginalization2018/4/1
- The TUM VI Benchmark for Evaluating Visual-Inertial Odometry2018/4/1
- Real-Time Trajectory Replanning for MAVs using Uniform B-splines and a 3D Circular Buffer2017/3/1
- Learning to Drive using Inverse Reinforcement Learning and Deep Q-Networks2016/12/1
- From Monocular SLAM to Autonomous Drone Exploration2016/9/1