Davide Scaramuzza
収録論文 151本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MPCソルバー勾配ガイダンスによる強化学習の加速:重み可変MPC向け強化学習/MPC2026/9/1
モデル予測制御(MPC)のコスト重みを適応的に学習する際、強化学習のサンプル効率を向上させるため、微分可能MPCのソルバー勾配を補助ガイダンスとして利用するSG-RL手法を提案した。自動レースプラットフォームで最大70.6%のサンプル削減を実証した。
- 深層学習はなぜビジュアルSLAMを改善するのか?SLAM2026/7/1
深層学習ベースのビジュアルSLAMの性能向上が、学習された2Dデータ対応と不確実性によるものか、再帰的アーキテクチャによるものかを制御実験で検証した論文。
- 投擲を学ぶ:クアッドローターによるケーブル吊り下げペイロードの機敏かつ正確な配送ドローン/強化学習2026/6/1
クアッドローターが吊り下げたペイロードを目標へ正確に投げる強化学習ポリシーを、高精度シミュレーションと実機で検証し、モデルベース手法より誤差と時間を大幅に削減した。
- 変分的神経ダイナミクスによるロボットポリシーの継続学習継続学習2026/6/1
実世界の経験を活用して、隠れた繰り返し発生するダイナミクス下でロボットのポリシーを継続的に改善するフレームワークを提案。物理事前知識とニューラル残差を組み合わせ、オンラインで条件を推定してポリシーを適応させる。
- 強化学習による敏捷な飛行における性能と汎化の橋渡し強化学習/ドローンレース/ゼロショット汎化2026/6/1
ドローンレースの強化学習において、タスク認識型スイッチングと物理情報に基づく手続き型トラック生成器を組み合わせ、テスト時適応なしでゼロショット汎化を実現するフレームワークを提案した。
- 荒れた海面への視覚に基づく機敏な着陸強化学習/着陸2026/5/1
強化学習を用いて、移動する海上プラットフォームへのマルチローターの自律着陸を、プラットフォームの状態推定なしで視覚特徴のみから実現する手法を提案した。
- マルチエージェント強化学習による超人的で安全なアジャイルレーシングマルチエージェント強化学習2026/5/1
マルチエージェント強化学習を用いて、高速クアッドローターレースで人間のチャンピオンパイロットを上回る性能と安全性を両立させ、ゼロショットで人間との安全な相互作用を実現した。
- 高速機動のためのイベントベースSLAMベンチマークSLAM2026/4/1
イベントカメラを用いた高速機動下での状態推定手法の限界を分析し、多様なプラットフォームと照明条件を含む新しいベンチマークフレームワークEvSLAMを提案した。
- EAAE: 未知の3次元環境におけるUAVのエネルギーを考慮した自律探索探索/UAV2026/3/1
マルチローターUAVの探索において、エネルギー消費を明示的に考慮したフロンティアベースの探索手法EAAEを提案し、シミュレーションでエネルギー消費を削減しつつ探索時間と地図品質を維持できることを示した。
- 基盤モデル整合による生成的イベント事前学習イベントカメラ/事前学習2026/3/1
イベントカメラのデータに、画像基盤モデルの知識を整合させつつ、時系列生成事前学習を行う2段階フレームワークを提案し、認識・セグメンテーション・深度推定などで最先端性能を達成した。
- イベントカメラを用いた混雑環境でのクアッドローター飛行のための近似模倣学習ドローン飛行2026/3/1
イベントカメラの高周波データをシミュレーションする計算コストを回避するため、表現学習と方策探索を分離し、オフラインデータで表現を学習後、軽量な状態情報のみで方策を微調整する近似模倣学習を提案。訓練時間を28倍短縮し、実機でも有効性を実証した。
- 知覚を考慮したクワッドローターのウェイポイント飛行における時間最適計画飛行ロボット2026/3/1
クワッドローターの時間最適軌道計画に、視覚的状態推定の品質を考慮した知覚制約を統合する新しい最適化フレームワークを提案した。
- イベントカメラ支援による高速飛行ドローンのための鮮明な放射輝度場再構成NeRF/イベントカメラ2026/2/1
高速飛行するドローンの運動ぼけ画像とイベントストリームを融合し、NeRF最適化と自己運動推定を同時に精錬することで、高精度な3D放射輝度場とカメラ軌跡を教師なしで復元する手法を提案。
- 実世界で俊敏なクアッドロータ飛行を学習する飛行制御2026/2/1
正確なシステム同定やSim2Real転移なしに、オンライン適応と残差学習でクアッドロータの俊敏な飛行を実現する自己適応フレームワークを提案。
- 動きを考慮したイベントカメラのイベント抑制イベントカメラ2026/2/1
イベントカメラのストリームから自己運動と独立移動物体によるイベントをリアルタイムに分離・抑制する軽量フレームワークを提案し、セグメンテーション精度と推論速度を大幅に向上させた。
- 四 rotor MPCにおける計画と制御の時間的カスケードMPC/制御2025/12/1
クアッドロータのMPCにおいて、階層的な計画と制御の積み重ねを時間的カスケードに置き換え、単一の多段MPCとして計画問題を定式化することで追従性能を最大75%改善した。
- ロボティクスにおけるリアルギャップ:課題・解決策・ベストプラクティスsim2real2025/10/1
シミュレーションと実環境の差異(リアルギャップ)の原因・解決手法・評価指標を体系的に整理したサーベイ。sim-to-real転移の現状と課題を概観する。
- 物体目標ナビゲーションのための強化学習手法で重要な要素は何か?実証研究と統合フレームワーク物体目標ナビゲーション2025/10/1
物体目標ナビゲーションの強化学習システムを認識・方策・テスト時強化の3要素に分解し、大規模実験で各要素の影響を分析。認識とテスト時戦略の改善が方策改善より効果的であることを示し、統合フレームワークを提案。
- PA-MPPI: 未知環境におけるクアッドロータ航法のための知覚認識型モデル予測パス積分制御ナビゲーション2025/9/1
未知環境でクアッドロータが目標まで飛行する際、障害物で目標が見えないときは未知領域を観測できる経路を優先する知覚コストをMPPIに組み込み、地図を拡張しながら代替経路をオンライン計画する手法を提案。50Hzで動作することを実機実験で示した。
- 見えれば到達不要:知覚考慮型強化学習による効率的なロボット検査ナビゲーション2025/9/1
検査対象が見えた時点で移動を止めることを目的とし、地図なしで最短の視認可能軌道を学習する強化学習フレームワークを提案。シミュレーションで訓練し実機に展開、従来手法より効率的な検査軌道を実現。
- イベント分光法:構造化光を用いたイベントベース多スペクトル・深度センシングイベントカメラ/構造化光/分光2025/9/1
単一のイベントセンサと波長変調構造化光により、高解像度・低遅延の深度再構成と650-850nmの分光イメージングを同時に実現し、森林環境での葉と枝の識別精度を向上させた。
- 選好から学ぶアクロバティック飛行sim2real2025/8/1
人間の選好フィードバックのみから、ドローンの複雑なアクロバティック飛行をシミュレーションで学習し、実機へゼロショット転移することに成功した研究。
- オンザフライ学習:微分可能シミュレーションによる迅速な方策適応sim2real2025/8/1
微分可能シミュレーション内で残差ダイナミクス学習と実時間方策適応を統合し、実世界データでモデルを逐次更新することで、未見の外乱に5秒以内で適応するオンライン学習フレームワークを提案した。
- ロボティクスにおけるAIのロードマップロボティクスAI2025/7/1
1990年代以降のロボティクスAIの成果を評価し、多様なタスク・環境に対応するデータセットや汎用性の高いアルゴリズム設計など、短期・中期的な研究課題と展望をまとめたロードマップを提案する。
- 狭いパイプ内でホバリングするドローンのための低遅延イベントベース流速計測飛行制御2025/7/1
パイプ内の気流をイベントカメラと煙でリアルタイム計測し、その流れ情報を強化学習コントローラに統合することで、狭い管内でのホバリングと壁衝突回避を実現した。
- 視線誘導イベントビジョンによる暗所読書イベントカメラ/OCR2025/6/1
スマートグラスにおいて、ユーザーの視線でイベントストリームを中心視化し、帯域を98%削減しつつ暗所や高速シーンでの文字認識を可能にするイベントベースOCRを提案。
- Sight Guide: Cybathlon 2024視覚支援レースのためのウェアラブル知覚・ナビゲーションシステムウェアラブル支援/ナビゲーション2025/6/1
視覚障害者支援のため、複数のRGB-Dカメラと振動・音声フィードバックを用いたウェアラブルシステムを開発し、Cybathlon 2024の視覚支援レースで有効性を示した。
- HDVIO2.0: ハイブリッド動力学VIOによる風と外乱の推定VIO2025/4/1
ドローンの並進・回転の6自由度動力学を学習ベースのモデルと組み合わせてVIOに統合し、風などの外乱下でも高精度な状態推定を実現した。
- ForesightNav: シーン想像による効率的な探索学習ナビゲーション2025/4/1
未探索領域の占有・意味情報を予測する想像モジュールを備え、長期的なナビゲーション目標を効率的に選択することで未知環境での探索性能を高める手法を提案。
- 視覚基盤モデルによるLiDAR位置合わせ位置推定2025/2/1
周囲カメラ画像から得たDINOv2特徴を点記述子として使い、RANSACやICPと組み合わせることで、季節変化や長期経過後でもLiDARスキャンを3Dマップに頑健に位置合わせする手法を提案。
- 解析的世界モデルによる効率的な車両ダイナミクスモデリングの実現自動運転2025/2/1
微分可能シミュレータを状態予測器と組み合わせることで、相対オドメトリ、最適プランナ、最適逆状態を学習する解析的世界モデル(AWM)を提案し、自動運転における意思決定を強化する。
- 単眼イベントカメラによるモーションキャプチャシステムモーションキャプチャ2025/2/1
狭い空間でも使えるよう、点滅LEDマーカーと単眼イベントカメラで物体の位置・姿勢を推定するシステムを開発し、小型ドローンの飛行制御に応用した。
- 状態空間ワールドモデルによるモデルベース強化学習の高速化モデルベースRL2025/2/1
状態空間モデル(SSM)を用いてダイナミクスモデルの学習を並列化し、モデルベース強化学習の計算ボトルネックを解消。部分観測環境向けに特権情報を活用するアーキテクチャも提案し、実機のアジャイルなクアッドロータ飛行タスクで検証した。
- 夢見るドローン:視覚ベース飛行のためのモデルベース強化学習VLA2025/1/1
DreamerV3を用いて、カメラ画像のみを入力としてドローンレースコースを最大9m/sで飛行する視覚運動ポリシーを学習させた研究。
- デジタルツインを活用したドリフトフリーVisual SLAMVisual SLAM2024/12/1
VIO/VSLAMが生成する疎な3D点群をデジタルツインに点対面マッチングで位置合わせし、視覚的特徴の対応付けなしに6自由度のグローバル位置推定を実現する手法を提案。
- クアッドロータのためのマルチタスク強化学習マルチタスク強化学習/クアッドロータ制御2024/12/1
クアッドロータ制御において、共有された物理ダイナミクスを活用し、単一のポリシーで複数の機動(高速安定化、速度追従、自律レースなど)を実行できるマルチタスク強化学習フレームワークを提案した。
- 生徒に合わせた教師の訓練:部分観測下での模倣学習の改善模倣学習2024/12/1
特権情報を持つ教師と限られた観測の生徒の非対称性を解消するため、教師と生徒を同時に訓練し、生徒が模倣可能な行動を教師に学習させる枠組みを提案。
- 単眼イベントカメラによるクアッドロータの障害物回避障害物回避2024/11/1
機載の単眼イベントカメラのみを用いて、深さ予測を事前学習に活用し、シミュレーションと実機データで学習することで、クアッドロータの屋内・屋外での障害物回避を実現した。
- 微分可能シミュレーションによる視覚特徴からのクアッドロータ制御学習sim2real2024/10/1
微分可能シミュレーションを用いてクアッドロータの制御方策を学習し、視覚特徴のみからでもモデルフリー強化学習より高効率・短時間で訓練できることを示した。
- 環境をポリシーとして:未知のコースを走るドローンレースの学習ドローンレース/強化学習2024/10/1
強化学習でドローンレースのポリシーを訓練する際、別のRLポリシーがエージェントの性能に応じて訓練環境を動的に調整することで、再訓練なしに未知のコースへ汎化できる手法を提案した。
- 微分可能シミュレーションを用いた知覚的四足歩行制御のための残差方策学習歩行2024/10/1
微分可能シミュレーションによる一次方策勾配法に残差方策学習を組み合わせ、四足歩行の移動と知覚ナビゲーションを数分でエンドツーエンド学習できることを示した。
- FaVoR: ボクセルレンダリングによる特徴量を用いたカメラ再定位カメラ再定位2024/9/1
追跡した2D特徴量をボクセルマップに蓄積し、ボリュームレンダリングで未知視点の記述子を合成することで、視点・外観変化に頑健なカメラ再定位を実現した。
- 構造非依存のレンジ・視覚・慣性オドメトリオドメトリ2024/9/1
火星ヘリコプター着陸のため、距離センサと視覚・慣性を融合し、地形の平面仮定なしにメートルスケールのドリフトを防ぐオドメトリ手法を提案した。
- 強化学習による視覚オドメトリの適応的制御VLA2024/7/1
視覚オドメトリ(VO)を逐次意思決定問題として捉え、強化学習でキーフレーム選択やグリッドサイズを動的に調整することで、人手によるパラメータ調整を不要にし精度と頑健性を向上させた研究。
- 俊敏ロボティクス:最適制御・強化学習・微分可能シミュレーション制御/強化学習2024/7/1
最適制御・強化学習・微分可能シミュレーションを組み合わせ、ロボットの俊敏性を高めつつ外乱に頑健な制御系を設計する方法を論じた論文。
- 状態推定なしでピクセルからアジャイル飛行を実現VLA2024/6/1
強化学習により、カメラ映像から直接制御指令を生成し、状態推定を使わずに時速40kmでゲートを通過するドローンレーシングを実現した。
- Hilti SLAMチャレンジ2023:建設現場における多様なセンサ構成での単一・複数セッションSLAMのベンチマークSLAM2024/4/1
建設現場でのSLAM性能を評価する新データセットとベンチマークを提供し、異なるセンサ構成や複数セッションSLAMの課題に取り組んだ。また、LiDARで観測可能な新規マーカーとmm精度の位置推定アルゴリズムを提案した。
- 微分可能シミュレーションによる四足歩行の学習歩行2024/3/1
高忠実度の非微分可能シミュレータと簡略化サロゲートモデルを組み合わせた微分可能シミュレーション枠組みを提案し、四足歩行を数分で学習、PPOより高いサンプル効率を実現した。
- 模倣学習で強化学習をブートストラップする視覚ベースの俊敏飛行VLA2024/3/1
特権状態で強化学習した教師方策を模倣学習で視覚入力の方策に蒸留し、さらに強化学習で微調整することで、視覚のみでドローンレースを飛行できる制御器を学習した。
- MPCC++: 安全制約付き時間最適飛行のためのモデル予測輪郭制御制御/ドローンレース2024/3/1
ドローンレース向けに、ゲート衝突を防ぐ空間制約と終端集合で安全性を保証し、実データから学習した空力・推力の残差項とベイズ最適化によるハイパーパラメータ調整を組み合わせたMPCC手法を提案した。
- ロボティクスと流体力学の融合:クアッドロータ下方の誘起気流を乱流ジェットとして特徴づける空力モデリング2024/3/1
クアッドロータのホバリング時に下方に生じる気流を乱流ジェット理論でモデル化し、機体質量・プロペラ径・機体サイズのみで平均速度場を高精度に推定できる軽量モデルを実験的に構築した。
- AERIAL-CORE: AI-Powered Aerial Robots for Inspection and Maintenance of Electrical Power Infrastructures2024/1/1
- Reaching the Limit in Autonomous Racing: Optimal Control versus Reinforcement Learning2023/10/1
- Flymation: Interactive Animation for Flying Robots2023/10/1
- Contrastive Initial State Buffer for Reinforcement Learning2023/9/18
- Contrastive Learning for Enhancing Robust Scene Transfer in Vision-based Agile Flight2023/9/1
- Learning to Walk and Fly with Adversarial Motion Priors2023/9/1
- Agilicious: Open-Source and Open-Hardware Agile Quadrotor for Vision-Based Flight2023/7/1
- HDVIO: Improving Localization and Disturbance Estimation with Hybrid Dynamics VIO2023/6/1
- Actor-Critic Model Predictive Control: Differentiable Optimization meets Reinforcement Learning for Agile Flight2023/6/1
- Autonomous Power Line Inspection with Drones via Perception-Aware MPC2023/4/1
- Microgravity induces overconfidence in perceptual decision-making2023/4/1
- Learning Agile, Vision-based Drone Flight: from Simulation to Reality2023/4/1
- Event-based Agile Object Catching with a Quadrupedal Robot2023/3/1
- COVERED, CollabOratiVE Robot Environment Dataset for 3D Semantic segmentation2023/2/1
- Improving safety in physical human-robot collaboration via deep metric learning2023/2/1
- Autonomous Drone Racing: A Survey2023/1/1
- User-Conditioned Neural Control Policies for Mobile Robotics2022/11/1
- Learning Perception-Aware Agile Flight in Cluttered Environments2022/10/1
- Learned Inertial Odometry for Autonomous Drone Racing2022/10/1
- Weighted Maximum Likelihood for Controller Tuning2022/10/1
- Learning Deep Sensorimotor Policies for Vision-based Autonomous Drone Racing2022/10/1
- Data-Efficient Collaborative Decentralized Thermal-Inertial Odometry2022/9/1
- Training Efficient Controllers via Analytic Policy Gradient2022/9/1
- Hilti-Oxford Dataset: A Millimetre-Accurate Benchmark for Simultaneous Localization and Mapping2022/8/1
- E-NeRF: Neural Radiance Fields from a Moving Event Camera2022/8/1
- Exploring Event Camera-based Odometry for Planetary Robots2022/4/1
- Real-time Neural-MPC: Deep Learning Model Predictive Control for Quadrotors and Agile Robotic Platforms2022/3/1
- Learning Minimum-Time Flight in Cluttered Environments2022/3/1
- Time-Optimal Online Replanning for Agile Quadrotor Flight2022/3/1
- Minimum-Time Quadrotor Waypoint Flight in Cluttered Environments2022/2/1
- A Benchmark Comparison of Learned Control Policies for Agile Quadrotor Flight2022/2/1
- Perception-Aware Perching on Powerlines with Multirotors2022/2/1
- Continuous-Time vs. Discrete-Time Vision-based SLAM: A Comparative Study2022/2/1
- Visual Attention Prediction Improves Performance of Autonomous Drone Racing Agents2022/1/1
- Policy Search for Model Predictive Control with Application to Agile Drone Flight2021/12/1
- Learning High-Speed Flight in the Wild2021/10/1
- Nonlinear MPC for Quadrotor Fault-Tolerant Control2021/9/1
- Range, Endurance, and Optimal Speed Estimates for Multicopters2021/9/1
- Expertise Affects Drone Racing Performance2021/9/1
- The Hilti SLAM Challenge Dataset2021/9/1
- A Comparative Study of Nonlinear MPC and Differential-Flatness-Based Control for Quadrotor Agile Flight2021/9/1
- Performance, Precision, and Payloads: Adaptive Nonlinear MPC for Quadrotors2021/9/1
- Model Predictive Contouring Control for Time-Optimal Quadrotor Flight2021/8/1
- Time-Optimal Planning for Quadrotor Waypoint Flight2021/8/1
- Powerline Tracking with Event Cameras2021/8/1
- NeuroBEM: Hybrid Aerodynamic Quadrotor Model2021/6/1
- DSEC: A Stereo Event Camera Dataset for Driving Scenarios2021/3/1
- Human-Piloted Drone Racing: Visual Processing and Control2021/3/1
- Autonomous Drone Racing with Deep Reinforcement Learning2021/3/1
- Autonomous Overtaking in Gran Turismo Sport Using Curriculum Reinforcement Learning2021/3/1
- AutoTune: Controller Tuning for High-Speed Flight2021/3/1
- Data-Driven MPC for Quadrotors2021/2/1
- Autonomous Quadrotor Flight despite Rotor Failure with Onboard Vision Sensors: Frames vs. Events2021/2/1
- Flightmare: A Flexible Quadrotor Simulator2020/9/1
- Unsupervised Feature Learning for Event Data: Direct vs Inverse Problem Formulation2020/9/1
- Fisher Information Field: an Efficient and Differentiable Map for Perception-aware Planning2020/8/1
- Super-Human Performance in Gran Turismo Sport Using Deep Reinforcement Learning2020/8/1
- Online Weight-adaptive Nonlinear Model Predictive Control2020/8/1
- CPC: Complementary Progress Constraints for Time-Optimal Quadrotor Trajectories2020/7/1
- Learning High-Level Policies for Model Predictive Control2020/7/1
- Deep Drone Acrobatics2020/6/1
- AlphaPilot: Autonomous Drone Racing2020/5/1
- Voxel Map for Visual SLAM2020/3/1
- Augmenting Visual Place Recognition with Structural Cues2020/3/1
- Tightly-coupled Fusion of Global Positional Measurements in Optimization-based Visual-Inertial Odometry2020/3/1
- AirSim Drone Racing Lab2020/3/1
- Event-Based Angular Velocity Regression with Spiking Networks2020/3/1
- Geometry-aware Compensation Scheme for Morphing Drones2020/3/1
- Redesigning SLAM for Arbitrary Multi-Camera Systems2020/3/1
- Towards Low-Latency High-Bandwidth Control of Quadrotors using Event Cameras2019/11/1
- Exploration Without Global Consistency Using Local Volume Consolidation2019/9/1
- Visual-Inertial Odometry of Aerial Robots2019/6/1
- Rethinking Trajectory Evaluation for SLAM: a Probabilistic, Continuous-Time Approach2019/6/1
- EVDodgeNet: Deep Dynamic Obstacle Dodging with Event Cameras2019/6/1
- Deep Drone Racing: From Simulation to Reality with Domain Randomization2019/5/1
- Event-based Vision: A Survey2019/4/1
- Focus Is All You Need: Loss Functions For Event-based Vision2019/4/1
- Beauty and the Beast: Optimal Methods Meet Learning for Drone Racing2018/10/1
- Asynchronous, Photometric Feature Tracking using Events and Frames2018/7/1
- Semi-Dense 3D Reconstruction with a Stereo Event Camera2018/7/1
- Deep Drone Racing: Learning Agile Flight in Dynamic Environments2018/6/1
- A 64mW DNN-based Visual Navigation Engine for Autonomous Nano-Drones2018/5/1
- A Unifying Contrast Maximization Framework for Event Cameras, with Applications to Motion, Depth, and Optical Flow Estimation2018/4/1
- PAMPC: Perception-Aware Model Predictive Control for Quadrotors2018/4/1
- Event-based Vision meets Deep Learning on Steering Prediction for Self-driving Cars2018/4/1
- A Real-Time Game Theoretic Planner for Autonomous Two-Player Drone Racing2018/1/1
- Differential Flatness of Quadrotor Dynamics Subject to Rotor Drag for Accurate Tracking of High-Speed Trajectories2017/12/1
- Fast, Autonomous Flight in GPS-Denied and Cluttered Environments2017/12/1
- Data-Efficient Decentralized Visual SLAM2017/10/1
- Ultimate SLAM? Combining Events, Images, and IMU for Robust Visual SLAM in HDR and High Speed Scenarios2017/9/1
- Efficient Decentralized Visual Place Recognition From Full-Image Descriptors2017/5/1
- Continuous-Time Visual-Inertial Odometry for Event Cameras2017/2/1
- Aggressive Quadrotor Flight through Narrow Gaps with Onboard Sensing and Computing using Active Vision2016/12/1
- The Event-Camera Dataset and Simulator: Event-based Data for Pose Estimation, Visual Odometry, and SLAM2016/10/1
- Event-based, 6-DOF Camera Tracking from Photometric Depth Maps2016/7/1
- Past, Present, and Future of Simultaneous Localization And Mapping: Towards the Robust-Perception Age2016/6/1
- Perception-aware Path Planning2016/5/1
- On-Manifold Preintegration for Real-Time Visual-Inertial Odometry2015/12/1
- Event-based Camera Pose Tracking using a Generative Event Model2015/10/1
- LightPanel: Active Mobile Platform for Dense 3D Modelling2015/6/1