Cesar Cadena
収録論文 99本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人型ロボットのための疎な3次元構造物の俊敏な知覚横断学習歩行2026/8/30
人型ロボットが猿渡りバーを跳び移りながら渡り切るタスクを強化学習で実現。頭部搭載ライダーの生データを注意機構付きエンコーダで処理し、実機で高い成功率を達成した。
- Tripody: 高所建設作業のための過拘束3-SPR型パラレルロボットパラレルロボット2026/7/1
天井建設作業向けに、車輪付き3自由度パラレルロボットを開発し、過拘束機構と弾性変形を利用して高剛性と高精度を実現した。
- LIME: 一人称視点ビデオから意図を考慮したカメラモーションを学習するカメラモーション生成2026/7/1
ロボットが自然言語の指示に基づいて次に観察すべきカメラの相対姿勢を生成する手法を提案。一人称ビデオから多様な意図とカメラ動作のペアを学習し、観察利得の予測と連続的なフローマッチングによる姿勢生成を組み合わせる。
- ロボットにはVLAと世界モデルだけでは不十分基盤モデル2026/6/1
ロボットの汎用知能はポリシースケーリングだけでは不十分で、非構造化データをロボットの教師信号に変換する仕組みが必要だと主張するポジションペーパー。
- 移動ロボットにおける能動知覚のための効率的ビームサーチアルゴリズム能動知覚/経路計画2026/4/1
移動ロボットの能動知覚問題に対し、ノード単位のビームサーチと期待利得指標を導入し、さらにRRAGグラフ構築法を提案して、効率的かつ頑健な情報収集経路計画を実現した。
- DigiForest: 持続可能な林業のためのデジタル分析とロボティクス林業ロボティクス2026/4/1
森林管理の持続可能性向上を目指し、自律ロボット群による樹木データ収集、自動特性抽出、意思決定支援、低影響伐採を統合した大規模精密林業システムを提案・実証した論文。
- BIEVR-LIO: バンプ画像強化ボクセルマップによる堅牢なLiDAR-慣性オドメトリオドメトリ2026/4/1
LiDAR-慣性オドメトリの精度低下や発散を防ぐため、ボクセルごとの高さ画像として表面を表現する高解像度マップと、幾何学的に情報量の多い領域に焦点を当てた点サンプリング戦略を提案した。
- 経路条件付き強化学習による長距離ナビゲーションのための局所計画ナビゲーション2026/3/1
参照経路を文脈として与えられた強化学習ベースの局所ナビゲーション方策を提案し、経路が高品質なときは効率を大幅に改善し、劣化・欠如時もベースライン性能を維持することを示した。
- ブドウ園におけるロボット位置推定のための意味的ランドマーク粒子フィルタ位置推定2026/3/1
ブドウ園の平行な列による見た目の類似性で位置推定が失敗する問題に対し、幹や柱の検出を意味的な壁として計測モデルに組み込んだ粒子フィルタを提案し、実地実験で精度を向上させた。
- 連結された四脚ロボットによる協調運搬タスクのためのマルチエージェント局所衝突回避学習群制御2026/3/1
四脚ロボット2台が物体を連結して運搬する際、事前地図や経路計画なしにセンサ情報のみで障害物を回避しながら目標方向へ追従する強化学習ベースの階層的制御手法を提案した。
- マルチ解像度3Dグリッド上での効率的な階層的任意角度経路計画経路計画2026/2/1
マルチ解像度の3Dボリュームマップを活用し、任意角度経路計画の最適性と完全性を保ちつつ計算効率を大幅に改善する手法を提案。実環境と合成環境での実験でサンプリングベース手法を上回る性能を示し、オープンソース化した。
- GrandTour: 実環境における脚式ロボットのマルチモーダル知覚と状態推定のためのデータセット歩行2026/2/1
ANYmal-D四脚ロボットにLiDAR・カメラ・固有感覚センサを搭載し、山岳から都市・廃墟まで多様な屋内外環境で収集した大規模マルチモーダルデータセットを公開。RTK-GNSSとトータルステーションによる高精度な正解軌道も含み、SLAMや状態推定、マルチモーダル学習の評価基盤を提供する。
- DeFM: 深度画像からロボティクスの基盤表現を学習基盤モデル2026/1/1
6000万枚の深度画像で自己蒸留により事前学習した基盤モデルDeFMを提案し、分類・セグメンテーション・ナビゲーション・歩行・マニピュレーションで最先端性能とsim-to-real汎化を実現した。
- 火山環境における大規模自律ガスモニタリング:エトナ山での脚式ロボット歩行2026/1/1
四足歩行ロボットANYmalに四重極質量分析計を搭載し、エトナ山の険しい地形で自律的に火山ガスを測定するシステムを開発・評価した。
- SAHA: 選択的間伐のための監督付き自律ハーベスタ森林ロボティクス2026/1/1
4.5トンのハーベスタを改造し、学習とモデルベースの制御を組み合わせて、森林内を自律走行して選択的に木を伐採するシステムを開発し、北欧の森林で数キロメートルに及ぶ実証実験を行った。
- CaRLi-V: カメラ・レーダー・LiDAR融合による点単位3D速度推定センサーフュージョン2025/11/1
レーダーの速度キューブ表現、カメラのオプティカルフロー、LiDARの距離計測を組み合わせ、密な点群に対して3D速度を推定するROS2パッケージを開発した。
- NaviTrace:視覚言語モデルの身体性ナビゲーション評価ベンチマークナビゲーション2025/10/1
視覚言語モデルに指示と身体タイプを与え、画像空間での2Dナビゲーション軌跡を出力させるVQAベンチマークを提案し、8つの最先端モデルを評価した。
- 見えれば到達不要:知覚考慮型強化学習による効率的なロボット検査ナビゲーション2025/9/1
検査対象が見えた時点で移動を止めることを目的とし、地図なしで最短の視認可能軌道を学習する強化学習フレームワークを提案。シミュレーションで訓練し実機に展開、従来手法より効率的な検査軌道を実現。
- 意味論を考慮したパーティクルフィルタによる信頼性の高いブドウ園ロボットの自己位置推定自己位置推定2025/9/1
ブドウ園で問題となる反復的な畝の形状による位置推定の失敗を解決するため、ブドウの幹や支柱といった安定した物体検出をパーティクルフィルタに組み込み、意味論的な壁で畝の曖昧さを軽減する手法を提案した。
- 空間強化リカレントメモリによる長距離マップレスナビゲーションのためのエンドツーエンド強化学習ナビゲーション2025/6/1
既存のRNNの空間記憶能力の限界を指摘し、空間記憶を強化するSRUを提案。単眼ステレオカメラを用いた長距離マップレスナビゲーションを実現し、既存RNN比で23.5%の性能向上を達成。
- Sight Guide: Cybathlon 2024視覚支援レースのためのウェアラブル知覚・ナビゲーションシステムウェアラブル支援/ナビゲーション2025/6/1
視覚障害者支援のため、複数のRGB-Dカメラと振動・音声フィードバックを用いたウェアラブルシステムを開発し、Cybathlon 2024の視覚支援レースで有効性を示した。
- TartanGround: 地上ロボットの知覚とナビゲーションのための大規模データセットデータセット/知覚・ナビゲーション2025/5/1
多様な環境で動く地上ロボット向けに、360度ステレオカメラやLiDAR、占有マップなどを含む大規模マルチモーダルデータセットを構築し、知覚・SLAMタスクの汎化性能評価を可能にした。
- Boxi: ロボティクスにおけるアルゴリズム性能を考慮した設計判断センサフュージョン2025/4/1
複雑な環境で移動ロボットの自律性を高めるため、LiDARやカメラ、IMUなどを統合したセンサペイロードBoxiを設計し、時間同期やキャリブレーションが状態推定性能に与える影響を分析した論文。
- 安全でプラットフォームを考慮したロボットナビゲーションのための学習型知覚フォワードダイナミクスモデルナビゲーション2025/4/1
周囲の形状と固有受容感覚の履歴からロボットの将来状態を予測する学習型フォワードダイナミクスモデルを提案し、MPPI計画に統合することで、コスト調整なしに安全なナビゲーションを実現した。
- ホリスティックフュージョン:タスク・構成に依存しない因子グラフによるロボット自己位置推定と状態推定自己位置推定/センサフュージョン2025/4/1
因子グラフを用いて、タスクやセンサ構成に依存せず多様なセンサを統合し、低遅延な局所運動推定と低ドリフトな大域自己位置推定を同時に実現するオープンソースの融合フレームワークを提案した。
- 森林におけるLiDAR位置認識:複数高さのBEV密度画像を用いた注意機構位置認識2025/3/1
森林環境でのLiDAR位置認識のため、異なる高さの水平スライスから得たBEV密度画像をViTで処理し、マルチBEV相互作用で統合する手法を提案。実世界データで既存手法より高い精度を達成。
- キーポイントの意味統合による屋外農業環境での特徴マッチング改善特徴マッチング2025/3/1
ブドウ園のような反復構造の多い屋外環境で、キーポイントに意味情報を統合して特徴記述子を識別しやすくし、特徴マッチング精度を12.6%向上させた。
- 建設ロボットの精度向上:高精度加速度計を用いたたわみ・バックラッシュ補償のためのモジュラーファクターグラフベースフレームワーク建設ロボット/キャリブレーション2025/1/1
長い運動連鎖を持つ建設ロボットの位置決め精度を高めるため、高精度加速度計とファクターグラフによるモジュラーな状態推定でたわみとバックラッシュを補償する手法を提案し、xy平面の95%誤差を半減させた。
- FrontierNet: 視覚的手がかりで探索する学習モデル探索2025/1/1
RGB画像と単眼深度からフロンティアを提案し情報利得を予測する視覚ベースの探索システムを開発し、3D地図依存の手法より初期探索効率を15%改善した。
- ロボティクスにおける連続時間状態推定手法のサーベイ状態推定2024/11/1
ロボティクスにおける連続時間状態推定の研究を統一的な定式化で整理し、スプラインとガウス過程をまとめて体系的に分類した包括的サーベイ。
- IPPON: 常識に導かれた情報経路計画による物体目標ナビゲーション物体目標ナビゲーション2024/10/1
大規模言語モデルの常識事前知識と3D物体確率マッピングを組み合わせ、未知環境で対象物体へ効率的に到達するゼロショットの経路計画手法を提案し、実機でも検証した。
- タグマップ:大規模言語モデルによる空間推論とナビゲーションのためのテキストベース地図ナビゲーション2024/9/1
大規模画像認識モデルを活用し、数千の意味クラスを表現できるテキストベースの地図を提案。従来の埋め込みベース地図より2〜4桁少ないメモリで同等の位置推定精度を実現し、LLMと組み合わせた実機ナビゲーションを検証した。
- 情報・制約・整合:実環境における退化対応点群レジストレーションのフィールド分析SLAM2024/8/1
LiDARベースのロボット位置推定において、幾何学的に不良な環境でのICPの退化を軽減する手法(TSVD、不等式制約、Tikhonov正則化など)を比較・分析し、実世界実験で有効性を検証した。
- ROS-LLM:タスクフィードバックと構造化推論を備えた身体性AIのためのROSフレームワークVLA2024/6/1
ROSと大規模言語モデルを統合し、非専門家が自然言語でロボットをプログラミングできるフレームワークを提案。行動モードや模倣学習、フィードバックによる反省機能を備え、多様なタスクで有効性を検証した。
- 野生環境の視覚ナビゲーション:事前学習モデルとオンライン自己教師あり学習による高速走行可能性学習ナビゲーション2024/4/1
森林や草原などの自然環境で、事前学習済みモデルの特徴量とオンライン自己教師あり学習を組み合わせ、短時間の実地デモから走行可能領域を推定してロボットをナビゲートするシステムを提案した。
- VIRUS-NeRF:視覚・赤外線・超音波を用いたNeural Radiance FieldsNeRF/マッピング2024/3/1
低コストな超音波・赤外線測距センサとカメラを組み合わせ、占有グリッドを更新しながらNeRFで環境マップを構築する手法を提案。LiDARに匹敵するカバレッジを達成し、学習速度も46%向上した。
- Resilient Legged Local Navigation: Learning to Traverse with Compromised Perception End-to-End2023/10/1
- COIN-LIO: Complementary Intensity-Augmented LiDAR Inertial Odometry2023/10/1
- Path-Constrained State Estimation for Rail Vehicles2023/8/1
- Local and Global Information in Obstacle Detection on Railway Tracks2023/7/1
- Efficient volumetric mapping of multi-scale environments using wavelet-based compression2023/6/1
- Fast Traversability Estimation for Wild Visual Navigation2023/5/1
- Seeing Through the Grass: Semantic Pointcloud Filter for Support Surface Learning2023/5/1
- iPlanner: Imperative Path Planning2023/2/1
- maplab 2.0 -- A Modular and Multi-Modal Mapping Framework2022/12/1
- Unsupervised Continual Semantic Adaptation through Neural Rendering2022/11/1
- A Framework for Collaborative Multi-Robot Mapping using Spectral Graph Wavelets2022/10/1
- SphNet: A Spherical Network for Semantic Pointcloud Segmentation2022/10/1
- 3D VSG: Long-term Semantic Scene Change Prediction through 3D Variable Scene Graphs2022/9/1
- SC-Explorer: Incremental 3D Scene Completion for Safe and Efficient Exploration Mapping and Planning2022/8/1
- Team CERBERUS Wins the DARPA Subterranean Challenge: Technical Overview and Lessons Learned2022/7/1
- SCIM: Simultaneous Clustering, Inference, and Mapping for Open-World Semantic Scene Understanding2022/6/1
- Sampling-free obstacle gradients and reactive planning in Neural Radiance Fields (NeRF)2022/5/1
- Descriptellation: Deep Learned Constellation Descriptors2022/3/1
- Embodied Active Domain Adaptation for Semantic Segmentation via Informative Path Planning2022/3/1
- Collaborative Robot Mapping using Spectral Graph Analysis2022/3/1
- Continual Adaptation of Semantic Segmentation using Complementary 2D-3D Data Representations2021/11/1
- See Yourself in Others: Attending Multiple Tasks for Own Failure Detection2021/10/1
- NeuralBlox: Real-Time Neural Representation Fusion for Robust Volumetric Mapping2021/10/1
- Panoptic Multi-TSDFs: a Flexible Representation for Online Multi-resolution Volumetric Mapping and Long-term Dynamic Scene Consistency2021/9/1
- Self-Improving Semantic Perception for Indoor Localisation2021/5/1
- CalQNet -- Detection of Calibration Quality for Life-Long Stereo Camera Setups2021/4/1
- Spherical Multi-Modal Place Recognition for Heterogeneous Sensor Systems2021/4/1
- PHASER: a Robust and Correspondence-free Global Pointcloud Registration2021/2/1
- Mesh Manifold based Riemannian Motion Planning for Omnidirectional Micro Aerial Vehicles2021/2/1
- Multiple Hypothesis Semantic Mapping for Robust Data Association2020/12/1
- Out-of-Distribution Detection for Automotive Perception2020/11/1
- Learning Trajectories for Visual-Inertial System Calibration via Model-based Heuristic Deep Reinforcement Learning2020/11/1
- Empty Cities: a Dynamic-Object-Invariant Space for Visual SLAM2020/10/1
- Freetures: Localization in Signed Distance Function Maps2020/10/1
- A Unified Approach for Autonomous Volumetric Exploration of Large Scale Environments under Severe Odometry Drift2020/10/1
- Deep Learning-based Human Detection for UAVs with Optical and Infrared Cameras: System and Experiments2020/8/1
- Precise Robot Localization in Architectural 3D Plans2020/6/1
- Learning Camera Miscalibration Detection2020/5/1
- Voxgraph: Globally Consistent, Volumetric Mapping using Signed Distance Function Submaps2020/4/1
- MOZARD: Multi-Modal Localization for Autonomous Vehicles in Urban Outdoor Environments2020/3/1
- VersaVIS: An Open Versatile Multi-Camera Visual-Inertial Sensor Suite2019/12/1
- Predicting Unobserved Space For Planning via Depth Map Augmentation2019/11/1
- SegMap: Segment-based mapping and localization using data-driven descriptors2019/9/1
- Learning Densities in Feature Space for Reliable Segmentation of Indoor Scenes2019/8/1
- Flexible Trinocular: Non-rigid Multi-Camera-IMU Dense Reconstruction for UAV Navigation and Mapping2019/8/1
- 3D Multi-Robot Patrolling with a Two-Level Coordination Strategy2019/6/1
- Experimental Comparison of Visual-Aided Odometry Methods for Rail Vehicles2019/4/1
- OREOS: Oriented Recognition of 3D Point Clouds in Outdoor Scenarios2019/3/1
- Volumetric Instance-Aware Semantic Mapping and 3D Object Discovery2019/3/1
- VIZARD: Reliable Visual Localization for Autonomous Vehicles in Urban Outdoor Environments2019/2/1
- Observability-aware Self-Calibration of Visual and Inertial Sensors for Ego-Motion Estimation2019/1/1
- Map Management for Efficient Long-Term Visual Localization in Outdoor Environments2018/8/1
- Modular Sensor Fusion for Semantic Segmentation2018/7/1
- Aerial-Ground collaborative sensing: Third-Person view for teleoperation2018/7/1
- Reinforced Imitation: Sample Efficient Deep Reinforcement Learning for Map-less Navigation by Leveraging Prior Demonstrations2018/5/1
- SegMap: 3D Segment Mapping using Data-Driven Descriptors2018/4/1
- Free LSD: Prior-Free Visual Landing Site Detection for Autonomous Planes2018/2/1
- A Data-driven Model for Interaction-aware Pedestrian Motion Prediction in Object Cluttered Environments2017/9/1
- 3D Registration of Aerial and Ground Robots for Disaster Response: An Evaluation of Features, Descriptors, and Transformation Estimation2017/9/1
- X-View: Graph-Based Semantic Multi-View Localization2017/9/1
- From Perception to Decision: A Data-driven Approach to End-to-end Motion Planning for Autonomous Ground Robots2016/9/1
- SegMatch: Segment based loop-closure for 3D point clouds2016/9/1
- Past, Present, and Future of Simultaneous Localization And Mapping: Towards the Robust-Perception Age2016/6/1