Kostas Daniilidis
収録論文 51本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 隠れた運動学を探索して関節物体を操作する学習マニピュレーション2026/9/29
関節物体の運動学の曖昧さをベイズ信念分布と強化学習で解消し、情報利得を報酬に探索行動を学習する手法を提案。
- 密度輸送によるフローマッチングポリシーの強化学習強化学習2026/6/7
フローマッチングポリシーを強化学習で微調整する新しいアルゴリズムRLDTを提案。最大エントロピーRL目的とSVGDを用いて輸送場を構築し、期待ターゲット推定で安定学習を実現。
- OctoSense: マルチモーダルロボット知覚のための自己教師あり学習自己教師あり学習2026/6/1
複数のセンサを搭載したロボット用データセットと、センサの特性に合わせたマスクオートエンコーダによる自己教師あり学習手法を提案。既存の画像基盤モデルより優れた性能を示す。
- OmniGuide:汎用ロボットポリシーを強化する万能ガイダンス場VLA2026/3/1
3D基盤モデルやVLMなどの多様なガイダンスを微分可能なエネルギー関数として表現し、VLAモデルの行動サンプリングを誘導することで、複雑な操作タスクの成功率と安全性を向上させるフレームワーク。
- オンボードセンシングと基盤モデルを統合したロボットトリアージのためのマルチロボットプラットフォームマルチロボット/医療トリアージ2025/12/1
大規模災害時に空撮UAVとセンサ搭載UGVを連携させ、被災者の発見からバイタル測定・外傷評価・重症度分類までを遠隔で行うトリアージ支援システムを開発した。
- 動画からのシーン内物体操作のゼロショット再構成マニピュレーション2025/12/1
単眼RGB動画から、シーン内での物体操作を再構成する初のシステムを提案。データ駆動型基盤モデルで初期化し、2段階最適化で把持から操作までの手と物体の動きをシーンに整合させて復元する。
- ActiveGrasp: 情報に基づく能動的把持のためのキャリブレーション済みエネルギーベースモデルマニピュレーション2025/11/1
SE(3)上の把持分布を捉えるキャリブレーション済みエネルギーベースモデルと、その分布から情報利得を見積もる能動視点選択を組み合わせ、限られた視点予算で混雑環境の物体把持を実現した研究。
- Maestro:視覚言語モデルでロボティクスモジュールを統合するゼロショット汎用ロボットVLA2025/11/1
VLMコーディングエージェントが知覚・計画・制御モジュールを動的に組み合わせてプログラム的政策を生成し、ゼロショットで汎用ロボットを実現する手法を提案。
- リスク回避型経路計画のための能動的次善視点最適化経路計画2025/10/1
オンライン更新される3Dガウススプラッティング放射輝度場上でAVaRに基づくリスクマップを構築し、リスク回避経路の精緻化とSE(3)多様体上の次善視点選択を統合したフレームワークを提案する。
- HELIOS: 未知環境における言語指示に基づく移動マニピュレーションのための階層的探索移動マニピュレーション2025/9/1
部分的にしか観測できない未知環境で言語指示に基づく移動マニピュレーションを実現するため、2D地図と3Dガウス表現を組み合わせた階層的シーン表現と、探索と情報獲得を両立する探索目的関数を提案した。
- 高速特徴場(F³): イベントデータの予測的表現イベントカメラ2025/9/1
イベントカメラのデータから過去のイベントを基に未来のイベントを予測することで、シーン構造と動きの情報を保持する高速な表現F³を学習し、光流推定・セマンティックセグメンテーション・単眼深度推定で最先端性能を達成した論文。
- RoboArena:汎用ロボットポリシーの分散型実世界評価ロボット評価/ベンチマーク2025/6/1
評価者ネットワークが自由にタスクと環境を選び、ペア比較の二重盲検評価を集約することで、汎用ロボットポリシーをスケーラブルかつ公平にランキングする手法を提案し、7機関・600以上の実機評価で有効性を示した。
- リーイベントに基づくニューラル慣性オドメトリ慣性オドメトリ2025/5/1
IMUデータをSE(3)リー代数上のイベントとしてサンプリングし、サンプリングレートや軌道プロファイルの変化に頑健なニューラル変位事前分布を学習することで、慣性オドメトリのドリフトを最大21%低減した。
- 対称性を強化したマルチエージェント強化学習群制御2025/1/1
マルチエージェント系に外在的な対称性を埋め込む枠組みを提案し、群れロボットの衝突低減とタスク成功率向上を実現した。
- ETAP: イベントカメラによる任意点追跡イベントカメラ/点追跡2024/12/1
イベントカメラの高時間分解能と高ダイナミックレンジを活かし、任意の点を追跡する初のイベントベースTAP手法を提案。動きに頑健な特徴学習のための特徴アライメント損失を導入し、ベンチマークで大幅な精度向上を達成。
- マルチモーダルLLMとフィッシャー情報を用いた探索・アクティブマッピングアクティブマッピング2024/10/1
3Dガウシアンスプラッティング表現とマルチモーダルLLMを組み合わせ、長期的な探索目標と短期的な行動計画を同時に行うアクティブマッピングシステムを提案。位置推定の不確かさを考慮した情報利得最大化により、最先端の性能を実現した。
- Next Best Sense: FisherRFで3Dガウシアンスプラッティングの視覚と触覚を誘導3Dガウシアンスプラッティング/能動視点選択2024/10/1
3Dガウシアンスプラッティングを用いたロボットマニピュレータのための能動的な次善視点・触覚選択フレームワークを提案し、SAM2による深度整合とFisherRF拡張で少数視点での性能を向上させた。
- EqNIO: 部分同変ニューラル慣性オドメトリ慣性オドメトリ2024/8/1
IMUデータの重力周りの回転と反射に対する対称性を考慮した同変ニューラルネットワークを設計し、慣性オドメトリの汎化性能を向上させた。
- 非線形運動事前分布とコントラスト最大化による高密度連続時間モーション推定イベントカメラ/オプティカルフロー2024/7/1
イベントカメラ向けに、画素レベルの軌跡を運動事前分布として組み込んだ自己教師あり損失を提案し、連続時間モーション推定とオプティカルフローの精度を向上させた。
- 不確実性を考慮した言語条件付き模倣学習ポリシーの展開VLA2024/3/1
事前学習済みの言語条件付き模倣学習エージェントに対し、温度スケーリングでキャリブレーションを行い、不確実性を考慮した行動選択を可能にする手法を提案し、タスク完了率を向上させた。
- 不確実性を超えて:FisherRFを用いた安全なロボットナビゲーションと3Dシーン理解のためのリスク認識型能動視点獲得能動視点獲得/3Dシーン理解2024/3/1
リスク尺度で危険領域を優先するRaEMを提案し、FisherRFと組み合わせてロボットの安全性と3Dシーン再構成の効率を両立させた。
- ロボットナビゲーションのためのランダム化アルゴリズムによるスケーラブルなネットワーク特徴選択群制御2024/3/1
未知環境を航行するロボット群の自己位置推定に有用な視覚特徴を、グラフラプラシアンとネットワーク接続性を利用したランダム化アルゴリズムで効率的に選択する手法を提案した。
- Learning to Navigate in Turbulent Flows with Aerial Robot Swarms: A Cooperative Deep Reinforcement Learning Approach2023/6/1
- EV-Catcher: High-Speed Object Catching Using Low-latency Event-based Neural Networks2023/4/1
- Cross-modal Map Learning for Vision and Language Navigation2022/3/1
- Uncertainty-driven Planner for Exploration and Navigation2022/2/1
- Discovering and Achieving Goals via World Models2021/10/1
- Bridge Data: Boosting Generalization of Robotic Skills with Cross-Domain Datasets2021/9/1
- Model-Based Reinforcement Learning via Latent-Space Collocation2021/6/1
- Learning to Map for Active Semantic Goal Navigation2021/6/1
- Object-centric Video Prediction without Annotation2021/5/1
- Reinforcement Learning with Videos: Combining Offline Observations with Interaction2020/11/1
- TLIO: Tight Learned Inertial Odometry2020/7/1
- Planning to Explore via Self-Supervised World Models2020/5/1
- An Adversarial Objective for Scalable Exploration2020/3/1
- Reactive Navigation in Partially Familiar Planar Environments Using Semantic Perceptual Feedback2020/2/1
- Technical Report: Reactive Semantic Planning in Unexplored Semantic Environments Using Deep Perceptual Feedback2020/2/1
- Learning Predictive Models From Observation and Interaction2019/12/1
- TagSLAM: Robust SLAM with Fiducial Markers2019/10/1
- Event-based Vision: A Survey2019/4/1
- Human Motion Capture Using a Drone2018/4/1
- EV-FlowNet: Self-Supervised Optical Flow Estimation for Event-based Cameras2018/2/1
- The Multi Vehicle Stereo Event Camera Dataset: An Event Camera Dataset for 3D Perception2018/1/1
- Fast, Autonomous Flight in GPS-Denied and Cluttered Environments2017/12/1
- Active End-Effector Pose Selection for Tactile Object Recognition through Monte Carlo Tree Search2017/3/1
- 6-DoF Object Pose from Semantic Keypoints2017/3/1
- A Game-Theoretic Approach to Robust Fusion and Kalman Filtering Under Unknown Correlations2016/10/1
- Distributed Consistent Data Association2016/9/1
- Fast, Robust, Continuous Monocular Egomotion Computation2016/2/1
- Nonmyopic View Planning for Active Object Detection2013/9/1
- Information Acquisition with Sensing Robots: Algorithms and Error Bounds2013/9/1