Danica Kragic
KTH Royal Institute of Technology
収録論文 108本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 行動表現の方向・スケール分解:VLAモデルで何をトークン化すべきかの再考VLA2026/9/24
VLAモデルの行動トークン化において、並進・回転の増分を方向とスケールに分解するDSD表現を提案し、シミュレーションと実機で成功率の向上を実証した。
- フォーカスプーリングによる局所視覚特徴の集約と視覚運動ポリシーへの応用視覚運動ポリシー2026/9/8
CNNの中間特徴から制御に重要な局所情報を選択的に集約するFocusPoolを提案し、シミュレーションと実機で成功率を大幅に向上させた。
- 顕著性ガイドによる拡張を用いた行動クローニングの視覚領域ロバスト性向上行動クローニング/データ拡張2026/8/1
視覚ベースの行動クローニングにおいて、タスク重要領域を保持しつつ非重要領域に積極的なデータ拡張を適用する顕著性ガイド拡張法RoboSaGAを提案し、シミュレーションと実環境で視覚領域シフトに対するロバスト性を向上させた。
- 物理的インタラクションの学習:触覚・力覚を考慮したロボット学習のサーベイ触覚・力覚学習2026/8/1
触覚・力覚センシングを統合したロボット学習手法を、マルチモーダルかつ多段階のシステム設計の観点から統一的な分類学TF-ARTを用いて整理し、今後の研究課題を考察したサーベイ論文。
- 行動から注意を学ぶ:ポリシー学習のための創発的視覚ボトルネック視覚的注意/ロボット学習2026/8/1
行動教師信号のみから注目領域(ROI)を学習するSeekerを提案し、RGBクロップやマスク拡張、点群フィルタリングの空間インターフェースとして利用。実機で成功率を大幅に向上させた。
- MoDex: 連続多物体器用把持のための拡散ポリシーマニピュレーション2026/6/1
単一の器用な手で複数の物体を順次把持する問題に対し、把持に参加する指を指定する対向空間条件を用いた拡散ポリシーを提案し、模倣学習と強化学習の2段階訓練でシミュレーションと実機の成功率を向上させた。
- MirrorDuo: 鏡像デモペアによる反射整合的な視覚運動学習模倣学習2026/6/1
鏡像関係にあるデモペアを自動生成し、データ数を実質2倍にする手法を提案。既存の模倣学習パイプラインに適用可能で、少ないデモで作業空間の鏡像側へのスキル転移を実現する。
- 一つの身体、二つの心:共身体化ロボットハンドのための可変自律性アプローチ共身体化/可変自律性/ウェアラブルロボット2026/6/1
人間とロボットが単一の身体を共有し、タスクの段階に応じて自律性のレベルを切り替える共身体化ロボットハンドを提案した。ユーザー研究で、物体探索・把持は自律、操作は人間主導という可変自律性が有効であることを示した。
- キーポイント模倣学習の汎化能力、設計選択、および限界について模倣学習2026/5/1
RGBベースの模倣学習の汎化を改善するため、視覚基盤モデルによるキーポイント表現を用いた模倣学習(KIL)の設計選択を検討し、実機2000回以上の試行で評価。KILはRGBベースライン(47%)を上回る75%の成功率を達成し、S2拡散モデルと同等の性能を示した。
- 夢のように掴む:生成された人間デモから機能的把持を模倣する把持2026/4/1
ビデオ生成モデルなどの視覚生成モデルで合成した人間のデモを使って、ロボットの機能的把持をゼロショットで学習する手法GraspDreamerを提案。データ収集の手間を省きつつ、多様な物体・タスクへの汎化を実現した。
- FlashSAC: 高次元ロボット制御のための高速かつ安定なオフポリシー強化学習強化学習2026/4/1
オフポリシー強化学習の不安定性を解決するため、勾配更新を削減しつつモデル規模とデータ処理量を増やし、ノルム制約で安定化したFlashSACを提案。60以上のタスクでPPO等を上回る性能と効率を示した。
- ManipulationNet:物理的スキル課題と身体化マルチモーダル推論を備えた実世界ロボット操作のベンチマーク基盤ベンチマーク2026/3/1
実世界のロボット操作タスクを標準化されたハードウェアキットと統一ソフトウェアクライアントで提供し、物理スキルと身体化推論の2トラックで評価する持続可能なベンチマーク基盤を提案した。
- 変形物体操作のための選好整合視覚運動拡散ポリシーマニピュレーション2026/2/1
衣類などの変形物体を折り畳むタスクで、人間の好みに合わせた動作を少ない実演から学習する選好整合手法RKOを提案し、実機実験で有効性を示した。
- 学習されたラグランジュ潜在ダイナミクスの低次元制御と幾何学的構造制御理論2026/2/1
高次元ラグランジュ系に対し、構造保存型の低次元潜在ダイナミクスを学習し、その上で追従制御則を導出。安定性・収束性の解釈可能な条件を示し、劣駆動系にも拡張した。
- PALM: 知覚アライメントによる局所視覚運動ポリシーの汎化性向上模倣学習2026/1/1
操作ポリシーを大域的な粗い部分と局所的な細かい部分に分け、局所レベルで視覚的注目と固有受容感覚表現を揃えることで、追加の入力やデータ収集なしに分布外環境への汎化性能を高めた研究。
- ハイブリッド拡散モデル:開ループルーチンと視覚運動拡散ポリシーの統合マニピュレーション2025/12/1
模倣学習による視覚運動ポリシーに、軸固定や移動などの開ループルーチンを組み合わせるハイブリッド拡散モデルを提案し、実世界の液体移送や容器の蓋開けタスクで検証した。
- 拡張現実による人間-ロボット相互作用の再構築:仮想ロボットと基盤モデルでより安全で賢く共感的な相互作用を実現HRI2025/12/1
拡張現実(XR)と大規模基盤モデルを活用した仮想ロボットが、物理的制約を超えて共感的で適応的な人間-ロボット相互作用を可能にすることを論じ、その可能性とリスク、研究課題を提示した展望論文。
- VBM-NET: 等変TransporterNetとGNNを用いた移動マニピュレーションのための視覚ベース姿勢学習移動マニピュレーション2025/10/1
移動マニピュレーションにおいて、シーンのトップダウン正射影から把持に適したベース姿勢を選択する学習手法を提案し、シミュレーションから実機への転移を実証した。
- 拡散ポリシーのためのリアルタイム反復スキームVLA2025/8/1
最適制御のリアルタイム反復法を応用し、前時刻の解を初期値に使うことで拡散ポリシーの推論を高速化する手法を提案。蒸留や再設計なしで大規模モデルにも適用可能。
- ロボティクスにおけるAIのロードマップロボティクスAI2025/7/1
1990年代以降のロボティクスAIの成果を評価し、多様なタスク・環境に対応するデータセットや汎用性の高いアルゴリズム設計など、短期・中期的な研究課題と展望をまとめたロードマップを提案する。
- ジェスチャー優先、LLM支援音声は補完:AR仮想ロボットによるマルチモーダル「操り人形」テレオペレーションの検討テレオペレーション2025/6/1
ARヘッドセット上で仮想ロボットを介して実機を操作する「操り人形」型テレオペレーションを提案し、ジェスチャーのみと音声+ジェスチャーの2条件を比較したユーザー研究から、マルチモーダル設計指針を導出した。
- DLO-Splatting: 3Dガウシアンスプラッティングによる変形可能な線状物体の追跡変形物体操作2025/5/1
多視点RGB画像とグリッパ状態から、予測更新フィルタリングと3Dガウシアンスプラッティングを用いて変形可能な線状物体の3D形状を推定する手法を提案し、結び目作成タスクで有効性を示した。
- FLoRA: 低ランクスタイル適応によるサンプル効率の良い選好ベース強化学習選好ベースRL2025/4/1
事前学習済みロボットの報酬モデルに低ランク行列を追加して選好に適応させることで、元タスクの性能を保ちながら少ない選好データでスタイル適応を実現する手法を提案。
- 視覚運動拡散ポリシーによる多指ハンドの巧みな把持内操作の学習マニピュレーション2025/3/1
ARテレオペで収集した熟練デモを外れ値除去し、視覚運動拡散ポリシーで多指ハンドの把持内操作(片手でのボトル蓋回し等)を実機学習する枠組み。
- 把持物体を環境に押し付けて操る確率的プッシングマニピュレーション2025/3/1
把持した物体を環境との接触を利用して操る「把持プッシング」を、外部接触点を確率分布として緩和した非線形軌道最適化で高速・低コストに解き、実機ロボットで実証した論文。
- FLAME: ロボットマニピュレーションのための連合学習ベンチマークマニピュレーション2025/3/1
多様な環境で収集した16万件超の実演データセットと連合学習フレームワークを構築し、ロボットマニピュレーション政策の分散学習を評価する初のベンチマークを提案した。
- ひと掴みで複数物体を把持:逐次的多物体巧み把持生成マニピュレーション2025/3/1
ロボットハンドの一部の自由度を使い、複数物体を順番に安定把持するためのサンプリング手法SeqGraspと拡散モデルSeqDiffuserを提案し、従来法より高い成功率と約1000倍の高速生成を実現した。
- S²-Diffusion: ロボットマニピュレーションにおけるインスタンスレベルからカテゴリレベルへのスキル汎化マニピュレーション2025/2/1
拡散ポリシーとプロンプト可能な意味モジュールを組み合わせ、単一RGBカメラと深度推定を用いて、訓練していない同一カテゴリの物体へもスキルを転移できる手法を提案。
- 人間とロボットの協働におけるハンドオーバー意図の早期検出:脳波・視線・手の動きの比較人間ロボット協働2025/2/1
人間とロボットの物体受け渡しにおいて、脳波・視線・手の動きの3つの生体信号からハンドオーバー意図を早期に検出できるかを比較検討した研究。
- 視覚運動拡散ポリシー訓練のためのリアルタイム操作者介入VLA2025/2/1
操作者が実行中の視覚運動拡散ポリシーにリアルタイムで介入し、修正動作を教示できる枠組みを提案し、剛体・変形・粒状物体タスクで性能向上を実証した。
- LLM駆動ARパペッティア:コントローラ不要の音声指令によるロボット遠隔操作遠隔操作2025/2/1
Meta Quest 3上でAR空間の仮想ロボットを操作することで、コントローラなしの音声指令により実機ロボットを遠隔操作できるシステムを試作し、その有効性を実証した。
- Cloth-Splatting: RGB画像からの3D布状態推定状態推定2025/1/1
RGB画像のみを教師信号として、3Dガウシアンスプラッティングとメッシュ表現を組み合わせ、布の3D状態を予測・更新する手法を提案。推定精度の向上と収束時間の短縮を実現した。
- ロボット中心プーリングによる身体所有感を高めたEnd-to-End視覚運動方策学習VLA2024/11/1
画像特徴をロボットの固有感覚状態と相関する領域に集約するRobot-centric Poolingを提案し、自己や周囲の類似物に頑健な視覚運動方策を実現した。
- 第1回InterAIワークショップ:人間中心ロボティクスのためのインタラクティブAIHRI2024/9/1
IEEE RO-MAN 2024併設の半日ワークショップで、人間中心ロボティクスにおけるインタラクティブAIをテーマに、基調講演・論文発表・パネル討論を行う。
- 特徴抽出器か意思決定者か:視覚運動ポリシーにおける視覚エンコーダの役割を再考するVLA2024/9/1
視覚運動ポリシーにおいて視覚エンコーダが単なる特徴抽出器ではなく意思決定にも寄与していることを実験的に示し、OOD事前学習モデルの性能低下を明らかにした研究。
- 布マニピュレーション研究の展開:レビュー布マニピュレーション2024/7/1
布や衣類のロボット操作に関する研究を、モデリング・知覚・ベンチマーク・操作の観点から整理し、布の多様性への対応度を分析して今後の課題を示したレビュー論文。
- ARでロボットを操る:拡張現実によるリーダー・フォロワー遠隔操作遠隔操作2024/7/1
拡張現実空間で仮想ロボットを操作し、実機を直感的に遠隔操作するシステムを提案。ブロック積みと米すくいの実験で好意的な評価を得た。
- 境界を越える視覚:人間とロボットの相互作用におけるドメイン特化型大規模視覚モデルの初期設計空間VLA2024/4/1
人間とロボットの相互作用(HRI)にドメイン特化型の大規模視覚モデルを適用するための設計空間を提案し、15名の専門家による評価で有効性を示した。
- 参加しますか?人間中心トピックにおけるロボティクス競技会の可能性を探る人間中心ロボティクス2024/3/1
安全性・プライバシー・説明可能性・連合学習という人間中心トピックに関するロボティクス競技会の現状と参加意欲を、欧州の研究者34名への調査で明らかにした。
- 視覚ベース触覚センサによる力覚フィードバックを備えた低コスト遠隔操作遠隔操作/触覚2024/3/1
カメラ式触覚センサのデータを人間の操作者に力覚として提示する遠隔操作フレームワークを提案し、低コストな市販ハードウェアのみで剛体から柔軟・壊れやすい物体まで9種類の操作を実現した。
- 変形可能物体操作のための対話的知覚変形物体操作2024/3/1
能動カメラとマニピュレータを協調させ、動的能動視覚空間(DAVS)を用いて変形物体の知覚と操作を同時に行う逐次意思決定フレームワークを提案し、シミュレーションと実機で有効性を検証した。
- AdaFold: フィードバックループ操作による布の折り畳み軌道の適応マニピュレーション2024/3/1
RGB-D画像から布の粒子表現を抽出し、モデル予測制御で折り畳み軌道を逐次再計画するフィードバックループ型フレームワークを提案。幾何特徴から意味記述子を得ることで曖昧な点群を区別し、異なる物性の布への適応とsim2realを実現した。
- 布物体の標準化とロボットマニピュレーションにおけるその重要性マニピュレーション2024/3/1
布の弾性・剛性・摩擦などの特性をロボット応用向けに評価する枠組みを提案し、5つの基本操作への影響を調べた研究。
- 脳とロボットの融合:EEGベースのブレイン・ロボット・インタラクションシステムのレビューBMI/ブレイン・ロボット・インタラクション2024/3/1
2018年から2023年に発表された87件の研究を調査し、EEG信号を用いたブレイン・ロボット・インタラクション(BRI)システムの手法、インタラクションモード、応用、評価、課題を整理したレビュー論文。
- 異種エージェント群による視覚的行動計画マルチエージェント計画2024/3/1
能力や身体性が異なる複数エージェントでの視覚的行動計画を実現するため、低次元潜在空間のロードマップに並列行動の実行可能性とコストを組み込み、不足能力の提案も行う手法を提案した。
- 拡散ポリシーと基盤モデルによるロボットスキル学習システムVLA2024/3/1
視覚運動拡散ポリシーと大規模マルチモーダル基盤モデルを組み合わせ、自然言語指示によるスキル選択と事前条件チェックを行うロボットスキル学習システムを構築し、実世界の配膳タスクで実証した。
- 身体性AIの基盤世界モデルにおける因果性の本質的役割身体性AI2024/2/1
身体性AIのための基盤世界モデルに因果性を取り入れる重要性を論じ、物理的相互作用の正確な予測に向けた展望と誤解の整理を行った位置論文。
- DexDiffuser: 拡散モデルによる巧みな把持生成マニピュレーション2024/2/1
部分的な物体点群から拡散モデルを用いて多指ハンドの把持を生成・評価・洗練する手法を提案し、シミュレーションと実機で従来手法を上回る成功率を達成した。
- Transfer Learning in Robotics: An Upcoming Breakthrough? A Review of Promises and Challenges2023/11/1
- CAPGrasp: An $\mathbb{R}^3\times \text{SO(2)-equivariant}$ Continuous Approach-Constrained Generative Grasp Sampler2023/10/1
- Enabling Robot Manipulation of Soft and Rigid Objects with Vision-based Tactile Sensors2023/6/1
- A Virtual Reality Framework for Human-Robot Collaboration in Cloth Folding2023/5/1
- Controllable Motion Synthesis and Reconstruction with Autoregressive Diffusion Models2023/4/3
- GoNet: An Approach-Constrained Generative Grasp Sampling Network2023/3/1
- Ensemble Latent Space Roadmap for Improved Robustness in Visual Action Planning2023/3/1
- EDO-Net: Learning Elastic Properties of Deformable Objects from Graph Dynamics2022/9/1
- Elastic Context: Encoding Elasticity for Data-driven Models of Textiles2022/9/1
- Back to the Manifold: Recovering from Out-of-Distribution States2022/7/1
- Deep Learning Approaches to Grasp Synthesis: A Review2022/7/1
- Training and Evaluation of Deep Policies using Reinforcement Learning and Generative Models2022/4/1
- Augment-Connect-Explore: a Paradigm for Visual Action Planning with Data Scarcity2022/3/1
- Comparing Reconstruction- and Contrastive-based Models for Visual Task Planning2021/9/1
- Learning Deep Energy Shaping Policies for Stability-Guaranteed Manipulation2021/3/1
- Enabling Visual Action Planning for Object Manipulation through Latent Space Roadmap2021/3/1
- Bayesian Meta-Learning for Few-Shot Policy Adaptation Across Robotic Platforms2021/3/1
- Graph-based Task-specific Prediction Models for Interactions between Deformable and Rigid Objects2021/3/1
- Textile Taxonomy and Classification Using Pulling and Twisting2021/3/1
- Interpretability in Contact-Rich Manipulation via Kinodynamic Images2021/2/1
- Sequential Topological Representations for Predictive Models of Deformable Objects2020/11/1
- Learning Stable Normalizing-Flow Control for Robotic Manipulation2020/11/1
- Human-centered collaborative robots with deep reinforcement learning2020/7/1
- Data-efficient visuomotor policy training using reinforcement learning and generative models2020/7/1
- Analytic Manifold Learning: Unifying and Evaluating Representations for Continuous Control2020/6/1
- Stability-Guaranteed Reinforcement Learning for Contact-rich Manipulation2020/4/1
- Modelling and Learning Dynamics for Robotic Food-Cutting2020/3/1
- Latent Space Roadmap for Visual Action Planning of Deformable and Rigid Object Manipulation2020/3/1
- Free Space of Rigid Objects: Caging, Path Non-Existence, and Narrow Passage Detection2020/2/1
- Benchmarking In-Hand Manipulation2020/1/1
- Multi-Object Rearrangement with Monte Carlo Tree Search:A Case Study on Planar Nonprehensile Sorting2019/12/1
- Learning Task-Oriented Grasping from Human Activity Datasets2019/10/1
- Imitating by generating: deep generative models for imitation of interactive tasks2019/10/1
- Data-efficient Model Learning and Prediction for Contact-rich Manipulation Tasks2019/9/1
- Fast Adaptation with Meta-Reinforcement Learning for Trust Modelling in Human-Robot Interaction2019/8/1
- Bayesian Optimization in Variational Latent Spaces with Dynamic Compression2019/7/1
- Object Placement Planning and Optimization for Robot Manipulators2019/7/1
- Dual-Arm In-Hand Manipulation and Regrasping Using Dexterous Manipulation Graphs2019/4/1
- Data-Driven Model Predictive Control for Food-Cutting2019/3/1
- Exploring Temporal Dependencies in Multimodal Referring Expressions with Mixed Reality2019/2/1
- Invariant Feature Mappings for Generalizing Affordance Understanding Using Regularized Metric Learning2019/1/1
- Learning Manipulation States and Actions for Efficient Non-prehensile Rearrangement Planning2019/1/1
- Global Search with Bernoulli Alternation Kernel for Task-oriented Grasping Informed by Simulation2018/10/1
- Reinforcement Learning in Topology-based Representation for Human Body Movement with Whole Arm Manipulation2018/9/1
- Rearrangement with Nonprehensile Manipulation Using Deep Reinforcement Learning2018/3/1
- Dexterous Manipulation Graphs2018/3/1
- Active Perception and Modeling of Deformable Surfaces using Gaussian Processes and Position-based Dynamics2018/2/1
- Active Exploration Using Gaussian Random Fields and Gaussian Process Implicit Surfaces2018/2/1
- A Comparison of Visualisation Methods for Disambiguating Verbal Requests in Human-Robot Interaction2018/1/1
- A Decomposition-Based Approach to Reasoning about Free Space Path-Connectivity for Rigid Objects in 2D2017/10/1
- Human-Robot Collaboration: From Psychology to Social Robotics2017/5/1
- Estimating Tactile Data for Adaptive Grasping of Novel Objects2017/4/1
- Deep Predictive Policy Training using Reinforcement Learning2017/3/1
- Reinforcement Learning for Pivoting Task2017/3/1
- Anticipating many futures: Online human motion prediction and synthesis for human-robot collaboration2017/2/1
- CapriDB - Capture, Print, Innovate: A Low-Cost Pipeline and Database for Reproducible Manipulation Research2016/10/1
- A Sensorimotor Reinforcement Learning Framework for Physical Human-Robot Interaction2016/7/1
- Interactive Perception: Leveraging Action in Perception and Perception in Action2016/4/1
- Self-learning and adaptation in a sensorimotor framework2016/1/1
- Data-Driven Grasp Synthesis - A Survey2013/9/1