Stelian Coros
ETH Zürich
収録論文 57本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 触覚的好奇心がロボットのインタラクションを駆動する触覚2026/9/30
触覚フィードバックを探索の内在的報酬として用い、接触を伴う操作スキルを効率的に学習するフレームワークTacExを提案。タスク報酬や専門家デモなしで物体操作を獲得し、VLAモデルの事後学習にも有効。
- バンドル接触勾配:展開可能な動的タスクのための微分可能シミュレーションの安定化sim2real2026/9/25
剛体接触の硬さに起因する勾配の高分散を、接触周辺でのランダム化平滑化により低減し、ヒューマノイドの動的動作を実機へゼロショット転移可能にした研究。
- WRAP: 治具不要の力覚考慮型マルチロボット組立計画マニピュレーション2026/9/24
複数ロボットで治具を使わずに組立を行うため、力の釣り合いを線形計画で考慮しつつ組立順序と把持を計画する手法を提案し、シミュレーションと実機で検証した。
- KINO: ヒューマノイドの移動操作におけるVLM計画と全身制御のためのキーフレームインターフェースヒューマノイド全身制御2026/9/16
VLMによる計画と強化学習制御の間の仲介表現として動作キーフレームを用い、物体の把持・運搬・配置をヒューマノイドで実現する階層的フレームワークを提案。
- 可逆潜在分解による凸集合の和集合学習と経路計画への応用経路計画2026/6/1
衝突回避経路計画のため、可逆写像と潜在空間での凸ポリトープの和集合を同時学習し、計画後に元の空間へ復元する枠組みを提案。可視性誘導サンプリングで集合間の連結性を保ち、2Dから14自由度の操作環境で成功率を向上させた。
- バイナリを超えて:物理に基づく接触表現によるシミュレーションから実世界への巧みな操作触覚/シミュレーション転移2026/5/1
触覚データを物理原理に基づく圧力中心(CoP)表現に変換し、シミュレーションから実世界へのゼロショット転移を可能にする手法を提案。多指ハンドでのピン穴挿入とボールバランス課題で有効性を実証した。
- PAINT: 脚式ロボットによるパートナー非依存・意図認識型協調運搬群制御2026/4/1
脚式ロボットがパートナーの意図を proprioceptive 情報から推定し、地形に頑健な歩容と組み合わせて協調運搬を行う軽量な階層学習フレームワークを提案。多様な地形・荷物・パートナーでの実験で有効性を示した。
- 安全なマルチエージェント航法のための微分可能な環境・軌道同時最適化群制御2026/4/1
環境配置を変数として扱い、エージェントの軌道と環境を同時に最適化することで、安全な航法を実現する微分可能な最適化手法を提案した。
- 実機ロボットのオンライン強化学習で重要な設計選択とは何か強化学習2026/2/1
3種類のロボットで100回の実機学習を行い、アルゴリズムやシステム、実験設計の各選択を系統的に検証し、安定した学習を実現する設計指針を明らかにした。
- 方策事前分布による安全な探索安全強化学習2026/1/1
保守的な方策を事前分布として利用し、確率的ダイナミクスモデルで安全を保証しながら最適方策へ収束する強化学習手法SOOPERを提案した。
- 犬のようにロボットを教える:誘導・ジェスチャー・音声による俊敏なナビゲーションの学習歩行2026/1/1
人間の身体的誘導・ジェスチャー・音声といったマルチモーダルな指示から脚ロボットが俊敏なナビゲーション行動をデータ効率的に学ぶ、人間参加型フレームワークを提案した。
- マルチドメイン運動埋め込み:脚式ロボットのための表現豊かなリアルタイム模倣模倣学習2025/12/1
ウェーブレットベースのエンコーダと確率的埋め込みを並列に用いて、構造的・非構造的な運動特徴を統合した運動表現MDMEを提案し、ヒューマノイドと四足歩行ロボットのリアルタイム模倣で高精度・高汎化を実現した。
- APEX: 行動事前分布による脚式ロボットのロバスト動作追従のための効率的探索歩行2025/11/1
専門家のデモンストレーションを減衰する行動事前分布として強化学習に組み込み、展開時の参照データ依存を排除しつつ、脚式ロボットの多様な動作追従を効率的かつロバストに学習する手法を提案。
- 脚式ロコマニピュレーションのための全身逆動力学MPCロコマニピュレーション2025/11/1
全身の逆動力学を直接最適化するMPCを提案し、四足歩行ロボットにマニピュレータを搭載して、荷物の牽引や箱押し、ホワイトボード拭きなどの実世界タスクを80Hzのリアルタイムで実現した。
- TARC: 時間適応型ロボット制御強化学習/制御2025/10/1
強化学習により、ロボットが状況に応じて制御周波数を自律的に調整し、制御動作とその持続時間を同時に選択する手法を提案。RCカーと四足歩行ロボットで実機検証し、固定周波数制御と同等以上の性能を保ちつつ制御周波数を大幅に削減。
- コスチュームで歩く学習:美的制約を持つヒューマノイドのための敵対的運動事前分布歩行2025/9/1
娯楽用ヒューマノイドCosmoの美的制約(大きな頭、限られたセンシング、保護シェル)に対応するため、敵対的運動事前分布(AMP)とドメインランダム化を適用し、安定した立ち・歩行を実現した。
- SPiDR: 悲観的ドメインランダム化によるsim-to-real転移のゼロショット安全性sim2real2025/9/1
ドメインランダム化に悲観性を導入し、sim-to-realギャップ下でも安全制約を保証するスケーラブルな安全強化学習手法を提案し、実機ロボットで有効性を示した。
- 脚式マニピュレータによる協調運搬・配置タスクのための動的報酬カリキュラムマニピュレーション2025/9/1
単腕脚式ロボットが物体の把持から配置までを一貫して行うタスクを強化学習で学習する手法を提案し、動的報酬カリキュラムで訓練効率を55%向上、実行時間を18.6%短縮、二台協調も実現した。
- 犬のように歩く:ラベルなし動作データから脚式ロボットの操縦可能な模倣コントローラを学習歩行2025/7/1
ラベルなしの実世界動作データから脚式ロボットの多様な歩容を自動発見し、ユーザーの操縦指令に応じてスタイルを保ちながら模倣・遷移する制御器を学習するフレームワークを提案。
- APEX: 行動事前分布による効率的探索で脚式ロボットの頑健な動作追従を実現歩行2025/5/1
参照動作への依存を減らすため、減衰する行動事前分布で探索を誘導し、複数クリティックでスタイルとタスクを分離学習する動作追従RLフレームワークを提案。人型・四足ロボットのシミュレーションとUnitree Go2でのゼロショット展開で有効性を示した。
- RAMBO: 強化学習で拡張したモデルベース全身制御による移動操作移動操作2025/4/1
モデルベース全身制御と強化学習方策を組み合わせ、四足ロボットでカート押しや皿の平衡など移動しながらの操作を実現したハイブリッド手法。
- 真空グリッパー操作のための実世界強化学習における視覚表現の比較マニピュレーション2025/3/1
真空グリッパーによる箱のピッキングタスクで、実世界の視覚入力と3Dシーン入力を強化学習フレームワークで比較し、空間情報が視覚のみより大幅に優れることを示した。
- サンプリングベースのマルチモーダル・マルチロボット・マルチゴール経路計画マルチロボット計画2025/3/1
複数ロボットが共有空間で各々複数の目標を達成する問題を集中型経路計画として定式化し、確率的完全かつ漸近最適なサンプリングベース計画法を提案した。
- CAIMAN: 因果的行動影響検出によるサンプル効率の良い移動マニピュレーション移動マニピュレーション2025/2/1
脚ロボットが物体を押すなどの移動マニピュレーションを、因果的行動影響を内在的報酬として強化学習で効率的に獲得する手法を提案し、実機移転も実証した。
- 少ないデータで多くを学ぶ:脚式マニピュレーションのためのサンプル効率の良いモデルベース強化学習モデルベースRL2025/1/1
四足歩行ロボットにアームを搭載したロコマニピュレーション制御のため、手設計の運動学モデルを物理事前分布としてベイズニューラルネットワークでダイナミクスモデルを学習し、限られたデータで高精度なエンドエフェクタ軌道追従を実現した。
- MaxInfoRL:情報利得最大化による強化学習の探索促進強化学習2024/12/1
情報利得を内在的報酬として最大化し、価値関数と状態・報酬・行動のエントロピーを自然にトレードオフする探索フレームワークを提案。連続状態行動空間のオフポリシーRLに適用し、困難な探索問題や視覚制御タスクで性能向上を実現。
- ボックス仕分けのための予算最適なマルチロボット配置設計マルチロボット配置最適化2024/12/1
床グリッド上に固定ロボットを選択配置して荷物を仕分ける際、ハードウェア予算を最小化しつつ動作可能性を保証する配置を、ネットワークフロー制約付き部分グラフ最適化として自動設計する手法を提案。
- 行動クローニングの分布外汎化のための問題空間変換模倣学習2024/11/1
ロボットマニピュレーションにおける行動クローニングの分布外汎化性能を向上させるため、姿勢同変性や局所性といった特性を利用した問題空間の変換を提案し、シミュレーションと実機実験で有効性を示した。
- ActSafe: 安全制約付き強化学習のための能動的探索安全強化学習2024/10/1
未知のダイナミクスに対する不確実性を考慮しつつ安全制約を守りながら探索するモデルベース強化学習手法を提案し、学習中の安全性と高性能を両立できることを示した。
- PokeFlex: ロボティクス向け体積変形物体の実世界データセット変形物体操作2024/10/1
柔軟物体操作のためのマルチモーダル実世界データセットPokeFlexを構築し、3Dメッシュ再構成のベースラインを実証した。
- PokeFlex: ロボットマニピュレーションのための実世界変形物体データセット変形物体マニピュレーション2024/9/1
ロボットアームで柔らかい物体をつついて変形させ、その3Dメッシュと力・トルクを360度ボリュームキャプチャで記録した実世界データセットを構築し、単一画像からの3Dメッシュ再構成モデルの学習に応用した。
- MetaLoco: メタ強化学習と動作模倣による汎用四足歩行歩行2024/7/1
メタ強化学習と動作模倣を組み合わせ、多様な四足ロボットにゼロショットで適応する汎用歩行制御ポリシーを学習した研究。
- RobotKeyframing: 高レベル目標を密・疎報酬の混合で学習する歩行制御歩行2024/7/1
脚ロボットの歩行において、時間的に任意に配置された複数のポーズ目標(キーフレーム)を達成するため、密・疎報酬を扱うマルチクリティック強化学習と可変数の目標を処理するTransformerエンコーダを組み合わせた制御フレームワークを提案。
- ロバスト性評価の再考:学習ベース四足歩行制御器への敵対的攻撃歩行2024/5/1
学習ベースの四足歩行制御器に対し、時系列に沿った敵対的攻撃を生成して脆弱性を定量的に特定する手法を提案し、シミュレーションと実機で有効性を検証した。
- 四足歩行ロボットのための時空間モーションリターゲティング歩行2024/4/1
手持ちカメラ映像などのノイズを含む動作源から、形態や物理特性の異なる四足ロボットへ動的で敏捷な動きを転移する手法を提案し、実機でバク宙などの技能を実現した。
- ベイズ推論によるSim-to-Realギャップの橋渡しsim2real2024/3/1
低忠実度の物理シミュレータを事前分布として活用し、ニューラルネットワークによるロボットダイナミクス学習を正則化するSIM-FSVGDを提案。RCレースカーでのドリフト駐車を少ないデータで実現。
- Data-Efficient Task Generalization via Probabilistic Model-based Meta Reinforcement Learning2023/11/1
- On Hand-Held Grippers and the Morphological Gap in Human Manipulation Demonstration2023/11/1
- TRTM: Template-based Reconstruction and Target-oriented Manipulation of Crumpled Cloths2023/8/1
- Embracing Safe Contacts with Contact-aware Planning and Control2023/8/1
- Tuning Legged Locomotion Controllers via Safe Bayesian Optimization2023/6/1
- Optimistic Active Exploration of Dynamical Systems2023/6/1
- RL + Model-based Control: Using On-demand Optimal Control to Learn Versatile Legged Locomotion2023/5/1
- Differentiable Task Assignment and Motion Planning2023/4/1
- Efficient Learning of High Level Plans from Play2023/3/1
- Computational Design of Active Kinesthetic Garments2022/10/1
- Nonlinear Model Predictive Control for Quadrupedal Locomotion Using Second-Order Sensitivity Analysis2022/7/1
- Differentiable Collision Avoidance Using Collision Primitives2022/4/1
- Gradient-Based Trajectory Optimization With Learned Dynamics2022/4/1
- Learning Solution Manifolds for Control Problems via Energy Minimization2022/3/1
- Spatial Computing and Intuitive Interaction: Bringing Mixed Reality and Robotics Together2022/2/1
- Manipulability optimization for multi-arm teleoperation2021/2/1
- ADD: Analytically Differentiable Dynamics for Multi-Body Systems with Frictional Contact2020/7/1
- Trajectory optimization for a class of robots belonging to Constrained Collaborative Mobile Agents (CCMA) family2019/10/1
- An optimization framework for simulation and kinematic control of Constrained Collaborative Mobile Agents (CCMA) system2019/1/1
- Automatic Design of Task-specific Robotic Arms2018/6/1
- Interactive Co-Design of Form and Function for Legged Robots using the Adjoint Method2018/1/1