Miroslav Bogdanovic
収録論文 12本 ・ フィジカルAI/ロボット学習
拡散ポリシー/強化学習ロボットポリシーsim2realマニピュレーションタスク・モーション計画タスクプランニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DIA: 拡散ポリシー最適化のためのデノイジング中間アドバンテージ拡散ポリシー/強化学習2026/9/10
拡散ポリシーの強化学習ファインチューニングにおいて、各デノイジングステップに中間アドバンテージを割り当てる手法を提案し、複数のロボット操作ベンチマークで性能を向上させた。
- チャンクベースロボットポリシーのための動的実行ホライズン予測ロボットポリシー2026/6/1
固定実行ホライズンに依存するチャンクベースのロボットポリシーに対し、強化学習で軽量な実行ホライズン予測ブランチを学習し、事前学習済みポリシーを凍結したまま動的に実行長を調整する手法を提案。高精度・長時間タスクの成功率を大幅に向上させた。
- MATTERIX:ロボティクス支援化学実験室自動化のためのデジタルツインsim2real2026/1/1
化学実験室の高忠実度デジタルツインを構築するGPU加速マルチスケールロボットシミュレーションフレームワークを提案し、ロボット操作・粉体/液体動力学・熱伝達・化学反応を統合してsim-to-real転移を実証した。
- AnyPlace: ロボット操作のための汎用物体配置学習マニピュレーション2025/2/1
VLMで大まかな配置位置を特定し、合成データのみで訓練したモデルで多様な配置姿勢を予測する2段階手法を提案。実世界の様々な物体形状や配置モードに対応し、高精度な配置を実現。
- タスク・モーション計画のための計画ドメイン自動推論タスク・モーション計画2024/10/1
少数の実演軌道から深層学習と探索で計画ドメインを自動推論し、TAMPの手動設計依存を減らす手法を提案。
- CLIMB: 言語ガイドによる反復モデル構築を伴う継続的タスクプランニング学習タスクプランニング2024/10/1
基盤モデルと実行フィードバックを活用し、自然言語記述からドメインモデルを構築しながら未知の述語を学習・蓄積する継続的タスクプランニング手法を提案。
- ORGANA: A Robotic Assistant for Automated Chemistry Experimentation and Characterization2024/1/1
- Model-free Reinforcement Learning for Robust Locomotion using Demonstrations from Trajectory Optimization2021/7/1
- TriFinger: An Open-Source Robot for Learning Dexterity2020/8/1
- Learning to Explore in Motion and Interaction Tasks2019/8/1
- Learning Variable Impedance Control for Contact Sensitive Tasks2019/7/1
- Leveraging Contact Forces for Learning to Grasp2018/9/1