Dmitry Makarov
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションモバイルマニピュレーションモデルベース強化学習ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 知識誘導型マルチタスク強化学習による操作制御マニピュレーション2026/3/1
部分観測環境下でのロボット操作タスクに対し、3Dシーングラフと知識グラフを強化学習に統合し、視覚・言語・グラフ情報を共有潜在空間で扱うことで、成功率・サンプル効率・汎化性能を向上させるフレームワークを提案した。
- 心と動きの統合:モバイルマニピュレーションにおけるタスク計画と低レベルポリシーのためのIsaacSimベンチマークモバイルマニピュレーション2025/8/1
Isaac Sim上に構築したキッチン環境で、言語指示に基づくタスク計画と低レベル制御を統合評価するベンチマークKitchen-Rを提案し、VLMベースの計画と拡散ポリシーによる制御のベースラインを提供した。
- M3PO: 大規模マルチタスクモデルベース方策最適化モデルベース強化学習2025/6/1
観測再構成を不要とする暗黙的世界モデルと、モデルベース計画とモデルフリーの不確実性ボーナスを組み合わせた探索戦略により、マルチタスク強化学習のサンプル効率と汎化性能を向上させる手法を提案。
- SGN-CIRL: シーングラフに基づくカリキュラム・模倣・強化学習を用いたナビゲーションナビゲーション2025/6/1
オープン語彙の3Dシーングラフ表現を強化学習に組み込み、模倣学習とカリキュラム学習で訓練を安定化させた地図なしロボットナビゲーション手法を提案し、Isaac Simでの実験で難易度の高いナビゲーション成功率を向上させた。
- TOCALib: 双腕マニピュレーションと障害物回避のための補間付き最適制御ライブラリマニピュレーション2025/4/1
2台のロボットマニピュレータ向けに、衝突判定を勾配ベース最適化に組み込んだ最適軌道ライブラリTOCALibを構築し、Mobile Alohaでの双腕操作例を示した研究。
- Benchmarking the Full-Order Model Optimization Based Imitation in the Humanoid Robot Reinforcement Learning Walk2023/12/1
- Combining Safe Interval Path Planning and Constrained Path Following Control: Preliminary Results2019/6/1