Maks Sorokin
RAI Institute
収録論文 11本 ・ フィジカルAI/ロボット学習
強化学習移動操作ロコ操作全身マニピュレーションマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 報酬を観測として:迅速な適応のための報酬ベース方策の学習強化学習2026/9/30
報酬と行動のみを条件とする方策を提案し、観測空間が全く異なる環境へのゼロショット適応を実現した。
- SMPCデモからのスパースオフライン・オンラインRLによる移動操作学習移動操作2026/8/1
シミュレーション内のSMPCを自動エキスパートとして用いて大規模オフラインデータを生成し、スパース報酬のみでオフポリシーRLエージェントを訓練することで、移動操作タスクを効率的に学習する手法を提案。低レベル安定化コントローラと統合し、教師を超える性能を実現。
- Sumo: 動的かつ汎用的な全身ロコ操作ロコ操作2026/4/1
事前学習した全身制御ポリシーをテスト時にサンプルベースのプランナーで操縦することで、脚式ロボットが大型・重量物を動的に操作できるようにするsim-to-real手法を提案。実機のSpotでタイヤの直立やバリアの引きずり等を実証し、シミュレーションで人型ロボットへの汎用性も示した。
- AdaptManip: オンライン再帰的状態推定による適応的な全身物体持ち上げ・運搬の学習全身マニピュレーション2026/2/1
ヒューマノイドが強化学習のみで物体の持ち上げと運搬を自律的に行う枠組みを提案し、再帰的物体状態推定とLiDAR自己位置推定を組み合わせて実機でゼロショット動作を実現した。
- Jacta: 器用な全身マニピュレーションを学習するための汎用プランナマニピュレーション2024/8/1
器用な手先と全身を使う複雑なマニピュレーションタスク向けに、強化学習のデモンストレーションを自動生成する柔軟な動作プランナを提案し、実機への転移も示した。
- On Designing a Learning Robot: Improving Morphology for Enhanced Task Performance and Learning2023/3/1
- Relax, it doesn't matter how you get there: A new self-supervised approach for multi-timescale behavior analysis2023/3/1
- Human Motion Control of Quadrupedal Robots using Deep Reinforcement Learning2022/4/1
- Learning to Navigate Sidewalks in Outdoor Environments2021/9/1
- A Few Shot Adaptation of Visual Navigation Skills to New Observations using Meta-Learning2020/11/1
- Learning Human Search Behavior from Egocentric Visual Inputs2020/11/1