Mitsuhiko Nakamoto
収録論文 5本 ・ フィジカルAI/ロボット学習
ロボット学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OGPO: 生成制御ポリシーのサンプル効率的な完全ファインチューニングロボット学習2026/5/1
拡散やフローベースの生成制御ポリシーを、オフポリシーな批判ネットワークとPPO目的関数を用いて効率的にファインチューニングする手法OGPOを提案し、操作タスクで最先端の性能を達成した。
- 拡散ポリシーを潜在空間強化学習で操縦するVLA2025/6/1
拡散ポリシーの潜在ノイズ空間に強化学習を適用し、実世界で効率的に自律適応させる手法DSRLを提案。
- 汎用ロボット基盤モデルを価値誘導で操る:V-GPSVLA2024/10/1
オフライン強化学習で学習した価値関数を用いて汎用ロボット方策の行動を再ランク付けし、微調整なしで性能を向上させる手法を提案。
- Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models2023/10/1
- Pre-Training for Robots: Offline RL Enables Learning New Tasks from a Handful of Trials2022/10/1