Takayuki Osa
収録論文 13本 ・ フィジカルAI/ロボット学習
強化学習クロスエンボディメント/オフラインRLオフライン強化学習マルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 階層的スキルポリシーの学習:オフライン品質多様性強化学習によるアプローチ強化学習2026/8/20
事前収集データから多様で高品質なスキルを抽出し、オンライン学習を強化する統合パイプラインQDOSを提案。アドバンテージ重み付き品質多様性事前学習とデータ再利用戦略により、操作タスクで優れた性能を達成。
- 大規模強化学習におけるアンサンブル方策勾配法のポリシー多様性の再考強化学習2026/3/1
アンサンブル方策勾配法において、ポリシー間の多様性をKL制約で調整するCoupled Policy Optimizationを提案し、探索効率と最終性能を向上させた。
- 異種ロボットデータセットのためのクロスエンボディメント・オフライン強化学習クロスエンボディメント/オフラインRL2026/2/1
多様なロボットの軌道データを統合して汎用制御則を事前学習するオフライン強化学習手法を分析し、形態類似性でグループ化する勾配更新戦略を提案した。
- 最適輸送写像によるWasserstein正則化を用いたオフライン強化学習オフライン強化学習2025/7/1
オフライン強化学習において、入力凸ニューラルネットワークで最適輸送写像をモデル化し、Wasserstein距離による正則化を敵対的学習なしで安定に計算する手法を提案。D4RLベンチマークで既存手法と同等以上の性能を示した。
- オンライン強化学習におけるベルマン最適作用素からベルマン作用素への段階的遷移強化学習2025/6/1
連続行動空間のアクター・クリティック強化学習において、ベルマン最適作用素を徐々にベルマン作用素へと切り替えるアニーリング手法を提案し、学習加速と過大評価バイアスの抑制を両立させた。
- 構造的な非定常性を持つデータセットからのオフライン強化学習オフライン強化学習2024/5/23
エピソード間で遷移・報酬関数が徐々に変化するオフラインデータセットに対し、対照予測符号化で非定常性を特定し方策学習に活かす手法を提案した。
- 多様な協調行動と敵対的スタイルサンプリングによるマルチエージェント強化学習の介助タスクにおける方策のロバスト化マルチエージェント強化学習2024/3/1
介助タスクを介護者と被介護者のマルチエージェント強化学習として定式化し、多様な被介護者応答を学習させつつ敵対的にサンプリングすることで、介護者方策のロバスト性を向上させるフレームワークを提案した。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Motion Planning by Learning the Solution Manifold in Trajectory Optimization2021/7/1
- Learning the Solution Manifold in Optimization and Its Application in Motion Planning2020/7/1
- Multimodal Trajectory Optimization for Motion Planning2020/3/1
- Goal-Conditioned Variational Autoencoder Trajectory Primitives with Continuous and Discrete Latent Codes2019/12/1
- An Algorithmic Perspective on Imitation Learning2018/11/1