Pablo Samuel Castro
収録論文 4本 ・ フィジカルAI/ロボット学習
視覚RL/アーキテクチャ強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- V-Simba: 視覚的連続制御におけるRLのアーキテクチャ的可能性を解き放つ視覚RL/アーキテクチャ2026/8/1
状態ベースRLで効果的なSimbaアーキテクチャを視覚RLに応用し、正規化層と点別畳み込みを追加したシンプルなアーキテクチャV-Simbaを提案。DMC、Adroit、Meta-WorldでSOTAと同等以上の性能を達成しつつ、計算効率も向上した。
- 表現学習がマルチタスク深層強化学習のスケーラビリティを実現する強化学習2026/6/4
モデルベース制御ではなく表現学習がマルチタスクRLのスケーラビリティの鍵であると主張し、予測的表現学習と高容量価値関数を組み合わせたモデルフリーアルゴリズムMR.Qを提案・評価した。
- 整列とフィルタリング:非同期オン方策強化学習の性能向上強化学習2026/3/1
分散学習と高頻度更新によるポリシーラグ(データ生成と学習の不整合)を軽減するため、全変動に基づくアドバンテージ整列制約付きポリシー最適化手法を提案し、古典的RLタスクとLLM数学推論タスクで有効性を検証した。
- 単体埋め込みによるActor-Criticエージェントのサンプル効率改善強化学習2025/10/1
Actor-Critic強化学習において、埋め込みを単体構造に制約する軽量な表現層を導入し、サンプル効率と最終性能を向上させる手法を提案。