Abbas Abdolmaleki
収録論文 30本 ・ フィジカルAI/ロボット学習
VLA/強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EXIMO: VLMによるVLAポリシー探索のガイドVLA/強化学習2026/8/20
VLAポリシーの効率的なファインチューニング手法EXIMOを提案。VLMをプランナーとして使い、長期的なタスクを分解してデータ収集し、模倣学習とオフポリシーRLで最適化する。
- Gemini Robotics 1.5:高度な身体性推論・思考・動作転移で汎用ロボットの最前線を押し広げるVLA2025/10/1
異種ロボットデータから学ぶ動作転移機構と自然言語での多段階推論を組み合わせたVLAモデルと、身体性推論に特化したモデルを発表し、複雑な多段階タスクの実行と解釈性を向上させた。
- ゲーム開始:言語モデルを強化学習の実験者として活用するVLA2024/9/1
VLMを用いて強化学習の実験サイクルを自動化し、タスク提案・スキル分解・カリキュラム構築を行うエージェントアーキテクチャを提案した。
- Real-World Fluid Directed Rigid Body Control via Deep Reinforcement Learning2024/2/1
- Offline Actor-Critic Reinforcement Learning Scales to Large Models2024/2/1
- Mastering Stacking of Diverse Shapes with Large-Scale Iterative Reinforcement Learning on Real Robots2023/12/1
- Policy composition in reinforcement learning via multi-objective policy optimization2023/8/29
- RoboCat: A Self-Improving Generalist Agent for Robotic Manipulation2023/6/1
- Leveraging Jumpy Models for Planning and Fast Learning in Robotic Domains2023/2/1
- SkillS: Adaptive Skill Sequencing for Efficient Temporally-Extended Exploration2022/11/1
- How to Spend Your Robot Time: Bridging Kickstarting and Offline Reinforcement Learning for Vision-based Robotic Manipulation2022/5/1
- Revisiting Gaussian mixture critics in off-policy reinforcement learning: a sample-based approach2022/4/21
- Forgetting and Imbalance in Robot Lifelong Learning with Off-policy Data2022/4/1
- Beyond Pick-and-Place: Tackling Robotic Stacking of Diverse Shapes2021/10/1
- Evaluating model-based planning and planner amortization for continuous control2021/10/1
- On Multi-objective Policy Optimization as a Tool for Reinforcement Learning: Case Studies in Offline RL and Finetuning2021/6/1
- From Motor Control to Team Play in Simulated Humanoid Football2021/5/1
- "What, not how": Solving an under-actuated insertion task from scratch2020/10/1
- Data-efficient Hindsight Off-policy Option Learning2020/7/1
- A Distributional View on Multi-Objective Policy Optimization2020/5/1
- Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning2020/2/1
- Continuous-Discrete Reinforcement Learning for Hybrid Control in Robotics2020/1/1
- Augmenting learning using symmetry in a biologically-inspired domain2019/10/1
- Modelling Generalized Forces with Reinforcement Learning for Sim-to-Real Transfer2019/10/1
- Imagined Value Gradients: Model-Based Policy Optimization with Transferable Latent Dynamics Models2019/10/1
- Compositional Transfer in Hierarchical Reinforcement Learning2019/6/1
- Value constrained model-free continuous control2019/2/1
- Simultaneously Learning Vision and Feature-based Control Policies for Real-world Ball-in-a-Cup2019/2/1
- Maximum a Posteriori Policy Optimisation2018/6/1
- Model-Free Trajectory-based Policy Optimization with Monotonic Improvement2016/6/1