Dhruva Tirumala
収録論文 11本 ・ フィジカルAI/ロボット学習
VLA強化学習モデルベース強化学習マルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HuGo: ヒューマノイドの移動操作のための全身ポリシーコードを設計するLLMVLA2026/9/24
LLMがタスク記述から高レベルポリシーコードを生成し、ロールアウトで改良することで、報酬設計や実演なしにヒューマノイドの移動操作を実現する階層的手法を提案。
- 実機ロボットのオンライン強化学習で重要な設計選択とは何か強化学習2026/2/1
3種類のロボットで100回の実機学習を行い、アルゴリズムやシステム、実験設計の各選択を系統的に検証し、安定した学習を実現する設計指針を明らかにした。
- 適応的事前分布を用いた計画学習のためのKL正則化フレームワークモデルベース強化学習2025/10/1
MPPIベースのモデルベース強化学習手法をKL正則化の枠組みで統一的に整理し、プランナの行動分布を事前分布として取り込むPO-MPCを提案した論文。
- 自己中心視覚と深層強化学習によるロボットサッカーの学習マルチエージェント強化学習2024/5/1
自己中心的なRGB視覚のみを入力とし、関節レベルの行動を出力するマルチエージェントロボットサッカーの方策を深層強化学習で訓練し、シミュレーションから実機へ転移することに成功した。
- Replay across Experiments: A Natural Extension of Off-Policy RL2023/11/1
- Learning Agile Soccer Skills for a Bipedal Robot with Deep Reinforcement Learning2023/4/1
- SkillS: Adaptive Skill Sequencing for Efficient Temporally-Extended Exploration2022/11/1
- MO2: Model-Based Offline Options2022/9/1
- Learning Transferable Motor Skills with Hierarchical Latent Mixture Policies2021/12/1
- Data-efficient Hindsight Off-policy Option Learning2020/7/1
- Hierarchical visuomotor control of humanoids2018/11/1