Haibo Ding
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- StructRL: 長期的視覚-言語-行動タスクのためのオンライン構造化強化学習VLA2026/9/28
長期的なロボット操作タスクを検証可能なサブタスクに分解し、前提条件が満たされた段階で中間報酬を与えるオンライン強化学習フレームワークを提案。VLAモデルのポストトレーニング性能を向上させる。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
長期的なロボット操作タスクを検証可能なサブタスクに分解し、前提条件が満たされた段階で中間報酬を与えるオンライン強化学習フレームワークを提案。VLAモデルのポストトレーニング性能を向上させる。