Andrey Polubarov
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Vintix: 文脈内強化学習による汎用行動モデルVLA2025/1/1
文脈内強化学習(ICRL)をスケールさせるため、クロスドメインで動作する固定の行動モデルを構築し、アルゴリズム蒸留が専門家蒸留に代わる有効な手法であることを示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
文脈内強化学習(ICRL)をスケールさせるため、クロスドメインで動作する固定の行動モデルを構築し、アルゴリズム蒸留が専門家蒸留に代わる有効な手法であることを示した。