Guoqing Wang
University of Electronic Science and Technology of China
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA強化学習オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GeoAAC: VLAポリシーのノイズ除去軌道の幾何に基づく適応的アクションチャンキングVLA2026/9/17
フローベースVLAポリシーにおいて、ノイズ除去軌道の幾何情報から予測信頼性を推定し、追加学習なしでアクションホライズンを適応的に決定する手法を提案。シミュレーションと実機で成功率を改善。
- 非専門家の観測データからの効果的なサブゴール誘導による目標到達方策学習強化学習2024/9/1
非専門家の行動なし観測データから長期的な目標到達方策を学ぶため、拡散モデルでサブゴールを生成し、状態-目標価値関数で効率的な探索を促す手法を提案した。
- 拡散モデルを最適化器として活用するオフライン強化学習の効率的計画法オフライン強化学習2024/7/1
拡散モデルのサンプリングを軌道生成と最適化に分離し、自己回帰モデルで高速に実行可能な軌道を生成しつつ拡散モデルで最適化することで、オフライン強化学習の計画を3〜10倍高速化した。