Christos Ziakas
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 最適Qガイダンスによるフローマップポリシーの整合強化学習2026/5/12
拡散やフローマッチングに基づく生成ポリシーの推論コストを削減するため、任意のジャンプ(1ステップを含む)を学習するフローマップポリシーを提案し、オフラインからオンラインへの強化学習において、批評家のQ値に基づく信頼領域最適化で適応させる手法を導入した。
- 世界モデルによる実行可能な計画への生成動画のグラウンディングVLA2026/2/2
生成動画を計画として使う際の物理的・時間的な不整合を、学習した行動条件付き世界モデルで潜在空間の軌道最適化により実行可能な行動列へ変換する手法を提案。