Marios Savvides
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA強化学習/報酬設計
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MetaVLA:効率的な身体性適応のための統合メタ共訓練VLA2025/10/1
多様なタスクを1段階の微調整に統合し、軽量なメタ学習で補助タスクを活用することで、VLAモデルの適応を高速化・低コスト化するフレームワークを提案。
- グラフ思考による報酬進化:強化学習のための二段階言語モデルフレームワーク強化学習/報酬設計2025/9/1
LLMとVLMを組み合わせ、タスクをグラフ構造で分解して報酬関数を自動生成・改良する強化学習フレームワークを提案し、複数のロボット操作タスクで成功率を大幅に向上させた。