Ömer Erdinç Yağmurlu
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA模倣学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FLOWER: 効率的な視覚-言語-行動フローポリシーによる汎用ロボットポリシーの民主化VLA2025/9/1
LLM層の削減とモジュラー適応でパラメータを抑えた9.5億パラメータのVLAモデルFLOWERを提案し、200GPU時間の事前学習で大規模モデルに匹敵する性能とCALVIN ABCベンチマークでのSoTAを達成した。
- BEAST: Bスプライン符号化による模倣学習向けアクション系列の効率的トークン化模倣学習2025/6/1
Bスプラインでアクション系列をコンパクトな離散・連続トークンに符号化するトークナイザを提案し、別途学習不要で滑らかな軌道生成と計算コスト削減を実現した。
- 基盤モデルによるゼロショットラベリングでロボット方策学習をスケールさせるVLA2024/10/1
視覚言語基盤モデルを組み合わせ、未整理の長期ロボットデータに自然言語指示を自動でゼロショット付与するNILSを提案し、11.5万軌道以上をラベリングした。
- マルチモーダル拡散トランスフォーマ:マルチモーダル目標から多様な行動を学習マニピュレーション2024/7/1
言語注釈が少ないデータでも、画像と言語の目標指示を統合した潜在表現を自己教師あり学習で獲得し、長期マニピュレーションタスクを高精度に実行する拡散ポリシーを提案。