Zhaokun Yue
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- R²-WAM:World Action Modelのための修復・棄却ポストトレーニングVLA2026/10/4
映像予測モデルを「入力行動と整合する未来を予測するよう修復」し、その予測を使って劣った行動サンプルを棄却・負例微調整することで、環境との追加対話なしに方策を改善する手法。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
映像予測モデルを「入力行動と整合する未来を予測するよう修復」し、その予測を使って劣った行動サンプルを棄却・負例微調整することで、環境との追加対話なしに方策を改善する手法。