Yijiang Li
収録論文 4本 ・ フィジカルAI/ロボット学習
ビデオ生成RL世界モデル動画推論強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CreFlow: スパース報酬の身体化ビデオ拡散強化学習のための修正リフロービデオ生成RL2026/5/14
ビデオ生成モデルを強化学習で微調整する際、線形時相論理に基づく報酬モデルと、報酬関連領域のみを更新する新しい枠組みを提案し、操作タスクの成功率を向上させた。
- ThinkJEPA:大規模視覚言語推論モデルで潜在世界モデルを強化世界モデル2026/3/1
VLMの長期的な意味推論とJEPAの密な動力学モデリングを二重時間経路で統合し、手の操作軌道予測の精度を向上させた研究。
- 超大規模動画推論スイート動画推論2026/2/1
200種類の推論タスクと100万本以上の動画からなる大規模データセットVBVRと、ルールベースで検証可能な評価ベンチマークVBVR-Benchを構築し、動画推論のスケーリング則と未見タスクへの汎化の兆候を示した。
- RN-D: オンポリシー強化学習のための離散化カテゴリカルアクター強化学習2026/1/1
連続制御のオンポリシー強化学習において、ガウス分布アクターの代わりに各行動次元を離散ビン上の分布として表現するカテゴリカルアクターと正則化ネットワークを組み合わせ、ベンチマークで最先端性能を達成した。