Jinke Ren
収録論文 4本 ・ フィジカルAI/ロボット学習
強化学習/生成ポリシーVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ReFPO: フローマッチングポリシー勾配のためのリフロー正則化強化学習/生成ポリシー2026/6/1
フローマッチングポリシー勾配法に明示的なリフロー正則化を追加したオンライン強化学習手法を提案し、生成ポリシーの学習安定性と性能を向上させた。
- 段階的視覚言語学習による物理的接地を備えた具現化タスク計画VLA2026/3/1
具現化タスク計画のための3段階学習フレームワークSVLLを提案し、空間接地と時間推論を分離してから、専門家軌道へのバイアスを注入するBias-DPOでアライメントを行うことで、物理的に不可能な行動を抑制する。
- RoboMemory: 物理エンボディドシステムにおける対話型環境学習のための脳に着想を得たマルチメモリエージェントフレームワークVLA2025/8/1
脳に着想を得て空間・時間・エピソード・意味記憶を統合したフレームワークを提案し、長期的な計画と対話型学習を実現してEmbodiedBenchで成功率を26.5%向上させた。
- CLEA: 動的環境におけるタスク実行を強化する閉ループ型身体性エージェントVLA2025/3/1
4つのオープンソースLLMを機能分離して組み合わせ、環境記憶に基づく対話型タスク計画とマルチモーダル実行批評による階層的再計画を備えた閉ループ身体性エージェントを提案し、実環境で成功率と完了率を大幅に改善した。