Ji-Rong Wen
収録論文 3本 ・ フィジカルAI/ロボット学習
LLMエージェント強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LLMエージェントのための世界モデル再考:エージェント編集型世界モデルLLMエージェント2026/9/23
LLMエージェントのタスク状態汚染を防ぐため、ツール応答の予測ではなく推論と行動が将来の進捗をどう形作るかをモデル化し、ノイズの多い推論・行動を編集するAEWMを提案。
- Robo-ValueRL: オフラインからオンラインへの強化学習における信頼性の高い価値推定強化学習2026/7/1
オフラインからオンラインへの強化学習において、価値関数の信頼性がポリシー最適化に与える影響を分析する統一フレームワークを提案し、信頼性の高い価値推定が下流の性能向上に寄与することを実験で示した。
- 初心者から熟練者へ:ステップ単位強化学習によるLLMエージェントの政策最適化VLA2024/11/1
専門家とエージェントの行動を比較して中間報酬を自動生成し、ステップ単位の強化学習でLLMエージェントを効率的に訓練する手法StepAgentを提案。