Rasul Tutunov
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Memento 3: 反省的ルールブックによるモデルベースの再帰的自己改善VLA2026/10/8
凍結したLLMエージェントが自然言語のルールブックを外部記憶として保持し、観察・反省・ルール改訂・コード生成・検証のループを通じて世界モデルを継続的に学習・改善する手法を提案。ARC-AGI-3の全25公開ゲームをクリア。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
凍結したLLMエージェントが自然言語のルールブックを外部記憶として保持し、観察・反省・ルール改訂・コード生成・検証のループを通じて世界モデルを継続的に学習・改善する手法を提案。ARC-AGI-3の全25公開ゲームをクリア。