跳到正文
原文
Hugging Face Daily Papers·· 2 天前AI 评分54

Memento 3 通过反思式规则手册实现基于模型的递归自我改进

Memento 3: Model-Based Recursive Self-Improvement through Reflective Rulebooks

AI 导读

Memento 3 提出让冻结 LLM 智能体通过外部记忆持续学习显式世界模型的方法。智能体维护自然语言规则手册,将其编译为可执行代码,并通过观察、反思、规则修订、编译和验证循环,用预测错误改进规则与代码;代码更新需由 LLM 判断忠实于规则手册,并用 cell-exact replay 复现已观察转移。

来源:Hugging Face Daily Papers · arxiv.org