跳到正文
Hugging Face 每日论文·· 2 天前精选AI 评分58

Memento 3:通过可修订规则手册实现基于模型的递归自我改进

Memento 3: Model-Based Recursive Self-Improvement through Reflective Rulebooks

AI 导读

Memento 3 让冻结参数的 LLM 智能体通过外部记忆持续学习显式世界模型:维护自然语言规则手册作为持久语义记忆,并将其编译为可执行代码用于预测与规划,通过观察、反思、修订、编译与验证的循环,用预测误差同时改进规则手册和代码,更新后的代码需通过 LLM 忠实性判断与逐格回放验证才被接受。

推荐理由

论文给出 ARC-AGI-3 全部 25 个公开游戏通关与 RHAE 100.0 的量化结果,可评估该方法的实际效率。

来源:Hugging Face 每日论文 · huggingface.co