MemoryForge:为类人LLM智能体合成终身记忆
arXiv 论文提出 MemoryForge 框架,用于为 LLM 智能体合成类人的终身记忆。该框架通过记忆条件化替代传统提示方法,包含上下文生成器、生活组织器和多分辨率模拟器三个组件。实验表明,MemoryForge 生成的记忆库能使冻结的 LLM 在角色扮演和用户模拟任务中表现出更类人的行为。
技术方向 · 长期记忆、上下文管理与会话状态 · 共 113 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
arXiv 论文提出 MemoryForge 框架,用于为 LLM 智能体合成类人的终身记忆。该框架通过记忆条件化替代传统提示方法,包含上下文生成器、生活组织器和多分辨率模拟器三个组件。实验表明,MemoryForge 生成的记忆库能使冻结的 LLM 在角色扮演和用户模拟任务中表现出更类人的行为。
AgentMemBench 是一个用于评估对话式 AI 代理长期记忆管理策略的统一基准,在相同条件下测试了五种策略(ICW、EKV、GEM、CBS、WAM),并使用三个公共数据集和 491 个标注问题进行了评估。结果显示,外部键值存储(EKV)在所有质量指标上表现最佳,尤其在长距离回忆方面显著优于其他策略,但代价是更高的内存占用。研究还评估了 MemGPT/
TransMem 是一种轻量级推理时参数记忆模块,可将冻结的大语言模型(LLM)的稀疏历史隐藏状态转换为可复用的记忆表示,通过门控网络动态干预当前隐藏状态,无需重复编码先前上下文。实验表明,TransMem 在 LoCoMo、HotpotQA 和 MemoryAgentBench 上均取得显著性能提升,验证了稀疏历史隐藏状态作为长上下文 LLM 智能体有效记
Meta AI 研究人员提出了一种双智能体记忆系统,通过一个独立的记忆智能体监控任务进度,并在适当时机向主智能体发送提醒,以解决长任务中的行为状态衰减问题。该系统在 Terminal-Bench 2.0 和 tau2-Bench 基准测试中显著提升了任务完成率,并优于现有记忆系统。
Mastra 发布 2026 年 7 月 28 日更新,AgentController 新增聊天频道支持,可在 Slack、Discord、Telegram 等平台运行持久化代理会话,并支持流式输出、工具审批卡片和打字指示器。MongoDB 向量存储支持自带集合和混合检索(向量+全文)。新增精确元数据过滤、平滑流式传输和更快的沙箱执行。同时包含多项破坏性变更
Agno 发布了 v2.8.4 版本,包含多项修复和新功能。修复了嵌套执行器需求序列化、技能脚本/参考工具中空路径参数的问题;新增了 TrustedRouter 作为 OpenAILike 模型类,并重构了实体记忆以增强第二大脑功能。新贡献者 jperla 首次参与。
Claude 应用更新了记忆功能,将其改为一组独立的分类条目,Claude 在对话中读取和更新这些条目,取代了之前的每日记忆摘要。用户可以通过聊天搜索和记忆功能利用之前的上下文。
Anthropic 发布了 Java SDK 的 2.48.0 版本,主要新增了 agent-memory-2026-07-22 测试版 API 头。该更新为开发者提供了对 agent 记忆功能的早期访问,可能影响基于 Anthropic 模型的 agent 应用开发。
Mastra 发布 2026 年 7 月 1 日更新,新增心跳 API 支持定时调度 agent,引入基于文件系统的 agent 定义与自动注册,增强人机协同的挂起运行发现,并升级观察记忆提取器。同时,InngestAgent 与 DurableAgent 功能对齐,并包含若干破坏性变更,如 Vercel 沙箱导出重命名。
微软研究院发布了 Memora,一种面向长期任务 AI 代理的可扩展记忆系统,通过解耦存储内容与检索方式,平衡抽象与具体性,显著提升代理效率。Memora 在 LoCoMo 和 LongMemEval 基准上达到最先进性能,相比全上下文推理减少高达 98% 的 token 使用。该论文发表于 ICML 2026,代码已在 GitHub 开源。
Claude 在 Enterprise 计划中推出记忆功能,能够记住聊天中的相关上下文并生成记忆摘要。用户可通过隐身聊天排除特定对话不被记忆。
Claude 应用更新,为 Team 计划用户提供记忆功能,并面向免费、Pro、Max 和 Team 计划推出隐身聊天模式。Claude 现在可以记住聊天中的相关上下文并生成记忆摘要,隐身聊天可让用户将对话排除在记忆之外。
微软发布了 AutoGen Python 库的 v0.7.2 版本,主要更新包括将 DockerCommandLineCodeExecutor 设为 MagenticOne 团队的默认执行器,为 CodeExecutorAgent 添加 approval func 选项,支持 OpenAI 模型客户端的 parallel tool call 配置,以及修复结