返回主题地图

记忆与上下文

技术方向 · 长期记忆、上下文管理与会话状态 · 共 113 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月26日周六 · 1 条
正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源开源8

Mem0 Python SDK v2.2.1 修复核心与向量存储缺陷

Mem0 发布 Python SDK v2.2.1,集中修复核心、LLM 与向量存储三方面的缺陷。核心层面,add() 不再把向量库拒绝的记录当作成功写入,全部失败时抛出 VectorStoreError,并恢复 Memory/AsyncMemory 的上下文管理器协议。LLM 层面修复 AWS Bedrock Anthropic 路径读取 Claude 推

9月24日周四 · 8 条
正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究2

SpeakerMem-R1:面向多方对话的说话人中心双轨记忆

研究者提出 SpeakerMem-R1,一种以说话人为中心的双轨记忆框架,用于多方对话中的长期记忆。其双轨记忆分别存储带说话人标注的逐字消息和派生状态,并按人物级与群组级视图组织,查询时按实体、事件和时间融合两轨证据。团队用 SpeakerLevenshtein 奖励和说话人条件 GRPO 训练 Writer-R1(基于 Qwen2.5-3B),在 Grou

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究1

过去塑造未来:自回归视频生成中的记忆机制综述

该论文针对自回归视频生成中因上下文窗口、存储和计算受限而导致历史信息(如实体身份、动态状态、干预引发的因果变化)过早丢失的问题,将记忆机制系统化为跨自回归步骤持久保存并能影响后续生成的历史信息。作者从形式、功能、操作、学习和评估五个互补视角综述了相关文献,并总结了可组合且资源感知的记忆架构、可信状态更新、自回归学习与标准化评估等开放挑战,为构建可靠的记忆条件

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布2

Mem0 发布 Pi Agent 插件 v0.3.2,优化记忆搜索策略

Mem0 发布 Pi Agent Plugin v0.3.2,主要调整记忆检索策略:不再要求 agent 在回答任何可能依赖先前上下文的问题前都先搜索,也不再要求每个问题执行多次搜索,改为在重复调查或先前决策、修复、命令、结果可能有帮助时再搜索。context-loader 技能从 2-4 次并行搜索改为单次搜索,并复用其他编码 agent 插件的搜索技能描

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布2

Mem0 发布 OpenClaw 插件 v1.2.1,调整 memory search 工具描述

Mem0 发布 OpenClaw 插件 v1.2.1,主要改进 memory search 工具的描述文案:不再要求 agent 主动搜索或对多部分问题执行多次搜索,改为在重复调查或需要参考此前决策、修复、命令、结果时先搜索。召回策略 smart、always、manual 保持不变。

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布2

Mem0 发布 OpenCode 插件 v0.4.1,精简记忆搜索提示词

Mem0 发布 OpenCode 插件 v0.4.1,主要调整了记忆搜索的提示词与技能行为。search memories 工具描述不再要求 agent 主动搜索或对多部分问题执行多次搜索,改为在重复调查或需要参考先前决策、修复、命令、结果时搜索。同时移除了两条要求并行搜索的系统上下文,/mem0-search 与 /mem0-context-loader

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源API 更新2

Mem0 Node SDK v3.3.0 新增用户画像功能

Mem0 发布 Node SDK v3.3.0,在 MemoryClient 中新增用户画像(User Profiles)功能,包括 getProfile、generateProfile、getProfileSettings、updateProfileSettings、sampleProfiles 和 getProfileJob 等方法。用户画像是由项目级

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源API 更新2

Mem0 Python SDK v2.2.0 新增用户画像功能

Mem0 发布 Python SDK v2.2.0,为 MemoryClient 和 AsyncMemoryClient 新增用户画像(User Profiles)功能,包括 get profile、generate profile、get profile settings、update profile settings、sample profiles 和

正文结构化主题已通过公开置信门槛
Google DeepMind News一手来源产品发布2

Google DeepMind 为 Private AI Compute 引入安全服务端记忆

Google DeepMind 发布 Private AI Compute 架构的技术更新,将私密、服务端记忆引入其平台。该方案通过加密存储与仅存于用户设备的密钥,实现跨设备的持久化 AI 记忆,同时保持设备端级别的隐私标准。数据在云端安全隔离区(secure enclave)中临时解密处理并立即重新加密,使 Google 自身也无法访问用户数据。

9月23日周三 · 4 条
正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布2

Convergent Intelligence 发布 SymbioticLM-14B 符号-Transformer 混合模型

Convergent Intelligence LLC 研究部门在 Hugging Face 发布 SymbioticLM-14B,一个基于 Qwen3-14B 的符号-Transformer 混合模型,声称拥有 178 亿参数、4096 个持久符号记忆状态及多种符号处理模块。该模型定位为实验性研究检查点,作者明确表示能力描述仅为架构意图而非基准测试结果。模

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布2

Convergent Intelligence 发布符号-神经混合模型 Symbiotic-Beta

Convergent Intelligence LLC 在 Hugging Face 发布实验性模型 Symbiotic-Beta(SymLM),基于 Qwen2.5-0.5B 冻结主干,融合符号认知模块(DTE-HDM、M.A.S.R.M、QwenExoCortex 等),在 MetaMathQA 的 2.5 万条样本上微调,面向数学推理与神经符号研究。模

正文结构化主题已通过公开置信门槛
Hugging Face Blog一手来源开源1

funes:基于 Lance 的编码智能体本地记忆

Hugging Face 发布 funes,一个为编码智能体提供本地记忆的工具,基于 Lance 数据集构建。它把 Claude Code、Codex、pi 和 Hermes 的历史会话轨迹索引到一个本地 Lance 数据集中,并提供 recall 和 get 工具让智能体在需要旧上下文时检索原始片段。索引过程完全本地、确定性,不经过 LLM 摘要,并支持凭

正文结构化主题已通过公开置信门槛
arXiv cs.MA一手来源研究1

执行溯源何时有助于智能体记忆检索?

该论文研究语言智能体在上下文窗口受限时,如何从执行历史中检索完整证据。作者提出将智能体记忆检索形式化为「预算内证据补全」问题,并构建 Execution Provenance Graph Memory(EPGM),用零初始化残差 R-GCN 在工具参数与输出的溯源单元上精炼稠密检索分数。在 ISETrace 的 2,000 条查询上,溯源单元相比固定 512

9月22日周二 · 4 条
正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布1

Reactiv 用 Amazon Bedrock AgentCore 将移动电商自动化提速 80%

Reactiv 为 Shopify 商家提供原生移动应用产品,利用 Amazon Bedrock AgentCore 构建了一个由三个 agent 组成的 AI Scheduler,可按计划自动更新商家应用首页和促销内容。该方案将商家配置时间减少 80%,上线速度提升 33%,并借助 AgentCore 的托管运行时、持久记忆、原生 MCP 托管和多租户隔离

正文结构化主题已通过公开置信门槛
arXiv cs.CL一手来源研究

面向个人记忆检索的零推理前瞻性记忆项

论文提出一种零推理成本的"前瞻性记忆检索"机制:将用户的承诺以带日期或触发条件的条目存入显式账本,当条目触发时,与之关联的记忆项获得显著性加成,并以乘法方式融入基于嵌入的检索,从而在查询时不运行任何模型。在仿照 TriggerBench 结构构建的合成任务集(48 段盲写对话、175 个任务)上,该机制将困难层的 recall@5 从 0.000 提升至默认

正文结构化主题已通过公开置信门槛
智东西商业

2026全球AI芯片峰会上海落幕:智能体时代CPU回归与3D存算成焦点

2026全球AI芯片峰会在上海落幕,由智东西发起、智猩猩主办,超过60位嘉宾围绕架构创新、3D堆叠、存算一体、HBF新型存储、智能体推理等议题展开分享。英特尔高宇提出智能体时代CPU重回C位,并预告将展示单机柜承载5万Agent的高密度CPU机柜;后摩智能、奎芯科技、东方算芯、亿铸科技等企业分别披露3D CIM、定制内存、软件定义芯片、通用存算一体等进展。大

正文结构化主题已通过公开置信门槛
智东西产品发布

一文看懂昇腾超节点:AI Infra已进入系统工程阶段

华为在HC2026大会上发布昇腾960超节点,基于灵衢+Hi-ONE打造,将4096颗算力卡通过统一内存编址融合为一台逻辑上的超级计算机,提供8EFLOPS FP8算力。华为副董事长汪涛称超节点是10T级参数大模型时代AI基础设施的必然选择,并称Hi-ONE是业界首个量产的NPO产品。文章还介绍了《超节点定义与实践白皮书》对超节点的界定,以及灵衢Unifie

9月19日周六 · 1 条
正文结构化主题已通过公开置信门槛
智东西商业

曝长鑫存储进军NAND闪存市场,市值逼近6万亿元

据路透社报道,三位知情人士透露中国DRAM头部厂商长鑫存储正准备进入NAND闪存市场,计划在北京新工厂建立NAND研发生产线并设立研究院,将与三星、SK海力士、美光等全球存储龙头竞争。此举背景是全球内存芯片持续短缺,AI服务器需求爆发推动行业进入紧缺周期,主要厂商资本支出优先投向DRAM和HBM,限制了NAND产能扩张。长鑫已与客户讨论NAND计划,包括一家

9月18日周五 · 1 条
正文结构化主题已通过公开置信门槛
Latent Space商业

AINews:Claude Code Projects、Gemini 托管智能体与 Jev 分类模型

本期 AINews 汇总了 2026 年 9 月 16-17 日 AI 动态:Anthropic 在 Claude Code 中推出 Projects,支持单次对话派生多个云端并行会话并跨线程传递上下文;Google 更新 Gemini 托管智能体,新增基于 Antigravity 的 harness 以及 Credentials API 和 Files A

9月16日周三 · 1 条
正文结构化主题已通过公开置信门槛
量子位观点

把记忆交给CPU,大模型会变快

量子位报道,随着Coding Agent等长任务普及,KV Cache占用显存导致并发下降、TTFT升高。英特尔提出以CPU侧管理、分层存储和QAT硬件压缩为核心的KV Cache优化方案,包括KV Shrink、KV Fuse、KV Cascade和KV Infinity四个方向。测试显示KV Shrink在80%缓存命中率下TTFT最高约5倍加速,QAT