返回主题地图

记忆与上下文

技术方向 · 长期记忆、上下文管理与会话状态 · 共 113 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月5日周六 · 5 条
正文结构化主题已通过公开置信门槛
arXiv cs.AI一手来源研究

PlanFence:分布式 LLM 智能体记忆的依赖范围验证协议

arXiv 论文提出 PlanFence,一种针对分布式 LLM 智能体团队的依赖范围动作验证协议。该协议解决“过期计划执行”问题,即智能体虽读取最新共享状态,但仍基于过时计划行动。PlanFence 要求计划引用精确的公共记录,执行器仅验证影响待执行动作的记录,必要时重新规划或阻止。在 30 个受控工作流中,PlanFence 避免了所有无效动作,而仅检查

正文结构化主题已通过公开置信门槛
MIT Technology Review AI观点

AI 时代的内存与存储架构设计

本文由 Micron 赞助,探讨 AI 推理时代对内存和存储架构的新要求。文章指出,AI 推理工作负载多样且对延迟敏感,数据移动成为新瓶颈,企业需将数据中心视为集成系统,统筹计算、内存、存储和网络。Tirias Research 分析师 Jim McGregor 强调,优化整个网络和了解工作负载至关重要,内存和存储应从后台硬件提升为战略资产。

正文结构化主题已通过公开置信门槛
智东西研究

d-Matrix详解3D-DRAM AI芯片:带宽超100TB/s,能效比HBM高10倍

在Hot Chips 2026大会上,AI推理芯片初创公司d-Matrix详细介绍了其Raptor 3D-DRAM加速器,该芯片采用台积电N4逻辑裸片与3D DRAM面对面堆叠,单卡带宽超100TB/s,能效比HBM高10倍。Raptor通过Stream Blocking、Stream Flipping和Bank Chaining等创新技术解决了带宽浪费、I

正文结构化主题已通过公开置信门槛
NVIDIA Technical Blog一手来源研究

NVIDIA 展示基于 NemoClaw 的记忆驱动智能体提升企业效率

NVIDIA 技术博客介绍了使用 NVIDIA NemoClaw 构建的基于记忆的智能体(Chief of Staff),该智能体通过自模型维护结构化知识层,以提升企业工作流效率。文章展示了该智能体在多个任务上的性能提升,如整体准确率从 82.8% 提升至 90.9%,并分享了五个设计经验,包括上下文维护、证据与知识分离、用户意图优先、用户纠正机制以及安全边

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布

AWS 推出 AgentCore 记忆生命周期管理方案

AWS 在机器学习博客中介绍了 AgentCore 记忆的生命周期管理方案,针对长期运行的 AI 代理(如客服、销售顾问)因记忆累积导致上下文过时和合规风险的问题,提出了基于记忆类型(情景、语义、程序)的三种生命周期策略:TTL 过期、相关性衰减评分和整合修剪。方案使用 AWS Step Functions 和 Amazon Bedrock 实现夜间工作流,

9月2日周三 · 2 条
正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布

Mem0 Python SDK v2.0.20 发布:改进通知与配置验证

Mem0 发布了 Python SDK v2.0.20,主要改进包括:将开源通知配置改为静态可缓存文件,并内置禁用回退,不再依赖 PostHog 功能标志 API,提高了通知的可靠性;同时 RedisDBConfig 改用 Pydantic 原生 extra="forbid" 处理未知字段,保持严格验证并返回标准错误。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

OPPO联合OpenKG推出端侧AI记忆评测基准MobileMem

OPPO联合OpenKG社区及浙江大学、同济大学、东南大学等高校推出行业首个端侧AI记忆评测基准MobileMem,旨在为端侧AI记忆能力提供统一评测标准。该基准覆盖长期事件建模、跨模态推理和持续个性化适应等维度,数据集规模达百万词元,并已发布技术白皮书,后续将开源相关工具。此举有助于推动端侧AI记忆技术的标准化和生态发展。

9月1日周二 · 3 条
正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

Violoop获亿元融资,让AI在真实工作中学会一个人

Violoop完成亿元级天使轮及Pre-A轮融资,投资方包括联想创投、中金保时捷等。其产品为桌面设备,通过HDMI和USB接入电脑,让AI通过视觉和键鼠操作学习用户工作方式,实现个人化自进化。产品计划9月上线,已获约1.2万人预订。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

存算一体进入产业化时刻,谁在领跑规模化交付?

2026年存算一体技术进入产业化阶段,小米、谦合益邦、东方算芯等公司发布或量产相关芯片,后摩智能M50和知存科技实现规模化落地。行业面临工程化、软件工具链和市场三道门槛,不同技术路线(SRAM、RRAM、3D等)竞争激烈,市场预计2030年达312.5亿美元。

正文结构化主题已通过公开置信门槛
arXiv cs.CL一手来源研究

参数化多模态用户记忆:存储字幕无法承载的感知信息

本文提出了一种参数化多模态用户记忆方法,将感知记忆(如声音、面部)以原生模态存储,通过VLM进行指代定位、专用编码器提取身份键,并利用AttMem记忆库以注意力令牌形式存储,无需外部检索。实验表明,该方法在跨年龄、多说话人等场景下显著优于基于文本描述的记忆系统,弥补了纯文本记忆的不足。

8月31日周一 · 2 条
正文结构化主题已通过公开置信门槛
THE DECODER产品发布

长鑫存储首次量产HBM3E,缩小AI内存差距

中国存储芯片制造商长鑫存储(CXMT)首次小批量生产HBM3E高带宽内存,用于AI处理器。该产品比三星、SK海力士和美光落后一代,后者已量产HBM4。阿里巴巴的平头哥和寒武纪正在测试该内存,计划2027年用于产品,这可能缓解美国出口限制对中国AI芯片的影响。CXMT在技术上落后3-5年,良率约25%,其上海IPO募资86亿美元,但未指定用于HBM。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

具身模型全科优秀才能进入百万小时时代,DM0.5登顶RoboDojo

雷峰网报道,香港大学等机构发布的具身智能评测RoboDojo显示,当前头部模型平均成功率仅8.8%,而中国公司原力灵机的通用具身基础模型DM0.5以24.90综合得分和19.34%平均成功率登顶,尤其在记忆维度大幅领先。DM0.5通过原生记忆架构、预训练和微调优化,实现60秒记忆和57毫秒推理延迟,并全面开源,旨在推动行业进入百万小时数据时代。

8月29日周六 · 1 条
正文结构化主题已通过公开置信门槛
智东西商业

AI热潮推动韩国出口增长超60%,存储芯片成核心驱动力

据路透社报道,经济学家预测韩国8月出口同比增长62.6%,主要受存储芯片巨头三星电子和SK海力士推动,全球AI投资热潮推高芯片价格。两家公司第二季度业绩爆发式增长,其中三星半导体营业利润占集团总利润的99.66%。分析师预计半导体出口将维持高增速,但受基数效应影响,未来增速可能回落。

8月28日周五 · 1 条
正文结构化主题已通过公开置信门槛
Strands Agents SDK Releases一手来源产品发布

Strands Agents SDK Python v1.54.0 发布

Strands Agents SDK 发布了 python/v1.54.0 版本,包含多项新功能、修复和文档更新。新功能包括模型路由、会话 ID 属性、外部取消信号注入、文件内存存储等。修复涉及缓存令牌计数、内容块处理、取消信号转发等。该版本提升了 SDK 的灵活性和稳定性。

8月27日周四 · 3 条
正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布

Mem0 发布 DeepSeek 插件 v0.1.1,新增匿名遥测

Mem0 发布了 DeepSeek 插件 v0.1.1,新增匿名使用遥测功能,通过 PostHog 批量收集工具名称、时长、计数和粗略失败类型等事件,不包含查询内容、记忆文本、过滤器或 API 密钥,并支持通过 MEM0 TELEMETRY=false 环境变量选择退出。

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布

Mem0 Strands 集成 v0.1.1 发布,新增匿名遥测

Mem0 发布了 Strands 集成 v0.1.1,新增匿名使用遥测功能,通过现有 PostHog 客户端上报事件,不包含敏感数据,并支持通过环境变量关闭。该版本旨在改进产品监控而不侵犯隐私。

正文结构化主题已通过公开置信门槛
NVIDIA Technical Blog一手来源产品发布

NVIDIA 发布 NVLink Fusion 与 NVHBM,提升定制 AI 基础设施性能

NVIDIA 发布了 NVLink Fusion 和 NVHBM 技术,旨在帮助超大规模企业和 AI 原生公司将其定制 XPU 和 CPU 集成到 NVIDIA AI 基础设施中。NVHBM 是定制 HBM 基底芯片技术,相比标准 HBM4e 可提供高达 30% 的带宽提升、25% 的计算芯片面积增加和 15% 的功耗降低。该技术通过减少内存接口面积和优化功

8月26日周三 · 2 条
正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

Recuris:递归经验-工作记忆演化提升长时程智能体性能

Recuris 提出了一种递归记忆架构,通过工作记忆跟踪任务进度并指导技能选择,利用经验记忆和验证门控的局部更新,提升长时程智能体任务的成功率。在四个基准和十个模型上的测试中,Recuris 在 37 个模型-基准组合中的 35 个上提升了任务成功率,例如在 tau-bench 上为 GPT-5.6 Sol 增加 17.8 分,为 Claude Opus 5

正文结构化主题已通过公开置信门槛
TechCrunch AI产品发布

Anthropic 统一 Claude 聊天与 Cowork 记忆,支持查看编辑

Anthropic 宣布将 Claude 聊天与 Claude Cowork 的记忆系统合并,使 AI 能跨功能记住用户信息,减少重复说明的麻烦。用户现在可以查看、编辑或删除 Claude 保存的记忆,且默认不存储敏感信息,但可手动开启。该更新已默认启用,适用于 Free、Pro 和 Max 套餐的网页、桌面和移动端。

8月25日周二 · 1 条
正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究

基于记忆增强推理的 LLM 智能体群组推荐方法

arXiv 论文提出 AGR,一个基于 LLM 的智能体框架,用于增强群组推荐。AGR 包含记忆模块和推理模块,通过 token 哈希表动态管理用户和群组的历史交互,并执行多步推理以生成可解释的推荐。实验表明,AGR 在 LastFM 和 Douban 数据集上显著优于现有方法,模型已开源。