Claude Cowork 新增记忆功能及敏感主题设置
Claude 应用发布更新,在 Claude Cowork 中引入记忆功能,支持跨聊天和 Cowork 使用,用户可在设置中查看、编辑或删除记忆主题,并新增敏感主题开关。该功能默认对 Free、Pro 和 Max 计划开启,对 Team 和 Enterprise 组织默认关闭。
另有 1 家信源报道
技术方向 · 长期记忆、上下文管理与会话状态 · 共 113 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Claude 应用发布更新,在 Claude Cowork 中引入记忆功能,支持跨聊天和 Cowork 使用,用户可在设置中查看、编辑或删除记忆主题,并新增敏感主题开关。该功能默认对 Free、Pro 和 Max 计划开启,对 Team 和 Enterprise 组织默认关闭。
另有 1 家信源报道
Mem0 发布了 Node SDK v3.1.7,主要修复了多个 bug 并提升了安全性。修复包括 Redis 和 Valkey 向量存储中返回字段的 snake case 一致性、内存嵌入缓存查找的继承属性问题、客户端 getAll() 分页参数处理,以及为 Bedrock LLM 配置添加 providerOverride。此外,通过 pnpm over
Mem0 发布了 Python SDK v2.0.19,主要包含多项 bug 修复。修复了 HuggingFaceEmbedding 在未配置 API key 时无法初始化 TEI 端点的问题,以及 remove code blocks 处理列表内容时的错误。此外,create procedural memory 在 LLM 无输出时抛出明确错误,mem0.
英伟达新一代Vera Rubin Ultra NVL144机柜采用LPDDR5X内存,其总成本已超过HBM,引发关注。LPDDR5X原本用于手机,现因AI工作负载需求被引入服务器,并通过SOCAMM2模块化设计提升性能。供应紧张导致价格飙升,英伟达被迫考虑削减配置,影响AI系统交付。
本文介绍了 PrimeAgentOrchestrator (PAO),一个为个人 AI 基础设施设计的系统,能够在启动时从用户的异构记忆后端(PostgreSQL 和 Cloudflare Worker 语义搜索)并行检索相关信息,并通过文件系统注入预加载到新生成的 Claude Code 编码代理中。PAO 管理代理的完整生命周期,包括信任预置、就绪轮询和
arXiv 论文提出 RecVerse,一种基于 GUI 的购物行为模拟智能体,通过截图感知页面并生成多轮轨迹。它采用认知启发的分层记忆(工作记忆、情景记忆、偏好记忆)解决长会话记忆挑战,并用轨迹级强化学习优化整体行为分布和购物意图。实验表明 RecVerse 在行为保真度和意图一致性上优于现有基线,并发布了 USB 基准数据集。
英伟达通知部分大客户,明年初交付的AI服务器价格将上涨15%以上,涉及Grace Blackwell和Vera Rubin系列,部分系统涨幅约17%。涨价主因是内存芯片成本飙升,HBM挤压DRAM产能,导致服务器DRAM和NAND价格大幅上涨。一座1GW级AI数据中心可能因此增加至少50亿美元建设成本。英伟达还投资了数据中心基础设施开发商Cloverleaf
llama.cpp 发布 b10584 版本,主要修复了 draft 模型上下文大小与目标上下文不匹配的问题,并优化了内存适配逻辑。该版本还引入了可选的第二模型支持,使 draft 或 MTP 上下文的内存测量更精确,同时移除了服务器中的预留块。
雷鸟发布iO AI眼镜,重34克,续航两天,搭载DeepSeek和千问大模型,支持全天候记忆、翻译等功能,售价2499元起。产品无摄像头和扬声器,聚焦知识、表达和记忆场景。同场还发布V4 AI拍摄眼镜32GB版本,售价1999元。
Strands Agents SDK 发布了 TypeScript 版本的 v1.14.0 更新,包含多项新功能、修复和文档改进。主要新功能包括音频内容块、文件内存存储、上下文管理器卸载策略、工具上下文中的执行范围取消、代理作为工具委托、MCP 客户端 OAuth 认证以及 Anthropic 提示缓存支持。修复了多个与 Bedrock 缓存、多代理令牌计数
谦合益邦宣布其全球首款4层3D DRAM堆叠存算一体芯片成功回片并点亮,标志着该技术从验证进入工程落地阶段。该芯片采用自研三维集成原生计算架构,实现计算与存储深度融合,访存带宽提升一个数量级,功耗和延时降低一个数量级。公司由网易孵化,近期完成超20亿元B轮融资,将推动云游戏等场景的硬件加速。
腾讯云在2026 DTCC中国数据库技术大会上发布面向AI时代的数据底座TDSQL Nexa,统一连接企业多源数据,为Agent提供业务语义理解和权限治理能力。同时公布多项AI数据库能力已进入生产环境,包括TDSQL-C服务50万开发者、Agent Memory开源80天获2万GitHub Stars、DatabaseClaw在头部客户规模化使用。腾讯云副总
AI新闻汇总报道了内存价格在12个月内上涨500%,128GB DDR5套件价格达到历史最低价的十倍,超大规模买家已锁定2027年全球DRAM产能。OpenAI暂停部分前沿强化学习训练两周以加强安全控制,Qwen3.8-27B成为本地模型焦点,GLM-5.3发布并强调后训练提升,Mojo开源,NVIDIA推出TensorRT Model Connect。
该研究探讨了跨模型冻结记忆迁移的有效性,发现仅冻结记忆内容不足以实现迁移,目标侧读取器的适配至关重要。实验表明,通过训练轻量级读取器,冻结记忆可显著提升不同目标模型的性能,相对困惑度降低最高达15.7%。研究提出Engram式哈希记忆可作为可重用的外部知识工件,但需目标模型具备兼容的读取接口。
BCMT(Blockwise Causal Memory Transformer)是一种新型Transformer架构,通过将局部token交互与全局上下文传播解耦,利用指数因果记忆机制高效建模长距离依赖。实验表明,在长达1024 token的语言建模任务中,BCMT在验证性能上与密集Transformer相当,同时显著提升训练吞吐量并降低内存消耗。该架构无
OpenAI 推出了名为“Computer History”的新功能,通过 macOS 辅助功能记录用户的点击、按键和应用切换等交互事件,生成可搜索的时间线,供 ChatGPT 和 Codex 作为上下文使用。该功能取代了之前的“Chronicle”预览版,不捕获屏幕截图或音频,且需要管理员和用户双重同意。OpenAI 警告存在提示注入风险,并建议敏感应用暂
3D存算一体芯片企业谦合益邦完成超20亿元B轮融资,投资方包括国调基金、中国移动链长基金等。该公司由网易孵化,专注于三维集成原生芯片架构和3D DRAM存算一体芯片,旨在突破内存墙瓶颈。融资将用于加大研发投入,推动产品迭代与商业化。
MARCH 是一种新型网络架构,通过周期性缓存循环状态检查点作为状态锚点,并利用内容条件锚键进行注意力聚合,从而在保持计算效率的同时扩展状态空间模型的记忆容量。实验表明,MARCH 在常识推理、LongBench 和上下文检索任务上优于多种线性注意力变体,显著增强了循环模型的长距离记忆能力。
Spatial Memory Agent (SMA) 提出了一种无需参数更新的框架,通过经验驱动的自我进化提升冻结视觉语言模型的空间推理能力。SMA 在可验证环境中利用验证器引导的反思,将空间经验提炼为可迁移的教训,并分配转移可靠性评分以优化检索。在五个空间基准和四个基础模型上,SMA 取得了最佳或接近最佳的性能,展示了无需外部工具的参数更新自由路径。
llama.cpp 发布 b10419 版本,主要针对 OpenVINO 后端进行了多项优化和修复。新增了对 Qwen3.5、GPT-OSS MoE 和 MXFP4 的支持,并修复了 NEOX RoPE 在 GPU 状态模式下的精度问题。此外,通过引入 GGML OPENVINO RELEASE WEIGHTS 选项和流式权重重量化,显著降低了 GPU 推理