Mem0 发布 DeepSeek 插件 v0.3.0,增强记忆自动召回与捕获
Mem0 发布了 DeepSeek 插件 v0.3.0,新增了在系统提示组装期间自动召回记忆、在对话回合完成后自动捕获记忆的功能,并默认启用 autoRecall 和 autoCapture。该插件现在以独立的 ESM 包形式发布,并支持跨用户覆盖需显式开启。
公司与模型 · DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与能力的搅局者
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03
Mem0 发布了 DeepSeek 插件 v0.3.0,新增了在系统提示组装期间自动召回记忆、在对话回合完成后自动捕获记忆的功能,并默认启用 autoRecall 和 autoCapture。该插件现在以独立的 ESM 包形式发布,并支持跨用户覆盖需显式开启。
vLLM 发布 v0.29.0 版本,包含 594 个提交,来自 277 位贡献者。主要亮点包括 Model Runner V2 成为所有模型的默认执行器,新增多个模型支持(如 Hy4-preview、Qwen3.8-Flash-Next、GraniteSWA 等),并针对 Kimi K3 和 DeepSeek V4 进行了性能优化。此外,该版本引入了新的默
llama.cpp 发布 b10844 版本,为 Vulkan 后端添加了 DeepSeek-V4 超连接融合算子(DSV4 HC COMB/PRE/POST),将 Sinkhorn 迭代等操作融合到寄存器中,大幅减少调度次数,提升解码性能。该版本还包含多个平台的二进制构建。
openJiuwen社区的ScienceDiscovery平台通过树搜索驱动RSI,在不训练模型、不调参数的情况下,自动迭代科研代码,实现加速科学发现。在振荡积分、超几何函数求值、代码加速和符号回归等案例中,ScienceDiscovery在数小时内生成通用求解器,显著提升性能并降低成本。该平台提供可复用的底座,支持异步并发和多种搜索策略,旨在将验证成本低的
在IFA 2026上,NVIDIA联合微软及合作伙伴宣布加速本地AI推理,推出RTX Spark迷你PC,并简化Hermes Agent、OpenClaw和Perplexity Portable Computer等应用的本地模型设置。同时发布了多项模型更新,包括Nemotron 3.5 Lightning、GLM-5.3-Flash、Qwen3.8系列等,并
陈大年复出创立本地模型公司StartLux,推出首款27B参数模型StartLux-V1.0-27B-Preview,在信通院MCP专项测试中综合得分排名第二,仅次于DeepSeek-V4-Pro。该模型可运行于消费级PC,Agent能力接近万亿级云端模型,采用Auto Research后训练技术。StartLux计划年内推出本地智能解决方案,推动本地模型商
bleysg 发布了 DeepSeek-V4-Flash 的 DSpark 草稿模型 GGUF 版本,专为 ds4 C+CUDA 推理引擎设计,支持无损投机解码,在 DGX Spark 上平均加速 1.38 倍,峰值 1.71 倍。该文件包含 3 层 transformer、目标融合投影、Markov 头等,采用 Q2 K 路由专家等量化策略,约 6.5 G
Kansas State University的研究人员提出了一种基于累积对话轮次的老年人金融诈骗风险评估框架,通过逐步聚合对话内容并重新评估风险,实现实时监控。他们构建了包含投资、慈善和技术支持诈骗场景的多轮对话数据集,并微调了Phi-4、LLaMA-3.2、DeepSeek-R1和Qwen3等小型语言模型。实验表明,Phi-4和LLaMA-3.2在参数规
该研究评估了大型语言模型(LLM)在UML类图建模中的表现,发现与专家设计的类图相比,LLM生成的类图存在关键类识别不完整、关系混淆或遗漏、继承关系不足、未使用类和循环依赖等问题。研究提出了记忆强化、外部知识注入和检测引导的自动修复三种策略,实验显示这些策略能有效改善模型输出,关键类识别修复率达85%,耦合关系修复率46%,继承关系修复率69%,未使用类和循
苹果CEO库克卸任,转任执行董事长,约翰·特努斯接任,库克在内部信中表达对继任者的信心。东方甄选前CEO孙东旭宣布新公司美丽明天员工年假30天,引发热议。科大讯飞公关副总裁韩煜尘被解除职务,疑似涉及私德问题。字节上调豆包股价格至17.02元/股,主要面向大模型部门。快手旗下北京可灵获国家人工智能基金14亿元注资。华为上半年营收4678亿元,研发投入1214亿
Xinference 发布 v3.3.0 版本,新增了对多个模型的支持,包括 Qwen3.8、DeepSeek V4 Flash、GLM-Image、Kimi-K3 等,并引入了 token 感知的虚拟模型路由、Anthropic Messages 协议适配器、世界模型生成等新功能。此外,该版本还增强了音频、图像、视频等多模态能力,并修复了若干 bug。
UC Berkeley 和 MIT 的研究人员发布了 FreeToken,这是一个开源推理引擎,旨在通过动态协同执行,在消费级硬件上运行前沿 MoE 模型。FreeToken 采用 q 策略动态分配 CPU 和 GPU 计算,并引入语义锚点检查点,显著提升解码和预填充速度。基准测试显示,FreeToken 在 RTX 4060 笔记本上运行 Qwen3.6-
RAGFlow 发布 v0.27.1 版本,新增 Azure DevOps 数据源连接器、You.com 和 Serply 网络搜索提供商,以及 Synthorai 模型提供商,并补充了 DeepSeek 模型。该版本改进了检索 API,暴露 rerank candidates count 等参数,并将元数据过滤下推到索引层以加速检索。同时修复了多项 bug
Mem0 发布了 DeepSeek 插件 v0.1.1,新增匿名使用遥测功能,通过 PostHog 批量收集工具名称、时长、计数和粗略失败类型等事件,不包含查询内容、记忆文本、过滤器或 API 密钥,并支持通过 MEM0 TELEMETRY=false 环境变量选择退出。
vLLM 发布 v0.28.0 版本,包含 584 个提交,重点优化了 Kimi-K3 和 DeepSeek V4 的性能,支持稀疏 MLA、DCP、FlashKDA 等特性,并改进了推测解码和模型运行器。该版本还引入了新的默认配置、破坏性变更,并扩展了模型支持,如 Muse Glimmer、Ling 3.0 Flash 等。
台湾网络安全公司TeamT5警告称,中国国家支持的黑客组织在使用AI工具后,攻击次数增加了一倍以上。这些黑客利用DeepSeek编写漏洞代码、收集IP地址,甚至使用ChatGPT和Anthropic的Claude Code进行攻击。英国AI安全研究所的研究显示,开源模型的网络能力大幅提升,但在完全自主攻击方面仍落后于西方前沿模型。
纽约大学阿布扎比分校与阿布扎比克利夫兰诊所的研究团队在ACL 2026 Findings发表论文,构建了首个多语言医疗错误评测基准MedErrBench,覆盖英语、中文和阿拉伯语,测试了GPT-4o、Gemini、Llama、Qwen、DeepSeek等模型。研究发现医疗专用模型在错误检测任务上不如通用模型,且英文原生模型在中文原生数据上表现更好。该基准旨在
Ornith AI 发布了 Ornith-1.5-397B,这是一个 397B 参数的混合专家模型,通过端到端自我改进训练,在 Terminal-Bench 2.1 上得分 86.1,在 DeepSWE 上得分 56.0,性能与 Claude Opus 4.8 相当,并优于 GLM-5.2 和 DeepSeek-V4-Flash-0731 等开源模型。该模型
中国云厂商为完成AI收入目标,以低于成本的价格转售智谱、DeepSeek、Kimi等第三方模型,折扣低至3折,引发价格战。此举虽能计入营收,但导致利润下滑和内部矛盾,类似2021年云计算市场的恶性竞争。然而,由于基础模型壁垒高,云厂商难以复制替代,模型公司首次获得与平台平等的话语权。
THE DECODER 的 Frontier Radar 第四期指出,中国 AI 模型如 Kimi K3 和 GLM-5.3 已接近美国顶尖模型水平,西方实验室指责中国通过蒸馏和刷分追赶,但模型领先优势难以维持。西方在抽象测试、可靠性和前沿领域仍有优势,但整体领先已转向系统层面。文章还提到欧洲在 AI 竞赛中落后。