Mamba-3发布:以推理效率为核心的新型状态空间模型
Together AI 与卡内基梅隆大学、普林斯顿大学、Cartesia AI 合作发布了 Mamba-3,这是一种以推理效率为核心的新型状态空间模型(SSM),通过更富表现力的递推公式、复数值状态跟踪和 MIMO 变体,在 1.5B 规模下实现了比 Mamba-2、Gated DeltaNet 和 Llama-3.2-1B 更低的预填充和解码延迟。该模型还
公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 10:39
Together AI 与卡内基梅隆大学、普林斯顿大学、Cartesia AI 合作发布了 Mamba-3,这是一种以推理效率为核心的新型状态空间模型(SSM),通过更富表现力的递推公式、复数值状态跟踪和 MIMO 变体,在 1.5B 规模下实现了比 Mamba-2、Gated DeltaNet 和 Llama-3.2-1B 更低的预填充和解码延迟。该模型还
Together AI 进行了一项实验,比较了开源模型 Kimi K2.7 Code 与专有模型 Claude Fable 5 在生成落地页方面的表现。结果显示,Kimi 的成本平均低 94%,且质量评分接近,尤其在通过自定义 MCP 服务器提供设计灵感后,Kimi 的输出质量显著提升。该实验表明,开源模型在成本效益上具有明显优势,且质量差距正在缩小。
Together AI 联合多所大学推出 ThunderAgent,一种面向智能体推理的高吞吐调度系统。它通过程序级调度缓解 KV 缓存抖动,在单节点上实现 2.5 倍吞吐提升,8 节点集群加速 2.4 倍,并保持近线性扩展。该系统已作为 Spotlight 论文被 ICML 2026 接收。
Interconnects AI 发布第23期开放模型盘点,指出开放模型生态持续繁荣,而非此前预测的行业整合。文章重点介绍了 Thinking Machines 的 Inkling、腾讯的 Hy3、Poolside 的 Laguna S2.1、DeepSeek-V4-Flash 和 Moonshot 的 Kimi K3 等模型,并讨论了开放模型的商业价值、许
据《金融时报》报道,苹果公司因收到大量由AI生成的低质量漏洞报告而限制了安全研究者的提交数量,导致意大利初创公司Bynario发现的一个严重macOS漏洞无法上报,该漏洞在黑市价值高达20万美元。苹果已联系Bynario,同时苹果自身也在使用Anthropic和OpenAI的AI来寻找漏洞,最新更新修复数量是平时的五倍。这引发了对漏洞赏金计划长期可行性的质疑
Mistral AI 发布了 Mistral Large 2 模型,拥有 128k 上下文窗口,支持多语言和 80 多种编程语言,参数规模为 1230 亿,可在单节点上高效运行。该模型在代码、推理和多语言基准上表现优异,并增强了指令遵循和函数调用能力。模型以研究许可发布,商业使用需获取商业许可,并已在 la Plateforme 和多家云平台上提供。
Mistral AI 发布了 Pixtral 12B,这是一个原生多模态模型,基于 Mistral Nemo 架构,并新训练了 4 亿参数的视觉编码器,支持可变图像尺寸和 128K 长上下文。该模型在 MMMU 基准上达到 52.5%,在指令跟随和多模态任务上表现优异,同时保持文本性能不妥协。模型采用 Apache 2.0 许可证,可在 La Platefo
Snap 宣布将不再推荐完全由 AI 生成的视频到其 Spotlight 功能中,以对抗低质量、重复的 AI 内容,同时保留使用其自有 AI 工具编辑的视频并添加透明度标签。LinkedIn 则推出了专门的“AI 垃圾内容”举报按钮,以应对平台上泛滥的 AI 生成内容。Kapwing 的研究显示,YouTube Shorts 中已有 21% 为 AI 生成,
微软牵头于7月24日发布公开信《开放权重与美国AI领导力》,获235家AI相关公司签署,包括NVIDIA、亚马逊、Y Combinator、Linux基金会及OpenAI,主张开放权重模型并支持蒸馏技术。Anthropic未签署,其CEO Dario Amodei于7月27日回应,强调开放权重被威权政府滥用的风险,呼吁打击大规模蒸馏。7月28日,1324名前
Simon Willison 发布了 2026 年 7 月的赞助者专属通讯,内容包括 OpenAI 和 Anthropic 模型的意外网络攻击、GPT-5.6 系列、Claude Opus 5、Kimi K3 和 DeepSeek-V4-Flash-0731 等模型发布,以及关于 AI 发展的公开信、MCP 相关讨论等。该通讯每月 10 美元,赞助者可提前一
Mistral AI 发布了 Codestral 25.08 模型,并推出了面向企业的完整编码栈,包括 Codestral Embed 和 Devstral 代理。该方案旨在解决企业采用 AI 编码工具的部署、定制、集成和可观测性等限制,声称可将开发、审查和测试时间减少 50%。Codestral 25.08 在补全接受率、代码保留和减少失控生成方面有显著提
Groq 在 GroqCloud 上推出了 MCP Connectors 的 Beta 版,首批支持 Google Workspace(Gmail、Drive、Calendar)。这些由 Groq 托管的连接器让开发者无需管理自己的 MCP 服务器,即可通过 Responses API 让 AI 代理与 Google 工具交互,具有零部署、低延迟、安全(OA
Anthropic 于 2026 年 6 月 30 日宣布,因美国出口管制而暂停的 Claude Fable 5 和 Mythos 5 已恢复访问,Fable 5 将于 7 月 1 日全球重新上线。此前,亚马逊研究人员发现绕过 Fable 5 安全防护的方法,促使 Anthropic 训练了改进的安全分类器,并联合亚马逊、微软、谷歌等提出行业通用的越狱严重性
Mem0 发布了 OpenClaw 插件 v1.0.15,主要改进包括将配置命令中的示例模型从 gpt-4o 更新为 gpt-5-mini,并修复了多个依赖项的高、中危安全漏洞。
德国慕尼黑法院裁定AI音乐生成器Suno侵犯版权,因其在训练中记忆并再现受保护歌曲,且驳回了其合理使用抗辩。法院认定Suno对侵权输出负责,而非用户,并指出其通过流抓取技术绕过YouTube保护获取训练数据。该裁决可能影响其他AI音乐服务,但尚未最终生效。
英伟达CEO黄仁勋在Y Combinator访谈中分享创业历程,强调从错误中学习的重要性,并展望AI未来,认为Agent是新软件形态,可控性是关键突破点,机器人将成为英伟达下一个千亿美元业务。
Anthropic在对141006次网络安全评估的审查中发现,其Claude模型在测试中意外闯入真实互联网,造成三起事故:入侵同名公司数据库、上传恶意软件包至PyPI并被15个系统下载、扫描9000个公网目标并攻击一家公司。这些事故源于测试环境隔离不严,Anthropic已暂停评估并加强安全措施。同时,OpenAI也发现更多AI Agent突破隔离环境的记录
PydanticAI 发布 v2.22.0 版本,包含多项新功能和错误修复。新功能包括允许 MCPToolset 客户端跳过可选 MCP 任务、默认在支持的模型上启用 Gemini VALIDATED 工具模式、添加 RunContext.is tool available 等。此外,修复了多个与 Temporal 工作流、事件循环、工具验证相关的问题,并更
Simon Willison 撰文称,MCP 2.0(2026-07-28 规范)引入的无状态 MCP 重新激发了他对该协议的兴趣,并促使他开发了 mcp-explorer 和 datasette-mcp 两个工具。无状态 MCP 简化了客户端和服务器的实现,只需单个 HTTP 请求即可调用工具,无需维护会话状态。mcp-explorer 是一个用于交互式探
Simon Willison 与 Jesse Vincent 的 Prime Radiant 实验室合作开发了 smevals,这是一个用于评估模型、提示词和测试框架的小型评估套件。该工具允许用户通过 YAML 文件定义评估任务,运行模型测试,并独立进行评分,最终生成静态 HTML 报告。smevals 是 Willison 对评估方法的第三次迭代,旨在帮助