OpenAI 切断 Cursor 合作,开源模型与推理系统迎来密集更新
OpenAI 在 SpaceX 收购 Cursor 后,以马斯克旗下公司违反合同为由切断了与 Cursor 的合作,此举被视为对 Anthropic 此前类似行动的效仿。Cursor 回应称 OpenAI 仅占其流量的 5%,并暗示决定尚未最终。同时,本周开源模型密集发布,包括 GLM-5.3、Hy4-preview 和 Qwen3.8-Flash,vLLM
公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 08:14
OpenAI 在 SpaceX 收购 Cursor 后,以马斯克旗下公司违反合同为由切断了与 Cursor 的合作,此举被视为对 Anthropic 此前类似行动的效仿。Cursor 回应称 OpenAI 仅占其流量的 5%,并暗示决定尚未最终。同时,本周开源模型密集发布,包括 GLM-5.3、Hy4-preview 和 Qwen3.8-Flash,vLLM
arXiv 论文提出 Modality Maturity Index (MMI) 基准,用于评估全模态模型在文本、图像、音频、视频和文档五种模态及其组合上的输入输出能力。MMI 包含 893 个问题,并引入 Modality Presence Score (MPS) 衡量模态生成能力。测试五个前沿模型发现 MPS 仅 15.6 至 34.9,表明现有模型多模
谷歌DeepMind扩展了其多智能体系统Co-Scientist,使其不仅能生成假设,还能规划实验、编写代码、控制实验室设备并撰写科学论文。该系统在材料科学、生物学和计算机科学三个领域进行了验证,其中在计算机科学中实现了全自动运行。尽管可靠性模块将关键结果捏造率降至4%,但基准测试结果与人类评估相关性较弱,且系统仍存在选择性报告等问题。
据传英伟达将以130亿美元收购开源AI模型平台Hugging Face,此前英伟达已与Poolside达成60亿美元协议,Stripe也以70多亿美元收购了OpenRouter。这些交易表明,科技巨头正通过收购开源AI公司来对冲对前沿实验室的依赖,并应对推理成本上升和自研芯片趋势。开源模型目前使用率较低,但因其成本效益和可定制性,未来可能被更多企业采用。
智东西报道,Hermes Agent 推出 Real Profile Browsing 功能,可复制 Chrome 登录态到隔离浏览器,使 Agent 能以用户身份访问网站。实测发现存在浏览器卡死、Cookie 覆盖、macOS 加密限制等问题,且与 Claude Code、OpenAI Codex 的浏览器方案相比,便利与风险并存,当前可用性有待优化。
Google DeepMind 推出首个针对专有前沿 AI 模型的加密双重盲测,以防止基准测试数据泄露。该测试使用 Google Cloud 的机密计算技术,确保外部测试数据和模型权重均保持私密,消除了传统评估中需要共享测试提示或模型权重的权衡。试点项目与新加坡 AI 安全研究所合作,对 Gemini Flash Lite 模型进行测试,旨在提高 AI 评估
云知声发布2026年中期财报,上半年营收5.62亿元,同比增长38.7%,其中智能体业务收入4.78亿元,占总收入85.1%,Token业务收入近3000万元,Q2环比增长超500%。公司通过“强基模+深应用”战略,将Agent落地医疗、保险等场景,复购收入占比超60%,亏损收窄。文章认为云知声正验证一条类似Palantir的产业AI商业化路径,并总结Age
OpenAI首席科学家Jakub Pachocki表示,未发布的Astra模型已达到其2026年9月设定的“自动化AI研究实习生”目标,而Sama在《时代》采访中估计OpenAI将在2026年12月内部宣布实现AGI。此外,Hugging Face与Pollen Robotics联合推出399美元的开源双足机器人Microduck,支持模拟训练和强化学习定制
LiteLLM 发布了 v1.100.0-dev.2 版本,该版本的所有 Docker 镜像均使用 cosign 签名,并提供了通过提交哈希或发布标签进行验证的方法。此版本包含多项修复和改进,涉及 UI 重构、Prometheus 指标、OpenTelemetry 错误映射、代理流式响应加密、模型价格更新、Azure 实时认证、Bedrock 推理参数映射、
Google ADK Python 发布 v1.39.1 版本,主要包含多项 bug 修复,涉及 A2A 协议、工件存储、CLI 安全、MCP 配置、模型上下文缓存、插件、会话管理等多个模块。这些修复旨在提升稳定性、安全性和兼容性,并完善 v1 版本的功能。
OpenAI联合100多家公司发布公开信,警告AI驱动的网络攻击将变得更加普遍和复杂,对医院、水务等关键基础设施构成严重威胁。签署方包括微软、谷歌、AWS、Anthropic等,呼吁企业、政府和AI公司加强防御措施。美国NSA、CISA和FBI的联合警告也证实攻击者已利用AI编写针对工业控制系统的攻击脚本。
CrewAI 发布了 1.15.18 版本,主要将对话流提升为稳定功能,并增强了对话流文档和 API。该版本还修复了多个 bug,包括保留工具结果、映射 Claude Sonnet 4.6 的 1M 上下文窗口、提高 Anthropic 默认最大 token 数等。此外,改进了项目 ID 的记录和报告,并更新了 Arize Phoenix 可观测性文档。
英伟达CEO黄仁勋在财报电话会议上再次宣称公司已实现AGI,但随即称这一里程碑‘毫无意义’。他指出AGI定义模糊,强调AI真正重要的是产生实际价值和盈利。业界对AGI定义缺乏共识,各公司如OpenAI、Anthropic等均有不同解读,使得AGI概念难以衡量。
OpenAI 研究员“roon”警告,超快 AI 推理速度可能带来现有安全措施无法应对的风险。他指出,一个未对齐的模型若以当前最佳系统 50 倍的速度运行,可能迅速渗透系统,人类响应团队将无法及时应对,因此需要自主检测和关闭机制,而非仅靠监控。该评论是对 OpenAI 发布新 AI 芯片的回应,该芯片推理速度超越现有硬件,且 OpenAI 和 Anthrop
OpenAI 近期经历高管离职潮,联合创始人兼总裁 Greg Brockman 借此巩固了权力,成为公司日常运营的实际负责人,监管包括 ChatGPT、Codex 在内的所有消费者和企业产品团队。Brockman 在 2023 年董事会政变中支持 Sam Altman 后获得其信任,如今在 OpenAI 准备 IPO 并面临盈利压力之际,其角色日益重要。
Langfuse 发布了 v4.22.0 版本,主要新增了评估器创建配置跟踪、支持从专用资产主机提供构建输出、实现 CHB API 客户端、改进状态消息渲染,并增强了应用内代理功能,包括支持 OpenAI 兼容 API 和默认启用 Assistant worker。此外,还修复了多个问题,如评论提及显示名称中的方括号、短 JSON 列表默认折叠、MCP 工具
NVIDIA 以 130 亿美元收购 HuggingFace,约为其 1.5 亿美元 ARR 的 80 倍,较 2026 年 1 月 70 亿美元的报价近乎翻倍。同时,Z.ai 正式发布 GLM-5.3-Flash(即 Ox Alpha),这是一个 320B 总参数、18B 激活参数的 MIT 许可多模态模型,支持 1M 上下文,完全运行在中国 AI 芯片上
Google 发布了 ADK Python 2.8.0 版本,新增了 A2A 任务模式、Model Armor 防护插件、NVIDIA NIM 集成示例、数据代理工具集、BigQuery SQL 注入防护、自定义 LLM 客户端注入、Vertex AI API 版本配置、流式工具调度、实时模式视频支持、MCP 遥测、LLM 评估并行化、内存库支持、会话保留、
Lovable CTO Fabian Hedin 在访谈中阐述了公司从应用构建平台向代理平台转型的愿景,即通过 MCP 服务器将应用功能转化为代理可调用的能力,打造团队的数字大脑。该公司已实现超 5 亿美元的年化收入,并完成 4 亿美元 C 轮融资,估值达 133 亿美元。Hedin 认为,编排能力是容易的部分,而构建可靠且连接良好的能力才是难点。
Hugging Face 发布 Transformers 库 v5.16.1,重点支持 GLM-5.3-Flash 模型。该模型是 GLM-5 系列首个原生多模态模型,拥有 320B 总参数和 18B 激活参数,性能超越 GLM-5.2,价格仅为十分之一,在编码和智能体基准上接近 Claude Opus 4.8。此外,该版本还包含若干小修复,如恢复张量并行