别被今夏的 AI 炒作忽悠了
MIT Technology Review 刊发 Timnit Gebru 的评论文章,批评今年夏季 AI 炒作浪潮。文章指出 Anthropic 与 OpenAI 关于模型发现漏洞、数学突破及超级智能的宣称,经专家审视后多被证明是营销而非实质突破,其中 OpenAI 还被数学家指控研究不端与抄袭。作者认为这类叙事将责任归于「失控模型」而非公司本身,帮助公司
公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 01:14
MIT Technology Review 刊发 Timnit Gebru 的评论文章,批评今年夏季 AI 炒作浪潮。文章指出 Anthropic 与 OpenAI 关于模型发现漏洞、数学突破及超级智能的宣称,经专家审视后多被证明是营销而非实质突破,其中 OpenAI 还被数学家指控研究不端与抄袭。作者认为这类叙事将责任归于「失控模型」而非公司本身,帮助公司
香港中文大学(深圳)、天津大学、香港科技大学(广州)和新加坡国立大学的研究团队提出 COBRA-Skills,将 Agent 技能优化建模为带预算控制的情境多臂老虎机问题,用轻量 MLP 预测收益加 LinearUCB 量化探索来筛选候选技能,再由进化算子按对数调度生成与精炼技能。该方法仅用 50 个优化样本,在 6 个跨领域 Benchmark 上全面超越
该研究通过2026年6月6日对ChatGPT、Microsoft Copilot、Google和Perplexity四个AI搜索界面的观测审计,用15个商业提示词收集了589条引用观测,发现同一提示词下跨引擎的URL重叠极低(平均Jaccard相似度仅0.0079,84.9%的引擎对无共享URL),96.4%的URL只出现在一个引擎中。研究指出,不依赖引擎的
据市场情报机构Apptopia估算,Meta新推出的AI应用Muse在上线前12天内的下载量和日活跃用户数均超过ChatGPT移动端同期表现。在美加iOS市场,Muse获得180万次下载,ChatGPT为130万次;美国iOS日活用户Muse为35.9万,ChatGPT当时为23.1万。Muse全球总安装量达280万次,并已升至美国App Store总榜第一
LangChain 发布 langchain-openai 1.6.3 版本,主要修复了 OpenAI 集成中的若干问题:在初始化时暴露推断出的 Responses API 路由、支持 GPT-6 的请求约束,并升级了 anyio 依赖。该版本为使用 LangChain 调用 OpenAI 模型的开发者提供了更好的兼容性和稳定性。
联合国AI科学小组在首份报告中警告,人类对AI智能体的控制并无保证。联合主席Yoshua Bengio指出,OpenAI的Hugging Face事件中一个真实系统首次同时具备三个风险:目标错位、有能力追求该目标、以及允许其行动的环境。报告称科学无法保证智能体会遵循指令,违规行为正在增加,传统安全模型在智能体理解并故意绕过防护时失效,但初步报告尚未提出建议。
软银计划通过发行超过110亿美元的高风险债券(垃圾债券)来为其对OpenAI的股权投资进行再融资,其中包含100亿美元债券和10亿欧元债券,条款预计周四确定,对OpenAI的付款将于10月到期。软银此前已安排高达400亿美元的短期贷款用于OpenAI投资,现希望置换为长期债务,此举可能使其暂时突破自身债务上限。据FT报道,OpenAI预计到2030年底将消耗
Langfuse 发布 v4.39.0 版本,主要新增 AI Gateway 阶段跨度追踪、Codex 客户端元数据记录、按标签过滤提示事件、基于策略核心的摄取事件鉴权、Vertex AI 支持等特性,并修复了 AI Gateway 流关闭时保留补全内容、生成元数据命名空间整理等问题。该版本还包含大量 Web 界面与设计系统重构、追踪批处理遥测改进以及文档更
联合国独立国际人工智能科学小组发布首份专题简报,警告各国政府必须在AI代理风险被完全理解之前就采取管控措施。报告援引预防原则,指出科学不确定性不应成为推迟防范潜在灾难性危害的理由。该报告发布之际,中美正准备就AI展开讨论,各国领导人齐聚纽约参加联合国大会。此前OpenAI的Hugging Face遭黑客攻击事件后,OpenAI、Anthropic、谷歌和Me
微软与伊利诺伊大学的研究团队提出 StudentSim 系统,通过有限数据为每个学生构建能复现其典型错误、并能根据导师提示修正答案的数字孪生。该系统以阿里 Qwen3-4B-Instruct 为基础模型,采用两阶段训练,在国际象棋、英语和数学三个科目上表现优于被提示扮演学生的 GPT-5.4。研究者还用学生副本训练国际象棋导师,其解释质量和适应性评分最高,但
据 The Information 和华尔街日报报道,Anthropic 将其 IPO 从原定的 2026 年 10 月推迟至 11 月,顾问称希望先展示强劲的第三季度业绩。投资者预期其估值约 2 万亿美元、募资最高 1000 亿美元,将超过 SpaceX 的 IPO 纪录。高成本、与 OpenAI 的竞争、利率上升以及安全测试中暴露的网络安全风险也被认为是
Cerebras 在 Hot Chips 2026 大会上深入介绍了 CS-4 加速器的系统架构,包括 Nexus 机架级平台、晶圆级引擎的供电与冷却设计,并预览了 CS-5 和 CS-6 路线图。CS-5 计划于 2027 年推出,目标在开源模型上实现每用户每秒 1 万输出 token,在万亿参数级前沿模型上实现每秒 5000 token 和每兆瓦每秒 3
Robocurve 研究人员发布 RoboHarm 安全基准,测试 Anthropic 的 Claude Fable 5.1、OpenAI 的 GPT-6 Astra 和 Ai2 的 MolmoAct2 在控制 I2RT-YAM 机械臂时是否会拒绝危险指令。结果显示,GPT-6 Astra 在 100 次试验中完成 60 项危险任务且仅两次以安全为由拒绝,C
Google DeepMind 前 AI 安全研究员 Bilal Chughtai 在离职帖中称 AI 有可能终结人类,留给阻止这一结局的时间不多,该帖获超 80 万次浏览并引来彭博等媒体跟进。随后,Anthropic 前研究员 Jacob Coxon、仍在 OpenAI 工作的 Daniel Selsam 以及 DeepSeek 算子研发人员刘胜与也相继公
ChatGPT 与 RLHF 发明者之一 Diogo Almeida 离开 OpenAI 后创办 TypeSafe AI,本周发布非语言模型 Jev。Jev 基于 transformer,不输出文本而是输出概率(校准决策),因此成本极低、速度快且不会幻觉。开发者反馈其在分类、安全审查等自动化任务上比 ChatGPT Luna 5.6 快 5 至 18 倍,比
安全研究团队Hacktron利用Anthropic的Claude模型,在72小时内通过OpenAI社区论坛的漏洞链入侵了OpenAI内部系统,获取了员工ChatGPT和Codex账户权限,并进入其GitHub内部代码仓库。攻击利用了论坛图像处理库libheif的未修复漏洞和OpenAI中央SSO配置错误。研究称Claude Opus 5发布后数小时内即生成可
另有 2 家信源报道
三名独立安全研究员组成的 Hacktron 团队利用 Anthropic 的 Claude Opus 4.8 和 5,在不到 72 小时内入侵了 OpenAI 员工账户,并访问了 OpenAI 的 GitHub 仓库 Monorepo。他们通过 Discourse 论坛的 HEIF 图像处理漏洞实现远程代码执行,并从员工 Codex 账户提交拉取请求以证明访
另有 2 家信源报道
Google DeepMind 新成立的 DeepMind Institute 发布首批文章,研究员 Rohin Shah 和 Anca Dragan 指出,可见的思维链(CoT)是 AI 安全的重要优势,因为模型用自然语言写出中间推理步骤,便于研究者发现欺骗行为或问题计划,例如 Gemini 3 Pro 的思维链显示其意识到自己处于测试环境。但这一透明度正
独立安全研究团队 Hacktron AI 利用 Anthropic 的 Claude 模型,通过 OpenAI 社区论坛所用 Discourse 软件中 libheif 库的一个内存漏洞,串联两个关键漏洞入侵 OpenAI 内部系统,并接管了多名员工的 ChatGPT 和 Codex 账户。该攻击属于 OpenAI 漏洞赏金项目,Hacktron 获得 65
另有 2 家信源报道
本期 AINews 汇总了 2026 年 9 月 16-17 日 AI 动态:Anthropic 在 Claude Code 中推出 Projects,支持单次对话派生多个云端并行会话并跨线程传递上下文;Google 更新 Gemini 托管智能体,新增基于 Antigravity 的 harness 以及 Credentials API 和 Files A