窃取专有LLM API的推理痕迹
研究人员发现,Anthropic、OpenAI 和 Google 等大型语言模型提供商返回给客户端的加密推理痕迹块在不同会话、用户和模型间可互换,存在架构漏洞。通过将该痕迹注入同一提供商的较弱模型中,可强制其解码并输出明文,从而绕过反蒸馏机制,实现私有数据提取、隐藏危险信息泄露和隐形提示注入。研究团队从公共仓库中解码了 315,320 个推理块,恢复了 36
另有 1 家信源报道
公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 01:14
研究人员发现,Anthropic、OpenAI 和 Google 等大型语言模型提供商返回给客户端的加密推理痕迹块在不同会话、用户和模型间可互换,存在架构漏洞。通过将该痕迹注入同一提供商的较弱模型中,可强制其解码并输出明文,从而绕过反蒸馏机制,实现私有数据提取、隐藏危险信息泄露和隐形提示注入。研究团队从公共仓库中解码了 315,320 个推理块,恢复了 36
另有 1 家信源报道
OpenAI 长期高管、前首席运营官 Brad Lightcap 宣布离职,将“开启新事业”。他于 2018 年加入公司,曾任 CFO 和 COO,今年早些时候转任特别项目负责人。Lightcap 表示未来将分享更多细节,并强调对 OpenAI 的信心。此次离职正值 OpenAI 筹备 IPO 及高层变动之际。
另有 1 家信源报道
安全研究人员发现了一个影响所有主要AI提供商API的漏洞,可以读取推理模型的加密思维过程。通过越狱,他们使用较小的模型转录更强大模型的原始推理,并在公开会话中暴露了密码和API密钥。该漏洞还加剧了关于推理蒸馏的争议,并揭示了模型内部使用难以理解的语言或考虑欺骗行为。
Langfuse 发布了 v4.9.0 版本,主要修复了在 trace 聊天视图中渲染 OpenAI Responses API 请求输入的问题,并新增了自托管实例切换器功能。该版本还迎来了新贡献者 DavidTraina 的首次贡献。
戴盟机器人宣布完成数亿元融资,由蚂蚁集团领投,老股东超额跟投,两个月内连续完成两轮融资。该公司孵化于香港科技大学,专注于触觉感知与物理AI,发布了全球首个触觉锚定世界模型Daimon-TWM,并已实现视触觉传感器万片级出货,服务全球200余家客户。融资将用于推动触觉感知、数据与模型的商业化落地,覆盖3C精密制造和汽车智造等场景。
另有 1 家信源报道
DocAtlas 是一个将长文档理解视为可变状态交互过程的系统,通过外部环境管理文档信息的搜索、读取、存储和展示。该系统结合了自改进检索、选择性证据访问和主动工作记忆,在固定上下文预算下运行。使用 GPT-5.4 时,DocAtlas 在 MMLongBench-Doc 上达到 71.4% 的准确率,超过人类专家参考水平;用 Qwen3.5-4B VLM 进
加州大学伯克利分校发布的CyberGym基准测试显示,国内机构与达酷诺威联合研发的DoGNAVY以90.8%的通过率排名全球第三、中国第一,超越OpenAI和Anthropic的模型。DoGNAVY仅使用开源的GLM-5.2模型,通过结构化工作流、漏洞可达性分析、动静结合分析和知识库实现高效漏洞挖掘。其背后的AgentDoG架构提供智能体安全诊断能力,用小模
该论文提出了一种用于深度伪造视频检测的多智能体取证推理框架(ARGUS),并发布了包含10万视频、33种合成方法的大规模数据集FaceVid-Forensics-100K。该框架由四个领域专家智能体分别分析纹理、光照、运动和物理线索,再由法官智能体整合证据做出最终判断。在跨域测试中,ARGUS超越了包括GPT-4o和Gemini在内的闭源模型,取得了最高准确
Meta 发布了 30B 参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可,可在消费级 GPU 上本地运行,并在多数基准测试中优于同类竞品。扎克伯格同时发表文章,捍卫模型蒸馏的合法性,并呼吁美国在开放模型领域保持领先。Meta 计划未来几周发布更强模型 Muse Spark 1.2 的开放权重版本,并考虑通过云业务变现其数据中心
另有 2 家信源报道
LangChain 发布了 langchain-openai 1.4.3 版本,主要修复了从内容中过滤无效工具调用的问题,并更新了针对 OpenAI 兼容提供商的 Responses API 使用指南及 include response headers 参数的文档说明。
GitHub Models 服务已正式退役,作者在 GitHub Actions 运行中遇到错误提示后确认了这一消息。该服务曾提供模型游乐场和统一 API,允许 GitHub Actions 使用内置密钥调用多种 LLM。作者推测关闭原因与编码代理模式导致免费或补贴令牌成本过高有关,并已改用 OpenAI API 和 GPT-5.6 Luna 生成摘要。
网友Vyom使用Opus 5模型,通过一条2000字的提示词和6.9亿token,生成了一款美式卡通风格的水上快艇竞速游戏《INK TIDE》,成本约423美元。随后,网友Anul Agarwal在Codex中利用GPT-5.6 Sol和Luna Max模型,以约5美元的成本复刻了类似游戏,但画面细节和完成度相对粗糙。两个案例展示了AI生成游戏的能力,但最终
Anthropic 宣布从 8 月 14 日起,Claude Code 将默认启用 Auto Mode,该模式允许 AI 自主执行开发任务,仅在检测到危险或不可逆操作时请求人工确认。测试显示,Auto Mode 在安全性上不逊于手动审批,并能使团队生成的 pull request 数量增加约 25%。此外,该模式还能抵御提示注入攻击,独立审计显示 720 次
另有 2 家信源报道
新晋菲尔兹奖得主、多伦多大学数论学家Jacob Tsimerman加入OpenAI,专注于AI安全研究。他曾发表论文探讨AI可能导致人类灭绝的“omnicide”情景,并认为数学家能为AI安全做出贡献。前DeepMind CEO Demis Hassabis评论称,AI在数学上的进展尚未达到AlphaGo“第37步”那样的根本性突破,但未来可能实现。
xAI 发布了 Imagine Image 2.0 模型,作为 Grok 平台的新“质量模式”,提供精细指令遵循、排版布局优化和跨生成一致性。该模型在 Arena 基准测试中排名第二,仅次于 OpenAI 的 GPT-Image-2。新模型包含 Magic Wand、区域分割、背景移除、多参考编辑和智能调整大小等编辑工具,并推出模板和视频预制作功能。API
本周谷歌AI团队发生重大人事变动,包括传奇工程师Jeff Dean在内的多位核心成员职位调整,部分人离开谷歌。The Vergecast节目讨论了这一变动背后的原因,包括谷歌模型与Anthropic和OpenAI的竞争差距,以及Demis Hassabis可能对虚拟助手之外更感兴趣的工作。节目还探讨了谷歌与Reddit的相互依赖关系及其潜在问题。
LangChain 发布了 langchain-openai 1.4.2 版本,主要修复了多个问题,包括处理上下文窗口超限错误、过滤生成的 content block ID、保留 Responses 的 text 选项、编辑 MCP 授权信息,并更新了模型配置文件。
微软发布了 Azure API Management 的专用 AI 网关层公开预览版,该网关围绕模型、MCP 服务器和工具而非 API 进行组织,支持 OpenAI、Anthropic、Mistral 等模型,并提供策略配置、遥测和工具联邦功能。该网关旨在集中治理 AI 流量,但引发了关于治理边界、密钥风险、预览限制及与现有网关共存等问题的讨论。
Together AI 对 DeepSeek-V4 Flash 0731 和 GPT-5.6 Luna 在 DeepSWE 基准上进行了 900 次测试。Luna 在 pass@1 上领先 14 个百分点(67.2% vs 53.3%),但 DeepSeek 成本仅为 Luna 的六分之一,每美元解决任务数是 Luna 的 4.8 倍。采用 DeepSeek
arXiv 论文提出 ASGE-RR,一种用于动态 AI 代理调用的在线控制器,通过可修订预留机制保护未来调用所需资源。在 OpenHands 和 GPT Researcher 工作流上评估,相比其他控制器,ASGE-RR 在 WAN 测试平台上可完成多达 10% 更多的工作流价值。研究表明运行时揭示的工作流结构创造了新的网络控制机会。