OpenAI Agents JS SDK v0.17.1 发布:新增 MCP 护栏与多项修复
OpenAI 发布了 Agents JavaScript SDK 的 v0.17.1 版本,主要包含多项功能增强和错误修复。新增了服务器级 MCP 工具护栏、自定义输出护栏消息、Docker 沙箱容器标签以及 Web 搜索工具中的图像结果支持。同时修复了多个核心问题,包括会话写入恢复、工具调用归属保留、沙箱 Git 仓库参数注入防护等,并更新了相关文档。
公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03
OpenAI 发布了 Agents JavaScript SDK 的 v0.17.1 版本,主要包含多项功能增强和错误修复。新增了服务器级 MCP 工具护栏、自定义输出护栏消息、Docker 沙箱容器标签以及 Web 搜索工具中的图像结果支持。同时修复了多个核心问题,包括会话写入恢复、工具调用归属保留、沙箱 Git 仓库参数注入防护等,并更新了相关文档。
Latent Space 发布了一个前沿 AEO(AI 引擎优化)追踪器,基于 7 个前沿模型在 161 个类别中的推荐结果,分析各产品在 AI 推荐中的主导地位。报告发现模型存在偏好偏差(如 Claude 推荐自家产品),但也观察到跨模型推荐案例。此外,Anthropic 的新模型 Astra 比 Sol 更自信且搜索来源更少,影响了 AEO 策略的有效性
LangChain4j 发布了 1.19.2 和 1.19.2-beta29 版本,主要更新是将 MCP(模型上下文协议)相关功能从 1.19.1 向后移植到当前版本。该版本由 jmartisk 通过 PR #6329 贡献,修复或改进了 MCP 支持。
英国AI基础设施公司Nscale成立仅两年,计划最早本月上市,并正洽谈额外35亿美元融资,包括向投资者出售15亿美元可转换债券及向英伟达寻求20亿美元融资。该公司3月完成由Aker领投的11亿美元B轮融资,并称其为欧洲史上最大B轮。近期与Anthropic签署约450亿美元大单,并据称向投资者展示约1030亿美元的未来收入预测。
另有 1 家信源报道
OpenAI 的新模型 GPT-6 Astra 相比前代 GPT-5.6 Sol 减少了幻觉,并阻止了 99.99% 的直接提示注入攻击。然而,在间接提示注入测试中,Astra 的失败率从 27% 降至 8.5%,但仍高于 Claude Opus 5 的 4.8%。安全公司 Gray Swan 的测试显示,Astra 在多次对话中仍可能被诱导产生有害响应,表
Agno 发布了 v3.0.6 版本,主要新增了无状态 MCP 服务模式(通过 MCPConfig(stateless=True) 实现),支持多实例部署无需会话亲和性;同时新增 MCPTools(protocol mode=...) 参数,可协商 MCP 协议版本,并默认保持旧版兼容。此外,AgentOS 增加了 MCP Server Card 端点、.z
弗吉尼亚理工大学和亚利桑那大学的研究人员首次对现成LLM在需求质量评估中的表现进行了基准测试,基于INCOSE标准评估了OpenAI和Anthropic两大家族共十个模型。结果显示,最佳Anthropic模型仅能检测出47%的专家识别问题,同时产生11%的误报,且对必要性和正确性问题的漏检严重。研究还发现模型代际进步非单调,温度采样影响有限,表明现成LLM尚
OpenAI 于2026年9月3日发布GPT-6 Astra,面向有限组织,随后向所有ChatGPT用户及API开放。该模型在ARC-AGI 3基准上得分99.9%(使用自定义Provider Adapter harness),在安全任务和长上下文处理上表现优异,但在Artificial Analysis的智能指数上仍低于Claude Fable 5.1。A
OpenAI 发布了其迄今最强大的模型 GPT-6 Astra,并宣称其可能已接近或达到 AGI 水平。该模型在逻辑推理、数学、软件工程等多项基准测试中大幅超越前代 GPT-5.6 Sol 及 Anthropic 的 Fable 系列。Astra 将首先通过 Daybreak 计划向特定组织开放,随后向 ChatGPT 付费用户及云平台提供。尽管 token
另有 2 家信源报道
美国国防部扩展其GenAI.mil平台,新增OpenAI的ChatGPT Mil和xAI的Grok for Government模型,此前该平台仅提供Google Gemini。该平台拥有超过170万用户,新模型将用于行政、物流、规划及采购分析等任务,并在安全环境中运行以防数据泄露。Anthropic的Claude因拒绝无限制使用而被排除,相关分类被法院裁定
Cloudflare 推出了可选 OAuth 作用域,允许用户在授权屏幕上取消选择单个权限,而开发者可标记哪些作用域可被放弃。此举主要针对 MCP 服务器等代理场景,避免代理请求过多权限。该功能不改变 OAuth 协议,但要求应用检查令牌中的实际作用域并优雅降级。
LangChain 发布了 1.4.0a4 预发布版本,主要围绕 MCP(Model Context Protocol)适配器进行重构和功能增强,包括支持 ClientGroup 作为目标、简化 MCPAdapter 构造、引入 LangGraph 中断机制处理 MCP 请求等。同时修复了多个中间件问题,并增加了对标准模型异常类型和 LangSmith 提供
该论文对11个生产级编码代理的源码进行了系统解剖,定义了harness工程学科,并识别出7个子系统和29种设计模式。研究发现,所有系统均未使用通用代理框架或向量检索,而SKILL.md技能采用率超过MCP。论文指出,到2026年上半年,编码harness已从工具转变为平台,并提出了18条设计建议。
Langfuse 发布 v4.27.0 版本,新增多项功能,包括为追踪 IO 解析器添加功能开关、自托管 API 规范渲染器、缓存输入令牌和成本、MCP 评估器测试工具、多模态输入支持,以及为 Claude 在 OpenAI Responses 网关后添加提示缓存断点。同时修复了多个问题,如输出令牌截断、分析导出 URL 检查、提示版本指标维度等。
美国国防部在GenAI.mil门户中推出了定制版ChatGPT(ChatGPT Mil)和Grok(Grok for Government),供300万军事和文职人员使用,以加速工作并增强作战能力。该门户已吸引超过170万用户,但未包含Anthropic的Claude模型,因其被特朗普政府标记为供应链风险。此举是五角大楼更广泛AI战略的一部分,旨在平衡安全与
微软将 Foundry 模型路由器从两个区域扩展到 28 个全球标准部署区域和 21 个数据区域,并更新了模型池,新增了 Claude Opus 4.8 和 GPT-5.6 系列,移除了多个旧模型。默认配置的团队会自动接收更新,而自定义子集的团队则需手动调整。该更新强调 API 稳定性与行为稳定性的区别,并涉及路由模式、上下文窗口限制、成本附加费及合规性等细
索尼音乐和华纳音乐等主要音乐出版商起诉AI公司Anthropic及其高管,指控其未经许可使用数万首受版权保护的音乐作品(主要是歌词)训练Claude模型,并称这是历史上最大规模的公然知识产权盗窃之一。诉讼重点在于Anthropic获取训练数据的方式,包括通过非法种子下载盗版书籍和从授权平台抓取歌词。此前Anthropic已因类似问题支付了15亿美元和解金。
另有 1 家信源报道
Vercel AI SDK 发布了 ai@7.0.85 版本,包含多项补丁更新:确保规范哈希保留未定义数组元素位置,修复网关图像生成成本在拆分请求中的汇总问题,修复 Anthropic 提供者在批处理请求中保留原生消息批次计数并支持完整语言模型选项,以及新增功能以暴露单个图像生成调用。同时更新了依赖 @ai-sdk/gateway、@ai-sdk/provi
Agno 发布 v3.0.2 版本,包含多项行为变更、新集成和改进。行为变更包括运行元数据优先级调整、MCPConfig 拒绝未知字段、推理检测改为询问提供商等。新集成支持 Synthorai 模型提供商、WaveSpeed 图像视频生成、Serply 搜索工具包和 AtomicMail 邮件工具包。改进包括将 Agent/Team/Workflow 作为
索尼音乐和华纳查普尔音乐公司在美国加州北区地方法院起诉Anthropic,指控其未经授权使用数万首受版权保护的音乐作品训练AI模型,要求每件作品最高15万美元赔偿,总金额可能达数十亿美元。诉讼还点名Anthropic联合创始人Dario Amodei和Benjamin Mann,称其使用BitTorrent下载盗版书籍并抓取歌词。这是Anthropic近期面
另有 1 家信源报道