Fanatics 在 AWS 上构建多智能体客户支持系统
Fanatics Betting and Gaming (FBG) 在 AWS 上构建了一个多智能体客户支持系统,以应对体育博彩中复杂的、因州而异的规则和高并发查询。该系统采用编排器模式,通过 Amazon Bedrock 访问多个基础模型,并集成 Guardrails 和负责任博彩分类器,显著提升了响应速度和准确性,同时降低了运营成本。FBG 的 CTO
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2401 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Fanatics Betting and Gaming (FBG) 在 AWS 上构建了一个多智能体客户支持系统,以应对体育博彩中复杂的、因州而异的规则和高并发查询。该系统采用编排器模式,通过 Amazon Bedrock 访问多个基础模型,并集成 Guardrails 和负责任博彩分类器,显著提升了响应速度和准确性,同时降低了运营成本。FBG 的 CTO
支付公司Stripe在致投资者的信中宣称,自1月1日起人类已进入‘奇点’时代,并以此为由推迟IPO,认为私营状态更利于应对不确定性。Stripe同时确认以超过80亿美元收购AI模型路由公司OpenRouter,并强调其业务正从支付基础设施扩展至AI经济基础设施。该公司业绩强劲,上半年收入同比增长41%,其客户包括OpenAI和Anthropic等。
OpenAI 修复了 Codex 中的一个安全漏洞,该漏洞曾导致模型在运行过程中未经用户许可删除真实文件。问题源于清理临时文件的命令误用了系统变量,指向了真实目录。OpenAI 已推出安全更新,要求 Codex 在执行删除前验证目标、创建新的临时文件夹,并加强了对高风险删除命令的检查。
另有 1 家信源报道
LangGraph 发布了 SDK Python 版本 0.4.3,包含多项更新,如新增解密替换结果功能、支持通过 update(end time=None) 清除 cron 的结束时间,并修复了配置元数据合并问题。同时,LangGraph 核心库也发布了多个小版本更新(1.2.3 至 1.2.11),并升级了依赖如 websockets 和 langsmi
Meta 发布了适用于 Mac 的 Meta AI 聊天机器人应用,用户可共享窗口以获取建议、回答问题或基于屏幕内容生成内容,并支持跨应用听写。该应用还可连接 Google Workspace,并与 Instagram、Facebook 账户及 Meta 广告活动集成,为企业和创作者提供分析帖子表现、创建文档和定期更新等新功能。此举旨在与已有桌面应用的 Ge
Langfuse 发布 v4.15.0 版本,主要改进包括:改进沙盒工具渲染、时间线紧凑模式、为开源版提供应用内代理基础、在分析事件中添加用户 ID。同时修复了多个问题,如会话回放内容掩码、工具竞态条件、RBAC 权限等。
Anthropic 发布了 Java SDK 的 v2.56.0 版本,该版本将 Files 和 Skills API 正式转为 GA(一般可用),并新增了计算机使用和浏览器使用的工具集。此次更新为开发者提供了更稳定的文件处理和技能调用能力,同时扩展了自动化操作浏览器的功能。
Anthropic 发布了 TypeScript SDK 的 0.119.0 版本。该版本将 Files 和 Skills API 正式定为 GA(通用可用),并新增了计算机使用和浏览器使用的工具集。此次更新为开发者提供了更稳定的文件处理和技能调用能力,并扩展了代理工具的使用场景。
Unsloth 发布了基于 Qwen3.8-27B 的 GGUF 量化模型,采用 Dynamic V3.0 技术,宣称在精度和量化性能上优于其他量化方案。Qwen3.8-27B 是 Qwen 系列最新开源模型,具备原生视觉语言理解、灵活思考控制、长上下文(262K 原生,可扩展至 1M)和增强的智能体执行能力。该模型支持在 Unsloth Desktop 中
LangChain 发布了 langchain-core 1.6.0 版本,包含多项修复和功能改进。主要更新包括新增标准模型异常类型、优化工具模式序列化、延迟导入 transformers 以提升性能,以及修复多个与工具注入参数、RunnablePick 反序列化和模板处理相关的问题。
Mastra 发布 2026 年 8 月 19 日更新,为 Agents API 增加无需部署的持久执行功能,并新增 Cloudflare Sandbox 提供商。MCP 协议升级支持无状态 2026-07-28 修订版和多轮 elicitation。RAG 模块新增 GraphRAG 快照序列化,降低大型语料库启动成本。核心包 @mastra/core 1
亚马逊宣布将其AI助手Alexa+免费推广至所有兼容的Fire TV设备,无需Prime订阅。该更新带来对话式搜索、智能家居控制和AI推荐功能。此举是行业趋势的一部分,谷歌和Roku也在其电视平台上推出AI功能。亚马逊表示,Alexa+用户的对话次数是原Alexa的两倍,表明用户更积极地与AI互动。
Agentic ESOpt 提出使用进化策略(ES)对长时程 LLM 智能体进行全参数微调,仅需推理级 GPU 内存,避免了强化学习(RL)中反向传播的高成本与长时程信用分配难题。该方法在 WebArena-Lite 上将 Qwen-3.5-27B 的 No Skill 基线提升 6.69%,并在 28/36 个测试时自动启发式设计设置中优于匹配基线。
OpenAI 发布了 Agents JavaScript SDK 的 v0.17.0 版本,主要引入了输出护栏重放安全机制,防止序列化检查点被不当重放,并在输出护栏拒绝结果时替换为占位文本。同时,该版本完善了护栏批处理结果的处理,并明确要求 OpenAI 客户端配置需在构造客户端时完成,否则会报错。
Calendly 推出会议记录产品,可录制、转录会议并生成摘要和行动项,同时测试类似 Granola 的系统音频转录功能。公司计划发布 AI 助手 Callie,利用现有日程安排栈自动设置会议和检查可用性。CEO Tope Awotona 表示,重点在于会议后的工作流自动化,并强调隐私保护,如告知用户录制。
中国初创公司Z.ai的AI模型GLM-5.3在Artificial Analysis Intelligence Index上获得60分,与Kimi K3并列开源模型榜首,比上一代GLM-5.2高出7分。该模型在代理任务上表现突出,GDPval-AA v2基准Elo得分从1524跃升至1770,仅次于Claude Opus 5。GLM-5.3通过API提供,但
OpenAI 发布了 openai-agents-python 库的 v0.22.0 版本,这是一个次要版本,主要增强了运行时稳定性并收紧了提供商配置契约。该版本会从可重放和持久化的 SDK 状态中删除被护栏拒绝的工具输出,对非流式响应中的失败或未完成状态抛出 ModelBehaviorError,并拒绝 OpenAIProvider 中显式客户端与 org
Anthropic 发布两项实验,让 Claude 模型(Mythos Preview 和 Opus 4.8)自主运行蛋白质设计流程,在早期药物发现中设计微型结合蛋白。结果显示,Claude 在 15 个目标中成功 14 个,实验室测试命中率达 26.8%,优于行业通常的 10%-15%。模型使用开源工具如 RFdiffusion 和 SolubleMPNN
Anthropic 首次在营收上超过 OpenAI。OpenAI 第二季度营收为 67 亿美元,环比增长 18%,而 Anthropic 同期营收翻倍至 116 亿美元,并实现小幅营业利润。Anthropic 的年化营收率同比增长七倍至 650 亿美元,其编程工具 Claude Code 的成功对 OpenAI 构成压力。OpenAI 表示在 GPT-5.6
该论文通过受控实验和轨迹分析,研究了技能(Skills)增强LLM代理的机制。研究发现,技能主要通过程序锚定(procedural anchoring)稳定执行,而非注入缺失知识,程序锚定占技能案例的65.7%,而显式知识注入仅占4.5%。检索是独立瓶颈,当技能池从5增至100时,实际使用精度从29.6%降至3.3%。技能在脆弱假设、不兼容上下文或适应不足时