First Orion 利用 Amazon Nova Act 加速 QA 自动化
First Orion 是一家品牌通信公司,其工程团队因开发速度超过 QA 测试能力而面临瓶颈。他们采用 Amazon Nova Act,将基于脚本的测试自动化转变为由 AI 驱动的智能代理,使 QA 分析师能用自然语言描述测试目标。该方案解决了回归测试非自助、新功能测试用例缺口和脚本脆弱等问题,提升了发布速度和质量。
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2491 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
First Orion 是一家品牌通信公司,其工程团队因开发速度超过 QA 测试能力而面临瓶颈。他们采用 Amazon Nova Act,将基于脚本的测试自动化转变为由 AI 驱动的智能代理,使 QA 分析师能用自然语言描述测试目标。该方案解决了回归测试非自助、新功能测试用例缺口和脚本脆弱等问题,提升了发布速度和质量。
AWS 发布了一篇关于部署 Anthropic Claude 应用网关(Claude apps gateway)的博客,该网关为 Claude Code 和 Claude Desktop 提供集中治理层,支持身份验证、模型访问控制、成本归属和支出限制。参考部署使用 AWS Fargate、RDS PostgreSQL、内部负载均衡器和 OIDC 身份提供商,
Nvidia发布了开源权重模型Nemotron 3.5 Lightning,该模型拥有316亿总参数但仅激活36亿参数,在智能指数上达到24分,与OpenAI的gpt-oss-120b持平,但推理速度接近每秒670个token,远超同类模型。该模型在代理基准测试中表现显著提升,采用宽松的OpenMDW-1.1许可证,并提供BF16和NVFP4权重,多家云服务
前 Kimi CLI 负责人 stdrc 在采访中提出,模型越强,Harness 反而越厚,但复杂度从能力层转移到协作层。他基于 Kimi CLI 的实践,指出底层 Harness 可被模型内化,但多智能体协作等上层需求催生更厚的 Harness。他创办的 Raft 公司直接实践这一理念,将成熟 AI 产品作为团队成员,专注多智能体协作的 Harness 架
安全公司 A Security 的研究人员利用不到 20 条 AI 提示词,发现 Zoom 存在一个严重安全漏洞,该漏洞可让攻击者在会议中劫持所有参会者的设备,无需受害者操作且无视觉提示。Zoom 已于周二发布修复补丁,影响 Windows、macOS、Linux、Android 和 iOS 平台。
LangGraph 发布了 1.2.11 版本,主要新增了在 add node 上暴露 trace policy 的功能,并进行了多项依赖更新和测试改进。同时,相关的 checkpoint 包(checkpoint-postgres 和 checkpoint-sqlite)也发布了新版本,修复了 delta 通道历史中的写入收集问题。
亚马逊近期简化了订单确认邮件,不再列出具体商品名称,仅显示商品类别,引发用户不满。亚马逊发言人表示此举是为了引导用户使用其应用和网站获取详细信息,并减少在外部共享客户信息以提升隐私。分析认为,这可能是亚马逊为应对AI购物代理(如Google的Gemini Spark)带来的竞争,保护其与消费者的直接关系。
Ollama 发布 v0.32.9 版本,新增对 NVIDIA Nemotron 3.5 Lightning 模型的支持。该模型是一个开放 30B 参数的混合专家(MoE)模型,仅有 3B 活跃参数,专为常驻 AI 代理的执行层设计,并支持 OpenClaw 和 Hermes Agent 等框架。此外,该版本还修复了 Muse Glimmer 函数调用解析器
NVIDIA 发布了 Nemotron 3.5 Lightning,一个 30B 参数的 MoE 模型,仅有 3B 活跃参数,专为长时间运行的 AI 代理的高频执行任务设计。该模型支持 OpenClaw 和 Hermes Agent 等框架,并配合 NVIDIA NeMo Switchyard 进行模型路由,以及 NeMoClaw 安全与管理栈。Nemotr
另有 1 家信源报道
NVIDIA 在八月庆祝本地 AI 生态,发布多款新模型和工具,包括 Cosmos 3 Edge、MiniMax-H3、Laguna S 2.1、DeepSeek-V4-Flash、Inkling-Small、Wan-Animate-2 和 LTX-2.5,并支持 Meta 的 Muse Glimmer 模型。这些模型和工具旨在推动本地 AI 和智能代理的发
NVIDIA 发布了 Nemotron 3.5 Lightning,一个 300 亿参数的混合专家模型,专为长时间运行的代理式 AI 工作负载设计,提供高达 4 倍的输出速度和 30% 更快的任务完成速度。同时,NVIDIA 推出了 NeMo Switchyard,一个开源模型路由库,可智能地将请求路由到最合适的模型,降低成本并保持质量。这些发布旨在为企业提
NVIDIA 发布了 NeMo Switchyard,这是一个用于 AI 代理工作负载的模型路由库,允许开发者根据任务需求在多个模型之间路由请求,以平衡准确性、成本和延迟。该库支持多种路由算法,并提供与提供商无关的 SDK 和服务器参考实现,可接受 OpenAI、Anthropic 等 API 请求。通过智能路由,系统可以在复杂任务中使用更强大的模型,在简单
Langfuse 发布 v4.8.0 版本,主要新增了应用内代理功能,允许用户在一次对话中批准一次工具使用。同时修复了 OpenTelemetry 中 Anthropic 缓存令牌别名映射和评估过滤器选项加载的问题,并更新了依赖库版本。
OpenAI 为 ChatGPT Business 推出 Premium Seats,每位用户每月收费 125 美元(年付 100 美元),提供标准席位 5 倍的使用容量,且不受五小时限制。此举旨在满足代理式 AI 消耗更多 token 的需求,并允许工作区内混合使用不同席位。分析认为,这反映了 AI 实验室从低价策略转向盈利模式的趋势。
Langfuse 发布了 v4.7.1 版本,主要包含两项更新:重构了应用内代理,移除了不再使用的前台运行时支持;修复了 worker 中 Mixpanel 导入请求超时的问题。该版本旨在提升稳定性和性能。
n8n 发布 2.35.0 版本,包含多项核心修复,重点优化 AI Agent 节点,防止工具调用前文本泄漏到响应中,并限制过大的代理工具结果。同时修复了 MCP 工具模式编译、OAuth2 参数去重、任务运行器健康检查等问题,提升了稳定性和安全性。
戴盟机器人宣布完成数亿元融资,由蚂蚁集团领投,老股东超额跟投,两个月内连续完成两轮融资。该公司孵化于香港科技大学,专注于触觉感知与物理AI,发布了全球首个触觉锚定世界模型Daimon-TWM,并已实现视触觉传感器万片级出货,服务全球200余家客户。融资将用于推动触觉感知、数据与模型的商业化落地,覆盖3C精密制造和汽车智造等场景。
另有 1 家信源报道
Langfuse 发布 v4.7.0 版本,包含多项新功能与修复。新功能包括新的会话头部、自动化 webhook 操作改进、应用内代理工具审批跟踪、OTel 流量自动直写、PostHog 和 Mixpanel 集成等。修复涉及代理会话取消、仪表板成本显示、MCP 工具模式验证、正则回溯 DoS 防护、Datadog 追踪中移除用户邮箱等。此外,还进行了多项性
本文提出了一种名为Agent Memory Distillation (AMD)的无训练框架,通过层次化记忆将大型教师智能体的结构化知识迁移到小型学生智能体。AMD构建了工作流记忆、子任务记忆和函数记忆三种互补记忆类型,并在三个工具使用基准上使用四个学生模型进行评估,平均准确率分别提升27.2%、11.2%和3.4%。分析表明子任务记忆贡献最大,教师有效性取
OpenAI Agents JavaScript 库发布 v0.15.0,默认模型改为 gpt-5.6-luna,并支持 MCP v2 协议协商。新版本增强了 RunState 的持久化能力,包括输入、工具输出和重试状态,同时改进了沙箱挂载凭据的安全性。此外,还增加了对 React Native 和 Realtime 的支持,并提升了 OpenAI 和 AI