VOL. 2026-08-04 · 12 STORIES · DAILY INTELLIGENCE

AI HOT RADAR 日报

新一期发布后,可按你的时区发送
REPORT DELIVERY

把报告送到邮箱

选择日报、周报或月报。我们会先发送确认链接,未经确认不会投递。

推送周期

UTC 当地时间投递,可随时从邮件退订。

今日看点

今日AI行业的核心动向集中在模型发布与基础设施升级两大主线

今日AI行业的核心动向集中在模型发布与基础设施升级两大主线。在模型侧,多家机构密集推出面向特定场景的轻量级或专用模型:Liquid AI发布2.6B参数的本地智能体模型,Mistral AI推出3B参数的多模态安全分类器,NVIDIA则连续发布两款面向自动驾驶的视觉-语言-动作模型,分别聚焦推理与链式思维能力。与此同时,Synthyra发布了蛋白质语言模型,Qwopus3.6-27B-Coder也推出了量化版本,显示出模型生态正加速向垂直领域和高效部署方向分化。在基础设施侧,Cloudflare集中发布了代理开发生命周期工具集、可编程钱包和CI SDK,旨在推动AI代理从代码生成走向完整的软件工程与支付闭环;Amazon Bedrock则正式上线Web Search功能,为模型响应提供网络知识接地。此外,llama.cpp连续发布两个版本,新增对Qwen3-TTS的支持并扩展SYCL路径的KV缓存兼容性,持续夯实本地推理的底层能力。整体来看,当日趋势呈现为:模型侧追求更小参数、更强专用能力,基础设施侧则着力构建代理运行所需的完整工具链与支付体系。

今日看点

2 个章节 · 12 条情报
  1. 01
    模型发布Liquid AI 发布 LFM2.5-2.6B:高效本地智能体模型
    6
  2. 02
    产品发布Cloudflare 推出代理开发生命周期工具集,推动软件工厂自动化
    6
01

模型发布

MODEL RELEASE6

Liquid AI 发布 LFM2.5-2.6B:高效本地智能体模型

Liquid AI 发布了 LFM2.5-2.6B,一个 2.6B 参数的小型语言模型,专为本地和边缘设备上的智能体部署而设计。该模型通过四阶段后训练(包括 SFT、教师专业化、多领域策略蒸馏和智能体强化学习)在工具使用、指令遵循和多步智能体任务上表现出色,可与 4 倍大的模型竞争。LFM2.5-2.6B 支持高效的 CPU 和 GPU 推理,在 Apple M5 Max 上达到 220 tok/s,在 AMD Ryzen CPU 上达到 113 tok/s,并已与 llama.cpp、vLLM 等推理框架集成。该模型已在 Hugging Face 上发布,并提供浏览器演示。

查看事件脉络阅读原文 ↗

Mistral AI 发布开源多模态安全分类器 Shieldstral

Mistral AI 发布了 Shieldstral,一个 3B 参数的开源多模态安全分类器,通过将内容审核构建为策略自适应问答任务,在文本安全方面匹配甚至超越高达其 7 倍规模的模型,并在多模态审核上达到新高度。该模型支持在推理时以自然语言提供政策,无需重新训练即可统一处理文本和图像,并输出校准的安全分数。Shieldstral 以 Apache 2.0 许可证开源,可在单张 16GB GPU 上高效运行,Mistral AI 还宣布其成为 Open Secure AI Alliance 的创始成员。

查看事件脉络阅读原文 ↗

NVIDIA发布Alpamayo 1.5:面向自动驾驶的100亿参数推理VLA模型

NVIDIA发布了Alpamayo 1.5,这是一个基于Cosmos-Reason2 VLM骨干的100亿参数链式思维推理VLA模型,专为自动驾驶社区设计。该模型支持导航引导、灵活摄像头数量和用户问答,采用扩散轨迹解码器,并已通过RL后训练。模型权重在OpenMDW-1.1许可下发布,源代码采用Apache 2.0,主要用于处理自动驾驶中的罕见长尾事件。

查看事件脉络阅读原文 ↗

Synthyra 发布 ESMplusplus_small 蛋白质语言模型

Hugging Face 上发布了 Synthyra/ESMplusplus_small 模型,这是 FastPLMs 对 ESMC 的实现,支持蛋白质语言建模和掩码语言模型任务。该模型提供嵌入、PEFT 微调和测试时训练功能,并支持多种注意力后端。模型要求 Python 3.11-3.14、PyTorch 2.13 和 Transformers 5.13,并依赖 FlashAttention。

查看事件脉络阅读原文 ↗

Qwopus3.6-27B-Coder 发布 NVFP4 量化版,支持 vLLM 与工具调用

Hugging Face 上发布了 Qwopus3.6-27B-Coder 的 NVFP4 量化版本,该模型基于 Jackrong/Qwopus3.6-27B-Coder,采用 W4A4 量化,大小约 18GB,相比 bf16 原始模型减少约 33%,在 wikitext-2 上困惑度为 6.63,支持 256K 上下文,专为 NVIDIA Blackwell 上的 vLLM 优化,支持工具调用和思考模式。

查看事件脉络阅读原文 ↗
02

产品发布

PRODUCT RELEASE6

Cloudflare 推出代理开发生命周期工具集,推动软件工厂自动化

Cloudflare 宣布推出新工具集,旨在让 AI 代理超越代码生成,承担更多软件开发生命周期(SDLC)的任务,包括 CI/CD 运行、本地开发中的可观测性、代理监控等。Cloudflare 提出用代理开发生命周期(ADLC)取代传统 SDLC,强调软件工厂需要可编程、可扩展、可复现、实时、原子化、权限化和自改进的平台。此举旨在应对 AI 生成代码带来的交付速度激增,减轻人类工程师负担。

查看事件脉络阅读原文 ↗

Cloudflare 推出可编程钱包,助力代理互联网支付

Cloudflare 宣布推出 Cloudflare Wallets,为 AI 代理提供可编程钱包,解决代理在注册和支付 API 时的困难。钱包分为账户钱包和虚拟钱包,支持稳定币微支付,并通过 x402 协议与 Monetization Gateway 集成。此举旨在推动代理经济,让代理能自主探索和购买服务,同时通过支出上限保障安全。

查看事件脉络阅读原文 ↗

Cloudflare 推出 CI SDK,支持在平台上运行百万级仓库的 CI/CD

Cloudflare 发布了 CI SDK,基于 Workflows 和 Sandbox SDK,允许开发者在 Cloudflare 平台上直接运行 CI/CD 流水线,支持构建、测试、缓存、自愈和条件部署。该 SDK 将 CI/CD 流水线定义为 TypeScript 代码,替代 YAML 配置,并支持平台管理和自定义 CI 并行运行。此举旨在简化大规模仓库的持续集成流程,提升开发者体验。

查看事件脉络阅读原文 ↗

Amazon Bedrock 推出 Web Search 功能,实现基础模型网络知识接地

AWS 在纽约峰会上宣布 Amazon Bedrock 上的 Web Search 功能正式可用,该功能通过内置的服务器端工具,将模型响应基于最新的网络知识进行 grounding,无需第三方供应商或外部 API。它采用多源 grounding 方法,结合亚马逊运营的网络索引和知识图谱,提供上下文高效的检索和单参数启用,并支持企业级合规(零数据出口)。开发者可通过 OpenAI Responses API 轻松启用,目前支持通过 Bedrock 提供的 OpenAI 模型。

查看事件脉络阅读原文 ↗

llama.cpp b10270 发布,支持 Qwen3-TTS

llama.cpp 发布 b10270 版本,主要新增对 Qwen3-TTS 的支持,包括文本模型、编码器、说话人编码器及代码到语音的转换,并重构了 llama-tts 二进制文件。该版本还提供了多种平台和硬件加速的预编译二进制文件。

查看事件脉络阅读原文 ↗

llama.cpp b10255 扩展 SYCL SDPA 支持非 FP16 KV 缓存

llama.cpp 发布 b10255 版本,扩展了 SYCL oneDNN SDPA 路径以支持非 FP16 的 KV 缓存(包括 Q4_0-Q8_0 和 FP32),通过在设备上将 K/V 反量化为 FP16 后送入 SDPA 图,使融合的 systolic 内核与原生 FP16 路径一致运行。该版本还包含流同步修复和移除 V_is_K_view 别名,并提供了多平台二进制下载。

查看事件脉络阅读原文 ↗
12独立事件
12一手报道
7发布来源
9 min读完本期
逐条速览当天值得追踪的 AI 变化所有事实条目均可回到原始发布方核验
阅读周报
已发布总述由 deepseek-chat 生成;条目来自已保存的精选与 Story,事实以原文为准。生成于 2026/8/5 10:16:12 · report-v2