VOL. 2026-08-30 · 12 STORIES · DAILY INTELLIGENCE

AI HOT RADAR 日报

新一期发布后,可按你的时区发送
REPORT DELIVERY

把报告送到邮箱

订阅整期 AI 行业简报,不会逐条发送动态。我们会先发送确认链接,未经确认不会投递。

  1. 1发送确认邮件链接 24 小时有效
  2. 2你点击确认防止他人冒用邮箱
  3. 3投递下一期报告含摘要、在线原文与退订链接
推送周期

Asia/Shanghai 当地时间 08:30 后投递已发布的下一期报告;不会补发确认前的历史期刊, 可随时从邮件退订。

今日看点

今日AI领域最显著的变化是模型发布与开源生态的活跃:腾讯推出770B…

今日AI领域最显著的变化是模型发布与开源生态的活跃:腾讯推出770B参数的开源模型Hy4 Preview,支持可调推理强度与1M上下文窗口;GLM-5.3-Flash的NVFP4量化版将体积缩减70%且保持高相似度,NaviDC-OCR等轻量级文档解析模型也相继亮相。同时,基础设施工具密集迭代,llama.cpp连续发布多个版本为Apple M2/M3 Pro添加fa-vec调优并支持Hexagon设备,LiteLLM与Agno则分别强化镜像签名验证和新增集成。开源平台three.ws为AI代理提供3D生成与支付能力,而索尼和华纳起诉Anthropic盗用音乐版权训练模型,凸显了版权合规在AI发展中的紧迫性。

今日看点

4 个章节 · 12 条情报
  1. 01
    模型发布GLM-5.3-Flash NVFP4 量化版发布:体积缩减70%
    4
  2. 02
    产品发布Agno v3.0.2 发布:新增集成与 MCP 改进
    6
  3. 03
    开源项目three.ws 开源栈:为 AI 代理提供身体、大脑、钱包与工作
    1
  4. 04
    行业与商业索尼和华纳起诉Anthropic,指控其大规模盗用音乐版权训练AI
    1
01

模型发布

MODEL RELEASE4

GLM-5.3-Flash NVFP4 量化版发布:体积缩减70%

LibertAI 发布了 GLM-5.3-Flash 的 NVFP4 量化版本,将模型从 598.5 GiB 压缩至 181 GiB,体积减少 70%,余弦相似度达 0.99665。该量化仅针对路由专家 FFN,保留注意力、视觉塔等关键部分为 BF16,确保多模态行为与原始模型一致。模型支持 vLLM 和 SGLang,但需要特定配置,且已修复 GB10 上的兼容性问题。

查看事件脉络阅读原文 ↗

NaviDC-OCR:轻量级文档解析模型,统一数字与拍摄文档

StarDoc-AI 发布了 NaviDC-OCR,一个约 1.2B 参数的开源视觉语言模型,专为文档解析设计,统一处理数字和相机拍摄文档。该模型引入了多节点共识投票、几何感知建模、曲率引导采样等技术,在 OmniDocBench 和 Wild_OmniDocBench 基准上达到最先进性能,且无需去畸变预处理。模型采用 Apache-2.0 许可证,支持中英日文。

查看事件脉络阅读原文 ↗

Ornith-1.5-35B-A3B Abliterated 多量化等级 GGUF 发布

gbuzhf 发布了 Ornith-1.5-35B-A3B 模型的 abliterated 版本,并提供了九个不同量化等级的 GGUF 文件,每个都嵌入了 MTP 头。测量显示 abliteration 对模型的影响(KLD 0.0151)小于 Q6_K 量化(KLD 0.0222),且 abliteration 与量化损伤近似正交,不会使模型恢复拒绝行为。

查看事件脉络阅读原文 ↗

腾讯发布Hy4 Preview:770B参数开源模型,推理强度可调

腾讯今日发布开源权重文本输入模型Hy4 Preview,总参数量770B,激活参数49B,上下文窗口1M token,Hugging Face上体积1.56TB,相比7月的Hy3大幅提升。模型支持两种推理强度:默认'high'和'no_think'(禁用推理)。作者通过SVG生成测试展示了其推理轨迹,并指出推理文本使用截断英文以节省token。

查看事件脉络阅读原文 ↗
02

产品发布

PRODUCT RELEASE6

Agno v3.0.2 发布:新增集成与 MCP 改进

Agno 发布 v3.0.2 版本,包含多项行为变更、新集成和改进。行为变更包括运行元数据优先级调整、MCPConfig 拒绝未知字段、推理检测改为询问提供商等。新集成支持 Synthorai 模型提供商、WaveSpeed 图像视频生成、Serply 搜索工具包和 AtomicMail 邮件工具包。改进包括将 Agent/Team/Workflow 作为 MCP 工具发布、工具包作为 MCP 工具、MCP 工具标题和注释支持等。

查看事件脉络阅读原文 ↗

LiteLLM v1.100.0-rc.1 发布:镜像签名验证与多项修复

LiteLLM 发布 v1.100.0-rc.1 版本,所有 Docker 镜像均使用 cosign 签名,并提供了基于提交哈希和发布标签的验证方法。该版本包含多项修复和功能更新,包括 Anthropic 消息处理、复杂性路由器、提示缓存节省报告、模型注册表更新、代理搜索工具、MCP 工具集强制、以及多个测试和 UI 改进。

查看事件脉络阅读原文 ↗

LiteLLM v1.99.0-rc.2 发布:镜像签名验证与多项修复

LiteLLM 发布了 v1.99.0-rc.2 版本,该版本的所有 Docker 镜像均使用 cosign 进行签名,并提供了通过固定提交哈希或发布标签验证签名的方法。此版本还包含多项修复,包括 UI 回归修复、Vertex 实时和视觉图像测试修复,以及 Anthropic 消息桥接中 tool_result 文档块的翻译修复。

查看事件脉络阅读原文 ↗
03

开源项目

OPEN SOURCE1

three.ws 开源栈:为 AI 代理提供身体、大脑、钱包与工作

three.ws 是一个开源平台,为 AI 代理提供 3D 生成、动画、支付和分发能力。其代码以 Apache-2.0 协议在 GitHub 上开源,模型托管在 Hugging Face。平台通过多引擎路由实现免费优先的 3D 生成,并支持照片到虚拟形象、骨骼动画、x402 支付标准及 MCP 集成。该平台旨在将代理的“身体、大脑、钱包和分发”整合为单一产品。

查看事件脉络阅读原文 ↗
04

行业与商业

BUSINESS1

索尼和华纳起诉Anthropic,指控其大规模盗用音乐版权训练AI

索尼音乐和华纳音乐等主要音乐出版商起诉AI公司Anthropic及其高管,指控其未经许可使用数万首受版权保护的音乐作品(主要是歌词)训练Claude模型,并称这是历史上最大规模的公然知识产权盗窃之一。诉讼重点在于Anthropic获取训练数据的方式,包括通过非法种子下载盗版书籍和从授权平台抓取歌词。此前Anthropic已因类似问题支付了15亿美元和解金。

查看事件脉络阅读原文 ↗
12独立事件
10一手报道
7发布来源
8 min读完本期
逐条速览当天值得追踪的 AI 变化所有事实条目均可回到原始发布方核验
阅读周报
已发布总述由 deepseek-v4-flash 生成;条目来自已保存的精选与 Story,事实以原文为准。生成于 2026/8/30 22:41:00 · report-v3