VOL. 2026-09-21 · 12 STORIES · DAILY INTELLIGENCE

AI HOT RADAR 日报

新一期发布后,可按你的时区发送
REPORT DELIVERY

把报告送到邮箱

订阅整期 AI 行业简报,不会逐条发送动态。我们会先发送确认链接,未经确认不会投递。

  1. 1发送确认邮件链接 24 小时有效
  2. 2你点击确认防止他人冒用邮箱
  3. 3投递下一期报告含摘要、在线原文与退订链接
推送周期

按 Asia/Shanghai 当地时间 08:30 后投递已发布的下一期报告;不会补发确认前的历史期刊, 可随时从邮件退订。

今日看点

Cloudflare Python Workers 正式 GA,Py…

Cloudflare Python Workers 正式 GA,Python 成为该平台一等公民语言,开发者可直接使用 FastAPI、Django、Flask 等框架,这是当天最直接的产品层面变化。模型侧,IFM 连续发布 K2-Horizon-3.7B 与完全开放的 K2-Horizon-7B,均具备 512K 原生上下文,微软则在《Nature》发表逆合成模型 RetroChimera。安全与对齐研究同样活跃,Loopjacking 揭示了人类在环审批中批准内容与实际执行不一致的边界失效问题,另有工作探索让模型只拒绝话题中的正确子集。此外,llama.cpp 对 Hexagon 后端进行 DMA 与 64 位映射重构,Langfuse 则增强了 AI Gateway 追踪与鉴权能力。

今日看点

5 个章节 · 12 条情报
  1. 01
    产品发布Cloudflare Python Workers 正式 GA
    2
  2. 02
    安全Loopjacking:劫持人类在环审批的安全边界
    1
  3. 03
    模型发布微软开源逆合成模型RetroChimera,登Nature
    4
  4. 04
    研究进展安全为谁?拒绝话题中的正确子集而非整个话题
    4
  5. 05
    开源项目llama.cpp b11070:Hexagon 后端 DMA 与 64 位映射重构
    1
01

产品发布

PRODUCT RELEASE2 篇

Cloudflare Python Workers 正式 GA

Cloudflare 宣布 Python Workers 正式 GA,Python 成为 Cloudflare 开发者平台上的一等公民语言。开发者可直接使用 FastAPI、Django、Flask 等框架,并通过内置 ASGI/WSGI 连接器接入 Workers 平台,同时原生支持 Workers AI、R2、D1、Hyperdrive 等绑定,无需再手写 JavaScript 类型转换胶水代码。

查看事件脉络阅读原文 ↗

Langfuse v4.39.0 发布:AI Gateway 追踪与鉴权增强

Langfuse 发布 v4.39.0 版本,主要新增 AI Gateway 阶段跨度追踪、Codex 客户端元数据记录、按标签过滤提示事件、基于策略核心的摄取事件鉴权、Vertex AI 支持等特性,并修复了 AI Gateway 流关闭时保留补全内容、生成元数据命名空间整理等问题。该版本还包含大量 Web 界面与设计系统重构、追踪批处理遥测改进以及文档更新。

查看事件脉络阅读原文 ↗
02

安全

SECURITY1 篇

Loopjacking:劫持人类在环审批的安全边界

该论文提出「Loopjacking」概念,指人类在环审批中,人类批准的操作与系统实际执行的操作不一致,导致审批安全边界失效。作者区分了表示型攻击(审批时展示不完整或误导性表示)和审批后状态替换攻击(审批后可变状态被替换)。在Agno AgentOS 3.0.9、LangGraph Agent Server 0.14.0和OpenClaw 2026.2.23等产品中复现了这些攻击,而OpenAI Agents SDK 0.22.0/0.22.2作为阴性对照未受影响。研究提出完整规范呈现加使用时精确绑定、以及防止未授权待审批状态修改两种防御方案。

查看事件脉络阅读原文 ↗
03

模型发布

MODEL RELEASE4 篇

微软开源逆合成模型RetroChimera,登Nature

微软研究院在《Nature》发表逆合成预测模型 RetroChimera,它结合基于 Transformer 的 R-SMILES 2 与基于图神经网络的 NeuralLoc 两个互补模型,通过学习式集成策略对二者预测排序。盲测中化学家更偏好 RetroChimera 给出的反应预测,优于子模型、既有方法甚至文献记录的反应。该模型已在 GitHub 以 MIT 许可开源并提供权重,同时可通过 Microsoft Foundry 访问,旨在加速药物与新材料研发。

查看事件脉络阅读原文 ↗

IFM 发布 K2-Horizon-3.7B 开放权重模型

IFM 在 Hugging Face 发布 K2-Horizon-3.7B,这是 K2-Horizon 系列中的小型稠密解码器模型,拥有 3.7B 核心参数和 512K 原生上下文窗口。该模型在 agentic、编码和推理基准上与 Qwen3.5-4B、G9v3-3B、Granite 4.2-3B、Nemotron 3 Nano-4B 等开放权重稠密模型对比。模型采用 Apache-2.0 许可,公开训练数据、配方、训练代码和评估资源,并发布中间检查点以便研究训练过程中的能力变化。

查看事件脉络阅读原文 ↗

IFM 发布 K2-Horizon-7B 开源稠密模型,支持 512K 上下文

IFM 在 Hugging Face 发布 K2-Horizon-7B,这是 K2-Horizon 系列的中等规模稠密解码器模型,拥有 512K 原生上下文窗口。模型在数学、编程、长上下文与推理等基准上对标 Gemma 4-12B、Qwen3.5-9B、Granite 4.2-8B 等参考模型,并公开训练数据、训练配方、训练代码与评测资源,同时提供中间检查点和用于加速推理的 Diffusion Adapters。

查看事件脉络阅读原文 ↗
04

研究进展

RESEARCH4 篇

安全为谁?拒绝话题中的正确子集而非整个话题

Hugging Face Blog 介绍了一篇新论文《Safety for Whom? Boundary-Aware Self-Distillation for Controlled LLM Safety Refusal》,研究如何让模型只拒绝某个话题中与部署政策不兼容的子集,而非整个话题。作者以政治说服为测试场景,指出标准自生成训练流程存在覆盖缺口、误拒副作用和边界度量缺失三个问题,并提出升级重试、分布内良性数据和边界配对等修复方法。实验显示,在 Qwen3-8B 上政治拒绝率从 9.47% 升至 84.75%,但 XSTest 过度拒绝率也从 2.00% 升至 74.00%,说明必须同时报告安全与过度拒绝两个维度。

查看事件脉络阅读原文 ↗

弹性阈值注意力:面向长上下文解码的学习型上下文稀疏

该论文提出 Elastic Threshold Attention(ETA),一种端到端可训练的稀疏注意力架构,用于缓解长上下文解码中的 KV 缓存内存带宽瓶颈。ETA 通过查询表示预测动态的逐头阈值,并在训练中以退火 sigmoid 门控乘性抑制低于阈值的 logits,而非直接删除,从而避免表示坍塌并消除初始 token 上的注意力汇。作者还实现了基于 Triton 的块稀疏解码内核,并称 1.45B 预训练模型在语言建模、常识推理和长上下文检索上可媲美稠密注意力,并在最长 512K token 序列上实现相对 FlashAttention-2 的墙钟解码加速。

查看事件脉络阅读原文 ↗

BI-Agent与BI-Bench:迈向端到端商业智能自动化

研究者从公开来源收集真实世界BI项目(.pbix文件),人工提取业务问题与标准答案,构建了首个端到端BI基准BI-Bench。测试发现前沿LLM在BI-Bench上准确率不足50%。为此提出工具增强的BI-Agent,将BI工作流分解为搜索、连接、转换等子任务,并开发后训练框架合成训练轨迹,结合SFT和RL进行训练。BI-Agent在BI-Bench上相比原始LLM提升最高40个百分点,后训练版本再提升最高30个百分点。

查看事件脉络阅读原文 ↗

CodeMidas:从代码本身扩展智能体编码强化学习环境

研究团队提出 CodeMidas,一个以源代码为唯一任务特定输入的智能体流水线,将现有代码库中已实现的功能转化为可执行的强化学习环境。该方法通过智能体探索功能、构建基于原始代码执行的测试,并经过执行检查与多次解答采样来验证和筛选任务。最终数据集包含来自 3185 个开源代码库、覆盖 23 种编程语言和 15 个技术领域的 5545 个训练任务。用 GRPO 训练 MiMo-V2.5 后,在五个基准上均有提升,包括 DeepSWE +11.7%、ProgramBench +17%、Terminal-Bench v2.1 +8.5%。

查看事件脉络阅读原文 ↗
05

开源项目

OPEN SOURCE1 篇

llama.cpp b11070:Hexagon 后端 DMA 与 64 位映射重构

llama.cpp 发布 b11070 版本,主要针对 Hexagon 后端进行大规模重构,重写缓冲区和 DMA 处理以支持 64 位映射。改动涵盖二进制算子、softmax、GDN、矩阵乘法等内核的 DMA 化,并新增检查脚本与开发者文档。同时提供 macOS、iOS、Linux(含 CUDA、ROCm、Vulkan、SYCL 等)及 Android 多平台预编译包。

查看事件脉络阅读原文 ↗
12独立事件
12一手报道
9发布来源
≈9 min读完本期
逐条速览当天值得追踪的 AI 变化所有事实条目均可回到原始发布方核验
阅读周报 →
已发布总述由 deepseek-v4-flash 生成;条目来自已保存的精选与 Story,事实以原文为准。生成于 2026/9/22 21:26:07 · report-v3