VOL. 2026-09-21 · 12 STORIES · DAILY INTELLIGENCE
AI HOT RADAR 日报
2026-09-21 · PUBLISHED · 约 9 分钟
Cloudflare Python Workers 正式 GA,Py…
Cloudflare Python Workers 正式 GA,Python 成为该平台一等公民语言,开发者可直接使用 FastAPI、Django、Flask 等框架,这是当天最直接的产品层面变化。模型侧,IFM 连续发布 K2-Horizon-3.7B 与完全开放的 K2-Horizon-7B,均具备 512K 原生上下文,微软则在《Nature》发表逆合成模型 RetroChimera。安全与对齐研究同样活跃,Loopjacking 揭示了人类在环审批中批准内容与实际执行不一致的边界失效问题,另有工作探索让模型只拒绝话题中的正确子集。此外,llama.cpp 对 Hexagon 后端进行 DMA 与 64 位映射重构,Langfuse 则增强了 AI Gateway 追踪与鉴权能力。
今日看点
5 个章节 · 12 条情报- 01产品发布Cloudflare Python Workers 正式 GA2
- 02安全Loopjacking:劫持人类在环审批的安全边界1
- 03模型发布微软开源逆合成模型RetroChimera,登Nature4
- 04研究进展安全为谁?拒绝话题中的正确子集而非整个话题4
- 05开源项目llama.cpp b11070:Hexagon 后端 DMA 与 64 位映射重构1
产品发布
PRODUCT RELEASE2 篇Cloudflare Python Workers 正式 GA
Cloudflare 宣布 Python Workers 正式 GA,Python 成为 Cloudflare 开发者平台上的一等公民语言。开发者可直接使用 FastAPI、Django、Flask 等框架,并通过内置 ASGI/WSGI 连接器接入 Workers 平台,同时原生支持 Workers AI、R2、D1、Hyperdrive 等绑定,无需再手写 JavaScript 类型转换胶水代码。
Langfuse v4.39.0 发布:AI Gateway 追踪与鉴权增强
Langfuse 发布 v4.39.0 版本,主要新增 AI Gateway 阶段跨度追踪、Codex 客户端元数据记录、按标签过滤提示事件、基于策略核心的摄取事件鉴权、Vertex AI 支持等特性,并修复了 AI Gateway 流关闭时保留补全内容、生成元数据命名空间整理等问题。该版本还包含大量 Web 界面与设计系统重构、追踪批处理遥测改进以及文档更新。
安全
SECURITY1 篇Loopjacking:劫持人类在环审批的安全边界
该论文提出「Loopjacking」概念,指人类在环审批中,人类批准的操作与系统实际执行的操作不一致,导致审批安全边界失效。作者区分了表示型攻击(审批时展示不完整或误导性表示)和审批后状态替换攻击(审批后可变状态被替换)。在Agno AgentOS 3.0.9、LangGraph Agent Server 0.14.0和OpenClaw 2026.2.23等产品中复现了这些攻击,而OpenAI Agents SDK 0.22.0/0.22.2作为阴性对照未受影响。研究提出完整规范呈现加使用时精确绑定、以及防止未授权待审批状态修改两种防御方案。
模型发布
MODEL RELEASE4 篇微软开源逆合成模型RetroChimera,登Nature
微软研究院在《Nature》发表逆合成预测模型 RetroChimera,它结合基于 Transformer 的 R-SMILES 2 与基于图神经网络的 NeuralLoc 两个互补模型,通过学习式集成策略对二者预测排序。盲测中化学家更偏好 RetroChimera 给出的反应预测,优于子模型、既有方法甚至文献记录的反应。该模型已在 GitHub 以 MIT 许可开源并提供权重,同时可通过 Microsoft Foundry 访问,旨在加速药物与新材料研发。
IFM 发布 K2-Horizon-3.7B 开放权重模型
IFM 在 Hugging Face 发布 K2-Horizon-3.7B,这是 K2-Horizon 系列中的小型稠密解码器模型,拥有 3.7B 核心参数和 512K 原生上下文窗口。该模型在 agentic、编码和推理基准上与 Qwen3.5-4B、G9v3-3B、Granite 4.2-3B、Nemotron 3 Nano-4B 等开放权重稠密模型对比。模型采用 Apache-2.0 许可,公开训练数据、配方、训练代码和评估资源,并发布中间检查点以便研究训练过程中的能力变化。
JoyFox 发布 Qwen3.8-27B 未审查变体,降低拒绝率
joyfox 发布了基于 Qwen3.8-27B 的未审查变体模型,通过 abliteration 技术降低拒绝率,同时保留原生架构、视觉栈和 MTP 权重。该模型在 800 个良性提示上实现 0% 拒绝率,能力得分与官方版持平,并提供多种 GGUF 量化版本。
IFM 发布 K2-Horizon-7B 开源稠密模型,支持 512K 上下文
IFM 在 Hugging Face 发布 K2-Horizon-7B,这是 K2-Horizon 系列的中等规模稠密解码器模型,拥有 512K 原生上下文窗口。模型在数学、编程、长上下文与推理等基准上对标 Gemma 4-12B、Qwen3.5-9B、Granite 4.2-8B 等参考模型,并公开训练数据、训练配方、训练代码与评测资源,同时提供中间检查点和用于加速推理的 Diffusion Adapters。
研究进展
RESEARCH4 篇安全为谁?拒绝话题中的正确子集而非整个话题
Hugging Face Blog 介绍了一篇新论文《Safety for Whom? Boundary-Aware Self-Distillation for Controlled LLM Safety Refusal》,研究如何让模型只拒绝某个话题中与部署政策不兼容的子集,而非整个话题。作者以政治说服为测试场景,指出标准自生成训练流程存在覆盖缺口、误拒副作用和边界度量缺失三个问题,并提出升级重试、分布内良性数据和边界配对等修复方法。实验显示,在 Qwen3-8B 上政治拒绝率从 9.47% 升至 84.75%,但 XSTest 过度拒绝率也从 2.00% 升至 74.00%,说明必须同时报告安全与过度拒绝两个维度。
弹性阈值注意力:面向长上下文解码的学习型上下文稀疏
该论文提出 Elastic Threshold Attention(ETA),一种端到端可训练的稀疏注意力架构,用于缓解长上下文解码中的 KV 缓存内存带宽瓶颈。ETA 通过查询表示预测动态的逐头阈值,并在训练中以退火 sigmoid 门控乘性抑制低于阈值的 logits,而非直接删除,从而避免表示坍塌并消除初始 token 上的注意力汇。作者还实现了基于 Triton 的块稀疏解码内核,并称 1.45B 预训练模型在语言建模、常识推理和长上下文检索上可媲美稠密注意力,并在最长 512K token 序列上实现相对 FlashAttention-2 的墙钟解码加速。
BI-Agent与BI-Bench:迈向端到端商业智能自动化
研究者从公开来源收集真实世界BI项目(.pbix文件),人工提取业务问题与标准答案,构建了首个端到端BI基准BI-Bench。测试发现前沿LLM在BI-Bench上准确率不足50%。为此提出工具增强的BI-Agent,将BI工作流分解为搜索、连接、转换等子任务,并开发后训练框架合成训练轨迹,结合SFT和RL进行训练。BI-Agent在BI-Bench上相比原始LLM提升最高40个百分点,后训练版本再提升最高30个百分点。
CodeMidas:从代码本身扩展智能体编码强化学习环境
研究团队提出 CodeMidas,一个以源代码为唯一任务特定输入的智能体流水线,将现有代码库中已实现的功能转化为可执行的强化学习环境。该方法通过智能体探索功能、构建基于原始代码执行的测试,并经过执行检查与多次解答采样来验证和筛选任务。最终数据集包含来自 3185 个开源代码库、覆盖 23 种编程语言和 15 个技术领域的 5545 个训练任务。用 GRPO 训练 MiMo-V2.5 后,在五个基准上均有提升,包括 DeepSWE +11.7%、ProgramBench +17%、Terminal-Bench v2.1 +8.5%。
开源项目
OPEN SOURCE1 篇llama.cpp b11070:Hexagon 后端 DMA 与 64 位映射重构
llama.cpp 发布 b11070 版本,主要针对 Hexagon 后端进行大规模重构,重写缓冲区和 DMA 处理以支持 64 位映射。改动涵盖二进制算子、softmax、GDN、矩阵乘法等内核的 DMA 化,并新增检查脚本与开发者文档。同时提供 macOS、iOS、Linux(含 CUDA、ROCm、Vulkan、SYCL 等)及 Android 多平台预编译包。