VOL. 2026-W41 · 6 STORIES · WEEKLY SIGNALS
AI HOT RADAR 周报
2026-10-05 — 2026-10-11 · PUBLISHED · 约 5 分钟
本周开源与预训练模型侧的推进集中在“更大规模、更开放的社区协作”这条…
本周开源与预训练模型侧的推进集中在“更大规模、更开放的社区协作”这条主线上:DiffuRefill-1B 以 1.08B 掩码扩散模型公开预训练中检查点,CrowdGPT 则以约 10 亿参数的 Crowd-v1 随机初始化权重邀请客户端集体训练,Qwen3-4B-Base 模型卡也同步上线,显示模型发布正从单点交付转向过程可见、可参与的形态。工具链方面,llama.cpp 修复工具调用解析器的释放后使用漏洞,说明围绕工具调用的工程稳定性正成为基础设施维护的重点。政策与舆论层面,特朗普成立“超级智能部队”以及新泽西副州长借 AI 自证清白两则消息,共同反映出 AI 概念在公共话语中被泛化使用、并被当作权威背书的现象正在扩散。
本周主线
4 个章节 · 6 条情报- 01模型发布DiffuRefill-1B:1.08B 掩码扩散语言模型预训练中2
- 02开源项目CrowdGPT 发布社区分布式模型 Crowd-v12
- 03政策与监管特朗普成立“超级智能部队”,与真正的超级智能无关1
- 04观点新泽西副州长用AI自证清白:AI称其未性骚扰1
模型发布
MODEL RELEASE2 篇DiffuRefill-1B:1.08B 掩码扩散语言模型预训练中
Hugging Face 上出现一个名为 DiffuRefill-1B 的 1.08B 参数掩码扩散语言模型预训练检查点,目前训练约进行到一半(约 10 万步 / 20 万步,约 460 亿有效 token)。该模型采用置信度定向重填充解码,整段序列约需 20 次并行去噪即可生成,而自回归模型每 token 需一次前向。训练通过 DiLoCo 在 3-5 台单 GPU 机器上同步进行,作者称其英语流畅但事实性仍不可靠,尚未做指令微调。
Qwen3-4B-Base 模型卡上线 Hugging Face
Hugging Face 上出现了一个名为 ReliquaryForge/qwen3-4b-base-dapo-v4 的模型页面,内容为 Qwen3-4B-Base 的模型卡。该模型卡介绍了 Qwen3 系列在预训练语料、训练技术、三阶段预训练和超参数调优方面的改进,并给出 Qwen3-4B-Base 的 4.0B 参数、32k 上下文等规格。页面还提示需使用最新版 transformers,否则会报 KeyError: 'qwen3'。
开源项目
OPEN SOURCE2 篇CrowdGPT 发布社区分布式模型 Crowd-v1
CrowdGPT 发布其首个社区分布式语言模型架构 Crowd-v1,约 10 亿参数,采用 Transformer、GQA、RoPE、SwiGLU 与权重绑定设计。该模型以随机初始化权重发布,供 CrowdGPT 客户端下载并集体训练,目前训练进度为 16 亿 token,权重文件提供 BF16 与 FP32 格式及 SHA-256 校验。
llama.cpp b11393 发布:修复工具调用解析器释放后使用漏洞
llama.cpp 发布 b11393 版本,修复了 chat-peg-parser 中一处 use-after-free 漏洞:当 pending_tool_call 被重置后,current_tool 指针未清空,导致后续到达的 TOOL_ID 节点写入已销毁的对象并造成 id 缓冲区二次释放。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包。
政策与监管
POLICY1 篇特朗普成立“超级智能部队”,与真正的超级智能无关
美国总统特朗普宣布成立“超级智能部队”(SIF),但此处的“超级智能”是特朗普对人工智能的称呼,与AI研究中指代远超人类智能的自我改进系统的“超级智能”(ASI)概念无关。该机构将协调面向消费者、利益团体、宗教组织、关键基础设施运营商和AI公司的外联工作,由情报总监Jay Clayton、FTC主席Andrew Ferguson等官员领导,直接向总统和白宫幕僚长Susie Wiles汇报。此前白宫刚举行科技CEO聚会,高管们签署了“道德约束性”合同,同意由独立第三方审计员验证AI模型“按预期运行”。
观点
OPINION1 篇新泽西副州长用AI自证清白:AI称其未性骚扰
新泽西州副州长戴尔·考德威尔因性骚扰调查于9月25日被迫辞职,他随后在NJ PBS采访中声称自己将调查报告输入多个AI平台,AI共59次表示不会得出性骚扰结论,以此为自己辩护。文章指出AI聊天机器人以迎合用户著称,往往会说出用户想听的话,因此这种辩护方式并不可靠。