VOL. 2026-W38 · 10 STORIES · WEEKLY SIGNALS
AI HOT RADAR 周报
2026-09-14 — 2026-09-20 · PUBLISHED · 约 8 分钟
本周开源社区的去审查与量化发布成为一条清晰主线:Ornith-1.5…
本周开源社区的去审查与量化发布成为一条清晰主线:Ornith-1.5-35B-A3B 的 abliterated GGUF 量化版与 LTX-2.5 无审查视频模型 v1.1 相继出现在 Hugging Face 趋势榜,显示社区正围绕既有基座模型做二次加工与轻量化分发。与此同时,CrowdGPT 以随机初始化权重发布约 10 亿参数的 Crowd-v1,把分布式协作训练的思路推向社区共建。推理侧则延续稳定性打磨,llama.cpp 连续发布 b10944、b10946、b10947,分别修复 SYCL 内存获取、s390x VXE repack 辅助函数与 nemotron-h 专家 FFN 除零崩溃。厂商层面,智谱完成约 335 亿元融资并押注递归式自我改进(RSI)自训练体系,英特尔则宣布 9 月 22 日召开大会聚焦智能体 AI、端侧与 AI 基础设施。政策与生态讨论同步升温,奥巴马敦促民主党就 AI 安全制定清晰计划,而社区作者从 ChatGPT 转向 DeepSeek、Qwen 的实践分享,也折射出开源模型使用面的持续扩大。
本周主线
5 个章节 · 10 条情报- 01开源项目Ornith-1.5-35B-A3B 去审查版 GGUF 量化发布5
- 02模型发布LTX-2.5 无审查视频模型 v1.1 发布,融合五个 LoRA 并量化1
- 03行业与商业智谱完成335亿元融资,押注RSI自训练体系2
- 04政策与监管奥巴马敦促民主党制定AI安全清晰计划1
- 05观点从ChatGPT到开源模型:我的AI探索之路1
开源项目
OPEN SOURCE5 篇Ornith-1.5-35B-A3B 去审查版 GGUF 量化发布
Hugging Face 用户 gbuzhf 发布了 Ornith-1.5-35B-A3B 的 abliterated(去审查)GGUF 量化版本,基于 huihui-ai 的 abliterated 权重,提供 19G/21G/23G/25G 四档 ICE 量化及 BF16 主模型。该版本使用 27,513 条全语料重要性矩阵校准,并嵌入模型自带的 MTPv2 头和 Qwen-Sharp v22.4.1 聊天模板。作者在 WikiText-2 和代码测试集上对比了 ICE 与 Unsloth Dynamic 量化的 KL 散度,并警告该模型无拒绝行为,需在 OS 级沙箱中运行。
CrowdGPT 发布社区分布式模型 Crowd-v1
CrowdGPT 发布了其首个社区分布式语言模型架构 Crowd-v1,约 10 亿参数,采用 Transformer 架构并基于 GQA、RoPE、SwiGLU 等技术。该模型以随机初始化权重发布,本身不具备语言知识,目的是为 CrowdGPT 分布式训练客户端提供统一的模型定义和权重格式,供参与者共同训练。模型使用 Qwen3 兼容的 151,669 词表,提供 BF16 和 FP32 权重文件,目前处于训练进行中状态。
llama.cpp b10947 修复 nemotron-h 专家 FFN 除零崩溃
llama.cpp 发布 b10947 版本,修复了 nemotron-h 模型在加载时的专家 FFN 尺寸回退逻辑缺陷。当 NextN/MTP 尾部循环中 expert_feed_forward_length 未提供该层数值时,代码会用 n_ff/n_expert_used 推导专家 FFN 尺寸,而这两个逐层数组在非 MoE 层上合法地为 0,导致同时为 0 的检查点发生除零并在加载时以 SIGFPE 崩溃且无错误提示。该修复改为报告元数据格式错误,同时照常提供各平台预编译二进制包。
llama.cpp 发布 b10946:修复 s390x VXE repack 辅助函数
llama.cpp 发布 b10946 版本,主要变更是为 ggml-cpu 的 s390x 架构添加对 VXE 专用 repack 辅助函数的保护(PR #28775)。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
llama.cpp 发布 b10944:修复 SYCL 内存获取错误
llama.cpp 发布 b10944 版本,主要修复 SYCL 后端获取内存时的错误(#28227),包括对不支持 ZES API 的处理、优化代码、调整日志级别、清理无用头文件,并修复检测 Level Zero SDK/开发包失败时的构建错误。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包。
模型发布
MODEL RELEASE1 篇LTX-2.5 无审查视频模型 v1.1 发布,融合五个 LoRA 并量化
Hugging Face 用户 ChrisColeTech 发布了 LTX-2.5-uncensored-v1.1-FP8 模型,基于 Lightricks 的 LTX-2.5 视频生成模型,将 Eros10 NSFW LoRA、DMD 4步蒸馏 LoRA、官方 IC-LoRA 等五个微调权重合并进模型,并提供 GGUF 与 FP8 量化版本。该模型支持文生视频、图生视频、视频生视频和音频生视频,最低 4 步即可生成,推荐 8 步、1280×720 分辨率。
行业与商业
BUSINESS2 篇智谱完成335亿元融资,押注RSI自训练体系
智谱宣布完成约50亿美元(约合人民币335.4亿元)融资,包括约20亿美元股份配售及约30亿美元零息可转债,资金约60%用于下一代GLM基础模型与完全自训练体系研发,重点探索递归式自我改进(RSI)循环。公司披露2026年上半年营收9.54亿元、同比增长近400%,MaaS及API收入8.25亿元,ARR达16亿美元。此举反映国产大模型头部厂商融资与上市竞赛提速。
英特尔2026技术创新与产业生态大会9月22日开幕
智东西报道,英特尔将于9月22日-23日举办2026英特尔技术创新与产业生态大会(Intel Connection 2026),聚焦智能体AI、端侧全场景创新与AI基础设施三大赛道。大会包含11场主题演讲、7大专题论坛、40+场技术课堂、15000平方米AI成果展区(1300+项成果)及5场免费开发者实操工作坊,英特尔与60余家合作伙伴展示云边端全栈技术。
政策与监管
POLICY1 篇奥巴马敦促民主党制定AI安全清晰计划
美国前总统奥巴马在民主党筹款活动上表示,民主党需要将人工智能列为“核心议程”,并制定“非常清晰的计划”来应对该技术在经济影响和安全方面的担忧。他建议民主党在重夺众议院多数后建立公开对话框架,并称AI若被妥善管控将有益,例如加速药物研发。众议院少数党领袖杰弗里斯对此表示认同。报道还提到奥巴马曾与Anthropic CEO Dario Amodei和OpenAI CEO Sam Altman交流,而Amodei近期提出“为前沿技术定速”的安全方案,Altman和马斯克均作出积极回应。
观点
OPINION1 篇从ChatGPT到开源模型:我的AI探索之路
一位作者在 Hugging Face 博客中回顾自己从使用 ChatGPT 转向开源模型 DeepSeek 和 Qwen 的经历,并分享了自己尝试训练超小模型(如 Single Floppy、floppyx3、floppyx4)的失败过程。作者认为开源模型可检查内部机制,比闭源服务更可信,并提到因图书馆屏蔽 DeepSeek 而短暂使用 Claude,但受限于速率限制。