返回主题地图

开源生态

技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 699 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月24日周四 · 3 条
正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11140:CUDA 稀疏注意力优化加速 dsv4 预填充

llama.cpp 发布 b11140 版本,主要针对 CUDA 后端优化 DeepSeek-V4(dsv4)预填充阶段的 sparse-fa(稀疏 FlashAttention)。改动包括将 sparse mask 扫描的查询循环按 ncols1 模板化以在编译期确定循环边界,并把越界检查提升到主机端代码,使 49k 列稀疏解码形状下的扫描耗时从 46us

正文结构化主题已通过公开置信门槛
智东西产品发布2

平头哥发布真武V900并开源SAIL软件栈

平头哥在2026杭州云栖大会发布新一代训推一体AI芯片真武V900,性能达上一代真武M890的3倍,计划2027年第一季度量产。次日,平头哥公布开源AI软件栈T-Head SAIL最新进展,宣布扩大框架适配、加速库、工具链、通信库等领域的开源力度,SAIL已适配260余个主流框架,平均适配时间小于7天。真武AI芯片已服务20多个行业、650多家客户,SAIL

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11139 发布:修复休眠时 token 计数 API 崩溃

llama.cpp 发布 b11139 版本,主要修复了 server 端在 sleep 状态下 token counting API 崩溃的问题,并改进了休眠服务器的唤醒逻辑。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 等多平台及 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端的预编译二进制

9月23日周三 · 17 条
正文结构化主题已通过公开置信门槛
正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11138 发布:修复 Jinja 一元运算符解析

llama.cpp 发布 b11138 版本,主要修复了 Jinja 模板引擎中一元 +/- 运算符的解析问题,使其在变量前(如 items[:-n] 和 GigaChat 的 indent[:-indent factor])能正确解析,并确保过滤器/测试保持在操作数之外。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译

正文结构化主题已通过公开置信门槛
LangChain Releases一手来源开源1

LangChain 发布 langchain-openai 1.6.5

LangChain 发布 langchain-openai 1.6.5 版本,包含三项变更:版本发布提交、为 Anthropic 的 Opus 5.5 和 GPT-6 添加 profile 增强,以及在 SystemMessage 上支持对话中途的工具变更。该更新主要面向使用 LangChain 集成 OpenAI 与 Anthropic 模型的开发者。

正文结构化主题已通过公开置信门槛
THE DECODER产品发布1

Meta AI 智能体 Muse 首周获 50 万用户,被指抄袭 OpenClaw

Meta 于 9 月 8 日在美国推出个人 AI 智能体 Muse,首周吸引超过 50 万用户,其中日活超 25 万,累计输入超 200 万条提示,并登顶苹果 App Store。Meta 产品负责人 Nat Friedman 承认 Muse 在产品上「深受开源项目 OpenClaw 启发」,用户发现两者部分文件名与内容几乎一致。报道指出,Muse 能否持续

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering开源1

Graphify:统一代码库上下文,简化智能体软件工程

Graphify 是一款开源工具,可将代码库、文档和非结构化数据转换为可查询的多模态知识图谱,以优化 AI 编码工作流。该项目于 2026 年 4 月发布,采用每周多次更新的快速迭代节奏,近期改进了 Terraform 块属性保留、跨文件方法解析等解析器能力。它通过 tree-sitter 提取 AST 并结合文档语义线索构建统一图谱,可经 MCP 服务器接

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp 发布 b11135:server 端去重草稿 HF 模型

llama.cpp 发布 b11135 版本,主要修复了 server 端通过 dedup-cache-models 对草稿 HF 模型进行去重的问题(对应 issue #27846),并避免在 lambda 中捕获结构化绑定。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台多后端的预编译二进制包。

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11132 支持 Gemma 4 DSpark 草稿骨干

llama.cpp 发布 b11132 版本,新增对 Gemma 4 DSpark 草稿骨干(draft backbone)的支持,包括 GGUF 转换与运行时支持,覆盖全注意力与 SWA 两种 Gemma 4 DSpark 草稿,并支持绑定输出权重与布尔型骨干元数据。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布2

TopologicalQwen:拓扑知识蒸馏的1.7B模型

Convergent Intelligence LLC 研究部门发布 TopologicalQwen,一个从 Qwen3-30B-A3B-Thinking-2507 蒸馏得到的 1.7B 参数模型。该方法称为拓扑知识蒸馏(TKD),将教师输出分布视为有界变差函数,分解为平滑、跳跃和漂移三个通道进行知识迁移,并采用 DualMind 格式训练模型进行推理、自我

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp 发布 b11130 版本更新

llama.cpp 发布 b11130 版本,主要更新为 make-release 流程中的 summary prompt 调整。该版本提供了覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文结构化主题已通过公开置信门槛
Haystack Releases一手来源开源1

Haystack 发布 v3.2.0-rc1:新增 Agent 压缩与 token 预算钩子

Haystack 发布 v3.2.0-rc1,引入多项 Agent 与 Pipeline 相关更新。新功能包括实验性的 SummarizationCompactor(配合 CompactionHook 渐进式压缩对话以适配 token 预算)、TokenBudgetHook(限制 Agent 运行 token 消耗)、stop run 控制标志,以及 Pip

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11126:Vulkan 新增 IQ4 XS 矩阵乘法内核

llama.cpp 发布 b11126 版本,主要变更为在 Vulkan 后端新增 IQ4 XS 量化格式的 MMQ/MMV 矩阵乘法内核并做性能优化。优化过程中针对 Intel A770 上 MMVQ 出现 27.3% 的 tg 性能回退,选择在 Intel 设备上禁用 IQ4 XS 的 MMVQ。该版本同时提供覆盖 macOS、Linux、Windows

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp 发布 b11125:ggml-meta 解析多缓冲区视图

llama.cpp 发布 b11125 版本,主要变更是 ggml-meta 解析多缓冲区视图(multi buffer views),并添加 TODO 以便在图分配器重构后重新审视。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布2

LiconStudio 发布 LTX-2.5 多主体参考 LoRA

LiconStudio 在 Hugging Face 发布 Licon MSR V1,这是一个为 Lightricks 的 LTX-2.5 视频生成模型训练的多参考 LoRA。它采用 Multiple Subject Reference(MSR)方法,将最多五张参考图编码为与目标视频同一潜空间的视觉 token,并通过学习到的 slot embedding

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp 发布 b11124:修复 CUDA top-k MoE 触发问题

llama.cpp 发布 b11124 版本,主要修复了 CUDA 后端中 top-k MoE 算子应始终触发的问题(PR #28432)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp 发布 b11123:SYCL 新增 mul mat hadamard fp16 测试

llama.cpp 发布 b11123 版本,主要变更为 SYCL 后端新增 mul mat hadamard fp16 的 UT 测试用例(#29218)。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预编译二进制,覆盖 CPU、CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL F

正文结构化主题已通过公开置信门槛
Vercel AI SDK Releases一手来源开源1

Vercel AI SDK 发布 ai@7.0.112 补丁更新

Vercel AI SDK 发布 ai@7.0.112 补丁版本,修复了推理内容清理、UI 消息流取消回调、provider 序列化中不透明文件 URI 保留以及 UI 消息校验时元数据保留等问题,并同步更新了 @ai-sdk/gateway、@ai-sdk/provider 和 @ai-sdk/provider-utils 等依赖。

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11122:SYCL 扩展 MMVQ GLU 融合并新增算子融合

llama.cpp 发布 b11122 版本,主要更新为 SYCL 后端扩展 MMVQ GLU 融合,支持混合量化类型,并新增 rms norm+scale 与 ssm conv+silu 融合。同时提供覆盖 macOS、Linux、Windows、Android 等多平台多后端的预编译二进制包。