返回全部动态

llama.cpp b10614:Metal 后端并行编译与新增算子支持

原标题:b10614

llama.cpp Releases一手来源产品发布质量 79

AI 摘要

llama.cpp 发布 b10614 版本,主要针对 Metal 后端进行重构,将算子源码拆分为多个文件并支持并行编译,显著提升编译速度。同时新增了 col2im_1d、CONV_2D_DW(深度卷积)、Q2_0 等算子支持,并融合了 snake 激活函数。该版本还提供了多平台(macOS、Linux、Windows、Android 等)的预编译二进制文件。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

<details open> metal: per-op source split + parallel compile (#26561) * metal : per-op source split + parallel compile (#24021) * preliminary extract common header * op source split * split metallib into 8 libs && load in parallel * derive kernel->library routing from functionNames * x-macro lib list + underscore filenames, dedup QK_NL, MRC fixes * op source split 8 to 20 * improve robustness of source fallback * clean up * change bool -> atomic_bool * only prepend headers that sourc


发布时间:2026-08-25 05:23
抓取时间:2026-08-25 06:18
来源机构:ggml-org
阅读原文github.com