返回全部动态

llama.cpp b10886:s390x 新增 Q1_0 向量 intrinsic 支持

原标题:b10886

llama.cpp Releases一手来源开源质量 66

AI 摘要

llama.cpp 发布 b10886 版本,主要变更为在 ggml-cpu 的 s390x 架构上新增 Q1_0 向量内积(ggml_vec_dot_q1_0_q8_0)的 intrinsic 支持,由 IBM 的 Aaron Teo 提交并同步更新了 Q1_0 的支持文档。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译包,涵盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

<details open> ggml-cpu(s390x): add Q1_0 vector intrinsic support (#28606) * ggml-cpu: add `ggml_vec_dot_q1_0_q8_0` support Signed-off-by: Aaron Teo <aaron.teo1@ibm.com> * ggml-cpu: clean up variable naming for understanding Signed-off-by: Aaron Teo <aaron.teo1@ibm.com> * docs: update support for Q1_0 Signed-off-by: Aaron Teo <aaron.teo1@ibm.com> --------- Signed-off-by: Aaron Teo <aaron.teo1@ibm.com> </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.c


发布时间:2026-09-10 16:32
抓取时间:2026-09-10 17:28
来源机构:ggml-org
阅读原文github.com