返回全部动态
llama.cpp b10922:OpenCL 新增 A8 Q4_K 二值化 GEMM 内核
原标题:b10922
AI 摘要
llama.cpp 发布 b10922 版本,主要变更是为 OpenCL 后端新增了一个 A8 Q4_K 非 MoE 二值化 GEMM 内核 kernel_gemm_noshuffle_q4_k_f32_32b_trans_ila_a8_bin,并修复了布局兼容性、重命名了二值内核选择辅助函数。该提交由高通工程师 Li He 参与贡献,同时发布了覆盖 macOS、Linux、Windows、Android 等多平台多后端的预编译二进制包。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
<details open> opencl: add bin kernel `kernel_gemm_noshuffle_q4_k_f32_32b_trans_ila_a8_bin` (#28677) * opencl: add A8 Q4_K non-MoE binary kernel * opencl: fix layout compatibility * opencl: rename binary kernel selection helpers --------- Co-authored-by: Li He <lih@qti.qualcomm.com> </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.com/ggml-org/llama.cpp/attestations/47035522> **macOS/iOS:** - [macOS Apple Silicon (arm64)](https://github.com/ggml-org/lla
发布时间:2026-09-12 16:30
抓取时间:2026-09-12 17:11
来源机构:ggml-org