返回全部动态

llama.cpp b10831:Vulkan 新增 TQ1_0 支持,Metal 拒绝相关操作

原标题:b10831

llama.cpp Releases一手来源产品发布质量 81

AI 摘要

llama.cpp 发布 b10831 版本,为 Vulkan 后端新增 TQ1_0 量化格式支持,涵盖矩阵乘法、向量乘法、反量化及行获取等操作,并修复了独立反量化着色器中的错误。同时,Metal 后端明确拒绝 TQ1_0 的 GET_ROWS 和矩阵乘法操作,以避免因缺少内核而崩溃。该版本还优化了代码结构,提取共享解码辅助函数,并精简了注释。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

<details open> vulkan: add TQ1_0 support (mm, mat-vec, mat-vec-id, dequant, get_rows) (#27765) * vulkan: add TQ1_0 support (mm, mat-vec, dequant, get_rows) * vulkan: pack TQ1_0 powers of 3 into a 32-bit constant Replaces the constant array with a packed 32-bit value (7 bits per entry, max 81 < 128) extracted with shift/mask, as suggested in review — avoids a constant array that may not be kept in registers. test-backend-ops on gfx1151: tq1_0 MUL_MAT 11/11, MUL_MAT_ID 6/6, GET_ROWS 4/4, unch


发布时间:2026-09-07 13:20
抓取时间:2026-09-07 13:35
来源机构:ggml-org
阅读原文github.com