返回全部动态
llama.cpp b11069:为 SM70 (Volta) 调整 MMVQ 到 MMQ 切换
原标题:b11069
AI 摘要
llama.cpp 发布 b11069 版本,主要变更是针对 SM70(Volta)架构调整了 MMVQ 到 MMQ 的切换阈值(crossover),由 Yangyu Chen 提交并经 Johannes Gaessler 审阅。该版本同时提供覆盖 macOS、Linux、Windows、Android 等平台的预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
<details open> cuda : tune MMVQ to MMQ crossover for SM70 (Volta) (#28912) * tune MMVQ to MMQ crossover for SM70 (Volta) Signed-off-by: Yangyu Chen <cyy@cyyself.name> * Apply suggestion from @JohannesGaessler * Apply suggestion from @JohannesGaessler * Apply suggestion from @JohannesGaessler --------- Signed-off-by: Yangyu Chen <cyy@cyyself.name> Co-authored-by: Johannes Gäßler <johannesg@5d6.de> </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.com/ggm
发布时间:2026-09-21 18:14
抓取时间:2026-09-21 18:18
来源机构:ggml-org