返回全部动态

llama.cpp b10442 发布:优化 Intel Xe Vulkan 性能

原标题:b10442

llama.cpp Releases一手来源产品发布质量 72

AI 摘要

llama.cpp 发布 b10442 版本,主要针对 Vulkan 后端在 Intel Xe 显卡上的 coopmat mul_mm 操作添加了 SHMEM_STRIDE_PAD 和 APPLY_SLM_A_RESHAPE 优化,并修复了共享内存估算和越界读取问题。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,并支持多种后端如 CUDA、Vulkan、ROCm 等。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

<details open> vulkan: add SHMEM_STRIDE_PAD/APPLY_SLM_A_RESHAPE for coopmat1 on Intel Xe (#25380) * vulkan: add SHMEM_STRIDE_PAD/APPLY_SLM_A_RESHAPE for coopmat mul_mm on Intel Xe * vulkan: fix shmem estimate for Intel SHMEM_STRIDE_PAD=0 in matmul_shmem_support * cacheline aligned for shared kvalues_mxfp4 * vulkan: fix OOB read in kvalues_mxfp4 init after cacheline padding * vulkan: restrict SLM-A reshape to Intel Windows driver, revert mxfp4 cacheline padding </details> **Website:** - <


发布时间:2026-08-15 22:58
抓取时间:2026-08-15 23:39
来源机构:ggml-org
阅读原文github.com