返回全部动态

llama.cpp b10712 发布:Vulkan 新增 top_k 基数选择优化

原标题:b10712

llama.cpp Releases一手来源产品发布质量 72

AI 摘要

llama.cpp 发布 b10712 版本,主要更新为 Vulkan 后端新增 top_k 基数选择着色器,用于 k >= 1024 的场景,并针对 Qwen 3.8 Flash Next 模型添加了 top-k 测试和 QSA 融合优化。该版本提供了多平台预编译二进制文件,包括 macOS、Linux、Windows、Android 等。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

<details open> vulkan: top_k radix select for k >= 1024 for Qwen 3.8 Flash Next (#28032) * vulkan: add top-k radix sort shader for k >= 1024 * add Qwen 3.8 Flash Next top-k tests * add top-k qsa fusion * clean up code </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.com/ggml-org/llama.cpp/attestations/44052683> **macOS/iOS:** - [macOS Apple Silicon (arm64)](https://github.com/ggml-org/llama.cpp/releases/download/b10712/llama-b10712-bin-macos-arm64.tar.gz


发布时间:2026-08-31 13:39
抓取时间:2026-08-31 13:48
来源机构:ggml-org
阅读原文github.com