返回全部动态
llama.cpp b10712 发布:Vulkan 新增 top_k 基数选择优化
原标题:b10712
AI 摘要
llama.cpp 发布 b10712 版本,主要更新为 Vulkan 后端新增 top_k 基数选择着色器,用于 k >= 1024 的场景,并针对 Qwen 3.8 Flash Next 模型添加了 top-k 测试和 QSA 融合优化。该版本提供了多平台预编译二进制文件,包括 macOS、Linux、Windows、Android 等。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
<details open> vulkan: top_k radix select for k >= 1024 for Qwen 3.8 Flash Next (#28032) * vulkan: add top-k radix sort shader for k >= 1024 * add Qwen 3.8 Flash Next top-k tests * add top-k qsa fusion * clean up code </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.com/ggml-org/llama.cpp/attestations/44052683> **macOS/iOS:** - [macOS Apple Silicon (arm64)](https://github.com/ggml-org/llama.cpp/releases/download/b10712/llama-b10712-bin-macos-arm64.tar.gz
发布时间:2026-08-31 13:39
抓取时间:2026-08-31 13:48
来源机构:ggml-org