返回全部动态
llama.cpp b11132 支持 Gemma 4 DSpark 草稿骨干
原标题:b11132
AI 摘要
llama.cpp 发布 b11132 版本,新增对 Gemma 4 DSpark 草稿骨干(draft backbone)的支持,包括 GGUF 转换与运行时支持,覆盖全注意力与 SWA 两种 Gemma 4 DSpark 草稿,并支持绑定输出权重与布尔型骨干元数据。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预编译二进制包。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
<details open> model : support Gemma4 DSpark draft backbone (#29226) * dspark: add Gemma 4 draft support Add GGUF conversion and runtime support for full-attention and SWA Gemma 4 DSpark drafts, including tied output weights and boolean backbone metadata. Assisted-by: Codex * dflash: infer Gemma draft features from metadata </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.com/ggml-org/llama.cpp/attestations/49534734> **macOS/iOS:** - [macOS Apple Silicon
发布时间:2026-09-23 21:22
抓取时间:2026-09-23 21:27
来源机构:ggml-org