返回全部动态

llama.cpp v0.1.2 发布:同步 ggml 并优化 CUDA 性能

原标题:v0.1.2

llama.cpp Releases一手来源产品发布质量 79

AI 摘要

llama.cpp 发布了 v0.1.2 版本,主要更新包括同步 ggml 子模块、升级 ggml 版本至 0.20.2、修复 xcframework 构建问题、优化 CUDA 性能(MMVQ nwarps=8)、改进 UI 和文档(如 MCP stdio 服务器说明)、增强 mtmd 图像处理(使用 SHA256 哈希)等。该版本还提供了 nightly build b10485,并改进了 CI 流程。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

> [!NOTE] > Semantic versioning is still work in progress. > More info can be found in https://github.com/ggml-org/ggml/discussions/1579 **Nightly build:** [b10485](https://github.com/ggml-org/llama.cpp/releases/tag/b10485) ## Change log since v0.1.1 1511ce3bc sync : ggml da786dc23 ggml : bump version to 0.20.2 (ggml/1589) 27e345b57 build : fix xcframework + cmake clean-up (#27304) 8b8640097 ci : create pre-release with change log and nightly link in make-release (#27302) 25ae3a9b3 CUDA: MMVQ


发布时间:2026-08-18 18:23
抓取时间:2026-08-18 18:41
来源机构:ggml-org
阅读原文github.com