返回全部动态

llama.cpp b10578 发布:优化 concat 操作并更新多平台支持

原标题:b10578

llama.cpp Releases一手来源产品发布质量 69

AI 摘要

llama.cpp 发布 b10578 版本,主要优化了 ggml 库中的 concat 操作,将逐元素 memcpy 替换为行级 memcpy,以提升性能。该版本提供了适用于 macOS、Linux、Windows、Android 和 iOS 的多种预编译二进制文件,并支持 Vulkan、CUDA、ROCm、OpenVINO 等后端。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

<details open> ggml: optimize concat op by replacing per-element memcpy with row-level memcpy (#24575) * ggml: optimize concat op by replacing per-element memcpy with row-level memcpy * ggml: fix concat offsets for row-level copies * ggml: add concat row contiguity asserts * ggml: move concat block size asserts * ggml: remove redundant concat asserts * Update ggml/src/ggml-cpu/ops.cpp Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co> --------- Co-authored-by: Sigbjørn


发布时间:2026-08-22 17:10
抓取时间:2026-08-22 17:11
来源机构:ggml-org
阅读原文github.com