返回全部动态
llama.cpp b10993 发布:为 hf-jobs 添加自托管 WebGPU 与 Vulkan
原标题:b10993
AI 摘要
llama.cpp 发布 b10993 版本,主要变更是为 hf-jobs 添加自托管的 WebGPU 和 Vulkan 后端,并调整 CPU 后端线程数。该版本同时提供覆盖 macOS、Linux、Windows、Android 等平台的预编译二进制,支持 CUDA、ROCm、Vulkan、SYCL、OpenVINO 等多种加速后端。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
<details open> ci : add self-hosted webgpu to hf-jobs (#28712) * add self-hosted vulkan and webgpu to hf-jobs * try t4-medium * cont : adjust cpu backend threads * try t4-small again * restore cm jobs --------- Co-authored-by: Georgi Gerganov <ggerganov@gmail.com> </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.com/ggml-org/llama.cpp/attestations/47838838> **macOS/iOS:** - [macOS Apple Silicon (arm64)](https://github.com/ggml-org/llama.cpp/releases/d
发布时间:2026-09-16 14:54
抓取时间:2026-09-16 15:13
来源机构:ggml-org