返回全部动态
llama.cpp b11054:Hexagon 后端启用 TOP_K 算子支持
原标题:b11054
AI 摘要
llama.cpp 发布 b11054 版本,主要变更为在 Hexagon 后端启用对 TOP_K 算子的支持,包括单行 TOP_K 线程化、提升基于 VTCM 的尺寸上限、修复 TOP_K mdev 行分区、优化大行选择,并更新了相关文档。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译包。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
<details open> hexagon: enable support for TOP_K op (#29113) * hexagon: enable support for TOP_K op * hex-topk: thread single-row TOP_K, raise VTCM-based size cap * hex-topk: fix TOP_K mdev row partitioning * hex-topk: optimize TOP_K large-row selection * hexagon: clean up comment formatting * hex-docs: update TOP_K support listings </details> **Website:** - <https://llama.app> **Attestations:** - <https://github.com/ggml-org/llama.cpp/attestations/48657197> **macOS/iOS:** - [macOS Ap
发布时间:2026-09-20 00:47
抓取时间:2026-09-20 01:32
来源机构:ggml-org