返回全部动态

Nanbeige4.2-3B GGUF 量化版本发布

原标题:gkraker04/Nanbeige4.2-3B-GGUF

Hugging Face New and Trending Models一手来源模型发布质量 83

AI 摘要

gkraker04 发布了 Nanbeige4.2-3B 模型的 GGUF 量化版本,该模型基于 Looped Transformer 架构,专为 buun-llama-cpp 运行时设计。量化使用重要性矩阵引导,提供从 Q8_0 到 IQ2_XS 的多种精度,并附有 MMLU-Pro 和 MuSR 基准测试结果,显示 Q4_K_M 在质量与体积间达到最佳平衡。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

--- license: apache-2.0 language: - en - zh library_name: gguf pipeline_tag: text-generation tags: - nanbeige - gguf - quantized - 3b - llama.cpp - imatrix base_model: Nanbeige/Nanbeige4.2-3B --- # Nanbeige4.2-3B GGUF GGUF quantizations of [Nanbeige4.2-3B](https://huggingface.co/Nanbeige/Nanbeige4.2-3B), a compact 3B agentic model built on a Looped Transformer architecture. These quants are built for [**buun-llama-cpp**](https://github.com/spiritbuun/buun-llama-cpp), the


发布时间:2026-08-10 21:37
抓取时间:2026-08-08 21:30
来源机构:Hugging Face
阅读原文huggingface.co