返回全部动态
Qwen3.8-27B 编码专用 GGUF 量化系列发布
原标题:quimmedes/Qwen3.8-27B-XYZ
AI 摘要
quimmedes 发布了 Qwen3.8-27B 的 GGUF 量化版本(XYZ 系列),专注于编码任务,提供从 Q1Q 到 Q8 及 ULTRA 的多种量化档位,并支持 MTP 投机解码和视觉投影。该系列通过每张量量化配方保留关键张量精度,并针对代码测试套件优化,但明确不追求通用知识性能。用户可通过 llama-server 使用 OpenAI 兼容 API 部署,并提供了针对不同显存和低比特模型的采样建议。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
--- license: apache-2.0 tags: - qwen - qwen3.5 - multimodal - vision - gguf - ssm - quantization - coding - code base_model: Qwen/Qwen3.8-27B --- # Qwen3.8-27B — GGUF quantizations (XYZ) GGUF quantizations of [Qwen/Qwen3.8-27B](https://huggingface.co/Qwen/Qwen3.8-27B) (multimodal, hybrid SSM + attention, 64 layers + 1 MTP layer), converted with upstream llama.cpp. All files include the built-in **MTP block** (`nextn_predict_layers=1`), usable for speculative decoding. ## What the XYZ series i
发布时间:2026-08-22 04:04
抓取时间:2026-08-20 15:08
来源机构:Hugging Face