Qwen3.8-27B EfficientThink GGUF 模型发布
原标题:nerkyor/Qwen3.8-27B-EfficientThink-Uncensored-K3-Opus5-Grok4.6-GPT5.6Sol-SFT-SimPO-DFlash2-GGUF
AI 摘要
Hugging Face 上发布了 nerkyor/Qwen3.8-27B-EfficientThink-Uncensored-K3-Opus5-Grok4.6-GPT5.6Sol-SFT-SimPO-DFlash2-GGUF,这是一个基于 Qwen3.8-27B 的 GGUF 量化模型,支持 DFlash2 投机解码和多种量化级别(Q2-Q8)。模型在 GPQA、MMLU 和 LCB 基准上展示了性能,并提供了 llama.cpp 的部署指南。该模型旨在提升推理效率和性能,并支持多语言(英语和中文)。
正文节选
--- license: apache-2.0 language: - en - zh tags: - qwen3.8 - gguf - efficient-thinking - dflash2 - speculative-decoding - llama.cpp - q2-lynnstyle - mixed-precision - gsq-rco - gsq - iq - rco --- # Qwen3.8-27B EfficientThink GGUF  > **No strict loops were observed in the reviewed Q2–Q8 evaluations.** **BF16 / FP8 main repository: [nerkyor/Qwen3