返回全部动态

Qwen3.8-27B MTPLX 8位量化优化质量版发布

原标题:Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality

Hugging Face New and Trending Models一手来源模型发布质量 33

AI 摘要

Hugging Face 用户 Youssofal 发布了 Qwen3.8-27B-MTPLX-Optimized-Quality,这是基于 Qwen/Qwen3.8-27B 的 8 位动态量化 MLX 模型包,面向 Apple Silicon Mac 本地运行。该版本保留原生多 token 预测(MTP)投机解码头,在 M5 Max 上实测约 48 tok/s,与 bf16 原模型的 top-1 一致率达 99.3%、KL 散度为 0.0005,官方称输出几乎无法与全精度模型区分。模型需 36GB 以上统一内存,可通过 MTPLX 命令行或 Mac 应用使用。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

--- license: apache-2.0 library_name: mtplx pipeline_tag: text-generation base_model: Qwen/Qwen3.8-27B base_model_relation: quantized tags: - mlx - apple-silicon - macos - speculative-decoding - multi-token-prediction - qwen - qwen3.8 - mtp - mtplx - local-ai - coding - qwen3-8 - qwen-3.8 - local-llm - llm - m5 - m5-max - m4 - m3 - macbook-pro - mac-studio - opencode - claude-code - 27b - qwen3.8-27b - qwen3-8-27b --- **[MTPLX](https://mtplx.com): the fastest way to run Qwen 3.8 on a Mac. Nativ


发布时间:2026-09-23 06:02
抓取时间:2026-09-23 06:03
来源机构:Hugging Face
阅读原文huggingface.co