AgentionAI 发布 Qwen3.8-Flash-Next AP GGUF 量化版
原标题:agentionai/Qwen3.8-Flash-Next-AP-GGUF
AI 摘要
AgentionAI 在 Hugging Face 发布了 Qwen/Qwen3.8-Flash-Next 的 Agention Precision (AP) GGUF 量化版本,兼容主线 llama.cpp,无需 fork。该系列提供从 AP-Q5_K_XL 到 AP-IQ2_S 共 7 个量化档位,按每 GiB 显存精度优化,并给出各档位的 KL 散度与 top-1 一致率评测数据。作者指出该架构带有 512 亿参数的 n-gram 查表,wikitext 属于其记忆集,因此采用留出语料评测以避免分数虚高。
正文节选
--- base_model: - Qwen/Qwen3.8-Flash-Next base_model_relation: quantized license: other license_name: qwen-community-1.0 license_link: LICENSE library_name: gguf pipeline_tag: text-generation tags: - gguf - qwen3.8-flash-next - qwen4exp - imatrix - agentionai --- # Qwen3.8-Flash-Next AP GGUF [Agention Precision](https://agention.ai/models/qwen3.8-flash-next/) (AP) quants of [Qwen/Qwen3.8-Flash-Next](https://huggingface.co/Qwen/Qwen3.8-Flash-Next). Mainline llama.cpp compatible — standard quant