返回全部动态

AgentionAI 发布 Qwen3.8-Flash-Next AP GGUF 量化版

原标题:agentionai/Qwen3.8-Flash-Next-AP-GGUF

Hugging Face New and Trending Models一手来源开源质量 61

AI 摘要

AgentionAI 在 Hugging Face 发布了 Qwen/Qwen3.8-Flash-Next 的 Agention Precision (AP) GGUF 量化版本,兼容主线 llama.cpp,无需 fork。该系列提供从 AP-Q5_K_XL 到 AP-IQ2_S 共 7 个量化档位,按每 GiB 显存精度优化,并给出各档位的 KL 散度与 top-1 一致率评测数据。作者指出该架构带有 512 亿参数的 n-gram 查表,wikitext 属于其记忆集,因此采用留出语料评测以避免分数虚高。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

--- base_model: - Qwen/Qwen3.8-Flash-Next base_model_relation: quantized license: other license_name: qwen-community-1.0 license_link: LICENSE library_name: gguf pipeline_tag: text-generation tags: - gguf - qwen3.8-flash-next - qwen4exp - imatrix - agentionai --- # Qwen3.8-Flash-Next AP GGUF [Agention Precision](https://agention.ai/models/qwen3.8-flash-next/) (AP) quants of [Qwen/Qwen3.8-Flash-Next](https://huggingface.co/Qwen/Qwen3.8-Flash-Next). Mainline llama.cpp compatible — standard quant


发布时间:2026-09-12 06:34
抓取时间:2026-09-10 07:07
来源机构:Hugging Face
阅读原文huggingface.co