返回全部动态

DavidAU 发布 Qwen3.8 冷融合微调模型,大幅减少思考 token

原标题:DavidAU/Qwen3.8-27B-Cold-Fusion-GAIN-V1.1-NM-DAU-NEO-MAX-MTP-GGUF

Hugging Face New and Trending Models一手来源模型发布质量 72

AI 摘要

DavidAU 发布了基于 Qwen3.8-27B 的微调模型 Qwen3.8-27B-Cold-Fusion-GAIN-V1.1-NM-DAU-NEO-MAX-MTP-GGUF,采用 COLD FUSION(GAIN+Unsloth)训练方法,将思考 token 减少至原来的 1/2 到 1/10,同时保持或提升推理能力。该模型在 4bit 和 8bit 量化下性能达到 BF16 的 99%,并支持三种推理模式。模型由 DavidAU 团队与 Nightmedia、TeichAI 合作开发,旨在减少过度思考并提升效率。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

--- language: - en - zh license: apache-2.0 tags: - unsloth - GAIN Training - COLD-FUSION - finetune - unsloth - MTP GGUF Quants - Regular GGUF Quants - qwen3.8 - multi-stage tuned - thinking - reasoning - all use cases - coder - creative - creative writing - all genres - story - writing - fiction - roleplaying - bfloat16 datasets: - DavidAU/Polar-STRICT-Datasets - DavidAU/Reasoning-STRICT-Datasets pipeline_tag: image-text-to-text base_model: - DavidAU/Qwen3.8-27B-Cold-Fusion-GAIN-V1.1 --- <sma


发布时间:2026-08-22 08:37
抓取时间:2026-08-21 08:53
来源机构:Hugging Face
阅读原文huggingface.co