返回全部动态
Qwen3.8-27B 去审查版发布:基于 LoRA 自蒸馏的拒绝抑制模型
原标题:wangzhang/Qwen3.8-27B-abliterated
AI 摘要
Hugging Face 用户 wangzhang 发布了 Qwen3.8-27B-abliterated,这是基于 Qwen3.8-27B 的拒绝抑制模型,通过 10 轮迭代 LoRA 自蒸馏管道(基于 Abliterix)生成。该模型在 100 个有害提示中拒绝率为 19%,KL 散度为 0.0069,旨在用于安全研究、红队测试和对齐评估,而非有害使用或部署。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
--- license: apache-2.0 library_name: transformers base_model: Qwen/Qwen3.8-27B pipeline_tag: text-generation tags: - qwen - abliteration - abliterix - lora-self-distillation --- # Qwen3.8-27B Abliteratex A refusal-suppressed derivative of [Qwen/Qwen3.8-27B](https://huggingface.co/Qwen/Qwen3.8-27B), produced with a 10-round iterative LoRA self-distillation pipeline built on [Abliterix](https://github.com/wuwangzhang1216/abliterix). The checkpoint is a full BF16 merge and requires no ad
发布时间:2026-08-21 04:50
抓取时间:2026-08-21 04:52
来源机构:Hugging Face