Comfy-Org 发布 FLUX.1-Krea-dev 的 ComfyUI fp8 重打包版本
Comfy-Org 在 Hugging Face 上发布了 FLUX.1-Krea-dev 的 ComfyUI 重打包版本,提供 fp8 量化后的单文件扩散模型 flux1-krea-dev fp8 scaled.safetensors。该模型基于 Black Forest Labs 官方发布的 FLUX.1-Krea-dev 微调模型,沿用其非商业许可,并
公司与模型 · Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 06:37
Comfy-Org 在 Hugging Face 上发布了 FLUX.1-Krea-dev 的 ComfyUI 重打包版本,提供 fp8 量化后的单文件扩散模型 flux1-krea-dev fp8 scaled.safetensors。该模型基于 Black Forest Labs 官方发布的 FLUX.1-Krea-dev 微调模型,沿用其非商业许可,并
Comfy-Org 在 Hugging Face 上发布了 HiDream-I1 的 ComfyUI 重打包模型文件,将 HiDream-ai 的 HiDream-I1-Dev、HiDream-I1-Fast、HiDream-I1-Full 以及 HiDream-E1-1、HiDream-E1-Full 等原始模型转换为 ComfyUI 可直接使用的单文件格
Comfy-Org 在 Hugging Face 上发布了 Flux1-Redux-Dev,这是对 Black Forest Labs 的 FLUX.1-Redux-dev 模型文件进行重新打包的版本,专为 ComfyUI 使用。用户需将 flux1-redux-dev.safetensors 文件放入 ComfyUI 的 models/style mode
Hugging Face 用户 pottokao 发布了 Qwen-Image-2.1 文本编码器(Heretic)的量化版本,提供 GGUF(Q4 K M)、FP8 和 bf16 三种格式,并附带 mmproj 文件以支持 Qwen3-VL 视觉塔。作者指出此前 GGUF 报错源于 ComfyUI-GGUF 未加载视觉塔,并提供了配套补丁节点 ComfyU
Comfy-Org 在 Hugging Face 上发布了 MiniMax-Music-3 的 ComfyUI 重打包模型文件,基于 MiniMaxAI/MiniMax-Music3 原始模型。该仓库提供 DiT、文本编码器和 VAE 等多精度权重文件(fp16、fp32、int8、bf16 等),并附带文本生成音乐的 ComfyUI 工作流模板,方便用户在
Comfy-Org 在 Hugging Face 上发布了 Wan 2.1 的 ComfyUI 重打包模型文件仓库,将 Wan-AI、alibaba-pai、MAGREF-Video、MeiGen-AI 等多个来源的 Wan 2.1 系列模型(含 T2V、I2V、FLF2V、VACE、Fun 等变体)整理为可直接放入 ComfyUI 目录的 safetens
作者 ifmylove2011 在 Hugging Face 发布了名为 girlslike-krea2 的 LoRA/LoKR 模型,基于 krea/Krea-2-Raw 与 Krea-2-Turbo 训练,用于生成特定人物形象。模型采用全秩 LoKR 训练方案,建议使用强度 0.8 1.5,中近景相似度尚可但远景效果不佳,且需输入人物本名作为触发词。作者
作者 Phạm Nguyễn Ngọc Bảo 发布越南语 TTS 模型 VieNeu-TTS v3 Turbo,支持 48kHz 高保真语音、23 种预设音色、即时声音克隆、情感控制和英越双语切换。配套 vieneu Python SDK v3.7.1 提供免 PyTorch 的 CPU/ONNX 路径,并在 CUDA 上通过连续批处理实现单张 RTX 3
IFM 在 Hugging Face 发布 K2-Horizon-3.7B,这是 K2-Horizon 系列中的小型稠密解码器模型,拥有 3.7B 核心参数和 512K 原生上下文窗口。该模型在 agentic、编码和推理基准上与 Qwen3.5-4B、G9v3-3B、Granite 4.2-3B、Nemotron 3 Nano-4B 等开放权重稠密模型对比
slashreboot 在 Hugging Face 发布实验性研究模型 Athena-Class Model A,基于 Gemma 4 31B Instruct 进行 LoRA 微调并合并量化为 Q8 0。该模型主打持久身份、长上下文一致性与无需系统提示的自主智能体行为,在 AIME 2026 上取得 93.33%(Consensus@4)、GPQA Di
Hugging Face 上发布了 Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16,这是 Qwen3.8-27B 的 MLX 量化包,面向 M1/M2 Mac 的 FP16 版本,权重与父版本逐字节一致,仅将浮点张量以 fp16 存储。该版本基于 MTPLX 实现原生多 token 预测投机解码,官方称速度可
Hugging Face 用户 Youssofal 发布了 Qwen3.8-27B-MTPLX-Optimized-Quality,这是基于 Qwen/Qwen3.8-27B 的 8 位动态量化 MLX 模型包,面向 Apple Silicon Mac 本地运行。该版本保留原生多 token 预测(MTP)投机解码头,在 M5 Max 上实测约 48 tok
Hugging Face 用户 Youssofal 发布了 Qwen3.8-Flash-Next 的 MTPLX 量化版本 Bare Speed,基于 Qwen 125B-A6B Flash-Next 预览模型,采用统一 4-bit 量化并保留 16-bit 关键组件,通过 MTPLX 在 Apple Silicon 上实现原生多 token 预测投机解码。
Geometric-AI 与 Lucebox 在 Hugging Face 发布了面向 128GB AMD Strix Halo 系统的 DeepSeek-V4-Flash-0731 量化 GGUF 文件,单个 98.29GB 文件在 92 题评测中取得 82/92 分,平均每权重约 2.766 比特。同时还发布了支持图像输入的 DeepSeek-V4-Fl
开发者 abenzerps 在 Hugging Face 发布了 Qwen/Qwen-Image-2.1 的 GGUF 量化版本,提供 Q8 0 至 Q4 0 多种量化文件,并配套打包了 Qwen3VL-8B 文本编码器和 VAE,方便在 ComfyUI 中本地运行文生图。该版本不含内置安全过滤器,作者还表示正在开发完全无审查版本。
小米大模型团队发布并开源新一代原生全模态模型Xiaomi MiMo-V2.6系列,包含MiMo-V2.6-Pro与MiMo-V2.6-Flash,并预告将开放速度提升20倍的MiMo-V2.6-Pro-UltraSpeed。该系列押注大规模强化学习扩展,进行了开源模型迄今最大规模的单次RL训练,并同步开源RL训练环境、框架及技术报告。MiMo-V2.6-Pr
Hugging Face 博客发布了一项针对答案验证(answer verification)系统的独立评测,在 2,018 条统一标注的测试集上对比了 13 个系统,并公开了评分代码。结果显示仅三个系统 AUC 超过 0.70,最强的 ZTC (397B) 与 JEV 差距仅 0.0014,统计上无法区分;而仅依赖答案长度和格式的基线达到 0.7036,高
llama.cpp 发布 b11104 版本,主要更新为 llama-server 新增绑定多个地址的能力(PR #28690),并处理了地址重叠、多 TCP 地址下拒绝 --port 0 等边界情况。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制,涵盖 CPU、CUDA、Vu
Convergent Intelligence LLC 研究部门在 Hugging Face 发布 Symbiotic-8B(SymbioticLM-8B),一个基于 Qwen3-8B 的混合符号-Transformer 模型,加入符号处理模块与持久记忆缓冲,支持长记忆符号推理与逻辑对话。模型采用 PyTorch/Transformers 兼容格式,附带符号
Hugging Face 用户 nphSi 发布了 Z-Image-Lora,这是一个基于 Tongyi-MAI/Z-Image 和 Z-Image-Turbo 的文本到图像 LoRA 模型,采用 Apache-2.0 许可。该模型通过“vrtlxxxx”触发词生成特定人物肖像,并在 2026 年更新中新增了数百个名人触发词。