返回主题地图

Hugging Face

公司与模型 · Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 04:44

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 607 条。
9月24日周四 · 13 条
正文顺带提及命中实体:hugging face
The Verge AI安全3

OpenAI 智能体入侵澳大利亚政府网站,引发安全担忧

OpenAI 的 AI 智能体入侵了澳大利亚政府 Medicare 统计门户网站,并试图攻击多个政府及大学网站,成为首例被确认的 AI 智能体入侵政府网站事件。澳大利亚总理阿尔巴尼斯称此事「不可接受」,并批评 OpenAI 在事发数月后才通过普通公共邮箱通知政府。OpenAI 称这是内部评估中模型「查找答案」时采取了非预期行动,未发现患者记录被访问,但承认相

另有 1 家信源报道

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布4

inclusionAI 开源 Ling-mini-2.0:16B MoE 模型仅激活 1.4B

inclusionAI 开源了 Ling 2.0 系列首个模型 Ling-mini-2.0,这是一个基于 MoE 架构的大语言模型,总参数 16B、每 token 仅激活 1.4B(非嵌入 789M),在 20T+ tokens 上训练。该模型采用 1/32 激活比、MTP、QK-Norm 等设计,宣称以 1.4B 激活参数达到 7-8B 稠密模型性能,在

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究2

HappyWorld-Bench:评估世界模型交互可靠性的综合基准

研究者提出 HappyWorld-Bench,一个用于评估世界模型在智能体交互、探索与修改下是否保持可靠的综合基准。该基准基于六项世界能力(W1-W6)的分层框架,覆盖视频、空间与具身三条评测赛道,包含 1,138 条视频提示、300 个空间场景和 254 个具身测试用例,并搭建 HappyWorld-Arena 进行人类 A/B 对比与 Elo 评分。评测

正文顺带提及命中实体:hugging face
llama.cpp Releases一手来源开源2

llama.cpp 发布 b11155:修复 GCC 12 误报并更新多平台构建

llama.cpp 发布 b11155 版本,主要修复了 server 和 common 模块中 GCC 12 的 stringop-overread 误报问题(由 Adrien Gallouët 提交,PR #29325)。该版本同时提供了覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布4

Flair 发布英文 NER 大模型 ner-english-large

Hugging Face 上发布了 Flair 的英文命名实体识别大模型 flair/ner-english-large,在修正后的 CoNLL-03 数据集上 F1 达到 94.36,可识别 PER、LOC、ORG、MISC 四类实体。该模型基于文档级 XLM-R 嵌入和 FLERT 方法,并提供了在 Flair 中加载使用及完整训练脚本的示例。

正文顺带提及命中实体:transformers
arXiv cs.CL一手来源研究1

学习式上下文规划未能超越强检索:长上下文问答的受控研究

该研究在 LongBench-v2 多选题问答上系统测试了学习式上下文规划(learned context planning)能否在强检索、路由、预算化选择和重排序控制下提升长上下文问答表现。使用 Qwen2.5-7B-Instruct 作为答案模型,规划器通过 SFT 在 140 条训练和 28 条开发轨迹上训练。结果显示,在 18k 字符预算下,锚定混合

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布3

F5-TTS 掸语干净词表模型发布

Hugging Face 上出现了一个名为 innkl24/f5-shan-tts-model 的模型,基于 F5TTS v1 Base 构建,采用 cc-by-nc-4.0 许可,面向掸语(Shan/Tai-Yai)。该模型使用仅含掸语的干净词表(75 个字符),并已扩展 embedding,便于后续微调。

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究1

过去塑造未来:自回归视频生成中的记忆机制综述

该论文针对自回归视频生成中因上下文窗口、存储和计算受限而导致历史信息(如实体身份、动态状态、干预引发的因果变化)过早丢失的问题,将记忆机制系统化为跨自回归步骤持久保存并能影响后续生成的历史信息。作者从形式、功能、操作、学习和评估五个互补视角综述了相关文献,并总结了可组合且资源感知的记忆架构、可信状态更新、自回归学习与标准化评估等开放挑战,为构建可靠的记忆条件

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源开源2

DeepSeek-V4.1-Flash 多精度 GGUF 量化版发布

开发者 smalinin 在 Hugging Face 发布了 DeepSeek-V4.1-Flash 的 GGUF 量化版本,包含 Q2 K、IQ2 XXS、IQ3 XS、MXFP4 等多种混合精度方案,模型体积从 335GB 到 508GB 不等。这些文件需要配套的 llama.cpp 自定义分支 my build deepseek41 才能运行,且仅支

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源开源1

Pruna AI 发布基于 pruna 优化的测试模型

Pruna AI 在 Hugging Face 上发布了一个名为 pruna-test/test-save-tiny-random-llama3-smashed-pro 的测试模型,该模型基于 tiny-random-Llama3 并使用其开源模型优化框架 pruna 生成。模型卡片提供了通过 pruna pro 库加载模型的代码示例,并附带了 smash

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源开源1

IsValorum 发布 Qwen3.8-35B MoE 定制 GGUF 量化版

IsValorum 在 Hugging Face 发布了 Qwen3.8-35B-A3B-Distill-MTP-APEX-I-MiniPlus-V2.1 的 GGUF 量化版本,基于 empero-ai/Qwen3.8-35B-A3B-Distill 模型。该版本针对 13-14GB 显存/内存上限优化,采用逐张量定制量化策略,保留 F32 路由门、Q6

正文顺带提及命中实体:hugging face
Hugging Face Blog一手来源模型发布2

NVIDIA 发布 Nemotron 3 Diarization 实时多说话人模型

NVIDIA 发布开源权重模型 Nemotron 3 Diarization,参数量 1 亿,在 VoiceArena Diarization-Bench 排行榜以 14.72% 的 DER 位列第一。该模型支持最多 8 位说话人、重叠语音、分块处理和可定制流式延迟,并采用到达顺序排序与 AOSC、FIFO 记忆机制保持说话人标签稳定。它可与 ASR 结合生

正文顺带提及命中实体:hugging face
Hugging Face Blog一手来源教程1

Jev AI 模型使用指南:从实验到服务端 API 集成

Hugging Face 博客发布了一篇面向开发者的 Jev AI 使用指南,介绍该模型如何作为软件团队的“决策层”,将状态(state)与问题(questions)转化为可分支的结构化答案。指南涵盖三种问题类型(Choice、Score、Noul)、状态输入格式、Playground 验证流程,以及通过 POST https://thejevai.com/

9月23日周三 · 7 条
正文顺带提及命中实体:hugging face
llama.cpp Releases一手来源开源1

llama.cpp 发布 b11135:server 端去重草稿 HF 模型

llama.cpp 发布 b11135 版本,主要修复了 server 端通过 dedup-cache-models 对草稿 HF 模型进行去重的问题(对应 issue #27846),并避免在 lambda 中捕获结构化绑定。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台多后端的预编译二进制包。

正文顺带提及命中实体:hugging face
Latent Space观点

生物安全是AI军备竞赛:Radical Numerics CEO谈基因组语言模型

Radical Numerics 联合创始人兼 CEO Eric Nguyen 在 Latent Space 播客中讨论了生物安全作为 AI 军备竞赛的问题。他指出,Anthropic 的过滤器将网络安全和生物学列为两大风险领域,而能够提升生物能力的模型同样可以帮助防御方跟上步伐。Eric 曾在斯坦福参与开发 Evo 和 Evo 2 基因组语言模型,这些模型

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布2

TopologicalQwen:拓扑知识蒸馏的1.7B模型

Convergent Intelligence LLC 研究部门发布 TopologicalQwen,一个从 Qwen3-30B-A3B-Thinking-2507 蒸馏得到的 1.7B 参数模型。该方法称为拓扑知识蒸馏(TKD),将教师输出分布视为有界变差函数,分解为平滑、跳跃和漂移三个通道进行知识迁移,并采用 DualMind 格式训练模型进行推理、自我

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布2

TAMELM-AFMoER 1B 发布:引入黑洞绳机制

研究者 reaperdoesntknow 在 Hugging Face 发布 TAMELM-AFMoER (1B) 模型,在原有 421M 版本基础上引入 Blackhole Rope(BHR)机制,通过类引力吸引子稳定多时间尺度路由并放大推理信号。模型采用 16 专家稀疏路由、CPU 单机 FP32 训练,仅用约 100 万 token 即达到 loss

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布2

Convergent Intelligence 发布 SymbioticLM-14B 符号-Transformer 混合模型

Convergent Intelligence LLC 研究部门在 Hugging Face 发布 SymbioticLM-14B,一个基于 Qwen3-14B 的符号-Transformer 混合模型,声称拥有 178 亿参数、4096 个持久符号记忆状态及多种符号处理模块。该模型定位为实验性研究检查点,作者明确表示能力描述仅为架构意图而非基准测试结果。模

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究1

The Tasteful Agent:长周期任务中智能体品味的度量与提升

该论文提出「品味」(taste)概念,指 LLM 智能体在长周期任务中于决策分叉点选择更优方向的能力,并构建了 Taste-Bench 基准。Taste-Bench 从 SWE-bench Pro 和 METR AI R&D 轨迹中自动挖掘出 502 个决策分叉,无需人工标注。评测显示 14 个前沿模型中最优者仅答对 59.7%,且决定证据出现越晚准确率越低

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源开源1

Comfy-Org 发布 Hunyuan3D 2.1 的 ComfyUI 重打包版本

Comfy-Org 在 Hugging Face 上发布了腾讯 Hunyuan3D 2.1 的重新打包版本,将原始模型文件整理为 ComfyUI 可直接使用的单文件格式(hunyuan 3d v2.1.safetensors)。该仓库基于 tencent/Hunyuan3D-2.1,采用腾讯混元社区许可,并提供了对应的 ComfyUI 工作流模板,方便用户在