返回主题地图

Hugging Face

公司与模型 · Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 07:58

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 607 条。
9月10日周四 · 3 条
正文顺带提及命中实体:hugging face
AWS Machine Learning Blog一手来源教程

AWS 教程:在 SageMaker HyperPod 上部署 Qwen3.8-2.4T-A95B

AWS 机器学习博客发布教程,介绍如何在 Amazon SageMaker HyperPod 上使用 vLLM 部署阿里 Qwen 团队开源的 Qwen3.8-2.4T-A95B 模型。该模型总参数 2.4 万亿,激活参数 950 亿,采用混合线性注意力与全注意力架构,原生上下文 262K,支持 NVFP4 量化、推理控制和多 token 预测。文章详细说明

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源开源

GAP-models 仓库发布:备份与量化评估模型存档

Hugging Face 上发布了 GAP-models 仓库,用于备份 GAP 参考生成和量化评估所用的本地模型,包含多个模型族和检查点。仓库通过清单和 SHA256 校验确保文件来源和完整性,并记录了候选模型的资格评估结果,评估基于特定 CUDA 构建和硬件环境。文件保留原始模型的许可和归属,不统一替换许可。

正文顺带提及命中实体:hugging face
TechCrunch AI观点

超级智能即将到来,我们应允许其发展吗?

TechCrunch 的 Equity 播客讨论了超级智能 AI 的潜在风险,并采访了非营利组织 ControlAI 的美国执行董事 Connor Leahy。Leahy 认为,由于对齐和遏制手段不足以应对风险,应完全停止开发超级智能,并指出近期立法支持了这一观点。

9月9日周三 · 9 条
正文顺带提及命中实体:hugging face
TechCrunch AI观点

ControlAI 总监:超级智能是敌手而非武器,应停止开发

ControlAI 美国执行总监 Connor Leahy 在 TechCrunch 的 Equity 播客中表示,超级智能不是武器而是对手,主张完全阻止公司开发超级智能,因为对齐和遏制已不足以控制风险。他评论了美国“禁止超级智能法案”及英国类似立法,认为前沿 AI 实验室更像政治角色,并警告当 AI 能自我改进时将出现失控循环。

正文顺带提及命中实体:hugging face
TechCrunch AI观点

Anthropic研究员辞职警告:自我改进AI或致人类灭亡

Anthropic研究员Jacob Coxon因担忧自我改进型AI的失控风险而辞职,他在社交媒体上指责OpenAI和Anthropic等公司不顾后果地竞相开发超级智能,认为这可能导致人类灭亡。Coxon呼吁行业放慢研发速度,并支持通过立法禁止超级智能的开发。近期,美国和英国已出现相关法案,同时多家初创公司如Ricursive Intelligence和Rec

正文顺带提及命中实体:hugging face
TechCrunch AI商业

红杉资本加码投资 Cymphony,应对 AI 代理带来的企业安全新风险

红杉资本领投了网络安全初创公司 Cymphony 的 2500 万美元 A 轮融资,该公司旨在应对 AI 代理带来的企业安全风险。Cymphony 构建了“劳动力图谱”平台,帮助安全团队统一管理人类员工和 AI 代理的访问权限,并已签约多家企业客户。红杉合伙人表示,Cymphony 将身份和数据安全统一处理的方法使其在竞争激烈的市场中脱颖而出。

正文顺带提及命中实体:hugging face
THE DECODER观点

Anthropic科学家辞职并警告AI十年内或毁灭人类

Anthropic科学家Jacob Coxon辞职,公开指责OpenAI和Anthropic拿人类生存赌博,认为AI系统即将超越人类并可能毁灭文明。Anthropic研究员Evan Hubinger估计,未来十年内超级智能AI导致人类灭绝的概率超过10%。多位AI研究人员签署公开信呼吁放缓AI开发,但业界对AI风险的严重性存在分歧。

正文顺带提及命中实体:huggingface
Interconnects AI观点

普通人何时能感受到AI的影响?

本文作者在休假后反思AI对普通人的影响,认为目前AI在日常生活中的直接作用仍很小,主要惠及精英和知识工作者。作者将当前AI发展与工业革命对比,指出社会惯性和利益分配不均可能阻碍AI的普及,并担忧其发展可能重蹈核能的覆辙。

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

ZipFormer-30M 越南语语音识别模型发布

Hugging Face 上发布了越南语语音识别模型 ZipFormer-30M-RNNT-6000h,基于 ZipFormer 架构,仅 30M 参数,在 CPU 上转录 12 秒音频仅需 0.3 秒。该模型在 VLSP 2025 竞赛中获第一名,并在多个基准上优于更大模型。模型采用 RNN-T 损失,训练数据约 6000 小时,支持快速 CPU 推理,适

正文顺带提及命中实体:hugging face
量子位模型发布

实测星火X2.5:代码智能体能力升级,全国产算力模型可交付

讯飞发布参数293B的星火X2.5 MoE大模型,重点提升代码与智能体能力,API支持Anthropic和Responses协议。实测中,该模型能生成3D粒子交互网页、拆解61页财报并发现数据错误,还能为游戏设计官网。星火X2.5基于全国产算力训练,训练效率提升至93%,标志着国产算力模型进入可交付时代。

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

OpenBMB 发布首个昇腾原生 1.58 位三元大模型 BitCPM-CANN

OpenBMB 发布了 BitCPM-CANN 模型系列,这是首个基于华为昇腾 NPU 原生训练的端到端 1.58 位三元大语言模型系统。该系统将量化感知训练集成到 Megatron-LM 框架中,并使用 MindSpeed 加速,在昇腾 910B 上训练了 0.5B 至 8B 四个模型。在 11 项基准测试中,1B/3B/8B 模型保留了全精度性能的 95

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

MiniMax-H3 Turbo LoRA 适配器发布,支持 ComfyUI 加速视频生成

drbaph 在 Hugging Face 发布了 MiniMax-H3 Turbo LoRA 适配器,专为 ComfyUI 优化,支持文本到视频和参考到视频生成。这些 LoRA 通过动态秩压缩技术,将模型大小减少最多 83%,同时保持高数值保真度,并加速推理步骤。该仓库包含多个版本的 LoRA 文件,并提供了详细的数值验证结果。

9月8日周二 · 7 条
正文顺带提及命中实体:hugging face
Hugging Face Blog一手来源研究

TranslatePsy-AfriSLM:面向非洲语言的优化机器翻译

Hugging Face 博客发布了 TranslatePsy-AfriSLM,一个覆盖 19 种撒哈拉以南非洲语言的开源机器翻译套件。其 0.8B 参数的小模型在多个基准上超越 Qwen3.5-122B 等大型模型,训练数据量减少 96%,并支持设备端部署。该研究旨在通过高质量数据扩展,为非洲社区提供无需联网的 AI 翻译服务,相关论文将发表于 EMNLP

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究

Uno:扩散增强LLM实现无损加速推理

Hugging Face 论文页面介绍了一种名为 Uno 的新型扩散增强自回归语言模型,通过扩散蒸馏和 Ψ-Spec 采样器实现无损并行解码,无需草稿模型即可加速推理。Uno 在多个基准上超越现有扩散模型,最高可提升 3 倍速度,并已发布代码和检查点。社区讨论中,作者回应了与 Orthrus 等方法的相似性争议,强调架构差异。

正文顺带提及命中实体:hugging face
雷峰网 AI科技评论产品发布

Perplexity转投阿里千问,基于Qwen3.8打造本地Agent

硅谷AI独角兽Perplexity推出本地Agent产品Portable Computer,采用阿里开源模型Qwen3.8-27B,并在英伟达DGX Spark硬件上优化算法。Perplexity估值超300亿美元,其大模型选择从Claude、GPT转向阿里Qwen,此前已基于Qwen3研发嵌入模型。阿里近期开源多个Qwen3.8系列模型,成为全球开源AI基

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究

教师门控在线蒸馏:提示级验证提升训练效率与准确性

Hugging Face 每日论文页面介绍了一篇题为《Verify Before You Distill: Prompt-Level Teacher Gating for On-Policy Distillation》的论文。该论文提出教师门控在线蒸馏(TGOPD)方法,通过验证器评分的探针在提示级别验证教师可靠性,并将提示路由到密集蒸馏或基于验证器的强化学

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

Qwen3.8 27B 多阶段微调模型发布,性能超越基础版

DavidAU 发布了 Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NEO-CODER-MAX-MTP-GGUF,这是一个基于 Qwen3.8 27B 的多阶段微调模型,采用 COLD FUSION 和 Fable Fusion 711 训练方法,显著减少思考 token 数量

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

NAICS GitHub 仓库分类器:基于 RoBERTa 的行业分类模型

Hugging Face 上发布了 aquiro1994/naics-github-classifier 模型,这是一个基于 RoBERTa-large 微调的多类文本分类模型,用于将 GitHub 仓库分类到 19 个 NAICS 行业部门。该模型使用 6,588 个标注仓库训练,支持通过仓库名称、描述、主题和 README 进行预测。模型提供了详细的 P

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

Synaptics 发布 MobileNetV2 多格式量化模型

Synaptics 在 Hugging Face 上发布了 MobileNetV2 模型,该模型由 tf.keras.applications 生成,支持 int16、int8、float32 和 float16 格式,其中 int8 量化使用随机数据。此外,还提供了 Google 发布的原始量化模型 kaggle.tflite,采用 v1 tflite 量

9月7日周一 · 1 条
正文顺带提及命中实体:hugging face
THE DECODER研究

OpenAI 报告 AI 研究智能体进展,首席科学家警告控制风险

OpenAI 发布内部数据,显示 AI 智能体已深度参与其研究,并宣称达到“自动化研究实习生”里程碑,同时首席科学家 Jakub Pachocki 发文警告,当前对 AI 系统的控制能力不足,链式思维监控可靠性下降,呼吁加强安全标准。

另有 1 家信源报道