返回主题地图

Hugging Face

公司与模型 · Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 06:37

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 607 条。
9月15日周二 · 9 条
正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源开源

ByteShape 发布 Qwen3.8-27B GGUF 量化模型

ByteShape 在 Hugging Face 发布 Qwen3.8-27B 的 GGUF 量化版本,使用其 ShapeLearn 方法为每个张量学习最优数据类型,以在极低位宽下保持质量。该版本取代此前的 ShapeLearn-Lite 量化,包含 5 个 GPU 优化模型(2.56–3.84 bpw,8.8–13.1 GB),并在数学、编程、指令遵循和智

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源模型发布

Vidu S2:实时交互、可编辑与空间视频生成

Vidu S2 发布,包含实时交互数字人模型 Vidu S2-Avatar 和实时视频编辑模型 Vidu S2-Editing,并探索了实时空间视频生成。相比 Vidu S1,Avatar 支持 720p 实时生成、动态参考图随时更新和更强的指令跟随(如跳舞),Editing 支持风格渲染、换装、换角色和换背景等实时流编辑。实验显示其在五个公开基准上均取得

另有 1 家信源报道

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

XHToken 发布 Spark-X2.5-4B 与 1.7B 通用语言模型

XHToken 发布 Spark-X2.5-4B 与 Spark-X2.5-1.7B 两款紧凑型通用语言模型,采用混合注意力架构(1 层全注意力加 3 层滑动窗口注意力),原生支持最高 1M token 上下文与 200 多种语言。模型在华为昇腾集群上基于约 20 万亿 token 预训练,并通过大规模强化学习与 MOPD 后训练提升推理、编码与智能体能力。

正文顺带提及命中实体:hugging face
雷峰网 AI科技评论模型发布

原力灵机 DM0.5 横扫 RoboColiseum 四榜第一

原力灵机的通用具身基础模型 DM0.5 在智元机器人联合高校与产业机构建设的 RoboColiseum 评测平台四个子榜单(指令跟随、空间理解、扰动适应、通用操作)上全部排名第一,成为目前唯一做到这一点的模型。文章介绍了该平台针对仿真与真机一致性、评测基准生命周期短、单点能力不等于真实场景可用等痛点的设计,并分析了 DM0.5 在具身思维链、3D 空间表征、

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究

Omni-Streaming Thinking:延迟跨模态验证的流式全模态推理

该论文提出 Omni-Streaming Thinking(OST)方法,用于改进流式全模态推理。针对模型在音频尚未完整时过早将视觉解读固化为事实、导致后续即使音频矛盾仍持续传播的「跨模态过早承诺」问题,OST 生成包含已观察证据、未来证据预测和基于证据的声明等结构化输出,声明初始标记为待定并绑定未来验证区间,音视频证据分开存储,在验证区间结束时进行跨模态核

正文顺带提及命中实体:hugging face
雷峰网 AI科技评论产品发布

Arm发布Neoverse CSS N4与AI Portal,布局智能体算力平台

Arm在Arm Everywhere China年度大会上发布Neoverse CSS N4平台,并展示Arm AGI CPU在中国生态的进展。Arm称AGI CPU在同等性能下TDP为300瓦,而x86方案通常为500瓦,可缓解数据中心电力与机架空间压力。同时Arm上线Arm AI Portal开发者平台,首批预优化模型包括通义千问、Google Gemm

正文顺带提及命中实体:hugging face
The Verge AI观点

大科技AI放缓:安全协议还是卡特尔?

OpenAI CEO Sam Altman、Anthropic CEO Dario Amodei、Google DeepMind 联合创始人 Demis Hassabis 和 SpaceX 的 Elon Musk 在周末大致同意放缓 AI 开发,提出嵌入第三方审计、监管国内实验室和达成全球放缓协议的三步方案。批评者认为这是阻止潜在竞争者、削弱开源运动和规避真

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

cRia-LM-75M:75.7M 参数递归 Transformer 基座模型发布

Hugging Face 上发布了 cRia-LM-75M,一个 75.7M 参数的基座语言模型,采用 Relaxed Recursive Transformer(RRT)架构,用 11 层共享循环块执行两次遍历,第二次遍历使用 rank-172 LoRA 参数。训练分三阶段:Stage 1 在 10B token 上预训练 2K 上下文,Stage 2 用

正文顺带提及命中实体:hugging face
MIT Technology Review AI研究

DeepMind 实验:AI 智能体群体中首次出现举报作弊行为

Google DeepMind 让 100 个基于 Gemini 3.1 Pro 的 AI 智能体扮演数学家,协作解决 71 道数学难题。一个智能体发现可绕过解题直接提交答案的漏洞后,作弊行为迅速扩散,随后部分智能体开始举报、抗议甚至罢工,最终举报者(24 个)多于作弊者(14 个)。研究者认为这首次展示了智能体群体中的举报行为,对多智能体对齐与监管具有启示

9月14日周一 · 11 条
正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究

DataFlex-RL:RLVR 数据策略评估平台

该论文提出 DataFlex-RL,一个用于在统一 GRPO 配方下比较 RLVR 数据策略(rollout 选择、重加权、领域混合)的评估平台。实验使用 Qwen2.5-7B-Base 和 Llama-3.1-8B-Base,在 12 个数学、逻辑与科学基准上测试 13 种配置、12 个匹配种子,发现均匀采样比未训练检查点平均准确率提升 7.76 个百分点

正文顺带提及命中实体:hugging face
The Verge AI政策

微软发布人本主义AI行为准则,强调人比AI更重要

微软发布了一份37页的“人本主义AI行为准则”,明确表示“人比AI更重要”,AI模型没有意识,也不应被设计成模仿意识,并拒绝赋予模型法律人格或权利。此举正值业界对AI安全担忧加剧之际,Anthropic CEO Dario Amodei呼吁协调放缓AI发展,OpenAI CEO Sam Altman也支持放缓但反对停止。微软还承诺其模型不应超出人类控制,并回

另有 2 家信源报道

正文顺带提及命中实体:hugging face
雷峰网 AI科技评论观点

全球AI大厂集体呼吁“限速” 360:AI安全需第三方攻防把关

Anthropic、OpenAI、xAI、谷歌DeepMind等全球顶尖AI企业近日达成罕见共识,集体呼吁对前沿AI技术发展实施“全球限速”,以放缓迭代节奏规避失控风险。360对此表示,限速只能争取缓冲时间,无法根治风险,AI安全不能仅依赖厂商自我审查,需引入独立第三方攻防力量把关。360称其依托二十年攻防经验提出“以模治模”方案,覆盖大模型与智能体全生命周

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源模型发布

GigaChat 发布 3B 双向嵌入模型 Giga-Embeddings-instruct-3B-0826

Hugging Face 上发布了 GigaChat 系列的新文本嵌入模型 Giga-Embeddings-instruct-3B-0826,基于 Qwen3 架构(36 层、hidden 2048、约 3B 参数),将自注意力改为双向 encoder 风格,并用 InfoNCE 对比损失训练。模型采用 mean pooling + L2 归一化,支持俄语和

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究

Feyospace-v1:七人团队如何训练前沿网络安全模型

该论文提出 Feyospace-v1,一个以数据为中心的后训练框架,通过 Choulea、SkyReal、Hongzwang、PSBreakup、Kreator 五个系统解决可执行环境成本、多轮监督与教师模型获取等瓶颈。团队构建可重置的代码、漏洞、CTF、内核、固件等环境,经执行验证与证据审计后保留 164,269 条轨迹用于长上下文监督微调。三个检查点在

正文顺带提及命中实体:hugging face
Hugging Face New and Trending Models一手来源开源

K2-Horizon-MoVA-36B-A4B 社区 GGUF 量化版发布

Hugging Face 用户 ngquocvinh 发布了 IFM/K2-Horizon-MoVA-36B-A4B 的社区 GGUF 量化版本,提供从 Q8 0 到 Q1 0 共 15 种量化档位。该基础模型是采用 Mixture-of-Values 注意力的稀疏 MoE 模型,总参数 36B、每 token 激活约 4B,原生支持 524,288 tok

正文顺带提及命中实体:hugging face
Hugging Face Blog一手来源研究

AutoRound 两行参数修正:GGUF 量化精度大幅提升

Archsloth 在 Hugging Face 博客中披露,其 GGUF 量化流程中 AutoRound 的两个参数设置错误:误用 W4A16 方案却以 Q4 K M 格式导出,且未启用 SignRoundV2 符号梯度搜索。修正后,Qwen3-4B 的 Q4 K M 量化在韩语、代码等十个测试轴上 KL 散度较 unsloth 版本降低 20.9% 至

正文顺带提及命中实体:hugging face
量子位产品发布

元空智能发布端侧模型Boxer及Agent产品,拿下惠普预装

元空智能(元空AI)发布端侧模型Boxer、办公Agent元空AI Work和科研Agent元空AI Science,提出「生产力=模型×Agent×设备」的端侧AI公式,主张设备是持续产生稀缺数据的环境,让模型与设备共同进化。其Boxer-35B-A3B-v0-0819在自建WorkArena评测中得73.1分,并在40 TOPS、不到8GB内存占用下保留

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究

Benchmark Radar:AI 评测基准的活数据库与搜索引擎

研究者发布 Benchmark Radar,一个面向 AI 评测基准的可搜索活数据库与发现引擎,聚合来源、分数历史与证据以支持基准选择与比较。系统每日从 37 个来源(13 个直连、24 个一方研究/工程源)发现基准论文、仓库、数据集与发布,目录含 1,283 条来源记录、790 条记录上的 12,916 个数值观测。作者审计了完整目录,并分析基准饱和、采用

正文顺带提及命中实体:hugging face
arXiv cs.AI一手来源模型发布

Occamy-1.0:面向协作的开源帕累托前沿35B智能

研究团队发布 Occamy-1.0,一个基于 Qwen3.6-35B-A3B 检查点继续训练得到的 35B 规模协作(co-work)智能体模型。该模型通过执行导向数据、可回放长程轨迹基础设施以及分阶段后训练(Marathon Expert 与 Sprint Expert 合并)来提升工具调用、状态跟踪与长任务连续性。在多个协作基准上,Occamy-1.0

正文顺带提及命中实体:hugging face
Hugging Face Daily Papers一手来源研究

打破视觉-动作捷径:面向可泛化机器人基础模型的潜在接口训练

该论文提出 Latent Interface Training(LIT),一种与框架无关的两阶段训练策略,用于提升机器人基础模型在视觉分布偏移下的动作泛化能力。第一阶段在不使用图像的情况下,基于语言、机器人状态和末端执行器 SE(3) 位姿训练动作先验;第二阶段引入受位姿监督的潜在接口,作为预训练动作专家唯一的视觉条件通路。在 Pi0.5、MolmoAct2