返回主题地图

开源生态

技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 702 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

8月18日周二 · 3 条
正文结构化主题已通过公开置信门槛
arXiv cs.CL一手来源模型发布

Jais 2:阿拉伯语中心的开源大语言模型家族

MBZUAI、Cerebras 和 Inception 联合发布了 Jais 2,一个以阿拉伯语为中心的开源大语言模型家族,包括 70B 和 8B 参数版本。该模型在阿拉伯语和文化相关基准测试中表现优异,并支持高效推理,70B 版本在 Cerebras 硬件上可实现每秒 2000 token 的生成速度。模型已在 HuggingFace 上以商业许可发布,并

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

MiniCPM-o 2.6:8B 参数端侧多模态模型发布

OpenBMB 发布了 MiniCPM-o 2.6,这是一个 8B 参数的多模态大模型,支持视觉、语音和实时多模态流式交互,在多个基准上超越 GPT-4o 等闭源模型。该模型基于 SigLip、Whisper、ChatTTS 和 Qwen2.5 构建,支持端侧部署,并已开放 ollama、int4、GGUF 等格式。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

OpenBMB 发布 VoxCPM-0.5B:无 tokenizer TTS 模型,支持上下文感知语音生成与声音克隆

OpenBMB 发布了 VoxCPM-0.5B,这是一个基于 MiniCPM4-0.5B 的无 tokenizer 文本转语音(TTS)模型,采用端到端扩散自回归架构,直接在连续空间中建模语音,支持上下文感知的语音生成和零样本声音克隆。该模型在 180 万小时的双语语料上训练,在 RTX 4090 上可实现低至 0.17 的实时率(RTF),支持流式合成。用

8月17日周一 · 5 条
正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源产品发布

DeepBeepMeep 发布 WanGP:低显存开源视频生成工具

DeepBeepMeep 发布了 WanGP,一个开源视频生成工具,支持 Wan、Hunyuan Video、Flux 1 & 2、Qwen、Z-Image 和 LTV Video 等模型,最低仅需 6GB 显存,兼容旧 GPU,并提供 Web 界面、Lora 支持、队列系统等功能。该工具旨在让低配置用户也能使用先进的视频生成模型。

正文结构化主题已通过公开置信门槛
Interconnects AI观点

Nvidia 推动开源模型生态,意图打破智能垄断

Nvidia 正大力投资近乎开源的模型(如 Nemotron),通过发布训练数据和代码,鼓励更多公司构建自己的模型,从而扩大对其芯片的需求。文章指出,开源模型生态的未来取决于能否形成经济回报闭环,否则可能转向效率优先的细分市场。同时,训练复杂度的提升和开源社区对后训练的关注,可能改变传统训练流程的划分。

正文结构化主题已通过公开置信门槛
量子位模型发布

HelixWorld 1.0发布:实时可交互音视频世界模型,将完全开源

Noiz AI联合香港科技大学、清华大学、CMU、Google DeepMind等机构的研究员发布了实时可交互音视频世界模型HelixWorld 1.0,支持24 FPS画面和48kHz立体声实时生成,画面与声音由原生Transformer架构统一生成。该模型通过四步技术路线实现声画同步响应动作,并将在未来几周完全开源。团队认为这补上了世界模型在声音方面的短

正文结构化主题已通过公开置信门槛
arXiv cs.SE一手来源研究

AI协作时代工程信号:vLLM与SGLang拉取请求纵向分析

该研究对vLLM和SGLang两个AI基础设施项目的33,228个合并拉取请求进行了纵向分析,发现PR吞吐量分别增长21倍和17.9倍,周期时间缩短,作者多样性增加,评论密度上升,而PR大小保持稳定。研究认为这些变化主要由人类驱动,并讨论了其对生物医学AI代理和生物信息学流水线开发的启示。

正文结构化主题已通过公开置信门槛
TechCrunch AI观点

为何公众不买账扎克伯格的AI未来愿景

Meta CEO马克·扎克伯格发布6500字宣言,宣称AI将赋能每个人,但TechCrunch播客主持人认为公众因Meta在社交媒体时代的负面历史而对其愿景持怀疑态度。评论指出Meta在AI前沿领域并非领先者,其新模型Glimmer和Muse Spark的硬件要求限制了普通用户的可及性。扎克伯格被比作Anthropic CEO Dario Amodei的反面

8月16日周日 · 4 条
正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

LuffyTheFox 发布基于 Qwen3.6 的无审查多模态 MoE 模型 GGUF 版

LuffyTheFox 发布了基于 Qwen3.6-35B-A3B 的无审查多模态 MoE 模型 GGUF 版本,采用其自研的 Genesis 算法进行张量噪声修复,并融合了 Hermes 微调数据以增强 agent 能力。该模型支持中英文,旨在提升指令遵循和上下文清晰度,并提供了量化脚本和推荐配置。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

Lightricks 发布 LTX-2.3 开放权重音视频生成模型

Lightricks 发布了 LTX-2.3,这是其 LTX-2 联合音视频基础模型的重大更新,提升了音频和视觉质量以及提示遵循能力。该模型基于 DiT 架构,可生成同步的视频和音频,并提供多种检查点,包括完整版、蒸馏版和上采样器。模型权重开放,支持本地运行,并提供了 ComfyUI 和 PyTorch 代码库等集成方式。

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源产品发布

llama.cpp b10451 发布:修复 LoRA 张量越界检查

llama.cpp 发布 b10451 版本,主要修复了 LoRA 张量数据越界检查问题,确保 LoRA 张量数据在文件边界内。该版本提供了适用于 macOS、Linux、Android、Windows 等多个平台的预编译二进制文件,并包含 UI 组件。

正文结构化主题已通过公开置信门槛
Hugging Face Blog一手来源模型发布

Nesso-1:加速开源结合亲和力预测

Valence 和 Recursion 团队发布了 Nesso-1,一个开源粗粒度共折叠模型,用于蛋白质-配体结合亲和力预测。相比 Boltz-2,Nesso-1 速度快一个数量级以上,在多个公共和专有数据集上达到或超越其准确性,且单 GPU 预测仅需 1 秒。该模型旨在解决封闭源码瓶颈、计算成本高、人类与 AI 归纳偏差以及公共基准泄漏等问题,并支持大规模

8月15日周六 · 5 条
正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源开源

MiniMax H3 量化权重集合发布,支持消费级 GPU 本地运行

Hugging Face 上出现了一个社区整理的 MiniMax H3 量化与剪枝权重集合,支持 INT4、INT8、混合精度及 NVFP4 格式,旨在让消费级 GPU(16-24GB 显存)用户通过 ComfyUI 本地运行 MiniMax H3 的多模态视频生成模型。该集合提供了针对不同显卡的下载指南,并包含文本编码器和 VAE 文件。MiniMax H

正文结构化主题已通过公开置信门槛
量子位模型发布

Qwen3.8-27B开源:消费级显卡跑Opus级Agent,多项评测超Claude

阿里开源了Qwen3.8-27B模型,总参数270亿,支持原生多模态、262K上下文,在SWE-bench Pro等多项代码和Agent评测中超越Claude Opus 4.6 Max。模型内置可调节的推理档位和preserve thinking功能,并支持通过Transformers、vLLM等框架部署,可在消费级显卡上运行。

正文结构化主题已通过公开置信门槛
量子位开源

DeepSeek Harness插件生态爆发:700+仓库,从多Agent到电子宠物

DeepSeek Harness插件生态在GitHub上爆发,已有超过700个相关仓库。开发者为其开发了多类插件,包括多Agent团队管理、侧边栏IDE、文件引用、长期记忆、Claude数据迁移、视觉理解等实用功能,以及电子宠物、小游戏、复古广告等趣味插件。这些插件极大扩展了DeepSeek Harness的能力,使其从单一Agent工具演变为可高度定制的开

正文结构化主题已通过公开置信门槛
Interconnects AI模型发布

GLM-5.3 发布:中国实验室如何保持前沿竞争力

Z.ai 发布了 GLM-5.3 模型,目前仅在编程计划中提供,API 即将上线,两周后开放权重。该模型在多个基准测试中超越了 Moonshot AI 的 Kimi K3,部分指标甚至超过 Claude Fable 5 和 GPT-5.6-Sol,且参数量仅为 Kimi K3 的三分之一。Z.ai 表示 GLM-5.3 基于 GLM-5.2 的相同基础模型,

正文结构化主题已通过公开置信门槛
THE DECODER模型发布

阿里Qwen发布Qwen3.8开源模型,性能超越更大版本

阿里巴巴的Qwen团队发布了Qwen3.8系列模型,包括核心的Qwen3.8-27B多模态稠密模型和更大的Qwen3.8-2.4T-A95B模型,权重以Apache 2.0许可证开源。Qwen3.8-27B在编码和办公任务上优于更大的Qwen3.7-Plus,并增强了智能体能力,原生支持262K上下文,可通过YaRN扩展到100万,支持图像和视频处理。模型已

8月14日周五 · 3 条
正文结构化主题已通过公开置信门槛
TechCrunch AI产品发布

扎克伯格称 AI 为所有人,但 Glimmer 发布仍有保留

Meta 本周发布了开放权重 AI 模型 Glimmer,用户可自由下载并在自有硬件上运行,而更强大的 Muse Spark 模型仍仅通过 API 提供。扎克伯格同时发表公开信,主张 AI 应“为所有人服务”,而非由少数实验室控制,但播客主持人指出这一愿景存在保留条件。

正文结构化主题已通过公开置信门槛
量子位模型发布

Qwen3.8-27B开源:家用显卡可跑,Apache 2.0免费商用

阿里巴巴正式开源Qwen3.8-27B模型,该模型为原生多模态稠密模型,支持262K原生上下文,可通过YaRN技术扩展至1M tokens,在编程和办公场景性能大幅提升,并新增reasoning effort功能。模型以Apache 2.0协议开放权重,所有人可免费下载、部署和商用。目前千问已累计开源460余个模型,全球下载量超30亿次。

另有 1 家信源报道

正文结构化主题已通过公开置信门槛