返回主题地图

通义千问 Qwen

公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 110 条。
9月27日周日 · 1 条
正文顺带提及命中实体:qwen3
Hugging Face New and Trending Models一手来源开源24

CrowdGPT 发布社区分布式模型 Crowd-v1

CrowdGPT 发布了其首个社区分布式语言模型架构 Crowd-v1,约 10 亿参数,采用 Transformer、GQA、RoPE、SwiGLU 和权重绑定设计。该模型以随机初始化权重发布,并非预训练模型,目的是为 CrowdGPT 客户端提供统一的模型定义和权重格式,供参与者共同进行分布式训练。发布包含 BF16/FP32 权重文件、配置和 SHA-

9月26日周六 · 1 条
正文顺带提及命中实体:qwen3
Xinference Releases一手来源开源8

Xinference 发布 v3.5.0:新增多模型支持与请求日志可观测性

Xinference 发布 v3.5.0,新增 AuK、Irodori TTS、YuE2、Spark-X2.5、Qwen-Image-2.1、MinerU2.5 等多种音频、图像与 LLM 模型支持,并加入模型请求日志、审计与可观测性功能。性能方面优化了 embedding/rerank 的 vLLM 批处理与 API 启动开销,同时修复了流式工具调用、客户

9月25日周五 · 2 条
正文顺带提及命中实体:qwen3
llama.cpp Releases一手来源开源7

llama.cpp b11178:修复 MUSA/MTT S5000 算子失败与构建问题

llama.cpp 发布 b11178 版本,集中修复 MUSA 后端(摩尔线程 MTT S5000 / PH1)的多个问题。改动包括:让 MUSA 使用 16 字节拷贝、启用 CUB 路径、采用上游代码路径、移除多余编译期守卫、在 PH1 上禁用 MMQ 路径,并修复 fused TOPK MOE 内核在 MUSA 上的死锁。修复后 27B 模型困惑度从

标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布9

Viggle 发布 Qwen-Image-2.1 少步蒸馏 LoRA v0.2.1

Viggle 在 Hugging Face 上发布了 Qwen-Image-2.1-viggle-turbo v0.2.1,这是基于 Qwen/Qwen-Image-2.1 的少步蒸馏 LoRA 适配器,采用分布匹配蒸馏(DMD)训练。它支持文生图和指令驱动编辑,仅需 6 次 transformer 前向(而非基座的 40 步)且无需无分类器引导,端到端约快

9月24日周四 · 2 条
正文顺带提及命中实体:阿里巴巴
雷峰网 AI科技评论商业1

斑马智能云栖亮出从汽车到具身智能的入场券

在2026年云栖大会上,斑马智能展示了以汽车作为具身智能“中试场”的路径,提出“意图经济”概念,即AI通过上下文与记忆读懂用户意图并直接调用服务。斑马智能座舱系统装车量达千万级,AI上车业务覆盖68%主流车企,并发布AutoOmni2.0-23B-A3B端侧大模型。其目标是将座舱验证的端云一体Agent架构与生态能力复制到手机、智能家居、机器人等终端。

正文顺带提及命中实体:阿里巴巴
量子位产品发布1

出海Agent小元AI入驻腾讯WorkBuddy,主打外贸经营智能体

米奥兰特在第五届全球数字贸易博览会上全球首发面向中国外贸企业的AI出海经营智能体“出海精灵·小元AI”,主打懂出海、能记忆、自进化,覆盖市场洞察、买家分析、客户盘点、内容营销、展会策划五大任务。该产品已上架腾讯WorkBuddy,通过MCP协议接入,用户可在WorkBuddy工作台内直接调用其买家匹配、开发信生成、展会获客等外贸垂直能力,商业模式为充值加to

9月23日周三 · 4 条
正文顺带提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布2

Convergent Intelligence 发布符号-神经混合模型 Symbiotic-Beta

Convergent Intelligence LLC 在 Hugging Face 发布实验性模型 Symbiotic-Beta(SymLM),基于 Qwen2.5-0.5B 冻结主干,融合符号认知模块(DTE-HDM、M.A.S.R.M、QwenExoCortex 等),在 MetaMathQA 的 2.5 万条样本上微调,面向数学推理与神经符号研究。模

正文顺带提及命中实体:qwen3
Hugging Face New and Trending Models一手来源模型发布1

VieNeu-TTS v3 Turbo:48kHz 越南语 TTS 与实时流式 API

作者 Phạm Nguyễn Ngọc Bảo 发布越南语 TTS 模型 VieNeu-TTS v3 Turbo,支持 48kHz 高保真语音、23 种预设音色、即时声音克隆、情感控制和英越双语切换。配套 vieneu Python SDK v3.7.1 提供免 PyTorch 的 CPU/ONNX 路径,并在 CUDA 上通过连续批处理实现单张 RTX 3

标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布1

Qwen3.8-27B MTPLX 优化速度 FP16 版发布

Hugging Face 上发布了 Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16,这是 Qwen3.8-27B 的 MLX 量化包,面向 M1/M2 Mac 的 FP16 版本,权重与父版本逐字节一致,仅将浮点张量以 fp16 存储。该版本基于 MTPLX 实现原生多 token 预测投机解码,官方称速度可

正文顺带提及命中实体:qwen3.8 max
智东西模型发布

小米开源MiMo-V2.6系列全模态模型,押注大规模RL扩展

小米大模型团队发布并开源新一代原生全模态模型Xiaomi MiMo-V2.6系列,包含MiMo-V2.6-Pro与MiMo-V2.6-Flash,并预告将开放速度提升20倍的MiMo-V2.6-Pro-UltraSpeed。该系列押注大规模强化学习扩展,进行了开源模型迄今最大规模的单次RL训练,并同步开源RL训练环境、框架及技术报告。MiMo-V2.6-Pr

9月22日周二 · 7 条
正文顺带提及命中实体:qwen3
llama.cpp Releases一手来源开源

llama.cpp b11103:为 HunyuanOCR 增加 DFlash 投机解码支持

llama.cpp 发布 b11103 版本,为 HunyuanOCR 目标模型增加 DFlash 投机解码支持,在 Hunyuan 图构建中注册层输入张量,修复了此前因张量为空导致的断言中止问题。同时修复了针对 HunYuan 目标转换 DFlash 草稿模型时的词表处理错误,包括缺失的 fix special tokens 方法和配置读取错误。测试显示图

正文主语命中实体:阿里巴巴
雷峰网 AI科技评论产品发布

千问办公发布企业上下文与Agent硬件QwenNote A2

9月22日云栖大会上,千问办公发布企业级Agent基础设施“企业上下文”(Enterprise Context)和名片大小的AI硬件QwenNote A2。Enterprise Context将群聊、文档、知识库和业务系统中的企业信息压缩、结构化并按需调用,QwenNote A2则通过录音转写补上线下对话这一外部上下文来源。千问办公CEO陈宇森认为模型能力已

正文顺带提及命中实体:qwen
THE DECODER模型发布

小米MiMo-V2.6-Pro登顶开源模型榜,Anthropic指控其蒸馏Claude

小米发布MiMo-V2.6系列开源模型,旗舰版MiMo-V2.6-Pro在Artificial Analysis智能指数上得分46,成为当前最强开源模型,且每百万输入/输出token价格仅为0.435/0.87美元,单任务成本约0.13美元。性能提升主要来自大规模扩展的强化学习,训练不到六天,Pro成本约262万美元。小米同时开源了RL工具包、训练框架及约7

正文顺带提及命中实体:阿里巴巴
正文顺带提及命中实体:阿里巴巴
雷峰网 AI科技评论商业

2026中国民营企业500强发布:华为腾讯研发投入居前二

全国工商联9月22日发布2026中国民营企业500强榜单及调研分析报告,京东、阿里、恒力、华为、比亚迪、腾讯位列前六,入围门槛255.99亿元。研发投入方面华为、腾讯排名前二,500强研发费用总额1.26万亿元,腾讯2025年研发投入857.5亿元、资本开支792亿元均创新高,并持续加码AI基础设施以支持混元模型升级及WorkBuddy、CodeBuddy推

正文顺带提及命中实体:qwen3.8 max
Latent Space模型发布

小米 MiMo-V2.6-Pro 开源:1T-A42B 新晋最强开源权重模型,训练成本 300 万美元

小米发布 MiMo-V2.6 系列开源全模态模型,其中 MiMo-V2.6-Pro 以 1.02T 总参数、42B 激活参数登顶开源权重模型智能指数(46),训练成本约 300 万美元。小米同时开源 RL 环境、训练配方与代码,并披露 RL 训练细节(130 小时、75B tokens、约 260 万美元)。此举被视为中国前沿实验室开源发布潮的一部分,也凸显

正文顺带提及命中实体:qwen
Hugging Face Daily Papers一手来源研究

面向软件工程智能体的类别感知迭代专家训练

该论文提出面向软件工程智能体的类别感知迭代专家训练框架,通过 Refresh-Repair-Expand 迭代开发各类别专家,并用标签路由的多教师在线策略蒸馏(MOPD)将其整合为单一可部署模型。最终策略在 Pro-618 上达到 58.04%、在 SWE-bench Multilingual 上达到 59.00%,分别较基座模型提升 5.39 和 2.78

9月21日周一 · 3 条
正文顺带提及命中实体:alibaba
Interconnects AI观点

开放模型当前的力量格局:中美竞争现状

Interconnects AI 作者向美国国会议员及幕僚介绍开放权重模型在中美竞争中的现状。文章指出,自 2025 年 4 月起中国 AI 公司在开放权重模型领域明显领先,Hugging Face 下载量约为美国的两倍(32 亿对 16 亿),在 Artificial Analysis 智能指数上中国模型 GLM-5.3、Kimi K3 等得分 42-45

正文顺带提及命中实体:qwen
Hugging Face New and Trending Models一手来源开源

DeepBeepMeep发布MiniMax H3模型及WanGP视频生成工具

DeepBeepMeep发布了MiniMax H3图像模型,这些模型与WanGP工具配合使用。WanGP是一个开源视频生成工具,支持多种模型,具有低VRAM需求、支持旧GPU、快速生成和Web界面等特点。该工具还提供Loras支持、队列系统和Discord社区支持。

正文顺带提及命中实体:qwen3.8 max
智东西模型发布

阶跃星辰发布Step 5 Preview,开源第三对标DeepSeek-V4-Pro

阶跃星辰发布新一代MoE旗舰模型Step 5 Preview,总参数600B、激活参数27B,支持100万Token上下文与原生文本、视觉输入,专为真实世界Agentic任务打造。该模型在Artificial Analysis Intelligence Index得分44分,位居开源模型第三,仅次于Qwen3.8 Max与GLM-5.3。其单任务成本约为Cl