返回主题地图

通义千问 Qwen

公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14

相关与对比厂商作为比较对象、合作方或受影响主体,当前共 96 条。
8月24日周一 · 2 条
对比或关联对象命中实体:qwen3
对比或关联对象命中实体:qwen
THE DECODER商业

汤森路透斥资4000万美元自建法律AI模型,基于阿里Qwen

汤森路透投资约4000万美元,基于阿里巴巴的Qwen开源模型构建了自有法律AI模型“Thomson”,并利用公司内部数据和领域专家进行训练。测试显示,Thomson在访问公司专属内容时能超越GPT-5.4等竞品,但在推理和编码方面表现较弱。公司计划将Thomson用于文档审查等高频任务,并发布小版本模型供非商业使用,以降低成本并保持独立性。

8月23日周日 · 1 条
标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

Qwen3.8-27B 去审查模型发布:V3 实现真实回答

Hugging Face 上发布了名为 Qwen3.8-27B-OBLITERATED 的模型,基于 Qwen3.8-27B 进行去审查(abliteration)处理,旨在消除安全拒绝和说教式回应。V3 版本通过迭代细化和定向语料库,在 MMLU 上仅下降 2.1 个百分点,同时实现了对受限查询的真实回答,并在代码生成任务中表现良好。该模型提供 GGUF、

8月22日周六 · 3 条
对比或关联对象命中实体:阿里巴巴
量子位产品发布

对话硅羽科技:让无人机拥有自主大脑,替人奔赴危险现场

香港大学副教授张富创立硅羽科技,致力于开发不依赖GPS和飞手遥控的空中智能体,将具身智能从地面拓展到空中,用于危险环境作业。公司半年内完成四轮融资,累计数亿元,投资方包括阿里巴巴等。硅羽科技计划年底量产第一阶段产品,并利用Real-to-Sim技术解决数据稀缺问题。

对比或关联对象命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

DavidAU 发布 Qwen3.6-40B 多阶段微调模型,宣称达到闭源智能水平

DavidAU 发布了 Qwen3.6-40B-Fable-Fusion-6-Core-Deckard-Eleanor-Heretic-Uncensored-NM-DAU-NEO-MAX-MTP-GGUF,这是一个基于 Qwen 3.6 的 40B 参数多阶段微调模型,据称在 8 位和 4 位量化下达到闭源模型(如 OpenAI、Claude)的智能水平。该

对比或关联对象命中实体:qwen
Hugging Face Blog一手来源研究

新 imatrix 数据集发布:量化校准实验与发现

Hugging Face 博客作者发布了新的 imatrix 校准数据集,并详细介绍了与 LTT Labs 团队合作进行的实验,测试不同数据集对量化模型性能的影响。实验发现,在低比特量化(如 Q2 K)下,imatrix 数据集的选择对 MoE 模型性能影响显著,但对高比特量化影响不大。作者公开了数据集和渲染脚本,并计划继续迭代。

8月21日周五 · 2 条
正文主语命中实体:阿里巴巴
雷峰网 AI科技评论商业

阿里财报揭示AI商业化:云和芯片成最大赢家

阿里最新财报显示,阿里云营收达487.37亿元,同比增长45%,经调整EBITA同比增长133%,利润率升至11.6%。增长主要来自AI算力需求激增和MaaS收入增加,同时自研芯片出货和全栈优化提升利润。阿里全栈AI布局使其在商业化中更具优势,云厂商成为AI浪潮中的受益者。

正文主语命中实体:alibaba
arXiv cs.CV一手来源研究

SceneGTMM:基于共形映射的场景感知可迁移GNN-Transformer双图交互地图匹配框架

阿里巴巴高德地图团队提出SceneGTMM框架,一种基于共形映射的场景感知可迁移GNN-Transformer双图交互地图匹配方法。该框架通过共形映射场景相对策略、GNN-Transformer双图交互架构和CRF增强结构化预测,在跨区域迁移和噪声鲁棒性上取得突破。实验表明,在定位误差16-50米的多源轨迹数据上,准确率超过80%,比传统HMM提升5.3%,

8月20日周四 · 2 条
正文主语命中实体:alibaba
THE DECODER观点

前沿雷达:中国AI模型逼近,西方领先还剩什么?

THE DECODER 的 Frontier Radar 第四期指出,中国 AI 模型如 Kimi K3 和 GLM-5.3 已接近美国顶尖模型水平,西方实验室指责中国通过蒸馏和刷分追赶,但模型领先优势难以维持。西方在抽象测试、可靠性和前沿领域仍有优势,但整体领先已转向系统层面。文章还提到欧洲在 AI 竞赛中落后。

对比或关联对象命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

Unsloth 发布 Qwen3.8-27B GGUF 量化模型,支持动态量化与智能体优化

Unsloth 发布了基于 Qwen3.8-27B 的 GGUF 量化模型,采用 Dynamic V3.0 技术,宣称在精度和量化性能上优于其他量化方案。Qwen3.8-27B 是 Qwen 系列最新开源模型,具备原生视觉语言理解、灵活思考控制、长上下文(262K 原生,可扩展至 1M)和增强的智能体执行能力。该模型支持在 Unsloth Desktop 中

8月19日周三 · 1 条
对比或关联对象命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

Qwen3.8-27B EXL3 量化版:更小下载、更快启动、更高保真

malaiwah 发布了 Qwen3.8-27B 的 EXL3 量化版本,其中注意力权重在磁盘上以 K6 精度序列化,相比 BF16 注意力版本,下载体积减少 29%,冷启动速度提升 5.4 倍,且与 BF16 的 KL 散度更低。该模型需要特定的 Gilded Gnosis vLLM 分支才能运行,属于实验性研究产物。

8月17日周一 · 2 条
正文主语命中实体:阿里巴巴
对比或关联对象命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

AtomicChat 发布 Qwen3.8-27B GGUF 量化模型

AtomicChat 发布了 Qwen3.8-27B 的 GGUF 量化版本,基于 Qwen 原始权重并使用自己的重要性矩阵进行量化。该模型支持文本生成和多模态(图像)输入,提供了多种量化级别,并附有详细的量化分析、运行指南和速度测试。用户可通过 llama.cpp 或 Atomic Chat 应用本地运行该模型。

8月16日周日 · 2 条
对比或关联对象命中实体:qwen
Ollama Releases一手来源产品发布

Ollama v0.32.14 发布:修复 WebP 图像转码与 Qwen 渲染器

Ollama 发布了 v0.32.14 版本,主要修复了 llama-server 对 WebP 图像的转码问题,并让 Qwen 渲染器能容忍非开头的系统消息。该版本更新了变更日志,用户可通过 GitHub 查看完整变更。

标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

Qwen3.6-35B-A3B 未审查多模态模型 Genesis Hermes V7 发布

LuffyTheFox 发布了基于 Qwen3.6-35B-A3B 的未审查多模态 MoE 模型 GGUF 版本,名为 Genesis Hermes V7。该模型通过其自研的 Genesis 算法对张量进行噪声修复,并融合了 Hermes 微调数据,旨在提升模型稳定性和指令遵循能力。模型支持多语言和视觉任务,并提供了量化脚本和推荐配置。

8月14日周五 · 1 条
对比或关联对象命中实体:alibaba
The Verge AI商业

苹果与阿里巴巴合作训练中国定制AI模型

据路透社报道,苹果与阿里巴巴合作,为中国市场训练了一款定制AI模型,这标志着苹果在华策略的转变,从使用国内模型转向自主开发。该模型将在未来几个月内随iOS系统更新推出,苹果已向中国网信办注册该服务。此举使苹果成为首家获准在华提供专有AI模型的美国公司。

8月13日周四 · 1 条
正文主语命中实体:alibaba
NVIDIA Technical Blog一手来源产品发布

NVIDIA 在 GB300 NVL72 上支持 Qwen3.8-2.4T-A95B 模型部署

阿里巴巴发布了其最大的开源权重模型 Qwen3.8-2.4T-A95B(Qwen3.8-Max),总参数达 2.4T,每个 token 激活 95B 参数,采用细粒度 MoE 架构和全注意力与线性注意力混合设计,支持百万 token 上下文。NVIDIA 宣布该模型可在 GB300 NVL72 平台上以 FP8 精度实现每 GPU 每秒超 4K tokens

8月12日周三 · 3 条
对比或关联对象命中实体:qwen
llama.cpp Releases一手来源产品发布

llama.cpp b10375 发布:优化 Qwen 模型解析

llama.cpp 发布 b10375 版本,主要更新为收紧 Qwen 模型的 bare function 解析逻辑。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,并支持多种硬件加速后端。

标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

DavidAU 发布 Qwen3.6-27B 多阶段微调模型,ARC-C 突破 700

DavidAU 发布了 Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF 模型,这是基于 Qwen3.6-27B 的多阶段微调模型,据称在 8 位和 4 位量化下 ARC-C 得分均超过 700,达到闭源模型水平。该模型在 7 项基准测试中 6 项超过基础模型,并支

对比或关联对象命中实体:qwen3
Hugging Face Daily Papers一手来源研究

无监督在线策略自蒸馏:仅靠内部一致性提升大模型推理

该研究提出无监督在线策略自蒸馏方法(U-OPSD),仅利用模型自身生成和内部一致性(多数投票)构建伪解决方案,无需外部监督即可纠正模型自信的错误。在多个数学推理基准上,U-OPSD 在 Qwen3 非思考模式下相比基础模型提升 8.5% 和 10.7%,并优于或持平于有监督方法 OPSD 和 GRPO。代码已开源。