返回主题地图

通义千问 Qwen

公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14

相关与对比厂商作为比较对象、合作方或受影响主体,当前共 96 条。
9月4日周五 · 3 条
对比或关联对象命中实体:qwen3
arXiv cs.LG一手来源研究

现代Transformer是隐式混合体:从功能分化到原则性混合架构设计

该研究通过干预式指标RFIS和RPD,揭示了基于RoPE的Transformer中头部功能分化为检索型和位置型两类,并识别出全局位置带(GPBand)作为功能边界。基于此提出设计原则,并实例化为头部级混合架构(HwH),采用无位置编码的全注意力进行全局检索、线性注意力进行局部位置建模。实验表明,HwH在保持语言建模和常识推理能力的同时,提升了检索性能,并显著

对比或关联对象命中实体:qwen3
arXiv cs.IR一手来源研究

DoPR:可复用压缩文档前缀实现高效 LLM 重排序

arXiv 论文提出 DoPR 框架,通过离线压缩文档前缀并在在线重排序中复用,减少 LLM 点式重排序的冗余计算。在 TREC DL、BEIR 和 BRIGHT 基准上,使用 Qwen3 模型(0.6B 至 8B)测试,实现了最高 8.0 倍的在线文档侧内存减少和 8.04 倍延迟加速,同时保留全文档重排序器平均 NDCG@10 的 97.1%-99.5%

正文主语命中实体:阿里巴巴
雷峰网 AI科技评论产品发布

千问办公上线首月用户破3000万,企业用户过半

阿里旗下企业级通用Agent产品千问办公上线首月用户数突破3000万,企业用户占比过半。产品保持高频迭代,推出国际版并开源上下文基础设施MyContext。基于自研模型优化,性能提升且成本降低。长安汽车等多家企业已接入该产品。

另有 1 家信源报道

9月3日周四 · 1 条
标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

ZeroDigest 发布 Qwen3.8-27B 架构感知量化系列,支持多 token 预测

ZeroDigest 实验室发布了基于 Qwen3.8-27B 的架构感知量化模型系列 Qwen3.8-27B-YMQ-MTP-GGUF,使用自定义 YMQ-Compiler v2.0 进行混合精度量化,支持多 token 预测(MTP)和高上下文优化。该系列提供从 XXS 到 XL 多个预设,针对不同 VRAM 容量优化,并公布了 WikiText-2 困

9月2日周三 · 2 条
对比或关联对象命中实体:qwen3
arXiv cs.AI一手来源研究

基于指令微调小语言模型的渐进式老年人金融诈骗增量风险评估

Kansas State University的研究人员提出了一种基于累积对话轮次的老年人金融诈骗风险评估框架,通过逐步聚合对话内容并重新评估风险,实现实时监控。他们构建了包含投资、慈善和技术支持诈骗场景的多轮对话数据集,并微调了Phi-4、LLaMA-3.2、DeepSeek-R1和Qwen3等小型语言模型。实验表明,Phi-4和LLaMA-3.2在参数规

对比或关联对象命中实体:qwen3
arXiv cs.LG一手来源研究

REAL-Q:通过动态梯度下降实现端到端大语言模型量化

REAL-Q 提出了一种新的后训练量化(PTQ)方法,通过端到端对齐的 Fisher MSE 目标和动态块级梯度下降,解决了现有方法中信息错位的问题。在 LLaMA-3.1 和 Qwen3 模型上,REAL-Q 在 W4A16 下将端到端 KL 散度最多降低 49%。该方法通过细粒度校正和滑动窗口机制,有效缓解了跨层误差传播。

9月1日周二 · 4 条
标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

Qwen3.8-Flash-Next 混合量化 SSD-PLE GGUF 发布

Baekpica 发布了 Qwen3.8-Flash-Next 的混合量化 GGUF 模型,采用 SSD-PLE 技术将 51.2B 参数的预测性潜在嵌入表移至 SSD,以 BF16 存储,从而将显存预算分配给 128.8B 参数的计算主干。在单个 NVIDIA DGX Spark 上,Q5 变体实现了 606.4 tok/s 的中位冷预填充速度和 28.3

正文主语命中实体:阿里
雷峰网 AI科技评论产品发布

实测Qwen 3.8-Max vs GPT-5.6:完成度更高但耗时3.5小时且额度耗尽

雷峰网作者通过Qwen Code和ChatGPT Codex分别调用Qwen 3.8-Max与GPT-5.6,要求它们从零搭建并迭代一个3D大模型演进宇宙网站。实测显示,Qwen 3.8-Max在页面完成度和视觉细节上优于GPT-5.6,但耗时更长(3小时29分钟)且因额度耗尽中断,而GPT-5.6在37分钟内完成但完成度较低。文章认为Qwen 3.8-Ma

标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

移动端轻量模型集合发布:Qwen3 与 GLM Edge 量化版

Hugging Face 上出现了一个名为 'good and small models' 的模型集合,由用户 flyingfishinwater 发布,旨在为移动设备提供轻量级 AI 模型。该集合包含 Qwen3-4B-Instruct-2507、Qwen3-4B-Thinking-2507 和 GLM Edge 4B Chat 等模型的 GGUF 量化版

标题相关提及命中实体:qwen
Hugging Face New and Trending Models一手来源模型发布

Qwen3.8-27B ROCmFP4 量化版发布,AMD Strix Halo 上解码速度提升 2.83 倍

kingjones777 发布了 Qwen3.8-27B 的 ROCmFP4 量化版本,专为 AMD Strix Halo 平台优化,并捆绑了多 token 预测(MTP)草稿头。该版本在 AMD Ryzen AI Max+ 395 上实现了 30.30 tok/s 的解码速度,是标准 Q4 K M 的 2.83 倍,同时困惑度与 Q4 K M 持平。作者发

8月29日周六 · 1 条
对比或关联对象命中实体:qwen
THE DECODER研究

谷歌为AI智能体打造Wiki知识库,实现经验积累与技能进化

谷歌研究院推出 WikiSkill 框架,为 AI 智能体配备持久化知识库,通过类似 wiki 的结构记录每次运行中的失败与成功经验,并生成可复用的“Agent Skills”模块来指导后续行为。该框架在多个基准测试中显著提升了模型性能,如 Gemini-3.5-Flash 平均准确率从 49.5% 提升至 68.1%,且技能可跨模型迁移。研究受 Andre

8月28日周五 · 2 条
对比或关联对象命中实体:qwen
Meituan Technical Team一手来源研究

GeoRA:为RLVR设计的几何感知低秩适配,获ACL 2026杰出论文

美团履约技术团队与北京大学联合提出了GeoRA,一种专为RLVR设计的低秩适配方法,通过谱先验和欧氏先验定位RLVR偏好的稀疏更新区域,再用SVD压缩为低秩适配器。实验表明,GeoRA在1.5B到32B的Qwen和Llama模型上,于数学、医学、代码等RLVR任务中稳定优于LoRA、PiSSA等基线,且训练参数降低99.5%,显存降低28.5%。该工作被AC

对比或关联对象命中实体:qwen
arXiv cs.IR一手来源研究

证据感知检索在RAG中的下游效用评估

本研究评估了RAG中证据感知检索评估的下游效用,发现其虽能改变检索排名,但在训练、系统选择及答案质量预测上并不稳定。人类注释确认过滤保留了证据,但不同评估器对答案质量改善结论不一,凸显了评估信号有效性的组合问题。

8月27日周四 · 1 条
正文主语命中实体:alibaba
NVIDIA Technical Blog一手来源模型发布

Qwen3.8-Flash-Next在NVIDIA GB300 NVL72上支持代理编码

阿里巴巴发布了Qwen3.8-Flash-Next模型权重,作为Qwen4架构的预览,供开发者实验和评估。该模型是一个多模态MoE模型,主模型125B参数,附加51B N-gram嵌入,每token激活6B参数,原生上下文窗口262,144 token,可通过YaRN扩展到1M。NVIDIA提供了Day 0功能支持,包括SGLang、vLLM和TensorR

8月26日周三 · 2 条
正文主语命中实体:阿里巴巴
雷峰网 AI科技评论商业

特斯拉FSD入华无望?自动驾驶首次写入法律,豆包工作发布

据网友爆料,特斯拉为FSD入华筹备的上海数据中心已人去楼空,相关团队撤离,FSD短期内无望进入中国,引发车主对已付6.4万元选装费的担忧。同时,道路交通安全法修订草案首次将自动驾驶写入法律,明确自动驾驶汽车在功能激活状态下发生违法由车企负责。此外,字节跳动发布“豆包工作”Agent产品,与飞书深度打通。

对比或关联对象命中实体:阿里巴巴
智东西产品发布

苹果发布M6/M5 Pro Mac mini及Mac Studio,AI性能大幅提升

苹果发布新款Mac mini和Mac Studio,Mac mini首发2nm M6芯片,AI性能大幅提升,Mac Studio搭载M5 Max/Ultra芯片,支持本地运行大模型。同时,苹果与阿里巴巴联合训练面向中国市场的AI大模型,推进Apple智能落地。此外,苹果计划在9月发布折叠屏iPhone等新品。

8月25日周二 · 4 条
对比或关联对象命中实体:阿里
雷峰网 AI科技评论模型发布

路透社基于阿里千问推出自研大模型Thomson-1

汤森路透基于阿里Qwen开源模型推出自研大模型Thomson-1,旨在降低对Claude等闭源模型的依赖和成本。该模型将用于表格分析、文档审核等专业工作,并逐步承接部分Claude任务。此外,Airbnb和Pinterest等公司也转向使用Qwen模型,Qwen已成为全球第一开源模型家族。

对比或关联对象命中实体:qwen
arXiv cs.SE一手来源研究

协议引导的 AI 网站冗余审计:从主观判断到可审计标准

arXiv 论文提出 Cora(反事实可观察冗余审计)框架,用于可审计的网站冗余 AI 审计。Cora 将冗余分解为重复负载、正常使用税和故障域恢复储备三个维度,并通过版本化视觉语言模型提出注释,经类型化验证和发布检查后选择性发布分数。在透明机制测试台上,Cora 的分解表示优于标量负载基线,但两个小型视觉语言模型因未满足发布要求而被拒绝自动评分。该框架定位

对比或关联对象命中实体:qwen
雷峰网 AI科技评论研究

ACL论文揭示医疗AI反直觉发现:通用模型优于专用模型

纽约大学阿布扎比分校与阿布扎比克利夫兰诊所的研究团队在ACL 2026 Findings发表论文,构建了首个多语言医疗错误评测基准MedErrBench,覆盖英语、中文和阿拉伯语,测试了GPT-4o、Gemini、Llama、Qwen、DeepSeek等模型。研究发现医疗专用模型在错误检测任务上不如通用模型,且英文原生模型在中文原生数据上表现更好。该基准旨在

对比或关联对象命中实体:阿里
智东西产品发布

韶音发布OpenFit 2 AI开放式耳机,联手千问深耕专业沟通场景

韶音发布OpenFit 2 AI开放式耳机,与阿里千问大模型深度合作,针对法律、金融等12个行业场景优化语音转录和总结功能,支持30种语言和19种方言实时翻译。该产品主打全天候舒适佩戴和长续航,通过Shokz App提供会议总结、待办事项和思维导图等功能,并获得国家网络安全等级保护三级认证。韶音表示开放式耳机有望成为最先大众化的AI语音入口,将推动耳机赛道进