返回主题地图

通义千问 Qwen

公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14

核心动态标题或摘要核心在讲该厂商及其模型,当前共 75 条。
8月4日周二 · 2 条
标题直接命中命中实体:qwen3.8 max
雷峰网 AI科技评论商业

三星收缩中国手机业务;阿里发布Qwen3.8-Max;DeepSeek日处理8万亿Token

三星被曝收缩中国手机业务,将清退月销售额不足30万元的门店,以应对市场份额仅0.1%的困境。阿里巴巴发布Qwen3.8-Max模型,带动港股上涨,并推出千问办公产品。DeepSeek V4 Flash单日处理8万亿Token,OpenAI被迫降价。智元官网披露合伙人团队,蚂蚁灵波确认融资传闻,MiniMax H3开源获多芯片适配。

标题直接命中命中实体:alibaba
THE DECODER商业

阿里新Qwen模型营销转向积极,淡化失业威胁

阿里巴巴为其新AI模型Qwen 3.8采用了与OpenAI或Anthropic不同的营销策略,通过视频展示人类追求爱好而AI完成工作,而非强调失业威胁。文章指出,阿里巴巴简化了AI对劳动力市场的影响,但积极宣传对上市公司更有利。目前尚无证据表明AI对就业或生产力产生重大影响,但金融市场反应不同。

8月3日周一 · 6 条
标题直接命中命中实体:alibaba
The Verge AI模型发布

阿里巴巴发布Qwen3.8-Max,挑战美国AI主导地位

阿里巴巴发布了其最大、最强大的AI模型Qwen3.8-Max,声称性能可与Anthropic和OpenAI的顶级系统媲美。该模型拥有2.4万亿参数,在Arena.AI排行榜上仅次于Anthropic的Fable 5和Opus系列。阿里巴巴计划下周开放模型权重,标志着其回归开源策略,加剧了中美AI竞争。

标题直接命中命中实体:alibaba
THE DECODER模型发布

阿里发布2.4万亿参数Qwen3.8-Max,主打长期自主任务

阿里巴巴发布了旗舰模型 Qwen3.8-Max,拥有 2.4 万亿参数,专注于自主完成长期复杂任务。在测试中,该模型自主构建软件、复现并改进研究论文结果、运行模拟电商业务,并在芯片设计中大幅优化电路。模型现已可用,权重将于下周发布。

摘要核心命中命中实体:阿里巴巴
Hugging Face Blog一手来源研究

超越表层对齐:信念层对齐成为AI对齐研究新视角

阿里巴巴与浙江大学的研究者提出“信念层对齐”概念,主张AI对齐不应仅停留在输出层面的表层对齐,而应关注模型内部信念与真实世界的一致性。文章引用OpenAI、Anthropic等研究,论证模型内部存在可观测和干预的信念结构,并呼吁发展系统方法进行度量与控制。

标题直接命中命中实体:qwen3.8 max
量子位模型发布

阿里发布Qwen3.8-Max,性能直逼Claude且价格低廉

阿里巴巴发布新一代基座大模型Qwen3.8-Max,总参数量达2.4万亿,在编程、专业工作、长程任务和多模态分析等场景表现突出,在第三方榜单Arena中进入全球第一梯队,直逼Claude系列。该模型定价低廉,国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,国际价格仅为Opus 5的40%和24%。实测显示其能端到端交付编程项目、进行长文

摘要核心命中命中实体:阿里巴巴
雷峰网 AI科技评论产品发布

阿里“千问办公”开启公测,整合三款产品面向企业市场

阿里巴巴于8月3日公测企业级Agent产品“千问办公”(QwenWork),整合了QoderWork、MuleRun、悟空三款产品,支持桌面端、云端和企业协同Agent,并内置最新旗舰模型Qwen3.8。该产品面向企业市场,已打通钉钉IM,未来将连接企业数据库和工作流,帮助提升办公效率。公测期间新用户可获积分奖励。

摘要核心命中命中实体:qwen
Together AI Blog一手来源研究

无提示词时LLM在想什么?模型家族主题偏好研究

Together AI 的研究团队通过使用极简、无主题的提示词,研究了大型语言模型在无明确指令时的自然生成行为。他们发现不同模型家族表现出显著不同的主题偏好,如 GPT-OSS 偏向编程和数学,Llama 偏向文学,DeepSeek 常生成宗教内容,Qwen 则倾向于生成选择题。这些差异具有系统性,并揭示了模型在无约束条件下的退化文本模式,可能带来安全和隐私

7月31日周五 · 1 条
摘要核心命中命中实体:阿里
雷峰网 AI科技评论观点

WAIC 2026观察:AI正变成制造业,Agent竞争转向落地

2026年WAIC大会上,Agent成为焦点,大厂如百度、腾讯、阿里等竞相布局通用Agent入口,小公司则聚焦垂直场景。IDC报告显示全球活跃Agent数量将增长近三倍,但商业化面临用户付费意愿低、成本高等挑战。行业正从模型竞争转向应用落地,下一轮竞争将围绕入口、垂直场景和基础设施展开。

7月22日周三 · 1 条
标题直接命中命中实体:qwen
Interconnects AI观点

开放模型综述:Kimi K3、Qwen 3.8、开源差距与蒸馏争议

在 Interconnects 播客中,Nathan Lambert 和 Florian Brand 讨论了开放模型的近期进展,包括 Kimi K3 的发布、Qwen 3.8 的开放权重计划、中国领导人的开源承诺,以及中美模型差距和蒸馏技术的争议。他们指出,开放模型在特定任务上可能接近前沿,但后训练和微调仍面临挑战。

1月9日周五 · 1 条
标题直接命中命中实体:qwen
Qwen Model Repository Activity一手来源模型发布

通义千问发布Qwen3-2507更新,支持百万级上下文

阿里通义千问团队发布Qwen3-2507更新,包含Instruct和Thinking两个变体,提供235B-A22B、30B-A3B和4B三种尺寸。新版本在指令跟随、逻辑推理、数学、编程、工具使用及多语言长尾知识等方面显著提升,并支持256K上下文,可扩展至100万token。Thinking版本在推理任务上达到开源思考模型的最先进水平。

9月23日周二 · 1 条
标题直接命中命中实体:qwen
Qwen Technical Blog一手来源模型发布

Qwen3Guard发布:实时流式安全检测护栏模型

Qwen团队发布了Qwen3Guard,这是Qwen系列首个安全护栏模型,基于Qwen3微调,支持提示和响应的安全分类,并提供风险等级和分类标签。该模型提供Gen和Stream两种变体,分别用于离线标注和实时流式检测,支持119种语言,并已在Hugging Face和ModelScope开源。Qwen3Guard在安全基准上达到先进水平,并可通过阿里云AI护

8月4日周一 · 1 条
标题直接命中命中实体:qwen
Qwen Technical Blog一手来源模型发布

Qwen-Image发布:原生文本渲染与精准图像编辑

Qwen团队发布了Qwen-Image,一个20B参数的MMDiT图像基础模型,在复杂文本渲染和精确图像编辑方面取得显著进展。该模型在多个公开基准上达到最先进性能,尤其在中文文本生成上大幅超越现有模型。用户可通过Qwen Chat体验该模型。

7月27日周日 · 1 条
标题直接命中命中实体:qwen
Qwen Technical Blog一手来源研究

Qwen提出GSPO算法:实现语言模型强化学习的可扩展训练

Qwen团队提出了一种新的强化学习算法GSPO(Group Sequence Policy Optimization),用于语言模型的规模化训练。GSPO基于序列似然定义重要性比率,并进行序列级裁剪、奖励和优化,相比GRPO具有更高的训练效率、稳定性和对MoE模型的友好性。该算法已成功应用于最新的Qwen3模型(Instruct、Coder、Thinking

7月24日周四 · 1 条
标题直接命中命中实体:qwen
Qwen Technical Blog一手来源模型发布

Qwen-MT更新:支持92种语言,低成本高速度翻译

Qwen团队通过Qwen API发布了Qwen-MT(qwen-mt-turbo)的最新更新,该模型基于Qwen3,支持92种语言,覆盖全球95%以上人口。新版本通过强化学习提升了翻译准确性和流畅度,并提供了术语干预、领域提示和翻译记忆等高级定制功能。Qwen-MT采用轻量级MoE架构,API成本低至每百万输出token 0.5美元,在自动评估和人工评估中均