返回全部动态

实测Qwen 3.8-Max vs GPT-5.6:完成度更高但耗时3.5小时且额度耗尽

原标题:我们用 Qwen 3.8-Max 做了一个 AI 大模型宇宙:效果竟然胜过 GPT5.6?

雷峰网 AI科技评论产品发布质量 72

AI 摘要

雷峰网作者通过Qwen Code和ChatGPT Codex分别调用Qwen 3.8-Max与GPT-5.6,要求它们从零搭建并迭代一个3D大模型演进宇宙网站。实测显示,Qwen 3.8-Max在页面完成度和视觉细节上优于GPT-5.6,但耗时更长(3小时29分钟)且因额度耗尽中断,而GPT-5.6在37分钟内完成但完成度较低。文章认为Qwen 3.8-Max代表结果导向路线,GPT-5.6代表效率优先路线,并指出长程Agent能力需权衡时间、预算和完成判断。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

0 作者丨李娜 编辑丨岑峰 我让Qwen 3.8-Max从零搭建了一个3D大模型演进宇宙网站,又和GPT-5.6做了迭代对比。 (Qwen3.8-Max运行成果截图) 效果上限方面,Qwen 3.8-Max 展现了远超 GPT-5.6 的交付细节; 效率和成本代价方面,Max高完成度背后是低效,而且因为无法自主判断任务终点导致了额度耗尽中断; 适用场景方面, 追求快速迭代、低成本原型,GPT 依然是首选,但在不计成本追求极致性能的场景,Qwen 3.8-Max 提供了一个昂贵但有效的国产替代。(雷峰网(公众号:雷峰网)) 01 8月3日,阿里正式发布Qwen 3.8-Max。 从规格看,它依然足够醒目:2.4万亿总参数、约950亿激活参数、100万Token上下文,覆盖文本、代码和视觉任务,并计划开放Max权重和27B小模型。榜单、规模、价格和开源,延续着Qwen过去几年的竞争路线。 (阿里Qwen3.8 max官方技术博客截图) 但到了这一代,仅靠这些已经很难解释Max的差异化。 相比Kimi K3用KDA混合线性注意力、Stable LatentMoE建立起鲜明的架构叙事,Qwen


发布时间:2026-09-01 16:36
抓取时间:2026-09-01 19:04
来源机构:雷峰网
阅读原文leiphone.com