返回全部动态

浪潮信息发布SD200 Ultra与HC2000,破局Agent算力

原标题:单机跑Kimi K3首破5.85毫秒,同等投资Token产能提升10倍!浪潮信息破局Agent算力难题

智东西产品发布质量 40

AI 摘要

在AICC 2026大会上,浪潮信息发布元脑SD200 Ultra超节点AI服务器和元脑HC2000多元算力机组,分别面向Agent时代算力的“向上”与“向广”需求。SD200 Ultra以128芯本土AI芯片、3D HyperMesh架构和8TB带宽、64TB内存,实现单机运行2.8万亿参数Kimi K3,Token生成时延首次突破5.85毫秒,并支持10万亿参数模型。HC2000基于DirectCom 2.0和MCIS软件栈,在典型Agent任务中同等SLO约束下实现同等投资10倍Token产能提升。浪潮信息称算力产业竞争已从单点转向系统协同。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

智东西(公众号:zhidxcom) 作者 |  王涵 编辑 |  漠影 2026年,Agent的火爆程度空前。 9月21日,在AICC 2026大会上,IDC发布了一组数字:2026年全球活跃Agent约7940万个,到2030年将达22.16亿个。 而同期Token消耗量的增长更为惊人:从2026年的0.026Peta(千万亿),增长到2030年的152667Peta。Agent数量增长约28倍,Token消耗却增长数百万倍。 需求侧增长如此之快,算力供给能接住吗? 今年有两个案例十分典型: 一是Kimi K3。这个总参数量2.8万亿的模型,权重文件达到1.56TB,普通AI服务器的GPU显存连权重都装不下,官方推荐至少64卡甚至更大规模才能运行。 它指向的是“向上”的困境:当Agent需要更强推理、更长上下文和更多智能体协同,能力上限越高,部署门槛越从单机走向集群。 二是DeepSeek。2026年上半年,它曾将V4-Pro的API价格下调75%,并称调整长期有效;但8月又预告整体提价,理由直指“算力不足”。 它指向的是“向广”的困境:当Agent大规模调用便宜模型,性价比算力的需


发布时间:—
抓取时间:2026-09-23 01:55
来源机构:智东西
阅读原文zhidx.com