返回全部动态

英伟达Groq 3 LPX全面投产:长上下文推理速度达3431tokens/s

原标题:3431tokens/秒!英伟达Groq 3 LPX全面投产,实测数据首次披露

智东西产品发布质量 80

AI 摘要

英伟达宣布面向Vera Rubin平台的Groq 3 LPX交互式推理机架全面投产,这是其收购Groq技术后首款商业化落地的机架级专用推理系统,专为AI Agent场景设计。第三方机构Artificial Analysis测试显示,在10万tokens长上下文下该产品输出速度达3431tokens/s,是当前公开同类方案的近4倍,且无精度损失。该产品与Vera Rubin NVL72协同,支持三种部署模式,可支撑2万亿参数级别的多智能体系统。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

芯东西(公众号:aichip001) 编译 | 崔嫄伟 编辑 | 陈骏达 芯东西8月25日消息,昨日,英伟达在官网上宣布,面向Vera Rubin平台的Groq 3 LPX交互式推理机架已进入全面投入生产阶段。 该产品是英伟达收购Groq相关技术后首款商业化落地的机架级专用推理系统,作为Vera Rubin平台的扩展组件,专门面向AI Agent场景,解决长上下文下实时交互推理的行业痛点,Nebius是首家采用NVIDIA Groq 3 LPX的AI云服务提供商。 同日,英伟达开发者博客发布深度技术长文,详解Groq 3 LPX与Vera Rubin NVL72的软硬件协同架构,并首次披露独立第三方机构Artificial Analysis的基准测试结果。 Artificial Analysis是行业公认的中立 AI 性能评测机构,本次测试选用谷歌 2026年4月发布的Gemma 4‑31B稠密模型,该模型已经完成针对英伟达硬件的官方适配优化。在10万tokens长上下文测试环境下,Groq 3 LPX实现 3431tokens/s 的输出速度,性能达到当前公开同类方案的近4倍,同时保


发布时间:—
抓取时间:2026-08-26 01:58
来源机构:智东西
阅读原文zhidx.com