英伟达Groq 3 LPX全面投产:长上下文推理速度达3431tokens/s
原标题:3431tokens/秒!英伟达Groq 3 LPX全面投产,实测数据首次披露
AI 摘要
英伟达宣布面向Vera Rubin平台的Groq 3 LPX交互式推理机架全面投产,这是其收购Groq技术后首款商业化落地的机架级专用推理系统,专为AI Agent场景设计。第三方机构Artificial Analysis测试显示,在10万tokens长上下文下该产品输出速度达3431tokens/s,是当前公开同类方案的近4倍,且无精度损失。该产品与Vera Rubin NVL72协同,支持三种部署模式,可支撑2万亿参数级别的多智能体系统。
正文节选
芯东西(公众号:aichip001) 编译 | 崔嫄伟 编辑 | 陈骏达 芯东西8月25日消息,昨日,英伟达在官网上宣布,面向Vera Rubin平台的Groq 3 LPX交互式推理机架已进入全面投入生产阶段。 该产品是英伟达收购Groq相关技术后首款商业化落地的机架级专用推理系统,作为Vera Rubin平台的扩展组件,专门面向AI Agent场景,解决长上下文下实时交互推理的行业痛点,Nebius是首家采用NVIDIA Groq 3 LPX的AI云服务提供商。 同日,英伟达开发者博客发布深度技术长文,详解Groq 3 LPX与Vera Rubin NVL72的软硬件协同架构,并首次披露独立第三方机构Artificial Analysis的基准测试结果。 Artificial Analysis是行业公认的中立 AI 性能评测机构,本次测试选用谷歌 2026年4月发布的Gemma 4‑31B稠密模型,该模型已经完成针对英伟达硬件的官方适配优化。在10万tokens长上下文测试环境下,Groq 3 LPX实现 3431tokens/s 的输出速度,性能达到当前公开同类方案的近4倍,同时保