NVIDIA 发布 NVLink Fusion 与 NVHBM,提升定制 AI 基础设施性能
原标题:NVIDIA NVLink Fusion Brings NVHBM to Next-Generation AI Infrastructure
AI 摘要
NVIDIA 发布了 NVLink Fusion 和 NVHBM 技术,旨在帮助超大规模企业和 AI 原生公司将其定制 XPU 和 CPU 集成到 NVIDIA AI 基础设施中。NVHBM 是定制 HBM 基底芯片技术,相比标准 HBM4e 可提供高达 30% 的带宽提升、25% 的计算芯片面积增加和 15% 的功耗降低。该技术通过减少内存接口面积和优化功耗,支持更大模型和更复杂的推理工作负载,并加速定制 AI 工厂的上市时间。
正文节选
AI factories must support increasingly large models and more complex reasoning workloads. To keep up with the insatiable compute demands of AI workloads, hyperscalers and AI-native companies are developing custom AI accelerators, or XPUs. Deploying these accelerators at scale requires high-bandwidth memory (HBM) to keep compute fed, sufficient package and silicon area for more compute, efficient power delivery, and a resilient supply chain. It also requires a rack-scale architecture for deployin