返回全部动态

谷歌披露第八代TPU细节:推理芯片配288GB HBM,训练能效翻倍

原标题:谷歌披露第八代TPU技术细节:推理芯片用上288GB HBM,训练芯片能效达前代2倍

智东西产品发布质量 80

AI 摘要

在Hot Chips 2026大会上,谷歌披露了第八代TPU技术细节,包括面向推理的TPU 8i和面向训练的TPU 8t。TPU 8i配备288GB HBM和384MB SRAM,采用Boardfly拓扑降低延迟;TPU 8t通过Virgo网络和光交换支持超大规模训练,能效达前代2倍。谷歌还利用AI优化芯片设计,并强调软件兼容性。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

芯东西(公众号:aichip001) 编译 | 崔嫄伟 编辑 | 陈骏达 芯东西9月2日消息,8月26日,在全球顶级半导体架构研讨会Hot Chips 2026上,谷歌披露了第八代TPU(张量处理单元)的技术细节。这代TPU共有两款,分别是面向推理场景的TPU 8i与面向训练场景的TPU 8t。 这两款芯片此前已于今年的Google Cloud Next大会上首次亮相,这也是谷歌首次在一代产品中同时推出两款芯片。 面向推理场景的TPU 8i定位为“低延迟推理引擎”。单颗芯片片上SRAM容量达384MB,是前代产品的2.4倍,更大的片上缓存可支撑更大规模模型运行,大幅减少片外内存访问;HBM总容量288GB,采用12层堆叠的HBM3E显存;片间互联(ICI)带宽达19.2Tb/s,较前代提升一倍。 面向训练场景的TPU 8t则以浮点算力与高扩展互联为设计核心。本次大会,谷歌暂未披露TPU 8t芯片参数。从集群规格来看,单个TPU 8t Superpod集成9600颗芯片,通过光交换技术聚合为总容量2PB的全局共享HBM内存池;FP4精度下集群峰值总算力达121 EFLOPS,能效比达到第


发布时间:—
抓取时间:2026-09-03 01:56
来源机构:智东西
阅读原文zhidx.com