实体
TPUv7
TPUv7
PulseAugur coverage of TPUv7 — every cluster mentioning TPUv7 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
TPUv7 推出 SparseCore,吞吐量提升 12%,性能超越 Blackwell Ultra
TPUv7 配备了一个称为 SparseCore 的专用硬件单元,用于通过对专家 token 进行分组来管理数据移动。此优化与用于矩阵乘法的 TensorCore 结合使用时,可将吞吐量提高 12%。结合其他增强功能和更低的总体拥有成本,与 Blackwell Ultra 相比,TPU 技术提供了高达 50% 的每美元性能提升,这在 InferenceX 等基准测试中尤为明显。
-
据报道,Google正在为未来的TPU开发六维环面(6D Torus),以增强互连
据报道,Google正在为其Tensor Processing Unit(TPU)互连拓扑进行演进,为未来的TPUv9t等模型从三维环面(3D Torus)转向六维环面(6D Torus)。这种由SemiAnalysis详细介绍的新架构旨在减少通信跳数(hops)并提高双isection带宽,尽管它需要更多的光学器件。Google还为推理专用芯片引入了Boardfly拓扑,同时为TPUv8t等训练专用芯片保留了三维环面。