跳到正文
@AYi_AInotes· @AYi_AInotes · X·· 2026-09-03AI 评分36
AI 导读

内存墙的核心矛盾是计算单元速度按摩尔定律每两年翻倍,而内存访问延迟与带宽增长极慢。GPU 靠 HBM 高带宽内存硬顶,TPU 靠脉动阵列减少内存访问次数,LPU 则最激进——直接舍弃片外内存,全部用片上 SRAM 承载。

正文

想真正搞懂芯片为什么会被内存卡脖子,必须理解内存墙(Memory Wall)这个底层物理矛盾:
计算单元的速度以每两年翻倍的摩尔定律狂飙,但内存访问延迟与带宽的增长极度缓慢。
GPU 靠 HBM 高带宽内存硬顶,TPU 靠脉动阵列减少内存访问次数,而 LPU 则是最极端的激进派——直接把片外内存扔掉,全部用片上 SRAM 扛

来源:@AYi_AInotes · x.com