NVLink / NVSwitch Scale-Up Fabric

NVIDIA Hopper / Blackwell 白皮书与 GTC 材料。paper-deepdive Day 8paper-deepdive-day-08.md。摘要:nvidia-nvlink-hopper-blackwell.md

哲学(相对 TPU v4 OCS):Topology is fixed (fat-tree);把每链路带宽做胖,使运行时换拓扑不必要。

关键数字(白皮书/笔记)

代际每 GPU NVLink 双向带宽备注
Hopper NVLink 4~900 GB/sH100
Blackwell NVLink 5~1.8 TB/s2× Hopper
NVL7272 GPU 单域~18 NVSwitch tray;聚合带宽笔记称 ~130 TB/s/rack 量级
NVSwitch Gen4(笔记)高基数 ASIC(数百 port 级)Clos/fat-tree 中枢

工艺:H100 ~80B 管;B200 笔记称 ~208B(双 die 等)。实体延伸:Nvidia Vera Rubin NVL72Kyber Rack

两条 scale-up 哲学

Google TPU v4NVIDIA NVLink
拓扑OCS 可重构固定 fat-tree
每芯片链路相对薄极胖(~6× ICI 叙事)
域规模Pod 4096 chipNVL72 72 GPU
交换光电路(慢切换、低 pJ/bit)高基数 packet switch
理论祖先Day 4/6「拓扑是旋钮」Day 6 high-radix Clos 工业极致

与 NoC 经典的连接

WSE 路径第三极:单晶圆 Mesh,无 NVSwitch/OCS——见 Cerebras WSE

相关页面

Citations

[1] paper-deepdive-day-08.md — Hopper/Blackwell NVLink 精读(Day 8)