
从一张 PCB 到一颗芯片,RTX 5090 的算力到底写在哪里?本期视频沿着“板级 → 芯片级 → 核心级”三层结构,把 RTX 5090 完整拆一遍:从整块板子的核心、显存、PCIe、显示输出,一路钻进 GB202 内部,看 11 个 GPC、85 个 TPC、170 个 SM 如何层层分发算力;再放大到单个 SM,数清 128 个 CUDA 核心、4 个 Tensor Core、RT Core 的分工;最后回到芯片边缘,看 96MB L2、16 个 32-bit 显存控制器、176 个 ROP 如何拼成 512-bit 位宽和每秒 1792GB 带宽。21760 个 CUDA 核心、680 个第五代 Tensor Core、3352 AI TOPS、318 TFLOPS 光追——这些数字不是堆出来的,而是一层一层设计出来的。拆解不是看热闹,而是理解一张显卡如何从电路变成算力机器。下集我们将一起芯片级拆解 NVIDIA H100,看 H100 板卡的算力实现硬件原理。 #AI #英伟达 #程序员 #编程 #算力