
NVIDIA Rubin GPU 公开架构 + 通用 GPU 设计/制造理论”整理为因素表。Rubin 公开资料偏数据中心 AI(算子/张量核/缓冲/HBM/3nm/chiplet/NV-HBI),渲染核在 Rubin AI SKU 中不是重点,因此渲染相关按 NVIDIA 通用图形子系统补充,标注“通用/若Rubin图形SKU”。编号类型模块属性参数/类型/模式数学建模和方程式关联知识1算子/计算范式GEMM/Transformer 算子精度、形状、K维吞吐NVFP4/FP8/BF16/FP16/TF32;M×N×K tile;Rubin 张量核每时钟K维吞吐较Blackwell翻倍,896 Tensor Core,最高50 PF NVFP4峰值张量算力:PTC=NSMNTC/SMfWKαprec;GEMM迭代数 IK=⌈K/WK⌉,Rubin相对Blackwell IKRub/IKBwk≈1/2;实际利用 U=min(1,PTCT2MNK,2(M+N)KBWeffHBM)