
【CNMO科技音问】在AI算力需求呈指数级增长的波澜下,英伟达正以两年一代的节律刷新着GPU架构的天花板。继2024年发布Blackwell架构后,下一代旗舰架构Rubin(以好意思国天文体家Vera Rubin定名)已于近日浮出水面,瞻望将在2026年下半年持重亮相。当作英伟达面向AI时间的又一次系统性跃迁,Rubin架构在制程工艺、中枢规格、内存子系统及互联期间等多个维度达成了全面升级。
英伟达
Rubin架构将采选台积电N3P(3nm级)制程工艺,这是英伟达GPU初度迈入3nm节点。比较Blackwell使用的N4P工艺,N3P在同等功耗下可升迁约10%至15%的性能,或在同等性能下镌汰约25%至30%的功耗。
这一制程升级的成功纳益者是芯片的晶体管密度。更高的密度意味着在换取芯单方面积内集成更多计较单位,为后续的算力跃升提供了物理基础。跟着2nm工艺的量产时期表(2026年下半年)与Rubin的量产节律存在时期差,3nm成为Rubin最实际且最可靠的选拔。
在核神思较单位层面,Rubin架构将搭载144个流式多解决器(SM),每个SM包含128个CUDA中枢,意象18,432个CUDA中枢。这一数字较Blackwell的170个SM(神话)有所减少,但收获于3nm工艺带来的频率升迁和架构效果蜕变,合座性能瞻望仍将达成大幅跃升。
英伟达居品
内存子系统是Rubin架构的另一大亮点。Rubin将采选HBM4高带宽内存,比较Blackwell的HBM3E,带宽升迁约50%至100%。旗舰型号瞻望配备高达288GB的HBM4内存,内存带宽将结巴4TB/s。这一成立将极大缓解大模子测验和推理中的内存墙瓶颈,尤其顺应万亿参数级别的大说念话模子部署。
在互联期间方面,Rubin将搭载第六代NVLink,瞻望将进一步升迁芯片间及办事器节点间的通讯带宽和效果。聚合英伟达的Spectrum-X以太网平台和Quantum InfiniBand交换机,Rubin将扶持更大边界的AI集群部署。
值得一提的是,Rubin并非单一芯片,而是一个齐备的平台化架构。英伟达在Rubin时间将连接“CPU+GPU+DPU”三芯策略:Rubin GPU当作算力中枢,搭配Vera CPU(基于Arm架构的下一代数据中心CPU)和BlueField-4 DPU(数据解决单位),共同构建面向AI工场的全栈计较平台。
据行业信息,Rubin架构瞻望于2026年下半年持重发布,2027年插足大边界量产。首批搭载Rubin GPU的将是英伟达的DGX SuperPOD超算系统,随后逐渐向OEM互助伙伴和云办事厂商盛开。
在市集定位上,Rubin将连接英伟达“超等芯片”策略万博manbext体育官网app官网,以GB300(GPU+CPU组合)的形势面向AI测验、高性能计较和生成式AI推理等场景。2026年众人半导体修复销售额瞻望增长23.2%至1659亿好意思元,2028年有望达2295亿好意思元,Rubin的量产将成为这一轮修复投资周期的进军驱能源。