群发资讯网

《英伟达Rubin:一颗芯片把"AI工厂"重写了一遍》 英伟达下一代旗舰Rubin,今年下半年放量。看几个数字,就知道这一代有多激进。 单颗Rubin GPU:3360亿晶体管,台积电3nm,两块光罩极限的die用10TB/s的片间互联焊成一颗——这是3nm时代把制造工艺逼到墙角之后,用封装继续往上堆的解法。896个Tensor ​

《英伟达Rubin:一颗芯片把"AI工厂"重写了一遍》

英伟达下一代旗舰Rubin,今年下半年放量。看几个数字,就知道这一代有多激进。

单颗Rubin GPU:3360亿晶体管,台积电3nm,两块光罩极限的die用10TB/s的片间互联焊成一颗——这是3nm时代把制造工艺逼到墙角之后,用封装继续往上堆的解法。896个Tensor Core配第三代Transformer引擎,单颗FP4算力50 PFLOPS。

内存是这一代真正的杀招:HBM4,单颗288GB,带宽22TB/s——接口宽度直接翻倍。过去两年AI推理最大的瓶颈不是算力,是内存墙;Rubin把墙拆了。

机柜形态Vera Rubin NVL144:144个GPU颗粒加36颗自研Vera CPU塞进一个柜子,全液冷,FP4推理3.6 EFLOPS,官方口径比上代GB300 NVL72整体性能3.3倍;加强版NVL144 CPX直接干到8 EFLOPS,是GB300的7.5倍,注意力机制处理快3倍。

最狠的一个数字:单位能耗下,智能体(Agent)推理吞吐是Blackwell的10倍。注意定语——不是训练,不是跑分,是Agent 7×24小时跑任务时的每瓦吞吐。英伟达给Rubin的定位写得很清楚:不是"更快的显卡",是"AI工厂的生产资料"——智能体时代的电力和土地。

还有一个容易忽略的新物种:Rubin CPX,一颗专管百万token长上下文的GPU,128GB GDDR7,和主力Rubin GPU同柜混装——推理时代,长上下文值得一颗专属芯片,这是品类创新。

一句话总结:Blackwell证明了AI能赚钱,Rubin证明的是——AI可以全天候替人干活。10倍每瓦吞吐,就是"数字员工"的电力成本表。