当大家还在讨论大模型参数卷不动了的时候,英伟达已经从底层把AI算力的游戏规则改了。
北京时间7月21日深夜,英伟达正式官宣:面向千兆级AI工厂的Vera Rubin平台进入全面量产阶段。CoreWeave、微软Azure、谷歌云、甲骨文云全球四大头部云厂商集体首批上车,全球350多个节点、覆盖30个国家已经落地部署。
这不是一次常规的显卡迭代——Vera Rubin根本不是单颗GPU,而是一整套从芯片、互联到散热的全栈AI工厂解决方案,它的量产标志着AI算力正式从“堆显卡数量的上半场”,进入“拼系统效率的下半场”,同时也拉开了Agentic AI(智能体AI)商业化的元年大幕。
一、到底什么是Vera Rubin?不是显卡,是一座微型AI工厂
过去我们聊AI算力,核心只看GPU:卡越多、单卡算力越强,集群就越强。但到了AI智能体时代,这套逻辑彻底失灵了。
现在的AI智能体要完成「生成-观察-推理-规划-执行」的完整闭环,除了模型计算,还有大量调度、工具调用、数据流转的工作——CPU跟不上,GPU就算算力再强也会空转;卡间通信延迟高,万卡集群的有效算力可能连一半都发挥不出来。
Vera Rubin就是冲着全链路痛点做的全栈重构,它是一套开箱即用的AI算力标准单元:
✅算力双核心:Rubin GPU负责模型训练推理,Vera CPU专门为AI智能体调度定制,是业界首款面向Agent场景的专用CPU;
✅全链路高速互联:NVLink 6负责卡间互联,Spectrum-X CPO交换机负责柜间互联,从芯片级到集群级无带宽瓶颈;
✅散热强制标配:100%全液冷设计,45℃温水散热方案直接写入官方AI工厂参考设计,扛住单机柜最高350KW的超高功率密度。
简单说,它不是卖你一堆芯片自己攒集群,而是直接交付一座可以直接投产的“微型AI工厂”,插电就能跑满算力。
二、性能炸场:10倍能效提升,直接把算力成本打下来
这次升级最有冲击力的不是纸面峰值算力,而是实际能效比——这才是决定云厂商成本、AI应用商业化速度的核心指标。
1. 每兆瓦Token吞吐提升10倍,算力成本砍到1/10
根据CoreWeave的生产环境实测:对比上一代Grace Blackwell NVL72,Vera Rubin NVL72在每兆瓦电力下的Token吞吐提升了整整10倍。
这是什么概念?
对于云厂商来说,机房供电容量是刚性天花板,同样的电力投入,现在能产出10倍的推理输出,相当于单位Token成本直接降到原来的十分之一。这不是百分之几十的优化,是量级的成本下降,直接打开了AI服务的降价空间和利润空间。
2. Vera CPU:Agent时代的隐形核心
专门为AI智能体设计的Vera CPU,是这次最容易被忽略的重磅升级。
云服务商DeepInfra的生产环境实测数据显示:Vera CPU的协同速度是传统x86 CPU的2.2倍,同等服务质量下,能多支撑60%的并发AI代理。要知道DeepInfra每周要处理近5万亿Token,其中30%的负载都来自AI智能体系统,真实业务场景下的性能提升,含金量远高于实验室跑分。
3. 三大技术硬突破,撑起能效革命
能效的跃升不是靠单一芯片,而是全链路技术突破的叠加:
✅HBM4高速内存:单颗GPU配备288GB HBM4显存,带宽达到1.69PB/s,直接解决了万亿参数大模型长上下文推理的KV缓存瓶颈,长文本、多轮对话的推理效率大幅提升;
✅CPO共封装光互联:Spectrum-X交换机首次大规模落地CPO技术,单端口带宽达102.4T,光损耗和延迟从22dB降至4dB,交换机侧散热功耗下降40%,超大规模集群的通信瓶颈被彻底打通;
✅全液冷散热体系:单芯片功耗突破300W,单机柜功率密度最高达350KW,传统风冷已经完全无法适配,全液冷从可选增值配置变成了强制标配。
三、产业链全景拆解:谁在吃到第一波量产红利?
Vera Rubin的全栈升级,带动了整条AI算力产业链的价值重构,从上游到下游传导路径清晰,多个环节迎来确定性增量:
1. 服务器整机代工:最直接的订单受益
工业富联作为英伟达全球核心AI服务器代工厂,承接了Vera Rubin一体化机架的主力代工订单,占据英伟达AI服务器40%以上的代工份额,Vera Rubin单机价值量相比上代平台翻倍,是量产最直接的受益环节。
2. 高速PCB:弹性最大的增量环节
平台升级后,PCB层数、信号复杂度大幅提升,行业测算单机PCB价值量相比上代增长233%。其中胜宏科技作为英伟达Tier1核心供应商,Rubin平台算力板、NVLink背板的供货份额约55%,AI服务器PCB全球市占率已跃居第一。
3. 液冷散热:从0到1的刚需赛道
液冷是Vera Rubin带来的全新增量市场,整套液冷系统中CDU冷却单元、冷板、分水歧管三大高价值环节合计占比达45%-65%。
✅英维克是国内唯一英伟达NPN Tier1认证的液冷系统厂商,冷板式液冷国内市占42%,CDU市占30%-40%,海外订单已排至2027年;
✅领益智造子公司立敏达是Rubin架构Manifold分水器、快接头生态中唯一的中国大陆供应商,已进入量产供货阶段。
4. 光模块与硅光:互联升级带动需求
配套Spectrum-6交换机和集群互联需求,800G/1.6T高速光模块用量进一步提升,中际旭创是Rubin平台第一大国产光模块供应商,天孚通信则卡位CPO光引擎核心无源器件环节。
5. 上游核心材料:细分赛道国产突破
高端材料环节也迎来国产替代窗口:东材科技是国内唯一通过英伟达认证的M9碳氢树脂供应商,M9树脂介电损耗低至0.0018,是Rubin平台高频高速覆铜板的核心原材料;巨化股份的电子氟化液适配浸没式液冷机型,通过英伟达相关认证,属于耗材类持续复购需求。
四、对标国产超节点:两条路线,各有棋局
很多人会问:Vera Rubin这么强,和国内华为昇腾超节点相比怎么样?其实二者是完全不同技术路线的产物,分别对应不同的市场需求,没有绝对的优劣之分。
核心相同点
二者都跳出了传统服务器堆叠的旧模式,通过高速互联实现超节点一体化架构,都标配全液冷散热,都面向大模型训练、AI智能体推理场景,是下一代AI算力的主流范式。
核心差异点
1.
算力路线不同:Vera Rubin走「单卡极致性能+高密度部署」路线,单卡算力强、单柜体积小,适合云厂商弹性部署;华为昇腾超节点走「大规模互联补单卡性能」路线,单集群最高支持1024卡互联,总算力更高,适合超大规模集中式训练。
2.
生态定位不同:Vera Rubin依托CUDA全球垄断生态,面向全球商用市场,核心卖点是降本增效;华为超节点依托全栈国产自主生态,面向国内政企、国资智算中心市场,核心优势是自主可控、不受海外出口管制约束。
3.
互联架构不同:Vera Rubin的NVLink是封闭生态,仅支持英伟达自家芯片;华为的灵衢高速总线更开放,支持更大规模的跨柜全光互联,适配万卡级超大型集群。
五、行业趋势:算力内卷进入下半场
Vera Rubin的量产,只是新一轮算力革命的开始,整个行业会出现三个明确的趋势:
短期(6-12个月):三大细分赛道率先爆发
HBM4内存、CPO光互联、液冷散热三个环节会率先进入需求爆发期,Vera Rubin单机架72颗GPU的配置,会带动相关组件需求指数级增长。同时日本等国家已经规划了140P级的Vera Rubin AI工厂,主权算力建设会成为新的需求增量。
中期(1-3年):AI工厂标准统一,马太效应加剧
接下来AI Factory的架构标准会逐步走向统一,英伟达的产品迭代周期也从一年压缩到半年,产业链更新速度越来越快。只有具备全栈方案能力的供应商能跟上快速迭代,产业资源会快速向头部厂商集中,中小供应商的生存空间会被持续挤压。
长期:物理AI、机器人接棒算力需求
Vera Rubin带来的推理性能跃升,会直接赋能物理AI和机器人产业。目前丰田等制造巨头已经在用这套算力落地工厂自动化场景,未来边缘智能体、工业机器人、具身智能,都会成为AI算力的下一波核心需求来源。
最后说几句,很多人看Vera Rubin,只看到了GPU性能又涨了多少,但真正的产业影响远不止于此。
它标志着AI算力的竞争已经彻底换了赛道:从单点的芯片性能比拼,变成了全栈系统的效率比拼;从只服务大模型训练,变成了全面支撑AI智能体商业化落地。
对于产业链来说,这是一次价值重构的机会——过去不起眼的散热、光模块、内存,正在变成核心环节;对于整个AI行业来说,算力成本的量级下降,会直接加速所有AI应用的落地速度。
AI的下一轮爆发,已经从最底层的基础设施开始了。
作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。