BT财经

境内金融信息服务备案编号:

【京金信备(2021)5号】

2026年10月06日

注册 / 登录

吞吐量翻4.8倍!英伟达Vera Rubin量产重塑价值链

英伟达在2026年9月底抛出了一份重量级的交付确认:全球顶尖的AI云服务商CoreWeave已经将其搭载最新一代计算平台的服务器集群正式投入使用,并开始向外部客户输出云服务。作为首个验证其工程能力的AI软件公司Cognition,在实际运行软件工程推理任务时测得的数据引发了市场高度关注——新版系统的总Token吞吐量最高达到了上一代主力机型GB200 NVL72的4.8倍。这不仅仅是一次简单的硬件换代,更标志着AI算力基础设施的研发竞赛已经从理论参数验证跨入了实质性的商业化交付阶段。对于资本市场而言,这不仅是一则科技新闻,更是新一轮资本开支(CapEx)启动的信号弹。

算力性价比的重估:为什么需要4.8倍的提升?

过去一年多时间里,关于新一代AI芯片性能增长的讨论往往陷入“浮点算力(FLOPS)”的数字游戏。然而,此次Cognition使用的评估维度是实际软件工程场景下的“Token吞吐量”。这个指标的跃升,揭示了一个关键的产业趋势:算力瓶颈正在从纯矩阵计算的峰值理论值,转向复杂工作负载下的大规模并行调度与内存交互效率。

英伟达方面同时披露的另一组数据进一步印证了系统级优化的深度:搭载新款Vera CPU的系统,在运行AI代理沙箱时的启动速度提升了超过3倍。这意味着新一代架构不再是单纯堆叠GPU核心数量,而是通过异构计算架构的深度解耦,解决了大规模分布式训练和实时推理中的排队延迟问题。

为什么云厂商愿意为此支付昂贵的升级成本?核心答案在于边际推理成本的下降。当吞吐量提升近5倍时,单次请求的能耗和时间成本将大幅压缩。对于依赖推理收入生存的AI初创公司和云服务巨头来说,这种能效比的质变意味着他们可以用同样的电力预算服务更多的用户,从而缩短投资回报周期。这种“摩尔定律+系统优化”的双重红利,是支撑未来三年AI基础设施建设的经济学基础。

系统级重构:单机价值量为何被迫上移?

随着单机物理密度的急剧攀升,英伟达的下一代Blackwell演进平台(业内通称Vera Rubin架构)正在从根本上改变AI服务器的物料清单(BOM)结构。以前我们习惯将注意力集中在GPU芯片本身的制程与流片上,但在NVL72这种超大规模机柜形态下,整机的系统集成难度远大于单一芯片的设计。

4.8倍的吞吐能力背后,是对数据传输带宽和能量转换效率的极限压榨。为了喂饱这些密集的计算核心,机架内部的互联拓扑结构必须全面升级。传统的铜缆互连在高频信号传输下开始出现严重的衰减,而高密度存储模块的堆叠则带来了前所未有的热设计功耗(TDP)挑战。因此,整机价值的增长不再仅仅由昂贵的GPU芯片独占,而是不可避免地向上游的基础材料与配套部件环节蔓延。这种价值重心的分散,正是当前供应链最核心的变量。

钱流向哪里:HBM4、液冷与高端PCB的拥挤通道

机构分析师普遍指出,随着Rubin架构切入生产跑道,三大赛道正面临单机价值量的显著上移。

首先是高带宽存储器(HBM)。为了满足大模型推理中近乎恐怖的显存读写需求,HBM4的容量密度和技术规格再次打破常规。由于制造工艺极度依赖先进封装技术(如CoWoS),HBM4将成为单机成本中最具刚性的支出项。SK海力士等头部厂商目前的产能倾斜表明,HBM4在未来相当长一段时间内都处于供不应求的状态,这将确保上游存储产业链享有极高的毛利率溢价。

其次是液冷散热体系的强制渗透。高密度的集成意味着风冷散热已达到物理极限,微通道液冷板与全浸没式冷却方案不再是锦上添花的选项,而是保障机柜连续运转的必要基础设施。随着数据中心PUE(能源使用效率)政策的收紧,具备微通道液冷板及相关核心技术的企业将获得确定的订单增量。

最后是高频高速PCB与连接器。当机架内部节点间的通信延迟必须压缩到纳秒级别时,传统多层板的介电损耗无法支撑海量数据的无损穿梭。高层数、低损耗的特殊覆铜板材以及与之匹配的精密加工产能,正在成为制约整体算力释放的新瓶颈。谁能在这个细分环节实现批量供货,谁就能分享这轮架构升级的红利。

投资兑现的滞后性:关注认证周期而非发布会

尽管英伟达的技术路线图已经清晰画定,但投资者需要警惕技术发布与业绩兑现之间的时间差。根据目前产业链的反馈,部分关键材料虽然已经通过了初步验证并获得小批量订单,但从实验室走向大规模的产线放量,通常需要经历严格的可靠性测试与良率爬坡期。特别是在涉及半导体封装材料和精密制造领域,任何一个微小的工艺瑕疵都可能导致整批硬件的报废风险。

因此,在追逐概念的阶段保持冷静尤为重要。那些能够在半年前就开始配合芯片原厂进行联合调试、并在当下拿到明确验收单的供应商,才具备真正的业绩弹性。而对于仅停留在公告传闻阶段的标的,还需要进一步的产能利用率数据来支撑判断。

观察指标:下一步该盯紧什么?

要持续跟踪这一轮算力基建的真实热度,建议重点关注以下三个维度的变化: 1。 HBM4的出货良率与定价权变化:这将直接决定单台服务器的基础成本底线。 2。 主流云厂商的资本开支指引更新:特别是针对新型液冷机柜的采购比例是否出现加速。 3。 高层数高速覆铜板厂商的营收同比增速:作为算力互联的物理载体,其排产情况能最快反映硬件制造的景气度。



版权声明:本文版权归BT财经所有,未经允许任何单位或个人不得转载,复制或以任何其他方式使用本文全部或部分,侵权必究。
帮助中心
联系我们
联系我们

 

商务合作:

 

公司地址

北京市丰台区汉威国际广场一区一号楼629

 

 

商务合作

周先生

Tel: +86-17743514315

Email: info@btimes.com.cn

官方微信公众号

北京领讯时代信息技术有限公司 | Copyright ©️ 2026 财经时报 版权所有 京ICP备19043396号-7

京公网安备 11010602007380号 | 境内金融信息服务备案编号:京金信备(2021)5号

网信算备110106674807801230011号


声明:未经授权,不得复制、转载或以其他方式使用本网站的内容。BT财经尽最大努力确保数据准确,但不保证数据绝对正确。