计算机行业超节点OEM系列:超节点,重构智算底座,国产AI加速突围

超节点:重构智算底座,国产AI加速突围 ——计算机超节点OEM系列评级:推荐(维持)证券研究报告2026年07月22日计算机刘熹(证券分析师)唐锦珂(联系人)S0350523040001S0350125070014liux10@ghzq.com.cntangjk@ghzq.com.cn 1851885风险提示和免责声明2相对沪深300表现表现1M3M12M计算机-7.8%-16.4%-10.3%沪深300-6.8%-1.7%14.5%最近一年走势相关报告《计算机“中国AI核心资产”系列(4):算力租赁与CPU的下一站:超节点OEM(推荐)*计算机*刘熹》——2026-05-12《算力租赁:锐度鲜明的中国AI核心资产 ——计算机“中国AI核心资产”系列(3)(推荐)*计算机*刘熹》——2026-04-21《计算机行业深度报告:从Rubin到Feynman,AI推理时代已至(推荐)*计算机*刘熹》——2026-03-29-17%-8%1%10%19%28%2025/07/222025/10/212026/01/202026/04/212026/07/21计算机沪深300 风险提示和免责声明3核心提要本篇报告解决了以下核心问题:1、阐明超节点需求真实、迫切,拆解技术解决路径;2、拆解英伟达Vera Rubin平台全栈架构;3、研判国产超节点产业周期与市场空间。u一、高带宽、低时延、统一内存寻址,实现算力利用效率提升1、大模型训推存在通信、显存双重刚性瓶颈。训练端MoE模型高频All-to-All通信挤占大量GPU算力;推理端KV Cache随上下文膨胀,出现容量大,小包高频、时延敏感,高并发等问题,传统服务器集群算力利用率偏低,催生超节点架构刚需。2、提高通信带宽,实现AI加速卡间高速互联。Scale-Up负责机柜内片间高带宽低时延通信(承载TP/EP强耦合并行,百纳秒级延迟),多技术路线(总线类/以太类/专有互联)并行下,多元互联技术路线加速突破发展。3、多层技术协同提升整机算力效率。依靠提高通信带宽实现卡间互联速率、依靠统一内存寻址实现内存池化、优化网络拓扑降低通信跳数、叠加软件栈调度优化,缩短通信时长,大幅降低单Token推理/训练成本,同时超节点落地需综合评估散热、运维、长期ROI等指标。u二、海外超节点标杆全栈架构Vera Rubin平台1、硬件完整覆盖训、推、存、调度全场景,引入LPU推高推理性能上限。整套NVL72平台包含Vera CPU、Rubin GPU、NVLink 6 Switch、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6 CPO以及Groq 3 LPU 7款芯片以及Vera Rubin NVL72、Groq 3 LPX、Vera CPU、BlueField-4 STX存储、Spectrum-6 SPX以太网5款机架。Rubin架构GPU推理算力较上代Blackwell提升5倍,Rubin与LPU协同可以实现35倍性能提升。2、STX机架补齐长上下文推理存储短板,布局CPU机架与以太网CPO交换机。STX机架配套CMX上下文内存存储平台,旨在支持长上下文和智能体工作负载所需的KV Cache快速扩展。针对未来代理式AI海量沙盒与强化学习的CPU需求,推出高密度Vera CPU整机柜;同步量产Spectrum系列CPO以太网交换机,硅光技术未来或升级为英伟达网络基础设施标配。u三、国产超节点放量条件逐渐成熟,服务器OEM有望直接受益1、国产互联协议多路线创新,各类厂商。国内卡间互联技术路线多元并行,华为UB、海光信息Hyswitch、沐曦MetaXLink、阿里ALink等自研互联协议竞相迭代突破,国产高速互联体系加速完善。2025年起芯片、服务器、云、ICT厂商集中发布自研超节点,华为、阿里、中科曙光等均推出自研整机。2、万卡集群真机部署+OEM订单批量落地,行业高速增长空间广阔。中科曙光实现10万卡集群部署、华勤技术订单逐渐开始批量落地,下游需求或超预期,渗透率有望加速上行,我们预计2025-2028年国产超节点市场规模CAGR达341%。3、技术壁垒抬高,看好头部整机及全产业链。超节点集成高速互联、液冷、整机结构设计,技术门槛显著高于传统服务器,头部OEM份额与毛利率有望提升。 风险提示和免责声明4核心提要l国产超节点规模化放量条件逐渐成熟,下游验证导入节奏或好于预期,渗透率或将加速抬升。加上超节点技术壁垒高,利好头部OEM厂商份额与盈利能力双提升,我们看好头部服务器OEM厂商及产业链加速放量,维持对计算机行业“推荐”评级。l相关公司:1)半导体:①GPU:海光信息、寒武纪、壁仞科技、沐曦股份、天数智芯、芯原股份;②Swith:澜起科技、盛科通信、万通发展;③CPU:中国长城、龙芯中科;④存储:长鑫科技;⑤ 晶圆制造:中芯国际、华虹宏力。2)超节点OEM:浪潮信息、中科曙光、华勤技术、紫光股份、锐捷网络、中兴通讯、联想集团、工业富联。3)超节点组件:①光模块:中际旭创、新易盛、天孚通信、华工科技、光迅科技;②PCB:沪电股份、胜宏科技、生益电子、深南电路、鹏鼎控股;③散热:光模块CAGE液冷:鼎通科技、奕东电子、硕贝德、达瑞电子、意华股份;柜内液冷:思泉新材、飞荣达、曙光数创;柜外液冷:申菱环境、英维克、高澜股份、同方股份、恒铭达、飞龙股份;④电源:麦格米特、欧陆通、中国长城,中恒电气。⑤连接:华丰科技、航天电器、沃尔核材;⑥存储:兆易创新、佰维存储、东芯股份、江波龙、德明利、朗科科技。4)算力租赁/云计算:协创数据、利通电子、宏景科技、润泽科技、智微智能、盛视科技、赛意信息、润建股份。5)数据中心IDC:云赛智联、世纪互联、大位科技、润泽科技、光环新网、奥飞数据、数据港、宝信软件。6)智能制造设备:联讯仪器、罗博特科、精智达、华盛昌、博众精工、优利德、鼎阳科技、强瑞技术。l风险提示:下游行业需求复苏不及预期、AI大模型发展不及预期、原材料价格波动的风险、市场竞争加剧、汇率波动风险、重点关注公司业绩不及预期。 风险提示和免责声明5第一章 超节点:高带宽、低时延、统一内存寻址,实现算力利用效率提升 风险提示和免责声明6● 模型训练效率对互联带宽、延迟和动态调度能力提出高要求。稠密(Dense)模型时代的核心通信模式是张量并行(TP)驱动的 All-Reduce/Reduce-Scatter,其流量模式相对规则(集合操作、同步屏障)。MoE架构引入的专家并行(EP)则要求高频All-to-All通信——每个token需要被路由到少量专家,且路由结果高度动态,流量模式呈现不可预测的稀疏多播特征。这不仅推高了总算力需求,还对互联带宽、延迟和动态调度能力提出了更高的要求。1.1 需求真实:训练对互联带宽、延迟和动态调度能力提出高要求资料来源:新华三官网,鲜枣课堂公众号,国海证券研究所图:All-Reduce通信图:All-to-All通信表:主流并行计算方式及算力资源扩展策略并行方式通信操作通信量(单卡)对网络的需求张量并行(TP)All-Reduce百GB级别(超)节点内高速

立即下载
电子设备
2026-07-24
国海证券
44页
8.51M
收藏
分享

[国海证券]:计算机行业超节点OEM系列:超节点,重构智算底座,国产AI加速突围,点击即可下载。报告格式为PDF,大小8.51M,页数44页,欢迎下载。

本报告共44页,只提供前10页预览,清晰完整版报告请下载后查看,喜欢就下载吧!
立即下载
本报告共44页,只提供前10页预览,清晰完整版报告请下载后查看,喜欢就下载吧!
立即下载
水滴研报所有报告均是客户上传分享,仅供网友学习交流,未经上传用户书面授权,请勿作商用。
相关报告
热门报告
加入社群
回顶部
报告群
公众号
小程序
在线客服
收起