1、AI算力跟踪深算力跟踪深度度(三)(三):从英伟达的视角看算力互连板块成长性Scale Up 网络的“Scaling Law”存在吗?行业研究报告请务必阅读正文之后的免责声明部分证券分析师:张良卫执业证书编号:S0600516070001联系邮箱:联系电话:021-601997932025年8月20日证券分析师:李博韦执业证书编号:S0600123070070联系邮箱:核心观点核心观点我我们认为们认为Scale Up网络存在网络存在Scaling Law,Scale Up柜间柜间第第二二层网络会逐渐出现,光层网络会逐渐出现,光+AEC连接多出与连接多出与芯片芯片1:9的配比需求,交换机多出与芯
2、片的配比需求,交换机多出与芯片4:1的配比需求,相较的配比需求,相较Scale Out网络均倍增:网络均倍增:1.英伟达持续扩大英伟达持续扩大Scale Up规模规模:英伟达正通过两大路径持续扩大英伟达正通过两大路径持续扩大Scale Up网络规模网络规模。2)提升单卡带宽:NVLink持续迭代,NVLink 5.0单卡带宽达7200Gb/s;2)扩大超节点规模:Scale Up超节点规模不断扩大,从H100 NVL8到GH200再到GB200等,NVL72等机柜方案可以提高训推效率,但并不是Scale Up的上限,NVL72等等机机柜后柜后续会作为最小的节点(续会作为最小的节点(Node)存
3、在,像积木一样在柜与柜之间进)存在,像积木一样在柜与柜之间进一步拼出更大的一步拼出更大的Scale Up超节点,届时需要光连接等进行通超节点,届时需要光连接等进行通信信。2.为什么为什么需需要要Scale Up网络网络:“内存墙”问题和“内存墙”问题和AI计算计算范式范式演进演进推推动动Scale Up网络升级网络升级。“内存墙”:单一大模型的参数量与单卡显存的差距(即模型内存墙)、单卡算力与单卡显存间的差距(即算力内存墙)均逐代放大,通过Scale Up将显存池化。计算范式:为了提升计算效率,在进行数据并行、流水线并行的同时也采用张量并行与专家并行,后者对通信频次、容量的要求都跨越数量级。1
4、核心观点核心观点3.为什么为什么需需要更大要更大的的Scale Up网络网络:TCO、用户体验、模型能力拓展、用户体验、模型能力拓展。随着单用户每秒消耗的Token数(Tokens Per Second,TPS)提高,包括NVL72在内的现有服务器单卡性能都会逐渐坍缩,在用户用户体体验持续提升、验持续提升、模型能力拓模型能力拓展的趋势下,单用户展的趋势下,单用户TPS必然增长,采用更大规模的必然增长,采用更大规模的Scale Out能提高单能提高单卡有效性能,卡有效性能,TCO也更具经济性。也更具经济性。我们认为Scale Up规模与预期单用户TPS、单卡实际性能间存在Scaling Law,
5、前者会随后者非线性增长。4.怎么组建更大的怎么组建更大的Scale Up网络:网络:网络结构层面,在柜间搭建第二层Scale Up交换机;端口连接层面,光与AEC有望在第二层网络中并存,按照最新的按照最新的NVLink与与IB标准测算,标准测算,1颗颗GPU需要需要9个额外的等效个额外的等效1.6T连接,为连接,为Scale Out网络的网络的3-4.5倍,每倍,每4颗颗GPU需要额外需要额外1台交换机,为台交换机,为Scale Out网络的网络的7.5-12倍。倍。投资建议:投资建议:我们认为Scale Up需求有望持续拓展,带来倍增的网络连接需求,光连接、AEC、交换机等环节都有望深度受益
6、,相关标的光互连:光互连:中际旭创,新易盛,天孚通信,光库科技,长芯博创,仕佳光子,源杰科技,长光华芯,太辰光;铜互连:铜互连:中际旭创,兆龙互连;交换机:交换机:锐捷网络,盛科通信,Astera Labs(美股,后同),博通,天弘科技,Arista风风险提示:险提示:算力互连需求不及预期;客户处份额不及预期;产品研发落地不及预期;行业竞争加剧。2我们认为后续算力互连需求发展存在乘数效应:我们认为后续算力互连需求发展存在乘数效应:资本开支结构优化,算力芯片增长速度高于资本开支增速 单芯片带宽提升,算力互连需求增速高于芯片需求增速 芯片需求 =CapEx 算力芯片投资在CapEx占比 芯片投资性