1、证券研究报告|行业周报 请仔细阅读本报告末页声明请仔细阅读本报告末页声明 gszqdatemark 通信通信 DeepSeek:模型模型效率的革命,效率的革命,算力算力基建基建的新起点的新起点 【我们团队对于我们团队对于 DeepSeek 理解,可以用一个非常巧妙的比喻来概括:理解,可以用一个非常巧妙的比喻来概括:内燃机效率的提高,一定会带来更大的石油消耗内燃机效率的提高,一定会带来更大的石油消耗】DeepSeek 做了什么:做了什么:【1】验证了新的验证了新的 Scaling Law:在过去的几年间,AI 模型的增长主要依靠于预训练阶段的规模堆积,通过对人类已有数据的不断积累,从而增加模型的
2、规模和能力。但随着训练耗尽了人类已有数据,叠加合成数据之路所产生的幻觉和边际收益递减问题,预训练阶段的Scaling Law 逐渐放缓。2024 年以来,基于强化学习的新 Scaling Law成为了行业重点方向,先后涌现出了 GPT-o1,Deepseek R1 等优秀模型。RL 这种新的 AI 增长曲线,在初期展现出了非常高的投入性价比,这也是 Deepseek V3 快速进化到 R1,并展现出强大能力的根本原因。当下 RL 依然是基于传统的预训练模型,在推理阶段加入 RL 使得模型面对理科问题时的推理技能更加强大。展望未来,随着 RL 算法在预训练阶段逐渐取代自回归算法,同时使用更强大的
3、算力和更多的数据,基于 RL 算法训练模型生成思维链,将共同构成 AI 新的 Scaling Law,算法创新与算力堆叠在这条曲线上将一起狂奔算法创新与算力堆叠在这条曲线上将一起狂奔,AI 的能力边界将迎来的能力边界将迎来新一轮的扩张新一轮的扩张。【2】极致的工程优化极致的工程优化:DeepSeek 的真正创新之处在于极致的工程优化,主要依靠了如键值缓存,创新型的 MoE 架构,以及基于 PTX 层汇编语言实现对于英伟达 GPU 效率的极致压榨等等,通过这些创新性的工程优化,使得 DeepSeek 打破了西方模型公司固有的降本周期曲线,能够用更低的价格,来提供接近头部模型的使用体验,提高了全球
4、算力的使用效率。【3】慷慨的开源:】慷慨的开源:与西方以 OAI 和 Anthropic 为代表模型巨头,逐渐走向闭源的模型商业理念不同,DeepSeek 将自身创新性原理和模型进行了开源,一方面使得全球模型厂商能够共享新的工程方法带来的性价比提升,另一方面使得全球用户能够本地或者通过公有云部署,从而避免高溢价,这也是 Deepseek 在全球开发者中获得如此高殊荣的核心原因。DeepSeek 对于对于英伟达英伟达的影响:的影响:Deepseek 的出现,让全世界看到 AGI 的实现又更近了一步。我们认为,海外在算力领域的布局不会因为 deepseek 有所放缓,相反,因为deepseek 的
5、出现,将会给全球科技巨头进一步上紧发条,海外科技巨头们将进一步加码在算力领域的布局。具体而言,一方面可能会进一步加大英伟达 GPU 采购力度,另一方面也会加紧推进自研 ASIC 方案的进度。此外,美国政府可能会进一步加紧芯片出口限制,试图在算力层面上进行最后的封锁,以限制其他国家地区的 AI 发展,维护其所谓的 AI 领先地位。对于英伟达而言,我们认为,deepseek 的阶段性胜利,将继续推动算力市场的整体需求,长期的天花板进一步被打开,我们不认为英伟达增持增持(维持维持)行业走势行业走势 作者作者 分析师分析师 宋嘉吉宋嘉吉 执业证书编号:S0680519010002 邮箱: 分析师分析师
6、 黄瀚黄瀚 执业证书编号:S0680519050002 邮箱: 分析师分析师 邵帅邵帅 执业证书编号:S0680522120003 邮箱: 相关研究相关研究 1、通信:如何丈量这一轮 CPO 的高度OIO 2025-01-27 2、通信:母线AI 大功率集群需求的新解 2025-01-25 3、通信:CPO:开启光学的新画卷 2025-01-19 -10%6%22%38%54%70%2024-022024-062024-092025-01通信沪深3002025 02 04年 月 日 gszqdatemark P.2 请仔细阅读本报告末页声明请仔细阅读本报告末页声明 的需求和订单会出现任何大幅度