当前位置:首页 > 报告详情

【华安证券】互联网:DeepSeek成本和性能双突破,有望加速国内AI进程-250205(3页).pdf

上传人: AG 编号:738932 2025-02-05 3页 399.99KB

1、 敬请参阅末页重要声明及评级说明 证券研究报告 DeepSeek 成本和性能双突破,有望加速国内 AI进程 Table_IndNameRptType 互联网互联网 行业点评 行业评级:增持行业评级:增持 报告日期:2025-02-05 Table_Chart 恒生恒生指数指数与与恒生恒生科技科技指数指数走势比较走势比较 Table_Author 分析师:金荣分析师:金荣 执业证书号:S0010521080002 邮箱: Table_Report 相关报告相关报告 1.公司深度|Apple:AI 新时代,有望驱动新一轮成长周期 2024-12-31 2.科技年度策略|GenAI 引领全球科技变革

2、,关注 AI 应用的持续探索 2024-12-18 主要观点:主要观点:Table_Summary DeepSeek 取得取得 AI 模型性能和成本的双重突破模型性能和成本的双重突破 公司发布并开源了其最新的 AI 模型 DeepSeek-R1。该模型在多个基准测试中表现出色,特别是在数学推理和编程任务上,达到了与 OpenAI 的 o1 模型相当的性能水平。例如,在 AIME 2024 数学基准测试中,DeepSeek-R1 的得分率为 79.8%,略高于 o1 的79.2%;在 MATH-500 基准测试中,DeepSeek-R1 的得分率为97.3%,也优于 o1 的 96.4%。此外,

3、DeepSeek 发布了多模态开源模型 Janus-Pro,在 GenEval 和 DPG-Bench 基准测试中,击败了Stable Diffusion 和 OpenAI 的 DALL-E 3;而阿里巴巴发布了Qwen2.5-Max,为超大规模 MoE 架构;OpenAI 跟进,依次发布了全新的推理模型 o3-mini,为其推理模型首次免费,并在 ChatGPT上线 Deep Research,可在数十分钟完成人类专家需要几个小时的复杂研究任务。DeepSeek 主要通过训练流程设计和新算法应用取得创新主要通过训练流程设计和新算法应用取得创新 12 月发布的 DeepSeek-V3 主要体现

4、了高效架构与创新技术的结合,包括 1)MoE 架构的共享专家策略,减少知识冗余,提高参数效率;2)DeepSeek-V3 引入了 FP8 混合精度训练框架,占用空间更小,计算速度更快;3)多头潜在注意力(MLA)机制,模型的表示空间得到扩展,复杂特征的学习能力提升,并行计算提高处理速度;4)多 Token 预测(MTP)的应用,通过极致的内存和通讯管理,部分克服了 MTP 的缺点,从整体上提高了大模型的训练效率;5)数据并行和模型并行,显著提高了 GPU 利用率,同时减少了通信开销;而从 DeepSeek-V3 到 1 月份的 DeepSeek-R1,则在强化学习技术上有所创新,结合了监督学习

5、和强化学习的优势,提高了模型的可读性和初始推理能力。投资建议投资建议 目前生成式目前生成式 AI 仍属于技术发展早期阶段,单位成本下降是技术仍属于技术发展早期阶段,单位成本下降是技术快速发展的必然趋势,可以加速技术扩展,增加应用范围及场景。快速发展的必然趋势,可以加速技术扩展,增加应用范围及场景。腾讯云、华为云、微软云、谷歌云、亚马逊云、英伟达、AMD、Intel 陆续上线 DeepSeek-R1,AI 下游使用的增长有助于拉动国内云基础设施的需求增加,建议关注阿里巴巴-W、腾讯控股、百度集团-SW、金山云(未覆盖)等;端侧 AI 有望提速,建议关注小米集团-W、联想控股等;SaaS 等软件是

6、 AI 赋能提效落地的重要场景,建议关注焦点科技、金山办公、金蝶国际等;垂直行业应用值得持续关注,成本降低有助于寻找 PMF(product market fit),建议关注美图公司等。Table_CompanyRptType 行业研究行业研究 敬请参阅末页重要声明及评级说明 2/3 证券研究报告 风险提示风险提示 行业竞争格局剧变风险、宏观经济波动风险、政策及监管趋严风险、科技创新落地进展不及预期风险。Table_CompanyRptType 行业研究行业研究 敬请参阅末页重要声明及评级说明 3/3 证券研究报告 Table_Introduction

word格式文档无特别注明外均可编辑修改,预览文件经过压缩,下载原文更清晰!
三个皮匠报告文库所有资源均是客户上传分享,仅供网友学习交流,未经上传用户书面授权,请勿作商用。
AG
AG

该用户很懒,什么也没介绍

客服
商务合作
小程序
服务号
折叠