当前位置:首页 > 报告详情

至顶AI实验室:2025年DeepSeek完全实用手册V1.5-技术原理·使用技巧·部署进展(209页).pdf

上传人: b**** 编号:624779 2025-04-15 209页 30.25MB

下载:

1、DeepSeek完全实用手册1.5版 技术原理使用技巧部署进展 2025 年 4 月出品机构:至顶科技执行机构:至顶AI实验室 至顶智库团队成员:孙硕 邓震东 高书葆 路飞 刘文轩 张建课题顾问:高飞媒体支持:至顶网 科技行者 Solidot组织机构/课题组前言?DeepSeek?DeepSeek?DeepSeek?DeepSeek?1 1.5 5?DeepSeek?DeepSeek?录三、DeepSeek是谁四、DeepSeek技术路线解析五、DeepSeek调与部署六、如何使DeepSeek七、?趋势判断、DeepSeek部署进展、DeepSeek V3更新一、DeepSeek V3模型更

2、新来源:DeepSeek,顶AI实验室整理2025年324,DeepSeek-V3-0324模型开源发布,与之前的?DeepSeek-V3?使同样的?base?模型,仅改进了后训练法。模型参数约 660B,开源版本上下文长度为 128K(网页端、App 和 API 提供 64K 上下文)。私有化部署时只需要更新 checkpoint 和 tokenizer_config.json(tool calls 相关变动)。简介DeepSeek V3本次更新主要体现于:推理能提升、前端开发能增强、中写作升级、中搜索能优化。新版V3在具调、扮演、问答闲聊等方面,也得到了一定幅度的能力提升。推理能力:新版

3、V3 模型借鉴 DeepSeek-R1 模型训练过程中所使用的强化学习技术,大幅提高了在推理类任务上的表现水平,在数学、代码类相关评测集上取得了超过 GPT-4.5 的得分成绩。前端开发:在 HTML 等代码前端任务上,新版 V3 模型生成的代码可用性更高,视觉效果也更加美观、富有设计感。中文写作:在中文写作任务方面,新版 V3 模型基于 R1 的写作水平进行了进一步优化,同时特别提升了中长篇文本创作的内容质量。中文搜索:新版 V3 模型可以在联网搜索场景下,对于报告生成类指令输出内容更为详实准确、排版更加清晰美观的结果。一、DeepSeek V3模型更新来源:DeepSeek?,顶AI实验室

4、整理推理任务表现提高?V3V3?03240324?MMLU-Pro?5.3?81.2GPQA?19.3?68.4MATH?3.8?94.0AIME?19.8?59.4LiveCodeBench?10.0?49.2?V3V3?QwenQwen-MaxMax?GPTGPT-4.54.5?ClaudeClaude-SonnetSonnet-3.73.7?MATH-500?AIME?2024?LiveCodeBench?务?MMLU-Pro?GPQA?Diamond?务?一、DeepSeek系列模型发布时间线来源:顶AI实验室整理绘制?DeepSeek Coder?2023?11?2?DeepSeek

5、 LLM?2023?11?29?DreamCraft3D3D?2023?12?19?DeepSeek MoE?2024?1?11?DeepSeek Math?2024?2?5?DeepSeek-VL?2024?3?11?DeepSeek V2?MoE?2024?5?7?DeepSeek Coder?V2?2024?6?17?DeepSeek-V2.5?2024?9?6?DeepSeek-VL2?2024?12?13?DeepSeek V3?2024?12?26?DeepSeek R1?2025?1?20?DeepSeek Janus-Pro?2025?1?28?DeepSeek V3?2025

6、?3?24?录三、DeepSeek是谁四、DeepSeek技术路线解析五、DeepSeek调与部署六、如何使DeepSeek七、?趋势判断、DeepSeek部署进展?DeepSeek V3?DeepSeek模型部署进展DeepSeek模型在我国地方政府、央企、四大直辖市国企以及智能终端的部署情况。1.DeepSeek模型 地方政府部署进展?务?72?DeepSeek?39?模?14?模?务?11?模?8?模?54%20%15%11%东部地区西部地区中部地区东北地区DeepSeek模型地方政府部署情况地区占比来源:至顶智库绘制来源:结合政府官网、公众号等渠道,至顶智库整理绘制?/?/?DeepS

word格式文档无特别注明外均可编辑修改,预览文件经过压缩,下载原文更清晰!
三个皮匠报告文库所有资源均是客户上传分享,仅供网友学习交流,未经上传用户书面授权,请勿作商用。
本文主要介绍了DeepSeek模型的技术原理、使用技巧、部署进展以及趋势判断。DeepSeek是由杭州深度求索人工智能基础技术研究有限公司研发的开源大模型,包括V3对话模型和R1推理模型。V3模型采用混合专家架构,专注于多任务处理,而R1模型基于强化学习训练,专注于代码生成和复杂数学问题解决。DeepSeek模型已在我国地方政府、央企、地方国企以及智能终端中得到广泛部署,应用于智能问答、知识库、场景应用、智能决策、数据挖掘、智慧运维等多个领域。此外,本文还介绍了如何使用DeepSeek模型,包括独立使用和工具组合使用两种方式,以及DeepSeek在编程辅助、创意设计、AI音视频、办公增效等方面的应用。最后,本文对DeepSeek模型的未来发展趋势进行了预测,认为模型对算力的需求将呈指数级增长,同时开源模型将推动AI应用生态的蓬勃发展。
DeepSeek技术原理是什么? 如何使用DeepSeek进行文本创作? DeepSeek在智能终端有哪些应用?
客服
商务合作
小程序
服务号
折叠