一、Deepseek大模型简介
1.1、Deepseek是什么
DeepSeek(中文全称:杭州深度求索人工智能基础技术研究有限公司)是总部位于杭州的大模型研发企业,由国内量化私募机构幻方量化(High-Flyer)孵化,2023 年 7 月正式成立,创始人兼 CEO 为梁文锋。公司核心定位是通用人工智能基础技术研究,以极致工程效率、开源开放、高性价比推理为核心特色,是全球开源大模型领域的核心厂商之一。
DeepSeek 采用【通用基座 + 垂直专项 + 开源开放】的产品策略,覆盖通用对话、推理、代码、多模态等全场景,同时提供 API 服务、开源权重、私有化部署多种交付形式。
1.2、Deepseek的核心产品矩阵
1.2.1、通用大模型系列(DeepSeek-V 系列)
| 模型版本 |
发布时间 |
总参数量 |
单 Token 激活参数 |
上下文窗口 |
核心定位 |
| DeepSeek-V4-Pro |
2026 年 4 月 |
1.6 万亿 |
490 亿 |
100 万 Token |
旗舰通用模型,平衡深度推理与综合能力 |
| DeepSeek-V4-Flash |
2026 年 4 月 |
2840 亿 |
130 亿 |
100 万 Token |
高性价比轻量版,主打低延迟、低成本通用场景 |
| DeepSeek-V3.2 |
2025 年 12 月 |
6710 亿 |
370 亿 |
128K Token |
上一代主力模型,推理与数学能力突出 |
1.2.2、推理专项模型(DeepSeek-R 系列)
代表产品:DeepSeek-R1
- 基于 DeepSeek-V3 基座通过大规模强化学习训练而成,主打复杂逻辑推理、数学求解、代码调试等深度思考场景,性能对标 OpenAI o1 正式版。
- 支持完整思维链输出,模型权重与代码全部以 MIT 协议开源,官方明确允许商用、允许二次蒸馏,是全球开源推理模型的标杆产品DeepSeek。
- 核心应用场景:科研计算、算法开发、复杂业务逻辑梳理、专业考试答题。
1.2.3、代码专项模型(DeepSeek-Coder 系列)
- 是全球公认的顶级开源代码模型之一,支持 100 + 编程语言,覆盖代码补全、代码生成、漏洞检测、文档生成、重构调试全研发流程。
- 在 HumanEval、SWE-bench 等全球权威代码评测中持续位列开源模型第一梯队,是企业私有化代码助手、研发提效工具的主流基座选型。
1.2.4、多模态与垂直专项模型
| 多模态与垂直专项模型 |
说明 |
| DeepSeek-VL 系列 |
视觉语言多模态模型,支持图像理解、图表分析、OCR 识别、文档解析。 |
| DeepSeekMath 系列 |
数学专项模型,覆盖初等数学到高等数学、竞赛级数学题求解。 |
| DeepSeek-OCR |
高精度文字识别模型,适配复杂排版文档、手写体、表格识别场景。 |
1.3、Deepseek的行业地位
| Deepseek的行业地位 |
说明 |
| 1、中文综合能力评测 |
在国内最具影响力的中文大模型评测基准 SuperCLUE 2026 年 8 月榜单中: * DeepSeek-V4-Flash 以 65.60 分位列总榜第 2,DeepSeek-V4-Pro 以 64.40 分位列总榜第 3,双双进入国内第一梯队。 * 单项维度:数学推理、幻觉控制、智能体任务规划三个维度均进入国内前三,其中幻觉控制得分接近 80 分,事实准确性表现突出 |
| 2、代码与智能体能力 |
在全球权威代码评测 SWE-bench Verified 榜单中,DeepSeek 系列模型持续位列开源模型第一梯队,与 GPT、Claude 等海外顶级闭源模型处于同一水平区间。 |
| 3、开源生态地位 |
* 在全球开源大模型榜单 Open LLM Leaderboard 中,DeepSeek-V3.2 综合得分位列全球开源模型第二,中文能力显著优于 Meta Llama 系列等海外开源模型。 * 是全球开发者二次开发、垂直领域微调的主流基座之一,国内大量创业公司、行业应用均基于 DeepSeek 开源模型进行定制化开发。 |
| 4、产业市场地位 |
* IDC《2025H1 中国 MaaS 市场跟踪报告》将 DeepSeek 列为中国大模型市场核心变量,其低成本推理路线带动了国内 MaaS 市场价格下探与普及,是国内 MaaS 市场第二梯队核心厂商。 * 中国信通院已完成 DeepSeek 大模型的软硬件协同适配评测,与海光、昇腾、鲲鹏等全品类国产算力平台完成 Day 0 级适配,是国产化替代场景的主流选型之一。 |
二、Deepseek的开源协议与商用授权规则
Deepseek开源许可说明
https://deepseeklicense.github.io/index-CN.html
| 模型系列 |
开源协议 |
商用权限 |
蒸馏权限 |
| V4 全系列、R1 系列 |
标准 MIT License |
完全免费商用,无营收门槛、无用户规模限制 |
官方明确允许,可基于模型输出蒸馏训练自有模型 |
| V3、Coder-V2 等旧系列 |
DeepSeek 自定义许可(基于 OpenRAIL 修改) |
允许商用,无营收限制,仅需遵守行为约束条款 |
早期版本未明确,R1 发布后统一放宽 |
| 代码仓库 |
标准 MIT License |
完全自由使用、修改、分发 |
- |
注意:DeepSeek 不同代际模型的开源协议有明确差异,商用前需对应确认!!!
| 开源协议内容的合规提示 |
| * MIT 协议为行业最宽松的开源许可之一,个人、中小企业、大型企业均可免费商用,无需单独申请授权, 需保留原始 MIT 版权声明与免责声明。 * 协议包含通用行为限制:禁止用于违法犯罪、危害公共安全、深度伪造诈骗等违规场景,违规使用需自行承担法律责任。 * 企业私有化部署场景,可直接下载开源权重本地部署,无需向 DeepSeek 支付授权费用;如需官方技术支持、定制微调、运维服务,可单独采购企业服务。 |
三、大语言模型在国内合规资质说明
| 大语言模型在国内合规资质 |
说明 |
| 1、生成式 AI 服务备案 |
已通过国家互联网信息办公室生成式 AI 服务备案,可合法面向国内提供 API 与在线服务。 |
| 2、信通院适配认证 |
通过中国信通院大模型软硬件协同适配评测,兼容主流国产芯片、服务器、操作系统,满足信创项目要求。 |
| 3、安全合规 |
符合《生成式人工智能服务管理暂行办法》要求,具备内容安全审核、数据安全保护、用户权益保障等完整合规体系。 |
| 大语言模型所有商用场景的通用合规红线 |
| 1. 不得用于违法犯罪、诈骗、深度伪造造谣、侵害他人肖像权 / 著作权等违规场景,违规使用责任由使用者自行承担。 2. 面向国内公众提供生成式 AI 服务的,需符合《生成式人工智能服务管理暂行办法》要求,完成服务备案,落实 AI 内容标识、内容安全审核义务。 3. 开源协议均为 "授权免责" 模式:DeepSeek 授予商用权利,但不对模型生成内容的准确性、合法性承担连带责任,商业风险由使用方自行把控。 |