DeepSeek(深度求索)
产品概述
DeepSeek 是深度求索公司推出的通用大模型与 AI 助手,是国内首个在全球范围内实现现象级突破的 AI 应用——2025 年初上线仅 18 天日活即达 1500 万,增速是 ChatGPT 的 13 倍,一度登顶 140+ 国家/地区 App Store 免费榜。它的定位与 Kimi(长文本)、豆包(多模态)等有本质区别:以「开源 + 极致性价比 + 顶尖推理能力」为核心壁垒。
DeepSeek 走的是「开源权重 + 低价 API」路线,模型以 MoE 架构实现每 token 仅激活少量参数,训练与推理成本远低于同性能闭源模型,因此能把 API 价格压到行业最低之一,倒逼全行业降价。它的 App/网页端对普通用户完全免费,深度推理(R1 系列)在数学、逻辑、代码、中文任务中表现出色,是开发者和研究者「高性价比推理引擎」的首选。
发展历程
| 时间 | 事件 |
|---|---|
| 2023-11 | DeepSeek 首次发布 LLM |
| 2024 | 发布 V2、Coder V2、VL 等系列 |
| 2025-01 | R1 发布并爆火,18 天日活 1500 万,全球现象级 |
| 2026-05 | V4-Pro 的 2.5 折限时优惠转为永久价格,输入价格降至原定价 1/4 |
| 2026-08-12 | V4 Pro 正式版上线,增强 Agent 能力 |
| 2026-08-13 | 宣布 API 峰谷定价(8-17 生效);同日开源 Agent 框架 Harness v0.1 与 V4-Pro-0813 模型 |
核心功能详解
1. 深度推理对话
R1/V4 系列具备长链推理能力,在数学、逻辑、代码等任务中性能对标 OpenAI o1,是「思考型」AI 的代表。
2. 代码生成与辅助
DeepSeek Coder V2 专精代码,App 内也支持代码生成、调试与解释,是开发者高性价比的编码辅助。
3. 文件解析与联网检索
支持上传文档解析、联网搜索(依赖外部搜索服务),覆盖信息检索与文档处理场景。
4. 开源权重生态
V3、R1、Coder 等模型权重开源,可本地部署、微调,是开源社区最活跃的国产模型之一。
5. Agent 能力(V4 系列)
V4 Pro/V4 Preview 重点增强智能体(Agent)能力,支持工具调用与多步任务执行。
6. DeepSeek Harness 代码智能体框架(2026-08-13 发布)
Harness(DSH)是 DeepSeek 首个开源的 Agent 运行框架,官方定位「Model + Harness = Agent」——大模型负责思考推理,Harness 承担模型外的所有工程化工作(工具调用、任务规划、执行调度)。它直接对标 OpenAI Codex 与 Anthropic Claude Code,标志着 DeepSeek 从「模型/API 提供商」正式延伸到「Agent 执行层」赛道。
- 「一切皆插件」架构:基于 Cordis 插件元框架,模型、工具、技能、会话、沙箱、存储、调度、UI 全部以插件形式存在,可自由替换、灵活重组,无需改源码。
- 四种运行模式:标准(全套工具)、PTC(程序化工具调用,模型生成代码编排多轮工具链)、极简(仅 Shell + 文件编辑,用于基线测试)、创造(自定义新模式)。
- 三种运行方式:Web UI、TUI(终端)、Headless,
npx @deepseek-ai/dsh web一键启动(端口 3080)。 - 能力覆盖:项目管理、长任务协作、多 Agent 编排、上下文管理、联网搜索、Skill 调用,可在代码库中完成查找文件、改代码、跑测试、依据报错继续修正的闭环。
- MIT 开源:GitHub 已公开,上线即获 7 万+ star,是目前国内开源 Agent 生态的重要补位。
适用场景
- 深度思考与推理:数学、逻辑、复杂问题求解。
- 代码辅助:生成、调试、解释,性价比高。
- 学术研究与数据分析:开源模型可本地部署,数据可控。
- API 集成:低成本接入推理能力。
不适合:多模态(图像/视频生成)场景;对实时搜索时效性要求高的场景(搜索能力依赖外部);需要稳定企业级 SLA 与专属支持的重度商用(以 API 自助为主)。
定价详情
DeepSeek 采用「C 端免费 + API 按量计费」模型,2026-08-13 官宣 API 引入峰谷定价(2026-08-17 生效)。
- 高峰时段:北京时间 9:00-12:00、14:00-18:00,输出最高约 27 元/百万 tokens。
- 空闲时段:其余时间,价格为高峰时段的一半。
- 历史参考:V3 输入/输出约 $0.27/$1.10 每百万 tokens;R1 缓存命中 $0.14/百万输入、$2.19/百万输出;V4-Pro 输入一度降至原定价 1/4,创全球大模型价格新低。
| 版本 | 价格 | 说明 |
|---|---|---|
| App/网页免费版 | 免费 | 基础对话全功能,无订阅费 |
| API 按量计费 | 峰谷定价 | 高峰全价、空闲半价,按 token 计费 |
成本测算
- 普通用户:App/网页免费即可满足日常。
- 开发者:把非紧急批量任务挪到空闲时段,调用成本直接减半;高峰时段成本未变,适合错峰调度能力强的团队。
- 相比 GPT-4o,V3/R1 价格约为其 1/10。
定价核验日期:2026-08-13。峰谷定价于 2026-08-17 生效,以 deepseek.com 官方 API 定价页为准。
技术架构与模型
- DeepSeek V4 Pro / V4-Pro-0813(2026-08):最新旗舰,MoE 架构,总参 1.6 万亿、推理时仅激活 490 亿,100 万 token 上下文,最大输出 38.4 万 token,支持思考/非思考模式,权重 MIT 开源可本地部署,编程与 Agent 能力相比预览版大幅提升。
- DeepSeek R1:深度推理模型,GRPO 强化学习,性能对标 o1。
- DeepSeek V3:MoE 架构,总参 671B、每 token 激活 37B,FP8 混合精度训练。
- DeepSeek Coder V2:代码专精模型。
- Harness(DSH):基于 Cordis 插件元框架,默认部署 159 个插件,模型、工具、UI、沙箱等均为可替换组件;提供 dsh CLI 与四种运行模式。
MoE 架构 + 无辅助损失负载均衡 + 多 token 并行预测,是其低成本高推理能力的底层技术支撑。
优势领域
- 推理能力顶尖:R1/V4 在逻辑、数学、代码任务对标 o1。
- 开源可本地部署:数据可控,政企可私有化。
- API 性价比高:价格约为 GPT-4o 的 1/10,倒逼行业降价。
- 中文能力突出:中文任务表现优于 GPT-4o 等。
- 开源 Agent 框架 Harness:全栈 MIT 开源 + 插件化架构,降低对 Codex/Claude Code 等海外闭源工具的依赖。
短板与限制
- 多模态能力弱:图像/视频生成非其重点。
- 搜索依赖外部:实时信息检索能力不如豆包、元宝等内置强搜索的产品。
- 峰谷定价高峰贵:高峰时段(恰是多数业务使用时段)输出价格上调。
- 企业服务弱:以 API 自助为主,专属 SLA 与技术支持不如云厂商。
使用建议
- 适合:需要顶尖推理与代码能力的开发者;预算敏感、追求性价比的团队;需开源模型本地部署的政企;想自建 Agent 工作流、不愿依赖海外闭源工具(Codex/Claude Code)的开发者。
- 不适合:多模态内容创作;对实时搜索时效要求高的用户;需要完整企业级 SLA 的客户。
- 最佳实践:把批量/离线任务挪到空闲时段跑以省成本;代码与推理场景优先 DeepSeek;开源部署场景直接下载权重本地运行;关注峰谷时段规划 API 调用;Agent 开发可尝试 Harness(
npx @deepseek-ai/dsh web快速起 Web UI,当前为 v0.1 预览版,接口仍会快速迭代)。