AI Agent 百科
9推荐指数
9.5性价比
满分 10 分

DeepSeek(深度求索)

产品概述

DeepSeek 是深度求索公司推出的通用大模型与 AI 助手,是国内首个在全球范围内实现现象级突破的 AI 应用——2025 年初上线仅 18 天日活即达 1500 万,增速是 ChatGPT 的 13 倍,一度登顶 140+ 国家/地区 App Store 免费榜。它的定位与 Kimi(长文本)、豆包(多模态)等有本质区别:以「开源 + 极致性价比 + 顶尖推理能力」为核心壁垒

DeepSeek 走的是「开源权重 + 低价 API」路线,模型以 MoE 架构实现每 token 仅激活少量参数,训练与推理成本远低于同性能闭源模型,因此能把 API 价格压到行业最低之一,倒逼全行业降价。它的 App/网页端对普通用户完全免费,深度推理(R1 系列)在数学、逻辑、代码、中文任务中表现出色,是开发者和研究者「高性价比推理引擎」的首选。

发展历程

时间 事件
2023-11 DeepSeek 首次发布 LLM
2024 发布 V2、Coder V2、VL 等系列
2025-01 R1 发布并爆火,18 天日活 1500 万,全球现象级
2026-05 V4-Pro 的 2.5 折限时优惠转为永久价格,输入价格降至原定价 1/4
2026-08-12 V4 Pro 正式版上线,增强 Agent 能力
2026-08-13 宣布 API 峰谷定价(8-17 生效);同日开源 Agent 框架 Harness v0.1 与 V4-Pro-0813 模型

核心功能详解

1. 深度推理对话

R1/V4 系列具备长链推理能力,在数学、逻辑、代码等任务中性能对标 OpenAI o1,是「思考型」AI 的代表。

2. 代码生成与辅助

DeepSeek Coder V2 专精代码,App 内也支持代码生成、调试与解释,是开发者高性价比的编码辅助。

3. 文件解析与联网检索

支持上传文档解析、联网搜索(依赖外部搜索服务),覆盖信息检索与文档处理场景。

4. 开源权重生态

V3、R1、Coder 等模型权重开源,可本地部署、微调,是开源社区最活跃的国产模型之一。

5. Agent 能力(V4 系列)

V4 Pro/V4 Preview 重点增强智能体(Agent)能力,支持工具调用与多步任务执行。

6. DeepSeek Harness 代码智能体框架(2026-08-13 发布)

Harness(DSH)是 DeepSeek 首个开源的 Agent 运行框架,官方定位「Model + Harness = Agent」——大模型负责思考推理,Harness 承担模型外的所有工程化工作(工具调用、任务规划、执行调度)。它直接对标 OpenAI Codex 与 Anthropic Claude Code,标志着 DeepSeek 从「模型/API 提供商」正式延伸到「Agent 执行层」赛道。

  • 「一切皆插件」架构:基于 Cordis 插件元框架,模型、工具、技能、会话、沙箱、存储、调度、UI 全部以插件形式存在,可自由替换、灵活重组,无需改源码。
  • 四种运行模式:标准(全套工具)、PTC(程序化工具调用,模型生成代码编排多轮工具链)、极简(仅 Shell + 文件编辑,用于基线测试)、创造(自定义新模式)。
  • 三种运行方式:Web UI、TUI(终端)、Headless,npx @deepseek-ai/dsh web 一键启动(端口 3080)。
  • 能力覆盖:项目管理、长任务协作、多 Agent 编排、上下文管理、联网搜索、Skill 调用,可在代码库中完成查找文件、改代码、跑测试、依据报错继续修正的闭环。
  • MIT 开源:GitHub 已公开,上线即获 7 万+ star,是目前国内开源 Agent 生态的重要补位。

适用场景

  • 深度思考与推理:数学、逻辑、复杂问题求解。
  • 代码辅助:生成、调试、解释,性价比高。
  • 学术研究与数据分析:开源模型可本地部署,数据可控。
  • API 集成:低成本接入推理能力。

不适合:多模态(图像/视频生成)场景;对实时搜索时效性要求高的场景(搜索能力依赖外部);需要稳定企业级 SLA 与专属支持的重度商用(以 API 自助为主)。

定价详情

DeepSeek 采用「C 端免费 + API 按量计费」模型,2026-08-13 官宣 API 引入峰谷定价(2026-08-17 生效)。

  • 高峰时段:北京时间 9:00-12:00、14:00-18:00,输出最高约 27 元/百万 tokens。
  • 空闲时段:其余时间,价格为高峰时段的一半。
  • 历史参考:V3 输入/输出约 $0.27/$1.10 每百万 tokens;R1 缓存命中 $0.14/百万输入、$2.19/百万输出;V4-Pro 输入一度降至原定价 1/4,创全球大模型价格新低。
版本 价格 说明
App/网页免费版 免费 基础对话全功能,无订阅费
API 按量计费 峰谷定价 高峰全价、空闲半价,按 token 计费

成本测算

  • 普通用户:App/网页免费即可满足日常。
  • 开发者:把非紧急批量任务挪到空闲时段,调用成本直接减半;高峰时段成本未变,适合错峰调度能力强的团队。
  • 相比 GPT-4o,V3/R1 价格约为其 1/10。

定价核验日期:2026-08-13。峰谷定价于 2026-08-17 生效,以 deepseek.com 官方 API 定价页为准。

技术架构与模型

  • DeepSeek V4 Pro / V4-Pro-0813(2026-08):最新旗舰,MoE 架构,总参 1.6 万亿、推理时仅激活 490 亿,100 万 token 上下文,最大输出 38.4 万 token,支持思考/非思考模式,权重 MIT 开源可本地部署,编程与 Agent 能力相比预览版大幅提升。
  • DeepSeek R1:深度推理模型,GRPO 强化学习,性能对标 o1。
  • DeepSeek V3:MoE 架构,总参 671B、每 token 激活 37B,FP8 混合精度训练。
  • DeepSeek Coder V2:代码专精模型。
  • Harness(DSH):基于 Cordis 插件元框架,默认部署 159 个插件,模型、工具、UI、沙箱等均为可替换组件;提供 dsh CLI 与四种运行模式。

MoE 架构 + 无辅助损失负载均衡 + 多 token 并行预测,是其低成本高推理能力的底层技术支撑。

优势领域

  • 推理能力顶尖:R1/V4 在逻辑、数学、代码任务对标 o1。
  • 开源可本地部署:数据可控,政企可私有化。
  • API 性价比高:价格约为 GPT-4o 的 1/10,倒逼行业降价。
  • 中文能力突出:中文任务表现优于 GPT-4o 等。
  • 开源 Agent 框架 Harness:全栈 MIT 开源 + 插件化架构,降低对 Codex/Claude Code 等海外闭源工具的依赖。

短板与限制

  1. 多模态能力弱:图像/视频生成非其重点。
  2. 搜索依赖外部:实时信息检索能力不如豆包、元宝等内置强搜索的产品。
  3. 峰谷定价高峰贵:高峰时段(恰是多数业务使用时段)输出价格上调。
  4. 企业服务弱:以 API 自助为主,专属 SLA 与技术支持不如云厂商。

使用建议

  • 适合:需要顶尖推理与代码能力的开发者;预算敏感、追求性价比的团队;需开源模型本地部署的政企;想自建 Agent 工作流、不愿依赖海外闭源工具(Codex/Claude Code)的开发者。
  • 不适合:多模态内容创作;对实时搜索时效要求高的用户;需要完整企业级 SLA 的客户。
  • 最佳实践:把批量/离线任务挪到空闲时段跑以省成本;代码与推理场景优先 DeepSeek;开源部署场景直接下载权重本地运行;关注峰谷时段规划 API 调用;Agent 开发可尝试 Harness(npx @deepseek-ai/dsh web 快速起 Web UI,当前为 v0.1 预览版,接口仍会快速迭代)。

相关词条

不确定选哪个?

把 DeepSeek 和其他 Agent 放在一起并排对比,18 个维度一目了然。

开始并排对比