简介与核心特点
DeepSeek(深度求索)是国内领先的通用大模型产品,凭借「高性价比 + 开源 + 强推理/强代码」三大标签迅速走红。它的主要优势包括:
- 极致性价比:API 价格在同级别模型中长期处于最低梯队,
deepseek-v4-flash的输入缓存未命中价低至 $0.14 / 百万 tokens,输出 $0.28 / 百万 tokens。 - 开源友好:DeepSeek 系列多个模型权重开源,社区可自行部署、微调与二次开发。
- 擅长推理与代码:其「深度思考」模式(源自 R1 推理路线)在数学、逻辑、编程等需要多步推理的任务上表现突出。
- 超长上下文:当前 V4 系列模型支持 1M tokens 上下文,最大输出可达 384K tokens,可一次性处理超长文档与代码库。
- OpenAI / Anthropic 兼容:API 格式与 OpenAI 一致,几乎零成本迁移。
一、网页 / App 端使用(面向普通用户)
1. 注册与登录
- 电脑浏览器打开官网 https://deepseek.com ,点击「开始对话」。
- 手机端在应用商店搜索「DeepSeek」下载官方 App(iOS / Android 均有)。
- 支持三种注册方式:手机号、微信、Apple ID。首次登录后即可免费使用。
2. 开始对话
登录后进入对话界面,在底部输入框输入问题、回车即可。当前对话产品线基于 DeepSeek-V3.1,具备联网搜索、文档阅读、写作、翻译、解题等能力。
3. 「深度思考」开关(重点)
输入框上方有 「深度思考」 按钮:
- 按钮点亮(蓝色):启用推理模型,模型会先「想一会儿」,展示完整思考过程后再给出答案,适合数学、代码、复杂逻辑分析。
- 按钮灰色(关闭):使用快速对话模式,秒回,适合日常问答、闲聊、简单改写。
建议:普通问题关闭深度思考更快;遇到难题、需要严谨推理时再打开。
4. 「联网搜索」开关
输入框上方还有 「联网搜索」 按钮。开启后,模型会实时抓取互联网上的最新信息再作答,适合查时事、最新政策、股价、新品发布等时效性强的问题。
组合技巧:深度思考与联网搜索可以同时开启。当问题既需要最新资料、又需要严谨分析(如「结合最新财报分析某公司」)时,两个都打开效果最佳。
5. 上传文件与图片
点击输入框旁的 「+ / 回形针」 图标,可上传:
- 文档:PDF、Word、TXT、Excel 等,用于总结、提取、问答。
- 图片:截图、题目、图表等,用于识图、解题、OCR。
上传后直接在下方输入你的需求(如「总结这份 PDF 的核心要点」)即可。
二、开发者部分:调用 DeepSeek API
1. 申请 API Key
- 访问开放平台 https://platform.deepseek.com 并登录。
- 左侧进入 「API Keys」(https://platform.deepseek.com/api_keys ),点击「创建 API key」。
- 复制并妥善保存(仅显示一次)。到「充值 / 账单」页面充值即可开始调用。
2. 当前模型
| 模型 ID | 说明 |
|---|---|
deepseek-v4-flash |
高性价比主力,速度快,支持思考/非思考模式 |
deepseek-v4-pro |
能力更强,适合高难度任务 |
deepseek-chat / deepseek-reasoner |
旧别名,仍可用,将于 2026/07/24 弃用,请尽快迁移 |
两款 V4 模型均支持 JSON 输出、工具调用(Function Calling)、思考模式与 1M 上下文。
3. 价格与缓存优惠(每百万 tokens)
| 模型 | 输入·缓存命中 | 输入·缓存未命中 | 输出 |
|---|---|---|---|
deepseek-v4-flash |
$0.0028 | $0.14 | $0.28 |
deepseek-v4-pro |
$0.003625 | $0.435 | $0.87 |
- 上下文缓存默认开启:当你的请求前缀与近期请求相同时,命中部分会自动走「缓存命中」低价(比未命中便宜约 98%),非常适合多轮对话、固定 system prompt、长文档重复提问的场景,无需任何配置。
- DeepSeek 历史上曾在 UTC 16:30–00:30(北京时间约 00:30–08:30)提供错峰折扣,具体是否适用于 V4 请以官方定价页为准。
4. 最小可运行调用示例
方式 A:curl
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{"role": "system", "content": "You are a helpful assistant"},
{"role": "user", "content": "用一句话解释什么是缓存命中"}
],
"stream": false
}'
方式 B:Python(OpenAI SDK 兼容)
import os
from openai import OpenAI
# 先安装:pip install openai
client = OpenAI(
api_key=os.environ.get("DEEPSEEK_API_KEY"),
base_url="https://api.deepseek.com", # 关键:指向 DeepSeek
)
resp = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{"role": "system", "content": "你是一个专业的中文助手"},
{"role": "user", "content": "写一个 Python 快速排序,并解释思路"},
],
stream=False,
)
print(resp.choices[0].message.content)
只需把 base_url 改成 https://api.deepseek.com、换上 DeepSeek 的 Key,任何原本用 OpenAI SDK 的代码都能直接跑。
5. 开启「思考模式」拿到推理链
推理模式下,回复会额外返回 reasoning_content(思考过程),与最终答案 content 分开:
resp = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "9.11 和 9.9 哪个大?请推理"}],
reasoning_effort="high", # 触发深度思考
)
msg = resp.choices[0].message
print("思考过程:", msg.reasoning_content)
print("最终答案:", msg.content)
注意:思考模式不支持
temperature、top_p等采样参数与 Function Calling;多轮对话时,请不要把上一轮的reasoning_content再传回去,否则会报 400。
三、进阶技巧
- 善用缓存省钱:把固定不变的内容(system prompt、长文档、few-shot 示例)放在 messages 最前面且保持不变,后续请求即可命中缓存,成本骤降。
- 选对模型:日常问答、批量任务用
deepseek-v4-flash;高难度推理、复杂代码用deepseek-v4-pro或开启思考模式。 - 强制 JSON 输出:设置
response_format={"type": "json_object"},让模型稳定返回可解析的结构化数据,适合做数据提取。 - 流式输出提升体验:设
stream=True,边生成边显示,长答案的等待感明显降低。 - 控制输出长度:用
max_tokens限制输出(思考模式默认 32K,可上调至 64K),既防跑偏又控成本。 - 一次性喂长文:利用 1M 上下文,把整篇论文/整个代码模块直接贴进去做全局分析,避免手动分块丢失上下文。
四、常见问题 FAQ
Q1:网页版是免费的吗? A:网页与 App 端的基础对话免费;API 按用量付费,需在开放平台充值。
Q2:deepseek-chat / deepseek-reasoner 还能用吗?
A:仍可用,但将于 2026/07/24 弃用,它们分别对应 deepseek-v4-flash 的非思考/思考模式,建议尽快改用新模型名。
Q3:为什么我的思考模式请求报 400 错误?
A:常见原因是把上一轮返回的 reasoning_content 又传进了 messages,或传了思考模式不支持的参数(如 temperature)。去掉即可。
Q4:如何降低 API 费用? A:三招——优先用 flash 模型、把不变内容前置以命中缓存、必要时利用官方错峰时段(以官方定价页为准)。
提示:模型与价格可能随时更新,正式开发前请以官方文档 https://api-docs.deepseek.com 为准。



