DEVELOPER MANUAL · ISOMETRIC DIORAMA
DeepSeek 大模型 API 开放平台使用指南
深度求索 API 全面基于工整、可靠的分布式楼层架构构建,原生兼容 OpenAI 接口规范与流式传输(SSE)。本手册将引导您在数分钟内完成从密钥申请、长思维链参数调优到海量并发调度的完整开发闭环。
1. 快速接入与鉴权方式
[AUTH: BEARER_TOKEN]
发起调用时,请在 HTTP 请求头中携带 Authorization: Bearer <YOUR_API_KEY>。所有 API 终结点均托管于高可用全球 Anycast 边缘网络,统一网关地址为 https://api.deepseek.com。
curl_request.sh
HTTP POST /v1/chat/completions
curl https://api.deepseek.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-your-api-key" \
-d '{
"model": "deepseek-reasoner",
"messages": [
{"role": "user", "content": "证明任意凸多面体欧拉示性数 V - E + F = 2"}
],
"stream": false
}'
2. 楼层模型选型与参数说明
[MODEL_SPECS]
针对不同业务场景,开放平台提供了两款主力大模型,均支持 128,000 Tokens 的长上下文输入:
3F 深度推理
deepseek-reasoner
搭载完整强化学习思考链。返回体包含 reasoning_content 字段,全面展开发散、回溯与校验全过程。
适用:复杂数学证明、程序漏洞审计、多面体拓扑建模
2F 通用基座
deepseek-chat
基于 DeepSeek-V3 架构,超低的首字延迟(TTFT)与极高生成吞吐,提供更经济的通用会话体验。
适用:客服对话、文章润色、多语言翻译、JSON 格式化提取
3. Context Caching 服务端缓存与 Token 计费
[CACHE: 90% OFF]
传统调用中,每次请求均需对提示词进行完整的前向计算。DeepSeek 创新研发了底层存储楼层智能前缀哈希算法,系统自动探测并复用公共 KV Cache 节点,开发者无需改造代码即可享受 90% 的资费降低。
未命中常规输入 (Cache Miss)
¥1.00 / 百万 Tokens
当输入提示词为全新动态内容时的标准计算费用。
缓存命中输入 (Cache Hit)
¥0.10 / 百万 Tokens
命中前缀缓存块,费用直降 90%,大幅降低长系统提示词成本。
4. DeepSeek Harness 确定性断网评测沙箱
[HARNESS: DOCKER_ISOLATED]
为了杜绝行业内普遍存在的“刷榜网络泄题”现象,深度求索开源了完整的基准评测框架 DeepSeek Harness。该套件依托轻量级 Docker 容器构建,通过显式切断网络连接实现纯粹确定性单测执行。
run_harness.sh
Docker Network None Isolation
docker run --rm \
--network none \
--memory 8g \
--cpus 4 \
-v $(pwd)/benchmarks:/workspace/benchmarks:ro \
-v $(pwd)/results:/workspace/results \
deepseek/harness:latest \
--model "deepseek-reasoner" \
--dataset "humaneval" \
--timeout 15
5. 开发者高频答疑 (FAQ)
[FAQ_SECTION]
Q: 如何在流式传输中提取 DeepSeek-R1 的思维链?
A: 当使用官方 SDK 或 SSE 流式接收时,检查每次 delta 中的 reasoning_content 字段即可实时打印长思维链,正文则输出在常规 content 字段中。
Q: 企业高并发调用时如何避免 429 速率限制?
A: 推荐在客户端配置 HTTP Keep-Alive 长连接池(如 httpx.AsyncClient),并启用指数退避重试(Exponential Backoff with Jitter),或联系客服开启企业专线预留并发。
Q: 模型是否支持本地完全离线满血运行?
A: 支持。全套模型权重与蒸馏版均已在 Hugging Face 与 ModelScope 完全开源,可以通过 Ollama 运行 ollama run deepseek-r1:7b 等尺寸模型,完全断网离线可用。