标准接口调用指引
3 行代码完成迁移,无需重新适配第三方客户端库。
流式自省推理调用
使用官方推荐的 deepseek-reasoner 模型,支持在流式返回中分离提取 reasoning_content 深度思维链字段。
分布式多活网关集群
全球多节点就近接入,智能会话负载均衡,保障高并发请求下首字返回延迟(TTFT)低至 120ms。
透明且普惠的资费标准
全自动 Context Caching 上下文缓存技术,命中部分直接享受 1 折价格优惠。
| 模型标识 (MODEL) | 输入资费 (未命中缓存) | 输入资费 (缓存命中 1折) | 输出资费 (生成内容) | 上下文窗口 |
|---|---|---|---|---|
| deepseek-chat (V3) | ¥1.0 / 1M tokens | ¥0.1 / 1M tokens | ¥2.0 / 1M tokens | 128K |
| deepseek-reasoner (R1) | ¥4.0 / 1M tokens | ¥1.0 / 1M tokens | ¥16.0 / 1M tokens | 128K |
DeepSeek Harness 自动化评测套件
开源可复现的端到端评测流水线,全面量化数理推理与代码工程能力。
一键复现学术全量测试指标
DeepSeek Harness 涵盖 AIME 2024、MATH-500、SWE-bench Verified 及 Codeforces 竞技编程测试。 支持自定义多分支采样与裁判验证器(Verifier),消除提示词过拟合与数据污染。
开发者高频问题指南
快速排查开发调试、计费抵扣与合规安全中的常见疑问。
1. 如何快速验证 API Key 连通性?
调用 GET /v1/models 端点。若成功返回包含 deepseek-chat 与 deepseek-reasoner 的列表,即代表接口鉴权成功且额度正常。
2. 上下文缓存(Context Caching)如何计费?
系统全自动比对请求的公共前缀,无需开发者在接口中配置特殊 Header。只要前缀命中,计费账单中该部分 Token 将直接按 1 折抵扣。
3. 默认速率与并发配额限制?
开发者账户默认提供 120 RPM 并发。对于需要大规模集群推理的企业客户,可在开发者中心一键提交并发扩容,系统在 15 分钟内动态就绪。
4. 商用接口数据安全承诺
官方严格遵守全球数据隐私安全合规标准,明确承诺不将调用者的商业 Prompt 及生成结果用于任何模型的后续预训练或微调。