首页 / 模型

模型规格

DeepSeek 开放平台当前提供两款主力模型,均支持思考与非思考模式、1M 上下文。

规格对比

项目deepseek-flashdeepseek-v4-pro
模型版本DeepSeek-V4.1-FlashDeepSeek-V4-Pro-0813
上下文长度1M1M
最大输出长度384K384K
思考模式支持非思考与思考模式(默认思考)
JSON 输出支持支持
工具调用支持支持
Responses API支持支持
Anthropic API支持支持
对话前缀续写(Beta)支持支持
FIM 补全(Beta)仅非思考模式仅非思考模式
图像理解支持不支持
并发限制2500500
模型命名提示:请使用模型名 deepseek-flash。旧模型名 deepseek-v4-flash、deepseek-v4-flash-vision-exp 仍可调用, 但对应模型已下线,请求将由 DeepSeek-V4.1-Flash 提供服务,并按 Flash 价格计费。

怎么选

选 deepseek-flash

  • 成本敏感的大批量调用与高并发场景
  • 需要图像理解的多模态输入
  • 实时对话、内容生成、分类抽取等低延迟任务
  • 需要更高并发上限(2500)

选 deepseek-v4-pro

  • 复杂推理与多步规划
  • Agent 长程任务:终端操作、代码工程、工具编排
  • 对答案质量要求高于成本敏感度的场景
  • 可接受较低并发上限(500)

V4-Pro-0813 基准与定位

据官方与媒体报道,V4-Pro-0813 在多项面向 Agent 的基准测试中表现突出,覆盖终端操作、 代码工程、工具调用与安全相关任务,部分项目已接近或超过海外领先模型。

基准DeepSeek-V4-Pro-0813对照
Terminal-Bench(终端环境 Agent 任务)87.9Claude Fable 5 — 88

基准数据来自公开报道,具体数值与测试条件请以 DeepSeek 官方发布为准。

行业背景:随着 AI 应用从简单对话转向长流程、多步骤工作流(依赖工具调用、 代码执行与持续任务完成),单次任务消耗的 token 量大幅上升,推理效率与价格成为关键竞争维度。

接入端点

# OpenAI 兼容格式
https://api.deepseek.com

# Anthropic 兼容格式
https://api.deepseek.com/anthropic
查看接入示例 →