● DeepSeek-V4-Pro-0813 正式版已发布

DeepSeek 深度求索
以极致性价比提供前沿智能

来自中国的 AI 公司 DeepSeek,专注于基础模型研究与开源。最新一代模型支持 100 万 token 上下文、最大 384K token 输出, 并在思考与非思考双模式下提供业界领先的 Agent 与代码能力。

1M
上下文长度(tokens)
384K
最大输出长度(tokens)
2
主力 API 模型
50%
空闲时段价格折扣

DeepSeek 是什么

DeepSeek(中文名“深度求索”)是一家中国人工智能公司,由梁文锋创立,以发布高性能、 低成本的开放权重模型而受到广泛关注。其模型覆盖通用对话、推理、代码与 Agent 任务, 并同时提供网页版、移动应用与开放 API。

🧠 前沿推理

支持“思考模式”与“非思考模式”。思考模式适合复杂推理与多步任务,非思考模式追求低延迟与低成本。

📚 超长上下文

1M token 上下文窗口,可一次性处理长篇文档、大规模代码库与长程对话历史。

🤖 Agent 就绪

原生支持工具调用(Tool Calls)与 Responses API,面向终端操作、代码工程等长程任务优化。

🔌 双协议兼容

同时提供 OpenAI 格式与 Anthropic 格式的 Base URL,迁移现有应用几乎零改动。

👁 图像理解

Flash 模型支持图像理解(Vision),可在同一接口内混合处理文本与图片输入。

💰 极致成本

空闲时段价格为高峰时段的一半,缓存命中输入价格低至 0.02 元 / 百万 tokens。

模型速览

两款主力 API 模型,按成本与能力梯度选择。

模型版本上下文最大输出图像理解输入(缓存未命中)输出
deepseek-flash DeepSeek-V4.1-Flash 1M384K支持 1 元(空闲)
2 元(高峰)
4 元(空闲)
8 元(高峰)
deepseek-v4-pro DeepSeek-V4-Pro-0813 1M384K不支持 4.5 元(空闲)
9.0 元(高峰)
13.5 元(空闲)
27.0 元(高峰)

价格单位为「元 / 百万 tokens」。完整对比见 模型 与 价格。

关于 V4-Pro-0813

2026 年 8 月,DeepSeek 将 V4-Pro 的预览版替换为正式版 DeepSeek-V4-Pro-0813, 并同步上线网页版、移动应用与 API。该版本显著增强了 Agent 能力,支持 Responses API 与 Codex 集成。

在面向 Agent 的终端操作基准 Terminal-Bench 上,V4-Pro-0813 取得 87.9 分, 与 Claude Fable 5 的 88 分接近。行业分析认为,前沿模型的竞争重点已从“对话质量”转向 “能否更低成本、更高可靠性地完成多步真实任务”。
阅读完整基准与规格 →