首页 / 价格

模型价格

按输入 / 输出 token 计量计费,单位为「元 / 百万 tokens」。空闲时段价格为高峰时段的一半。

输入价格(缓存命中)

模型空闲时段高峰时段
deepseek-flash0.02 元0.04 元
deepseek-v4-pro0.15 元0.30 元

输入价格(缓存未命中)

模型空闲时段高峰时段
deepseek-flash1 元2 元
deepseek-v4-pro4.5 元9.0 元

输出价格

模型空闲时段高峰时段
deepseek-flash4 元8 元
deepseek-v4-pro13.5 元27.0 元
空闲时段怎么算?高峰时段为北京时间周一至周五(不含中国法定节假日) 9:00–12:00 与 14:00–18:00。其余所有时段——包括夜间、 周末及中国法定节假日全天——均为空闲时段,价格减半。

成本对比示意

以一次「输入 1M tokens(未命中缓存)+ 输出 1M tokens」的调用为例:

模型空闲时段合计高峰时段合计
deepseek-flash 1 + 4 = 5 元 2 + 8 = 10 元
deepseek-v4-pro 4.5 + 13.5 = 18 元 9.0 + 27.0 = 36 元
缓存命中可大幅降本。若输入内容命中上下文缓存,输入价格可降至 0.02 元 / 百万 tokens(Flash)或 0.15 元 / 百万 tokens(V4-Pro), 在长系统提示词、多轮对话与重复文档场景下收益显著。

并发限制

模型并发限制
deepseek-flash2500
deepseek-v4-pro500

扣费规则

价格与规则来源: DeepSeek API 官方文档 · 模型 & 价格。 本站为介绍性整理,实际计费请以官方为准。