图片来源:视觉中国
界面新闻记者 | 宋佳楠
8月6日,DeepSeek发布官方声明,宣布计划近期对API服务价格进行整体上调,预计涨幅显著,建议用户提前做好使用规划。最终方案将以正式通知为准。
图片来源:DeepSeek
界面新闻查阅DeepSeek开放平台发现,目前对外执行的V4‑Flash与V4‑Pro两款主力模型,其价格仍维持在多轮下调后的基准水平。
依据官方定价表,deepseek‑v4‑flash模型在缓存命中时,输入费用仅为0.02元/百万tokens;若缓存未命中,输入费为1元/百万tokens,输出费则为2元/百万tokens。定位更高阶的deepseek‑v4‑pro模型,缓存命中输入价为0.025元/百万tokens,未命中输入为3元/百万tokens,输出价高达6元/百万tokens。
DeepSeek API现行定价机制
此外,DeepSeek API引入了峰谷分时计费模式。工作日高峰时段费用翻倍,夜间、周末及节假日则保持平峰低价,旨在缓解算力资源压力。这两套模型均支持百万级超长上下文,并兼容OpenAI与Anthropic两种调用格式。
步入2026年,DeepSeek已多次调整API价格策略。
4月25日,平台曾下调缓存命中输入价格,针对deepseek‑v4‑pro模型推出限时2.5折优惠,活动持续至2026年5月5日。优惠期间,百万tokens输入(缓存命中)降至0.25元,输入(缓存未命中)为3元,输出为6元。
彼时有分析指出,deepseek‑v4是二季度备受瞩目的国产模型事件,其国产化适配意味着国内“模型-芯片-云”闭环正逐步跑通,有助于构建自身AI商业闭环。模型越强、迭代越快,越能向AI芯片、设备及云基础设施环节传导价值,国产算力核心标的也将直接受益。
5月23日,DeepSeek再次宣布,模型API将于2026年5月31日结束2.5折优惠,随后正式调整为原价的四分之一。调价后,输入缓存命中0.025元/百万tokens、未命中缓存3元/百万tokens、输出6元/百万tokens,较原价实现75%降幅。紧随DeepSeek公告之后,小米MiMo-V2.5系列API也宣布永久降价,最高降幅达99%。外界普遍将这一系列动作视为国内大模型价格战进入白热化的标志。
转折点出现在6月底。DeepSeek向用户发送的升级提醒邮件显示,DeepSeek V4正式版计划于7月中旬上线,预计此次更新将带来功能优化与性能提升。
DeepSeek方面解释称,为更合理配置资源并提升服务稳定性,正式版发布后将同步调整API定价策略,引入峰谷定价机制,高峰时段调用价格直接翻倍。
具体而言,deepseek‑v4‑pro模型百万tokens输入(缓存命中)平日价格为0.025元,高峰时段升至0.05元;输入(缓存未命中)平时3元,高峰6元;输出平时6元,高峰12元。DeepSeek将每日北京时间9:00-12:00及14:00-18:00定义为高峰时段。
deepseek‑v4‑flash价格相对较低,百万tokens输入(缓存命中)平时0.02元,高峰0.04元;输入(缓存未命中)平时1元,高峰2元;输出平时2元,高峰4元。
有分析人士认为,DeepSeek V4正式版实施的峰谷定价并非单纯涨价,而是算力资源稀缺背景下的标准化调度工具。
今年以来,DeepSeek API调价时间线
而DeepSeek即将到来的大幅涨价,实则是应对高昂算力成本的策略。大模型推理极度消耗高端GPU,长期以低价换取规模,会持续侵蚀企业现金流。
多模型聚合平台OpenRouter发布的全球AI大模型调用量周榜单(7月27日至8月2日)显示,DeepSeek V4 Flash以7.22万亿Token的调用量位居榜首。另据开源项目团队OpenCode数据,其平台上DeepSeek V4 Flash调用量激增,仅8月1日一天,模型单日处理量就达8万亿Token。8月4日,deepseek‑v4‑flash还因前所未有的访问量遭遇容量不足问题。
不仅DeepSeek,近半年来多家大模型服务商均进行了不同形式的价格调整。在今年4月的智谱2025年业绩说明会上,智谱CEO张鹏透露,2026年一季度智谱API调用定价提升了83%。即便如此,市场仍供不应求,调用量增长400%。
过去两年,为抢占市场份额,各家疯狂压低API单价,甚至推出大规模免费额度吸引开发者迁移。进入2026年下半年,随着算力供需紧张、芯片采购成本及运营成本持续走高,单纯靠低价换规模的模式已难以为继。行业逻辑正从“拼低价抢用户”逐步转向“在成本可承受前提下的商业化”。
对于DeepSeek即将涨价一事,有观点认为,API定价回调反映出厂商开始正视可持续经营问题,但调价势必给中小开发者的AI创新项目带来直接压力。









