返回博客2026年8月16日2 分钟阅读

DeepSeek 一夜贵一倍:3000 元 API 账单明天变 6000 元

摘要

DeepSeek 将于北京时间 8 月 17 日 0 点启用峰谷定价,高峰期 API 单价全面翻倍。按最极端口径计算,每月 3000 元的调用成本将升至 6000 元,一年多出 3.6 万元。

北京时间 8 月 17 日 0 点,DeepSeek-V4-Pro 和 DeepSeek-V4-Flash 将正式进入峰谷计价。每天 9:00 - 12:00、14:00 - 18:00,两款模型的 API 高峰价全部翻倍。

这句话换成账单更直接:如果一家小团队现在每月在 DeepSeek API 上花 3000 元,并且调用主要集中在高峰时段,那么同样的 token、同样的请求量、同样的业务,明天开始就可能要付 6000 元。

不是多几十块,也不是贵 20%。是一个月多 3000 元,一年多 3.6 万元。

我把这次价格调整拆开算一遍,也把“6000 元”成立的条件写清楚。期望对大家有所帮助。

最高涨幅就是 100%

DeepSeek 此前的公开价格,可以视为这次峰谷计价里的平时价格。高峰时段则在这个基础上乘以 2。

模型计费项原价 / 平时价高峰价涨幅
DeepSeek-V4-Flash缓存命中输入0.02 元 / 百万 tokens0.04 元 / 百万 tokens100%
DeepSeek-V4-Flash缓存未命中输入1 元 / 百万 tokens2 元 / 百万 tokens100%
DeepSeek-V4-Flash输出2 元 / 百万 tokens4 元 / 百万 tokens100%
DeepSeek-V4-Pro缓存命中输入0.025 元 / 百万 tokens0.05 元 / 百万 tokens100%
DeepSeek-V4-Pro缓存未命中输入3 元 / 百万 tokens6 元 / 百万 tokens100%
DeepSeek-V4-Pro输出6 元 / 百万 tokens12 元 / 百万 tokens100%

计算公式没有任何花样:

提价幅度 =(高峰价 - 原价)÷ 原价 × 100%
         =(2 - 1)÷ 1 × 100%
         = 100%

“涨价 100%”和“涨到原来的 200%”是同一件事。最容易写错的是把它说成“涨价 200%”,那意味着价格会变成原来的 3 倍,并不符合这次公布的价格表。

3000 元如何变成 6000 元

按照最大提价比例做压力测试,假设调用量、模型结构、输入输出比例全部不变,只把全部用量从原价切换到高峰价:

新月账单 = 3000 ×(1 + 100%)
         = 6000 元

每月新增 = 6000 - 3000
         = 3000 元

全年新增 = 3000 × 12
         = 36000 元

账单的放大效应很直观:

原月账单高峰价下的新月账单每月多付一年多付
500 元1000 元500 元6000 元
1000 元2000 元1000 元1.2 万元
3000 元6000 元3000 元3.6 万元
1 万元2 万元1 万元12 万元
10 万元20 万元10 万元120 万元

对个人开发者来说,这可能是少买一台电脑。对月调用费 10 万元的团队来说,则是每年多出 120 万元 - 足够新增几名工程师,或者直接决定一个低毛利 AI 产品还能不能继续免费。

7 个小时为什么很关键

DeepSeek 划出的高峰时段合计 7 小时:上午 9:00 - 12:00 是 3 小时,下午 14:00 - 18:00 是 4 小时。

如果调用在全天 24 小时里完全均匀分布,只有 7 / 24 的用量按双倍价格结算。此时月账单不会从 3000 元直接涨到 6000 元,而是变成:

3000 ×(17 / 24 × 1 + 7 / 24 × 2)= 3875 元

也就是每月增加 875 元,整体上涨约 29.2%。一年仍然要多付 1.05 万元。

但“全天均匀”对很多面向国内企业的 AI 应用并不现实。客服、办公 Agent、代码助手和内部知识库的请求,恰好会在工作时间集中出现。高峰窗口覆盖上午和下午最主要的 7 个办公小时,真正决定账单的不是一天有多少小时,而是你的 token 有多少比例落在这 7 个小时里。

高峰时段用量占比3000 元月账单调整后实际涨幅
0%3000 元0%
25%3750 元25%
50%4500 元50%
75%5250 元75%
100%6000 元100%

所以“3000 元变 6000 元”不是所有用户都会收到的账单预测,而是高峰用量占比达到 100% 时的上限压力测试。对于业务请求高度集中在中国工作时间的团队,这个上限并没有听起来那么遥远。

最贵的不是 token,是来不及改架构

过去 DeepSeek 的低价,让不少产品在设计阶段不太需要关心请求发生在几点。峰谷价出现后,时间本身也进入了成本公式。

能异步处理的任务,可以挪到 12:00 - 14:00、18:00 之后或次日凌晨;不能延迟的在线请求,则需要重新检查缓存命中率、上下文长度和输出 token 上限。尤其是代码仓库分析、长文档问答和多轮 Agent,同一段上下文反复输入,缓存策略会直接影响最终账单。

上线前至少应该拉一次按小时统计:

  • 每小时的输入、输出和缓存命中 tokens
  • 两个高峰窗口占全天用量的比例
  • V4-Pro 与 V4-Flash 各自承担的请求类型
  • 可延迟任务能够迁移到平时段的比例

只看月度总 token 已经不够了。先把最近 30 天用量按小时重算一遍,再分别套入 25%、50%、75% 和 100% 的高峰占比,预算会比一句“价格翻倍”准确得多。

DeepSeek 依然可能比许多同级模型便宜,但这次变化释放的信号很明确:低价不再等于价格结构简单。8 月 17 日 0 点之后,同一个模型、同样一百万 tokens,只因为调用发生在不同时间,价格就能相差一倍。

而那张每月 3000 元的账单,最坏情况下也真的会变成 6000 元。


相关文章

最近一封 · Sample

OpenRig 冲上 Trending:把 Claude Code 和 Codex 编成一支队伍

“OpenRig 在 GitHub Trending Today 获得 622 个 stars 的窗口信号。它用可恢复的队列、席位与权限记录,把 Claude Code 和 Codex 放进同一套多 Agent 工程流程。”

—— william

Letters

来信

里面装的是

  • 新文章 — 写完一篇就寄一封,不攒货
  • 这周读到的、看到的、好用的工具
  • 正在折腾的实验,附带翻车记录

约莫 1–2 周一封 · 随时退订

合作伙伴

CompeteMap — 英国及爱尔兰学生竞赛一站式搜索

数学、编程、科学、写作等各类竞赛信息汇总,支持按年龄和科目筛选,再也不错过报名截止日。

准备开始了吗?

先简单说明目标,我会给出最合适的沟通方式。