DeepSeek 一夜贵一倍:3000 元 API 账单明天变 6000 元
摘要
DeepSeek 将于北京时间 8 月 17 日 0 点启用峰谷定价,高峰期 API 单价全面翻倍。按最极端口径计算,每月 3000 元的调用成本将升至 6000 元,一年多出 3.6 万元。
北京时间 8 月 17 日 0 点,DeepSeek-V4-Pro 和 DeepSeek-V4-Flash 将正式进入峰谷计价。每天 9:00 - 12:00、14:00 - 18:00,两款模型的 API 高峰价全部翻倍。
这句话换成账单更直接:如果一家小团队现在每月在 DeepSeek API 上花 3000 元,并且调用主要集中在高峰时段,那么同样的 token、同样的请求量、同样的业务,明天开始就可能要付 6000 元。
不是多几十块,也不是贵 20%。是一个月多 3000 元,一年多 3.6 万元。
我把这次价格调整拆开算一遍,也把“6000 元”成立的条件写清楚。期望对大家有所帮助。
最高涨幅就是 100%
DeepSeek 此前的公开价格,可以视为这次峰谷计价里的平时价格。高峰时段则在这个基础上乘以 2。
| 模型 | 计费项 | 原价 / 平时价 | 高峰价 | 涨幅 |
|---|---|---|---|---|
| DeepSeek-V4-Flash | 缓存命中输入 | 0.02 元 / 百万 tokens | 0.04 元 / 百万 tokens | 100% |
| DeepSeek-V4-Flash | 缓存未命中输入 | 1 元 / 百万 tokens | 2 元 / 百万 tokens | 100% |
| DeepSeek-V4-Flash | 输出 | 2 元 / 百万 tokens | 4 元 / 百万 tokens | 100% |
| DeepSeek-V4-Pro | 缓存命中输入 | 0.025 元 / 百万 tokens | 0.05 元 / 百万 tokens | 100% |
| DeepSeek-V4-Pro | 缓存未命中输入 | 3 元 / 百万 tokens | 6 元 / 百万 tokens | 100% |
| DeepSeek-V4-Pro | 输出 | 6 元 / 百万 tokens | 12 元 / 百万 tokens | 100% |
计算公式没有任何花样:
提价幅度 =(高峰价 - 原价)÷ 原价 × 100%
=(2 - 1)÷ 1 × 100%
= 100%
“涨价 100%”和“涨到原来的 200%”是同一件事。最容易写错的是把它说成“涨价 200%”,那意味着价格会变成原来的 3 倍,并不符合这次公布的价格表。
3000 元如何变成 6000 元
按照最大提价比例做压力测试,假设调用量、模型结构、输入输出比例全部不变,只把全部用量从原价切换到高峰价:
新月账单 = 3000 ×(1 + 100%)
= 6000 元
每月新增 = 6000 - 3000
= 3000 元
全年新增 = 3000 × 12
= 36000 元
账单的放大效应很直观:
| 原月账单 | 高峰价下的新月账单 | 每月多付 | 一年多付 |
|---|---|---|---|
| 500 元 | 1000 元 | 500 元 | 6000 元 |
| 1000 元 | 2000 元 | 1000 元 | 1.2 万元 |
| 3000 元 | 6000 元 | 3000 元 | 3.6 万元 |
| 1 万元 | 2 万元 | 1 万元 | 12 万元 |
| 10 万元 | 20 万元 | 10 万元 | 120 万元 |
对个人开发者来说,这可能是少买一台电脑。对月调用费 10 万元的团队来说,则是每年多出 120 万元 - 足够新增几名工程师,或者直接决定一个低毛利 AI 产品还能不能继续免费。
7 个小时为什么很关键
DeepSeek 划出的高峰时段合计 7 小时:上午 9:00 - 12:00 是 3 小时,下午 14:00 - 18:00 是 4 小时。
如果调用在全天 24 小时里完全均匀分布,只有 7 / 24 的用量按双倍价格结算。此时月账单不会从 3000 元直接涨到 6000 元,而是变成:
3000 ×(17 / 24 × 1 + 7 / 24 × 2)= 3875 元
也就是每月增加 875 元,整体上涨约 29.2%。一年仍然要多付 1.05 万元。
但“全天均匀”对很多面向国内企业的 AI 应用并不现实。客服、办公 Agent、代码助手和内部知识库的请求,恰好会在工作时间集中出现。高峰窗口覆盖上午和下午最主要的 7 个办公小时,真正决定账单的不是一天有多少小时,而是你的 token 有多少比例落在这 7 个小时里。
| 高峰时段用量占比 | 3000 元月账单调整后 | 实际涨幅 |
|---|---|---|
| 0% | 3000 元 | 0% |
| 25% | 3750 元 | 25% |
| 50% | 4500 元 | 50% |
| 75% | 5250 元 | 75% |
| 100% | 6000 元 | 100% |
所以“3000 元变 6000 元”不是所有用户都会收到的账单预测,而是高峰用量占比达到 100% 时的上限压力测试。对于业务请求高度集中在中国工作时间的团队,这个上限并没有听起来那么遥远。
最贵的不是 token,是来不及改架构
过去 DeepSeek 的低价,让不少产品在设计阶段不太需要关心请求发生在几点。峰谷价出现后,时间本身也进入了成本公式。
能异步处理的任务,可以挪到 12:00 - 14:00、18:00 之后或次日凌晨;不能延迟的在线请求,则需要重新检查缓存命中率、上下文长度和输出 token 上限。尤其是代码仓库分析、长文档问答和多轮 Agent,同一段上下文反复输入,缓存策略会直接影响最终账单。
上线前至少应该拉一次按小时统计:
- 每小时的输入、输出和缓存命中 tokens
- 两个高峰窗口占全天用量的比例
V4-Pro与V4-Flash各自承担的请求类型- 可延迟任务能够迁移到平时段的比例
只看月度总 token 已经不够了。先把最近 30 天用量按小时重算一遍,再分别套入 25%、50%、75% 和 100% 的高峰占比,预算会比一句“价格翻倍”准确得多。
DeepSeek 依然可能比许多同级模型便宜,但这次变化释放的信号很明确:低价不再等于价格结构简单。8 月 17 日 0 点之后,同一个模型、同样一百万 tokens,只因为调用发生在不同时间,价格就能相差一倍。
而那张每月 3000 元的账单,最坏情况下也真的会变成 6000 元。
相关文章
2026年3月26日
DeepSeek vs ChatGPT vs Claude:2026 年怎么选
三大 AI 模型各有什么强项?中文能力谁最好?写代码谁最强?这篇给你一个实用的选择框架。
2025年3月24日
DeepSeek v3 0324更新:685B参数模型的惊艳表现
DeepSeek 悄然发布 v3 0324 更新,模型参数规模达 685B,在编程和前端设计方面表现亮眼。本文通过 80 年代风格计时器组件、开源项目网页等实测例子,展示它在代码生成与前端设计上的能力。
2025年1月26日
DeepSeek-R1: 通过纯强化学习打造的推理型大模型
探索DeepSeek团队在大语言模型推理能力提升方面的创新方案,包括纯强化学习的R1-Zero和结合冷启动的R1模型。
最近一封 · Sample
OpenRig 冲上 Trending:把 Claude Code 和 Codex 编成一支队伍
“OpenRig 在 GitHub Trending Today 获得 622 个 stars 的窗口信号。它用可恢复的队列、席位与权限记录,把 Claude Code 和 Codex 放进同一套多 Agent 工程流程。”
—— william
来信
里面装的是
- 新文章 — 写完一篇就寄一封,不攒货
- 这周读到的、看到的、好用的工具
- 正在折腾的实验,附带翻车记录
约莫 1–2 周一封 · 随时退订
合作伙伴
CompeteMap — 英国及爱尔兰学生竞赛一站式搜索
数学、编程、科学、写作等各类竞赛信息汇总,支持按年龄和科目筛选,再也不错过报名截止日。