DeepSeek V4 涨价了:峰谷定价上线后,营销人的 AI 账单怎么算
目录
看到 DeepSeek V4 的缓存命中输入从 0.025 元涨到峰值 0.30 元/百万 tokens——12 倍涨幅的时候,我之前那些静悄悄路由到 DeepSeek 廉价层的 long-context 日常摘要 pipeline,瞬间从默认选项变成了三档路由决策。
缓存命中这一行,是大多数高并发后台任务的真正燃料。先看这个数字。
数字本身:到底改了什么
DeepSeek V4 系列(Pro 和 Flash)从 2026 年 8 月 17 日北京时间 00:00 开始执行峰谷定价:
- 高峰时段: 工作日北京时间 9:00–12:00、14:00–18:00
- 空闲时段: 其他时间(夜间、周末、节假日)
- 空闲时段价格 = 高峰时段价格的 1/2
下面这三行,是营销 pipeline 真正关心的(每百万 tokens,元):
V4 Pro
| 项目 | 调价前 | 空闲时段 | 高峰时段 |
|---|---|---|---|
| 输入(缓存命中) | 0.025 | 0.15 | 0.30(+1100%) |
| 输入(缓存未命中) | 3 | 4.5 | 9(+200%) |
| 输出 | 6 | 13.5 | 27(+350%) |
V4 Flash
| 项目 | 调价前 | 空闲时段 | 高峰时段 |
|---|---|---|---|
| 输入(缓存命中) | 0.02 | 0.05 | 0.10(+400%) |
| 输入(缓存未命中) | 1 | 1.5 | 3(+200%) |
| 输出 | 2 | 4.5 | 9(+350%) |
两件事值得注意。第一,所有人都在转的"Pro 输出高峰 27 元"这个数字是真的,但它依然远低于美国前沿模型的定价。DeepSeek 不是突然变贵了,它是不再便宜到可以无脑当默认值了。
第二,大部分报道漏掉了空闲时段那一列。空闲时段 Pro 输出 13.5 元——相比原价只涨了 125%。 这数字放在一年前,比绝大多数营销人在 Claude Sonnet 上花的钱还低。新模型惩罚的是高峰时段的批量调用,其他时段基本没动。
实际账单:哪些真疼,哪些无所谓
我把自己三个标准 pipeline 都跑了一遍新价格表。
每日 SEO 简报生成器。 长上下文(约 200K tokens),大约 30K 输入 + 3K 输出,北京时间早上 8 点跑一次推到 Slack。旧成本:约 0.20 元/天。新高峰成本(8 点接近高峰):约 0.35 元/天。新空闲成本(如果推到早上 6 点):约 0.18 元/天。高峰时段多花 4–5 元/月。可以接受。
Reddit 监控 agent 跑在 DeepSeek Flash 后端,早上 7:30。每天 100K token 输入大部分是缓存命中(系统提示词 + 板块上下文)。旧成本:约 0.10 元/天。新高峰成本(缓存命中输入涨 400%):约 0.50 元/天。新空闲:约 0.25 元/天。这条有点疼——每天涨 5 倍,天天跑。
每周竞品广告库抓取。 北京时间周日凌晨 2 点跑——纯空闲时段。成本只受空闲列影响:13.5 元/M 输出,而不是 6 元。多 1 元/月。可以忽略。
规律很清楚:凡是跑在 9–12 或 14–18 北京时段、缓存命中多、用 Flash 的任务,新价格开始疼。其他时段,基本无感。
5 个继续用 DeepSeek 的任务(走空闲)、3 个换掉的任务
这不是一篇"抛弃 DeepSeek"的文章。新空闲定价对一大类营销负载依然有竞争力。我的拆分是这样的:
继续留在 DeepSeek V4 Pro/Flash,但挪到空闲时段:
- 隔夜竞品监控
- 每周内容刷新批次(周日凌晨 2 点)
- 季度内容审计(10K URL 抓取 + Claude 分析——完美的空闲任务)
- Reddit + 论坛摘要(从 7:30 推到 6 点,没人察觉)
- 外链回收扫描(后台任务,没时间压力)
高峰时段换到 OpenRouter 或其他供应商:
- 面向客户的交互式工具(聊天插件、即时摘要)——必然撞上高峰
- 必须 9 点前到 Slack 的每日早报
- 在线广告创意的实时内容 QA
我之前写过的 OpenRouter 路由方案正好处理这件事——一个每日 Slack /research 工作流,当 DeepSeek 高峰时段价格或延迟不合适时,自动 fallback 到 Qwen 3 Max,再 fallback 到 Claude Sonnet。现在还在跑单供应商栈的营销人,没有这条退路。这周搭一条。
这件事背后更大的趋势
DeepSeek 这波涨价不是孤例。整个 2026 年,中国大模型厂商都在悄悄退出"最便宜"这场竞赛。 智谱、月之暗面、云厂商都上调过价格。与此同时,太平洋对面的 GPT-5.6 Luna Q2 降价 80%。两条曲线在过去半年里交叉了。
对营销人来说,这件事意味着过去靠直觉跑的路由逻辑,现在变成了硬要求:别再把 DeepSeek 当作永远的低成本默认值。 把它当成四到五个供应商里的一个槽位。批量任务走它的空闲时段。交互式工作用 Qwen 3 Max 或 Claude Sonnet。低敏感、低风险的任务用本地模型(Llama 3.3、Qwen 2.5 14B)。我在 Grok 4.5 第一周复盘 和 xAI Grok 对比其他模型 里列的供应商组合,正好能嵌进这张图。
8 月 17 日之前该做的三件事
按工作量从小到大排:
- 按小时审计你的 DeepSeek 调用。 后台有 OpenAI 风格的使用日志,画个时段分布图。9–12 和 14–18 北京时段的任务马上变贵,时段外的没事。
- 把不卡时间的任务挪到空闲时段。 大部分"早 8 点的每日摘要"改成"早 6 点的每日摘要",没人察觉。1 小时的位移,常常就是 4.5 倍成本和 1.25 倍成本的区别。
- 搭一条 fallback 路径。 哪怕只是配一个 OpenRouter key 加一个 fallback 模型,差别就是"DeepSeek 涨价,超预算了"和"DeepSeek 涨价,我们绕过去了"。
把整套 pipeline 都建在 DeepSeek 8 月之前定价上的营销人,这次会疼。已经备好 OpenRouter 或 Qwen 3 fallback 的人,不会。整件事的教训就这一句。