从「便宜」到「按时计费」

DeepSeek 的 API 价格一直是行业低价标杆。V4 Pro 刚出来时,输出 0.87 美元/百万 token 让不少人把业务迁过来。8 月 13 日的 0813 版本能力涨了,但 8 月 16 日生效的新价单把成本结构完全改写:高峰时段 V4-Pro 输出 3.96 美元/百万,是原来的 4.55 倍;谷时也要 1.98 美元,涨幅 128%。这不是简单的涨价,而是把 API 定价从「统一定价」切换成「电力市场式的峰谷定价」——高峰用贵资源,低谷用闲资源。

峰值涨幅最猛的三项

  • 输出 token:0.87 美元 → 3.96 美元(峰值,+355%)
  • 缓存命中输入:0.003625 美元 → 0.044 美元(峰值,+1114%)
  • 缓存未命中输入:0.435 美元 → 1.32 美元(峰值,+203%)
V4-Pro 新价单:峰值、谷时与旧价对比
V4-Pro 新价单:峰值、谷时与旧价对比

谷时也不便宜

谷时输出 1.98 美元/百万,仍比旧价高 128%;缓存命中输入谷时 0.022 美元,涨幅 507%。DeepSeek 官方解释是 8 月 1 日出现 8 万亿 token 访问洪峰导致算力紧张。换句话说,即使按谷时跑,成本也比上半年贵,只是贵的程度不同。对习惯了 DeepSeek「白菜价」的团队,需要重新做单位经济学测算。

对工程团队的影响

  • 批量任务优先排到夜间/非高峰窗口,能省接近一半
  • 长上下文 Agent 要特别注意缓存命中成本——以前几乎可以忽略的 KV cache 复用,现在成了账单大头
  • 多模型路由策略从「能力优先」变成「能力 × 价格 × 时间」三维优化
  • 交互式产品很难像批处理那样错峰,成本上涨会直接传导到毛利率
大模型 API 的低价时代没有结束,但「全天候低价」确实结束了。以后上线 Agent,得像看电价一样看 token 价。