科技与AI今日必读

DeepSeek 将 V4 Pro 与 V4 Flash 的 API 价格上调约四倍,8月16日起按峰谷分时计费

深度求索公布API调价方案,V4两款模型涨约四倍,8月16日生效

深度求索(DeepSeek)公布了 V4 系列 API 的调价方案,新价格自2026年8月16日起执行,覆盖 V4 Pro 与 V4 Flash 两款模型。按公开报道的美元计价,V4 Pro 的输出token从每百万0.87美元改为高峰时段3.96美元、空闲时段1.98美元;V4 Flash 从每百万0.28美元改为高峰时段1.32美元、空闲时段0.66美元,均低于 V4 Pro 的3.96美元高峰价。两款模型的高峰价都约为原先统一价的4.6至4.7倍,空闲价则定在高峰价的一半。公司对外的说法是要“更合理地配置资源”,用分时价格把开发者的调用挪到不那么拥挤的时段。这不是一次孤立的调整。今年5月,深度求索先把促销价说成长期价格,随后又推翻;6月底已经对 V4 加收高峰费,把每日北京时间9:00至12:00、14:00至18:00划为高峰,V4 Pro 的输出价在高峰翻倍到每百万12元人民币。8月上旬公司又预告要“大幅”提价,而一周前才刚发布过一款比 Claude Opus 4.8 便宜99%的代码模型。把这条线索连起来看,靠低价打开局面的阶段正在收尾:定价真正暴露出来的是推理算力的供给,而不是模型能力。即便如此,涨价后的绝对价位仍远低于海外主要竞品,深度求索也仍在融资,并为最早2026年的上市做准备。

这场由 DeepSeek 自己发动的中国大模型价格战,第一次出现方向性反转,刹车还是它自己踩的。更值得注意的是反转的形式:不是简单提价,而是按时段收费。峰谷分时是电力、算力这类供给刚性的行业才会用的定价手段,用上它,等于公开承认高峰时段的推理资源已经不够分配。对下游来说,模型调用成本从今往后是一个随时间波动的变量,不再是能直接摊进单位经济模型的常数。

最直接受影响的是把 V4 Pro 和 V4 Flash 接进产品的开发者与中小AI应用公司:面向终端用户的实时交互多半落在白天高峰窗口,这部分调用的单位成本按公开价格约升至原先的4.6倍;批量处理、离线生成这类可以挪动的负载,则有一半的降幅空间。对中国云与模型厂商来说,跟随降价的压力减轻了,但把低价当唯一卖点的策略也同时失效。对深度求索自己来说,这是在上市准备期把收入模型往可持续方向调,代价是被开发者质疑时机。

后续关注

看8月16日新价生效后,高峰时段的实际调用量会不会明显向空闲时段迁移,以及深度求索会不会像今年5月那样再改口径;同时看字节、腾讯等此前跟随降价的厂商,是同步跟进峰谷计费,还是靠维持低价接走高峰时段流失的开发者。

信息来源

  1. Engadget媒体报道 · en · 2026年8月14日发布
  2. Fortune媒体报道 · en · 2026年8月13日发布
  3. South China Morning Post媒体报道 · en · 2026年6月30日发布
  4. Semafor媒体报道 · en · 2026年8月7日发布

GFT Finance 整理归纳公开信息并总结要点,不构成投资建议。数据以来源原文为准。