8 月 16 日 16:00 UTC(北京时间 17 日 00:00),DeepSeek 停掉了 V4 系列原有的统一单价,正式切换为峰谷计费。按官方价目表,V4-Pro 的「缓存命中」输入 token 在峰值时段从每百万 0.003625 美元涨到 0.044 美元,涨幅约 1114%,是本次调价最极端的一档;整体涨幅区间为约 51% 至 1114%,与 Reuters 报道的「50% 至 1100%」基本吻合。此时距 DeepSeek 在 5 月把 V4-Pro 的 75% 折扣「永久化」过去不到三个月。
新价目:峰谷各一张表
调价前,V4-Flash 的统一价是 $0.0028(缓存命中)/ $0.14(缓存未命中)/ $0.28(输出),V4-Pro 是 $0.003625 / $0.435 / $0.87。调整后的价格如下,谷时价统一为峰值价的一半:
| 模型 | 时段 | 缓存命中输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|---|
| V4-Flash | 峰 | $0.014 | $0.44 | $1.32 |
| V4-Flash | 谷 | $0.007 | $0.22 | $0.66 |
| V4-Pro | 峰 | $0.044 | $1.32 | $3.96 |
| V4-Pro | 谷 | $0.022 | $0.66 | $1.98 |
(单位:每百万 token。峰值时段为 01:00–04:00 与 06:00–10:00 UTC。)
这两个峰值窗口换算到北京时间是 09:00–12:00 与 14:00–18:00,正好覆盖中国工作日的上午与下午两个工作段。The Decoder 指出,对欧洲用户而言,下午几乎全部落在谷时段;InfoWorld 引述 Greyhound Research 首席分析师 Sanchit Vir Gogia 的话说,「24 小时里有 17 小时是半价」,因此新价目「最重地打击 DeepSeek 的本土市场,最轻地打击其出口市场」。
缓存命中为什么涨得最狠
缓存命中(cache hit)指请求中与上次相同的前缀部分被复用,模型不必重新计算这部分 token 的 KV 缓存,因此厂商普遍对这类输入打折。InfoWorld 引述 Gogia 的估算称,DeepSeek 此前给出的缓存命中折扣约为 98%,高于行业常见的约 90%——这套机制正是它真正的成本护城河:即便 OpenAI 把 GPT-5.6 Luna 的 API 价下调 80%,DeepSeek 每任务的实测成本仍比 Luna 低约 60%。
但这次涨幅恰恰集中在这一行。V4-Pro 的缓存命中输入从 $0.003625 涨到 $0.044(峰值),相当于把缓存折扣从「常规输入价的约 1/120」压缩到「约 1/30」(The Decoder)。对反复读取同一批文件、系统提示词、工具 schema 或代码仓库的编码 Agent 而言,缓存命中输入往往是账单里最大的单项,而它正是这次最贵的部分。用 Gogia 的话说,「缓存是优势真正被侵蚀的地方」。
从「永久折扣」到实质反转
DeepSeek 的低价是一条刻意经营的曲线。V4 系列在 4 月发布时主打「1M 上下文的极致性价比」;5 月 24 日,DeepSeek 把原定 5 月 31 日到期的 V4-Pro 75% 折扣「永久化」,The Next Web 当时称之为「AI 价格战升级」。6 月底公司预告将引入峰谷定价,但未给出具体数字与生效日期(The Decoder)。8 月 16 日生效的新价目「部分推翻了 5 月的降价,且缓存命中价反而比降价前更高」(The Decoder)。
峰谷定价本身对 DeepSeek 并非全新事物:2025 年 2 月它曾对 V3 和 R1 提供夜间折扣。区别在于,这次是整体提价与时段定价叠加,方向从「降价抢份额」转为「给算力排负载」。
公司给出的公开理由只有一句:峰谷定价是为了「更合理地分配资源」,鼓励用户「按实际使用情况安排任务」(InfoWorld 转述)。The Decoder 把提价与「公司正在募集新资金、筹备 IPO」并列,但这一关联是媒体的推断,DeepSeek 未就动机作更多说明。
谁受影响最深:Agent 与高频推理
最受伤的是两类负载:高频复用上下文的 Agent(缓存命中涨价最狠),以及输出占比高的长回答类应用——V4-Pro 峰值输出涨 355%,V4-Flash 涨 371%。
对照竞品,涨价并没有抹平全部优势,但改变了对比。Info-Tech Research Group 分析师 Mark Tauschek 指出,峰值时段 V4-Flash 相对 OpenAI GPT-5.6 Luna 的价格优势消失、谷时段仍在;V4-Pro 即便峰值仍相对中档推理模型 GPT-5.6 Terra 保持优势(InfoWorld 引述)。Gogia 的判断更具体:谷时段 V4-Flash 的输入比 Luna「略贵」、输出便宜约 45%;峰值时段 V4-Pro 在典型编码 Agent 负载上约是 Luna 价格的 5 倍。
Gogia 还点出一层更根本的变化:一家学会了给时钟定价的供应商,已经意识到自己手中的某种议价权。当 24 小时里的价格由时段决定、且客户可以把批量任务排进谷时段时,定价就成了一种负载调度工具,而不只是收入工具。这比某一次涨价本身更能说明 DeepSeek 这家「极致低价」公司正在切换的姿势。
边界与下一项变量
需要明确的边界有三处。其一,涨价动机未被证实:公司只字未提成本、利润率或算力紧张,公开口径仅「更合理地分配资源」,融资与 IPO 背景来自媒体转述。其二,涨幅数字高度依赖口径:同一张新价目表,用「整体区间」说是约 51% 至 1114%,只看输出 token 则约 4.5 倍;不同媒体报出不同数字,往往是因为各自聚焦了不同的 token 类型。其三,「仍然最便宜」是相对的——在真实的高缓存命中率下,DeepSeek 的单任务成本仍可能低于多数替代品,但这一优势对 Agent 负载正在收窄。
下一项可观察变量是第三方分发渠道。Tauschek 认为各托管商尚未跟进涨价,「但最终不得不跟」。若二次分发商跟进,中小开发者的实际成本曲线会进一步上移;若不跟进,DeepSeek 官价与渠道价之间的价差会倒逼流量重新分配。另一个变量是 DeepSeek 是否会把「峰谷」进一步向「分时负载调度」演进——这取决于首批账单落地后,客户是选择迁移还是选择把任务挪进谷时段。