8 月 13 日,DeepSeek 官宣对 API 大幅调价,同步发布 V4 Pro 正式版。新价格 8 月 17 日零时生效,并引入峰谷分时定价。这波动作信息量不小:一边是涨价,一边是能力升级,背后是国产大模型从「价格战」转向「能力战」的清晰信号。
事实梳理:涨了多少
先看数字。旗舰模型 V4 Pro 高峰时段每百万 token 输出价格,从现行的 6 元涨到 27 元,涨幅 350%;缓存未命中输入从 3 元涨到 9 元;缓存命中输入从 0.025 元涨到 0.30 元,涨幅高达 1100%。轻量的 V4 Flash 同样涨,高峰输出从 2 元涨到 9 元,涨幅 350%。
值得注意的机制是峰谷定价:闲时价格只有高峰的一半。也就是说,同一批调用,错峰跑可能省一半钱。这对时延不敏感的批量任务是个明确的引导——把活挪到闲时。
事实梳理:V4 Pro 正式版带了什么
跟调价同步落地的 V4 Pro 正式版(DeepSeek-V4-Pro-0813),上下文扩到 100 万 token,最大输出 384K,支持 Responses API、Tool Calls 和 Anthropic API 兼容,还加了思考/非思考双模式。官方强调的重点是 Agent 能力增强——在 HLE、Terminal Bench、Cybergym、DeepSWE 等 Agent 评测上超过了 Claude Opus 4.8,逼近 Fable 5。
这也是 DeepSeek 战略重心转向的注脚:从「卖 token」转向「卖 Agent 生产力」。上一篇文章我们刚写过 Agent = Model + Harness,DeepSeek Harness 开源之后,V4 Pro 就是那个被 Harness 调度得更顺的「大脑」。
影响分析:为什么会涨价
涨价不是拍脑袋。摩根士丹利 8 月 9 日的研报给了一组数据:2026 年 Q2,中国大模型平均 API 输入价已升至每百万 token 4.9 元、输出价 21.9 元,比 2025 年 Q1 的 3.3 元和 12.2 元分别涨了 48% 和 80%。报告的核心判断是——中国大模型行业正在建立更健康的商业化环境,竞争重点从价格转向模型能力。
直接推手是调用量。据 OpenCode 披露,8 月 1 日 V4-Flash 单日处理 token 总量达 8 万亿。调用量暴增,算力资源趋紧,成本压力自然来了。今年 6 月 DeepSeek 已经引入峰谷计费,这次是「全线产品整体定价」的进一步落地。一句话:价格战打到头了,该算总账了。
影响分析:开发者该怎么应对
对用 DeepSeek API 的人,这次调价最该盯的不是涨幅本身,而是两件事:缓存命中率,和调用时段。
缓存命中率直接决定成本。命中了,输入价格便宜一大截;没命中,按高峰价全付。有开发者反映正式版上线后缓存命中率可能跌破 80%,那意味着成本被放大。这跟 知识库陈旧内容巡检 背后的逻辑相通——成本往往藏在那些「看起来不起眼的细节」里,命中率就是那个细节。调用时段则是新给的杠杆:能错峰的批量任务,尽量排到闲时,把 质量门禁 那套「能省则省、该省才省」的算账思维用上。
老达点评
我对这次涨价的态度是:正常,甚至是好事。一个行业如果一直靠补贴抢市场,最后谁都做不大。DeepSeek 敢涨 350%,底气是 V4 Pro 的 Agent 能力确实顶——能力撑得住价格,才叫定价;撑不住,才叫自杀。
对普通用户,我的建议只有一句:别只盯着「涨了 350%」焦虑,去算你自己的账。你任务的缓存命中率是多少?能不能错峰?把这些算清楚,涨价对你的实际影响可能远没有标题那么吓人。成本治理从来不是靠「换更便宜的模型」这一个动作,而是靠 把每一笔调用都留痕、都能复盘。算不清账的人,涨不涨价都在亏。
总结
DeepSeek 这波「涨价 + V4 Pro 正式版 + 峰谷定价」,本质是国产大模型告别价格战、进入能力战的标志。对开发者,理性定价意味着可持续的服务;对用户,意味着要真正学会算缓存命中率和错峰这两笔账。价格战的红利过去了,接下来拼的是谁更会用。