深评 | DeepSeek 预告"大幅涨价":价格屠夫时代落幕,但护城河还有 30 倍宽

AI 情报站 · 深度评论 | airedirector.com/news

8 月 6 日,DeepSeek 在开放平台向开发者弹窗:"计划近期整体上调 API 定价,预计涨幅较大"。没有价目表,没有生效日期,甚至没有涨幅数字——但官方罕见地加了一句提醒:"按需充值,不要大额预存余额"。这不是一次普通的调价。从 5 月"永久降价 75%"到 8 月"大幅涨价",中间只隔了 75 天。中国大模型行业最惨烈的价格战,正在迎来它的拐点。

价格一纸模糊的公告,为什么比涨价本身更值得读

8 月 6 日,DeepSeek 通过开放平台弹窗向 API 开发者预告:计划近期整体上调定价,预计涨幅较大,请合理安排使用,具体方案以正式通知为准。目前未公布上涨比例、新价格表与生效时间。与此同时,7 月上线的峰谷计费继续有效:工作日 9:00-12:00、14:00-18:00 高峰时段价格为平峰的 2 倍。官方同时提醒用户按需充值,不要大额预存余额

注意公告的措辞艺术:不公布涨幅,先做预期管理。如果直接甩出一张翻倍价目表,开发者会连夜迁移;而"预计涨幅较大、以正式通知为准"的模糊表达,给了市场消化的缓冲期,也给了自己根据竞品反应微调的空间。这是价格战老兵才有的手法。

而"不要大额预存余额"这句话,是整份公告里信息量最大的一句——它等于官方承认:新价格与旧余额之间可能存在不利结算,也等于明说"这次不是小幅微调"。把用户资金风险主动讲出来,反而是一种少见的坦诚。

名词速懂 · 缓存命中价:多轮对话中重复的上下文(如系统提示词)可复用缓存,DeepSeek 的缓存命中输入价 0.02 元/百万 token,是未命中价 1 元的 1/50——会用缓存和不会用,成本差 50 倍。
观察点:正式价目表的落地时间与涨幅结构——重点看是"基准价整体上浮"还是"分模型差异化涨价",后者说明涨价前做过精细的成本核算。

复盘75 天里的 180° 掉头:一条完整的价格轨迹

把时间线拉长,这次涨价并不突然。结合我们的每日价格监测快照与公开报道,DeepSeek 的定价轨迹如下:
2024-04API 降至输入 1 元 / 输出 2 元,创行业低位,"价格屠夫"成名
2026-04-25V4-Pro 限时 2.5 折促销(监测快照:原价 12/24 元)
2026-05-23宣布"永久降价 75%",限时优惠转为长期定价(快照:输出价 24 → 6 元)
2026-06 底预告 V4 正式版,宣布引入峰谷定价机制
2026-07峰谷计费生效:工作日高峰时段价格翻倍
2026-08-06弹窗预告"整体大幅上调",并提醒勿大额预存

动词的变化说明一切:从"降价"到"优惠",从"峰谷"到"上调"。峰谷定价是用价格调节流量,整体涨价是用价格回收成本——前者是调度手段,后者是商业决策。高盛此前就指出,峰谷定价不代表需求疲软,反而说明国内 AI 需求旺盛、算力资源趋紧。如今预告落地,等于为这个判断盖了章。

更值得注意的是节奏:5 月 23 日说"永久降价",8 月 6 日预告"大幅涨价",间隔 75 天。"永久"二字在 AI 行业的保质期,比一次模型迭代还短。这提醒所有把成本模型建立在"当前价格不变"假设上的团队——这个假设从今天起正式失效。

深读单日 8 万亿 Token:成本反噬的数学题

媒体测算显示,DeepSeek V4-Flash 单日处理量已达 8 万亿 Token。DeepSeek 官方在说明中明确表示:涨价并非单一厂商行为,而是 AI 算力从"低价红利"走向"合理定价"的行业性调整。同一时期,智谱 CEO 张鹏披露 2026 年一季度智谱 API 调用定价提升 83%;而今年 5 月,小米 MiMo-V2.5 系列曾宣布最高降幅 99%。

DeepSeek 的低价从来不是烧钱补贴,而是靠 MoE 架构与工程优化把单 token 成本压到了别人到不了的位置——它能扛住对手的降价,但扛不住自己的增长。调用量爆发式增长之后,硬件折旧与电力成本最终会反噬定价:卖得越多,亏得越快的悖论,只有涨价能解。

把三件事放在一起看才有全景:DeepSeek 涨价、智谱 +83%、小米 -99%。价格战没有结束,只是从"全场一价"进入了"分层定价"阶段——有成本优势的守底线收利润,没有成本的用补贴换份额。行业第一次出现了真实的定价分化,这比统一涨价更能说明市场成熟了。

名词速懂 · 峰谷定价:和居民用电的"峰谷电价"一个逻辑——高峰时段算力紧张就贵一倍,凌晨周末便宜。本质是把有限的 GPU 用价格拍卖给出价最高的调用。

格局关键问题:大幅涨价之后,它还是最便宜的吗?

我们对比了数据库内 27 个主流模型的输出价(美元按 6.8 折算人民币,单位:元/百万 token):DeepSeek-V4-Flash ¥2,与 Qwen3.5-Plus 并列全市场最低;V4-Pro ¥6 排第 8;而 GPT-5.5 为 ¥204(34 倍),Claude Fable 5 为 ¥340(170 倍)。按单任务成本测算,V4-Flash 约 $0.03,GPT-5.6 约 $1.86,Claude Fable 5 约 $3.15。

做一道简单的推演:即便 V4-Flash 翻倍到 ¥4,仍低于 MiniMax M3(¥16.8)、豆包 2.0 Pro(¥16)等一众国产竞品,稳居市场前三;即便涨三倍到 ¥6,也还是大多数国内旗舰的一半以下。DeepSeek 的护城河从来不是"绝对低价",而是成本曲线的位置——涨价只是把价格从"贴地"抬回"贴成本",与海外 30-170 倍的差距纹丝不动。

真正被这次涨价改变的不是格局,而是开发者的心理账户:过去两年大家默认"价格只会更低",于是架构里不做缓存、不做错峰、不做多模型备份。从今天起,"价格可变"必须成为架构设计的一等公民——这比任何具体涨幅都影响深远。

平价替代矩阵(输出价/百万 token):Qwen3.5-Plus ¥2(并列最低)|MiniMax M2.5 ¥2.72|腾讯混元 Hy3 ¥4|Llama 4 系开源 ¥4.08。涨价落地后,这几家大概率承接溢出流量。

判断免费午餐结束后,留下什么

判断一:涨价是需求的勋章。只有真实需求撑爆算力,厂商才敢涨价。高盛说得对——峰谷与涨价恰恰证明国内 AI 调用量在规模化爆发。对行业,这是比任何融资新闻都硬的利好。

判断二:下一轮竞赛的裁判换了。补贴时代比谁融资多,成本时代比谁算得精。MoE 架构、缓存体系、峰谷调度这些工程能力,第一次直接变成了定价权。没有成本优势的厂商,只能继续用亏损换份额。

判断三:开发者依然是最大赢家。$0.03 对 $3 的百倍差距,就算缩水一半还是五十倍——足够撑起几乎所有 AI 应用的商业模型。涨价敲碎的是"永远免费"的幻想,敲不碎这笔账。

今日总结

维度信号
事件8/6 官方预告整体大幅涨价,无具体方案,提醒勿大额预存
轨迹75 天内从"永久降价 75%"掉头至"大幅上调"
动因V4-Flash 单日 8 万亿 Token,折旧与电力成本反噬
行业智谱 Q1 +83%、小米 -99%,定价进入分层时代
格局即使翻倍仍居市场前三,与海外差距 30-170 倍不变
今日行动清单
开发者:把高峰调用(工作日 9-12/14-18 点)尽量错峰,立省 50%;把系统提示词等重复上下文做成缓存命中,输入成本差 50 倍
架构师:为所有 AI 调用加价格监控与多模型回退,把 Qwen3.5-Plus / MiniMax M2.5 列入备选池
财务采购:按需充值、勿大额预存;年度预算按"再涨 1-2 倍"重估,而不是按当前价
行业观察:盯正式价目表落地时间,以及其余国产厂商是否跟涨——跟涨则确认行业性拐点
价格屠夫的时代结束了,成本为王的时代刚开始——谁算得过账,谁才有定价权。