五周前说「永久降价」,今天说「高峰期翻倍」——DeepSeek 到底在打什么牌?
2026年6月29日。
如果你是一个 DeepSeek API 的用户,你今天打开邮箱的时候,大概愣了一下。
DeepSeek 发来一封邮件。核心内容就一句话:下个月中旬起,工作日白天调用 API,价格翻倍。
早 9 点到中午 12 点,下午 2 点到 6 点——也就是你用 API 最频繁的那段时间——每百万 tokens 的输入价从 3 块变 6 块,输出价从 6 块变 12 块。V4 Flash 也跟着翻:输出 2 块变 4 块。
这距离他们宣布「永久降价」只过了五周。
一张表看懂:这次到底涨了多少?
DeepSeek V4 Pro(高端模型)
| 计费项 | 平时价(元) | 高峰价(元) | 涨幅 |
|---|---|---|---|
| 输入 — 缓存命中 | 0.025 | 0.05 | ×2 |
| 输入 — 缓存未命中 | 3 | 6 | ×2 |
| 输出 | 6 | 12 | ×2 |
| 上下文长度 | 1M | 1M | — |
DeepSeek V4 Flash(主力模型)
| 计费项 | 平时价(元) | 高峰价(元) | 涨幅 |
|---|---|---|---|
| 输入 — 缓存命中 | 0.02 | 0.04 | ×2 |
| 输入 — 缓存未命中 | 1 | 2 | ×2 |
| 输出 | 2 | 4 | ×2 |
| 上下文长度 | 1M | 1M | — |
高峰时段定义:工作日 9:00–12:00 和 14:00–18:00(北京时间)。周末及法定节假日全天执行平时价。
一边是「永久降价」,一边是「高峰翻倍」
倒回去看时间线,你会发现这件事的戏剧性:
| 时间 | 事件 | 价格变动 |
|---|---|---|
| 4月24日 | V4 预览版上线 | 首发定价偏高 |
| 4月26日 | 紧急调价 | 缓存命中价砍至首发 1/10;Pro 叠 2.5 折限时特惠 |
| 5月22日 | 宣布「永久降价」 | 2.5 折限时优惠到期后直接转永久,承诺不再恢复原价 |
| 6月1日 | 永久降价生效 | V4 Pro:输入 0.025 / 3 元,输出 6 元 |
| 6月29日 | 宣布峰谷定价 | 高峰时段全部翻倍,7 月中旬生效 |
| 7月中旬 | V4 正式版上线 + 峰谷定价生效 | 工作日白天 ×2 |
| 7月24日 | 旧模型名称弃用 | deepseek-chat / deepseek-reasoner 停用 |
「永久降价」是真的,降价幅度也确实够狠。只是这个「永久」里藏了一个后门:价是降了,但高峰期你可以收两遍。
客观地说,这件事没那么简单
先别急着骂。把这件事掰开看,有几个事实值得放进天平两端:
翻倍之后,还是便宜到离谱
拿全球主流模型的输出价格横向对比(单位:元/百万 tokens):
| 模型 | 输出价(元) | DeepSeek V4 Pro 高峰价 vs 对方 | DeepSeek V4 Flash 高峰价 vs 对方 |
|---|---|---|---|
| DeepSeek V4 Flash(平时) | 2 | — | — |
| DeepSeek V4 Flash(高峰) | 4 | — | — |
| DeepSeek V4 Pro(平时) | 6 | — | — |
| DeepSeek V4 Pro(高峰) | 12 | 基准 | — |
| OpenAI GPT-5.5 | ≈216 | 便宜 18 倍 | 便宜 54 倍 |
| OpenAI GPT-5.5 Pro | ≈1296 | 便宜 108 倍 | 便宜 324 倍 |
| Anthropic Claude Opus 4.7 | ≈180 | 便宜 15 倍 | 便宜 45 倍 |
| Google Gemini 2.5 Pro | ≈67 | 便宜 5.6 倍 | 便宜 17 倍 |
再补一张输入价格的对比(元/百万 tokens,均取缓存未命中场景):
| 模型 | 输入价(元) | DeepSeek V4 Pro 高峰价 vs 对方 |
|---|---|---|
| DeepSeek V4 Pro(高峰) | 6 | 基准 |
| DeepSeek V4 Flash(高峰) | 2 | — |
| OpenAI GPT-5.5 | ≈54 | 便宜 9 倍 |
| Anthropic Claude Opus 4.7 | ≈108 | 便宜 18 倍 |
| Google Gemini 2.5 Pro | ≈21 | 便宜 3.5 倍 |
你在喊贵的时候,隔壁 OpenAI 用户可能正在哭。
峰谷定价不是「涨价」,是「弹性定价」
峰谷定价的电费、机票、酒店人们都认了,为什么 AI API 用就不行?
DeepSeek 的算力资源在白天被挤爆——你的请求排队、响应变慢、超时率上升——这对需要稳定服务的用户来说,比加价更致命。峰谷定价的本质是用价格信号把一部分对延迟不敏感的请求推到闲时,让必须在高峰期调用的人能拿到更稳定的服务。
从这个角度看,这不是一个「涨价」动作,而是一个资源分配机制。
但问题出在「信用损耗」上
你可以涨价,但别刚说完「永久降价」就涨价。
「永久」两个字是 DeepSeek 自己说的。5 月 22 日的公告里,措辞就是「永久降价」,不是「基础价调低」、不是「建议零售价」、不是「促销延续」。用户默认为「以后就是这个价了」。
结果只用了一个月,解释权就被重新定义了:「我没涨基础价啊,我只是在高峰期加了一层价格嘛。」
从法律上说,没错——基础定价没动。但从用户感知上说,上班时间调 API,价格翻了一倍,这就是涨价。文字游戏救不了体感。
这种「先给确定性,再悄悄推翻」的做法,比直接涨价的伤害更大。直接涨,用户骂完就算了;先承诺再推翻,用户会开始怀疑你的每一句话。
全行业都在涨,但 DeepSeek 的姿势最别扭
国内 AI API 市场这一年的涨价全景:
| 厂商 | 动作 | 幅度 |
|---|---|---|
| 智谱 | 2026 年三轮上调,GLM-5.1 再涨 | 累计 +10%~15% |
| 腾讯混元 | 部分模型调价 | 最高 +463% |
| 阿里云百炼 | 5 月 15 日起上调 | 未公开具体幅度 |
| 字节豆包 | 推出订阅制(标准版 68 元/月,专业版 500 元/月) | 从免费/低价转入付费 |
| DeepSeek | 先永久降价 75%,再引入峰谷 ×2 | 整体仍为全行业最低 |
整个行业都在往「高价、高利润」的方向走,DeepSeek 独走降价路线——然后发现降价降太狠,白天算力撑不住了,又用峰谷翻倍往回找补。
DeepSeek 的牌:为什么非要这么做?
换个角度想,DeepSeek 为什么要打这么一张让自己尴尬的牌?
1. V4 Flash 太猛了,自家人抢自家人
V4 Flash 发布后直接登顶 OpenRouter 全球调用量第一——这是 DeepSeek 系列史上首次。Flash 的价格太低了,大量用户涌入,算力吃紧。峰谷定价本质上是在给 白天的 Flash 调用者一个刹车信号:不是不让用,是你稍微多付一点,或者晚上再用。
2. 700 亿融资要交代
DeepSeek 正在推进 700 亿元的融资,创中国科技初创企业纪录。投资方不会看你「一直亏钱一直爽」——利润率要交代。此前 545% 的推理成本利润率是 V4 Pro 的数据,Flash 的价格更便宜,利润空间更薄。用峰谷定价把利润率拉回来,也是融资过程中必须算的账。
3. 概率不大但值得提的可能:V4 正式版确实更强
7 月中旬上线的是 V4 正式版,不是预览版。如果正式版能力有显著提升,那么「价格翻倍」这件事至少在价值感知上部分成立——你的确用更少的 token 就能完成任务。
真正的结论:DeepSeek 没变,只是长大了
回到文章标题的问题:DeepSeek 到底在打什么牌?
它在打一张所有从「挑战者」变成「头部玩家」的公司都不得不打的牌:增长和可持续之间的平衡。
当你是行业搅局者的时候,「全网最低价」就是你的武器。你可以把利润率做到 545%,然后说「我们不在乎赚钱」,树立一个技术普惠的旗帜。
但当你的模型登顶全球调用榜、当 700 亿融资的压力压上来、当白天的算力已经被挤爆——你就不能再只是「全网最低价」了。你需要赚钱,你需要控制高峰期流量,你需要给投资方一个可持续的商业模型。
DeepSeek 没有变坏。它只是从一个「反正我不靠 API 赚钱」的实验室,变成了一个「我确实得靠 API 赚钱」的公司。
给 API 用户的三个务实建议
- 别慌。 即使翻倍,DeepSeek 仍然是全球性价比之王,算力成本比 OpenAI/Anthropic 便宜 15-50 倍。如果你的预算跑不起 DeepSeek,那你跑得起别家吗?
- 调整调用策略。 把不那么紧急的批处理任务推到晚上跑。峰谷差价的本质就是让你分流——你照着做了,反而更省钱。
- 对 DeepSeek 的公告打七折看。 「永久」不一定永久,「降价」可能有后手。这五周的经历说明了一件事:看 DeepSeek 的价格承诺,要看趋势(长期低价),别看字面(永远不变)。趋势没变,但别信每一句话。
2026年6月29日,DeepSeek 宣布 V4 正式版将于7月中旬上线,同步引入峰谷定价机制,工作日白天 API 调用价格翻倍。此时距其宣布「永久降价」仅 37 天。
来源: