文章 / #083

大模型集体降价的时候,DeepSeek 反手宣布涨价

官方只说了一句话

2026 年 8 月 6 日,DeepSeek 在官方 API 价格页的脚注里写下一句话:「计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。」没有幅度,没有日期,没有原因。

先把利益相关说清楚。我这条内容流水线的中文表达层,全押在 DeepSeek 上。长文润色、标题、封面文案,加上跨家审阅里的一家,跑的都是 DeepSeek 的子代理。这账我自己也得算。

官方没说的,谁也别替它说

把那段话拆开看,它只说了三件事。「近期」「整体上调」「涨幅较大」。官方一个字都没提涨多少、哪天生效、为什么涨。同一页还写着:「产品价格可能发生变动,DeepSeek 保留修改价格的权利。」

外面流传的「要涨 300%」「因为算力紧张」「因为需求太猛」,全都不是官方口径。它们是知乎答主的推测、是媒体的解读。读任何分析之前,先分清哪句话是谁说的。

第三次涨价

把涨价从情绪事件里拎出来看历史,官方价格页的存档摆在那里,这次是第三次。

2024 年 5 月,V2 上线,输入 1 元、输出 2 元(每百万 token。token 可以理解成 AI 计费的字数单位)。1 元/百万 token 这条线,从那时候画下。

2024 年 12 月预告、2025 年 2 月 8 日生效,V3 恢复标准价,较 V2 全面上调,媒体口径称「最高涨幅 400%」。

2025 年 8 月下旬官宣,9 月 6 日零时生效。官方调价并取消夜间优惠,聊天模型缓存未命中输入从 2 元涨到 4 元,输出从 8 元涨到 12 元。

2025 年 9 月 29 日又降了 50% 以上;2026 年 4 月 V4 上线;4 月 26 日,缓存命中价降到首发价的十分之一。

然后到今天,V4-Flash 的缓存未命中输入价是 1 元,和 2024 年 V2 的输入单价对得上。不过当年 V2 还没有缓存命中、未命中之分,严格说是两个口径的 1 元。两年多绕了一圈,价格线回到了起点。

这段历史想说明两件事。涨价是这个行业的周期动作,不是突发事件。同时,现在的价格确实压在历史低位,「涨幅较大」四个字,是把这两年多的低价一起找补。

关于「涨 300%」的传言,知乎答主卜寒兮(赞同 1533)推测,这次大幅涨价可能是把 5 月 31 日生效的 1/4 促销价恢复原价,涨幅约 300%。这是他的个人推测,他依据的那份 5 月公告我没核到原文,官方也从没确认过「原价」怎么定义。

为什么涨:被自己的用量撑爆了

那这次为什么涨?官方没给原因。外界解读集中在一条链上。

7 月 31 日,V4-Flash 正式版公测。(OpenCode 按它官方 X 帖的说法是个 AI 编程平台,不少开发者拿 DeepSeek 当后端跑代码。)据 OpenCode 官方 X 帖转述(原始帖子我没核到,属转述口径),8 月 1 日起调用量暴增,单日达到 8 万亿 tokens。同一条转述链上,知乎答主 edward(赞同 455)梳理,8 月 4 日 DeepSeek API 多次性能下降,OpenCode 官方 X 称 DeepSeek 因为「前所未有的访问量」出现容量问题(原始 X 帖我同样没核到)。8 月 6 日,涨价脚注上线。

知乎高赞答主 Nomore(赞同 5172)把话说到了根上:「大模型领域,高智、低价和服务的稳定性目前来讲还是个不可能三角。」三个好处只能占两个,剩下的那个一直在硬撑。

我的判断是,这次涨价的价格杠杆做的是限流。用价格把需求挡在外面,给挤爆的服务器喘口气。这是推断,不是官方口径。说它割韭菜,方向可能是反的。如果 8 月初那些容量信号是真的,DeepSeek 更像是被自己的用量撑爆的。便宜到大家用起来不心疼,需求就刹不住车。如果这个判断成立,涨价的功能就是限流。但官方一天不开口,这都还是推测。

不过这套说法有个地方对不上。官方说的是「整体上调」,涨的是全部模型。如果目的纯粹是给服务器卸压,先动的应该是超载的 V4-Flash。它是这次公测的主角,并发上限 2500,Pro 只有 500。全模型一起涨,更像定价策略,不像容量管理。

另一种说得通的解释是,为 V4 Pro 正式版的定价先立预期。三条都摆在官方文档里。官方 7 月 31 日的说明里明写「DeepSeek-V4-Pro 正式版将会尽快发布」;Pro 现在收的 0.025 / 3 / 6 元,还是 4 月首发时按 2.5 折执行的价;而它的标准价是 0.1 / 12 / 24 元,自上线以来就没按这个价收过。Pro 的「原价」早就挂在那儿了,只是一直没执行。在 Pro 正式版定价之前,先把「整体要涨」的预期立起来,后面按标准价收,就好开口得多。这条照旧算我的推断,官方从没说过要拿它给 Pro 铺路。

两种解释不互相排斥,也都不是官方口径。官方给的只有那一句话。我倾向前一种(限流),可它解释不了「整体」两个字。正式方案出来之前,谁也别把话说死。

同一个月,海外三家在降,只有它在涨

再抬头看外面。7 月 30 日,OpenAI(做 ChatGPT 那家)把 GPT-5.6 Luna 的输入价格从 1 美元降到 0.2 美元、输出从 6 美元降到 1.2 美元,官方博客写明降了 80%。Anthropic(做 Claude 那家)给 Sonnet 5 挂出 2 美元/10 美元的优惠价,8 月 31 日前有效。Google 的 Gemini 3.6 Flash 输出价降了约 17%(这条是第三方汇总,我没直接核到官方价目页)。

两边卖的不是同一件商品。海外在降的是「用得起」;如果前面的推断成立,DeepSeek 要涨的是「排得上」。海外降价抢新用户,DeepSeek 涨价拦超载的用户。这两件事也从来不互斥。

我的账本:便宜是有代价的

说点我自己的,全是我的用量,不是行业数据,统计截止 2026 年 8 月 1 日。

DeepSeek 系的 5 个子代理,529 次后台任务,累计跑了 20.5 小时,失败率 4.9%。同期全池 5000 多次任务的平均失败率是 14.9%,它只有全池的三分之一。

最勤的一环是长文润色。185 次调用,零失败。这是我最不能出岔子的一环,它直接改我的成稿。

我专门给 DeepSeek 做了一个四档热切换开关。OpenCode 网关和官方直连、Flash 和 Pro 各一档,改一个词就换通道。为一个模型做这种开关,因为它是我这条流水线的承重结构。

2026 年 8 月 3 日,OpenCode 网关的 DeepSeek 上游额度耗尽,报了 402,断了约 20 分钟才恢复。同一网关上的其它模型全部正常,是 DeepSeek 这一条线的问题。

这几条放在一起,就是一句话:便宜在实践里经常等于共享池、没有服务承诺、随时可能断。如果真如我猜的那样,官方这次涨价不过是把这份隐性成本摆到了明面上。

正式通知下来之前,能做的三件事

把缓存命中当第一优先级。 现在 Flash 的缓存命中输入 0.02 元、未命中 1 元,50 倍价差;Pro 是 0.025 对 3 元,120 倍。缓存命中就是 AI 重复用已经算过的部分,按最低价收费。官方口径是自动开启,不用改代码;但只有前缀从第 0 个 token 完全相同才算命中,不保证 100% 命中;接口返回里有 prompt_cache_hit_tokens 字段,可以自己核对。这不是省一点,是差一个半到两个数量级。涨价后它只会更值钱。这个号之前写过一篇缓存账,结论是,决定账单量级的是命中率,不是单价;那个结论今天依然成立。

峰谷计价和整体上调是两件事。 有报道说 DeepSeek 要搞「峰谷计价」,高峰时段价格翻倍。但截至今天,官方价格页仍是统一费率,官方文档站查不到任何 2026 年的峰谷计价公告,那部分只有媒体转述。两件事别混着算账。

等正式通知,别按传言排期。 官方明说「具体方案以正式通知为准」。涨幅、生效日,现在都没有。架构也不用急着改。先把「它一直这么便宜」从你的假设清单里摘出来,正式方案出来再重算。

DeepSeek 的便宜是这个阶段的策略,有期限。这次涨多少,等正式通知就知道了。更值得你现在花十分钟盘一遍。你手上有多少个流程、多少条自动化、多少笔预算,是踩在「它一直这么便宜」这个假设上的。


本文事实来源

DAVID YIN · 2026 · 08 · 07 · 杭州
← Older · #084
AI 新股宇树科技定价 610 亿:骂它贵的人,多数没搞懂这个数怎么来的