文章 / #079

GPT-5.6降价80%:这次省下的钱,是模型自己抠出来的


封面

OpenAI最新一次降价公告里,藏着一句大多数人会直接划过去的话:这次成本下降,有一部分归因于 GPT-5.6 Sol 参与重写和优化生产环境里的推理内核。

这句话如果坐实,等于把过去两年AI降价新闻的默认剧本掀了一半。厂商让利、内卷烧钱——这套叙事大家都熟。但OpenAI这次说得挺直白:成本降下来,不完全是补贴撑的,是模型自己在优化自己跑起来的方式。

三档降价里,扎眼的不是80%这个数字

02 three tiers

7月30日宣布、7月31日起陆续生效,GPT-5.6系列的价格档位动了。Luna(入门款)的输入价格从每百万token(模型处理文本的计量单位)1美元降到0.2美元,跌了80%;输出价格从6美元降到1.2美元,跌幅一样。均衡款Terra温和一些,输入输出各降20%,落到每百万token 2美元和12美元。旗舰款Sol没降价,但加了个Fast Mode——价格是标准模式的2倍、速度最高2.5倍。

据量子位7月31日报道,这轮调价里Luna的降幅最狠。Replit(一个海外常用的AI辅助编程平台)负责AI业务的Michele Catasta给了句挺高的评价:Luna是他们目前用过最接近”便宜到不用计费”的智能。原话是英文,“the closest we’ve come to intelligence too cheap to meter”,出自OpenAI7月30日的官方博客。这话听着像客套,落到Replit这种靠调用量吃饭的产品上,价格砍80%不是营销词,是真金白银的成本变化。

单看这三档,很容易读成一次常规的”低配打骨折、高配加配置”促销组合拳。

价格表之外,OpenAI在博客里说了另一件事

03 self kernel

答案写在那篇标题叫《Advancing the price-performance frontier with GPT-5.6》的官方博客里。里面提到一个细节:在一个人类工程团队主导的流程里,GPT-5.6 Sol 参与重写并优化了生产环境里的推理内核——控制模型在芯片上怎么跑、怎么分配算力的那层底层代码,过去这活儿是系统工程师靠经验手工调的。Sol自己设计并跑了几百个实验,专门优化token的生成效率。OpenAI工程团队确认,这一步让服务成本降了20%,token生成效率提升了15%以上。

注意口径:前面那个80%,是价格表上让利的幅度;这个20%,是模型自己把成本抠下来的部分。两码事,别加在一起。

这跟”AI帮工程师写代码”那种熟悉的叙事不太一样。工程师写代码,AI是工具,主体没变。这次的主体反过来了——被优化的对象,自己变成了优化者。

Luna在Agents’ Last Exam(专门考AI智能体处理复杂任务能力的高难度测试集)上,表现超过了Claude Fable 5(Anthropic旗舰);单次任务的成本,按OpenAI官方博客口径,预估低约99%。性能没退,跟同行旗舰比,成本砍了99%。

从”被优化的对象”到”优化者”,变的不只是账单

04 optimizer

过去讲AI降价,路子基本是两条:芯片更便宜,厂商肯亏钱。这两条都有天花板——芯片降价看摩尔定律的脸色,亏钱抢市场撑不了太久,投资人不会一直买单。

模型自己优化自己的推理内核,是第三条路子,而且不受芯片周期限制。只要模型能力够,它理论上可以持续给自己”减肥”,不用等下一代芯片,也不用公司继续烧钱补贴。这条路子一旦成立,AI的成本曲线可能比大家预期压得更快。

对干这行的人,这事儿还有一层不舒服的地方。写推理内核、做token效率优化,一直是系统工程里最硬核、最难被替代的岗位之一,门槛高到只有少数人干得了。现在OpenAI说,这活儿模型自己能干一部分。这跟”简单重复劳动被AI替代”的旧故事不一样——这次啃的,是最难的那批系统工程活儿。

这句话信几分,我拿不准

得说句扫兴的:这条消息目前只有OpenAI自己的说法。20%的成本下降、15%以上的效率提升,都是”工程团队确认”,没有第三方审计,也没有公开代码或实验记录可供外部复现。**Sol到底自己决定了多少、工程师提前定好目标又占了多少,官方博客没写清楚。**这中间的自主程度,外面现在没法验证。

国内大模型厂商会不会跟进类似的说法,目前没看到实锤动作,只能留个问号,不瞎猜。

但不管这次”自我优化”的含金量有几分,有一件事已经很清楚:以后再看到AI降价的新闻,“厂商让利”这个默认解释,可能已经不够用了。

这套说法你信几分?觉得把话讲透了的,帮转一下。


数据来源

DAVID YIN · 2026 · 07 · 31 · 杭州
← Older · #080
腾讯砍职级、字节改绩效、京东减两级:AI这次专挑「传话」的中层下手