OpenAI推出GPT-5.6系列模型价格调整:Luna输入输出价格均降80%,Terra降价20%,Sol保持原价但新增Fast mode加速功能;降价源于GPT-5.6 Sol参与优化自身生产系统(如GPU Kernel和推测解码),显著降低服务成本,旨在推动Agent工作流规模化落地。

入门款Luna直接打骨折,每百万Token输入价格从1美元降到0.2美元,输出价格从6美元降到1.2美元。
换算成人民币,相当于输入价格从约6.8元降到1.35元,输出价格从约40.6元降到8.1元。
定位「日常干活主力」的Terra也降价20%,输入、输出价格分别降到2美元和12美元。
换算成人民币,分别约为13.5元和81.2元。
只有旗舰模型Sol,稳坐原价,但推出了Fast mode,速度最高达到标准模式的2.5倍,加速不加价。

自Codex猛猛重置用量之后,降价也给立马安排上了,OpenAI你是要卷死谁…
这价格战直接白热化了。
OpenAI表示,降价是因为GPT-5.6 Sol自己帮自己省了钱。
GPT-5.6 Sol参与自身改进,效率取得了飞跃式提升,故特此回馈新老用户~
左脚踩右脚原地飞升这套,OpenAI你也是玩上了

。
现在,GPT-5.6三款模型的API价格分别是:
GPT-5.6 Luna:每百万Token输入0.2美元、输出1.2美元;
GPT-5.6 Terra:每百万Token输入2美元、输出12美元;
GPT-5.6 Sol:每百万Token输入5美元、输出30美元。

降价之后,Luna属于一手大跳水。
其输入价格已经和上一代GPT-5.4 nano持平,输出价格甚至还便宜0.05美元。
但两款模型干的活不完全一样,GPT-5.4 nano主要面向分类、信息抽取和排序等简单高频任务。
GPT-5.6 Luna则被OpenAI定位为一款面向成本敏感型工作负载的模型,可以调用工具、处理长上下文,执行多步工作流。
简单来说,OpenAI正在把支撑Agent干活的模型,卖到过去简单小模型的价位。
Terra相对克制,降价20%。
Sol则保持原价,新增了Fast mode,速度最高达到标准模式的2.5倍,价格则是标准模式的2倍,模型智能水平不变。
它还会取代此前的Priority Processing。原本使用priority标签的API请求,可以自动切换到Fast mode。
官方表示,这轮调整也会进入Codex和ChatGPT Work。
订阅价格不会下调,用户的额度总量也不会增加,但调用Terra和Luna时,消耗的额度将相应减少。
同样一笔订阅费,可以让模型多干几次活。
OpenAI还顺手把ChatGPT和Codex CLI里的Auto-review模型从GPT-5.4换成了GPT-5.6 Luna。
Auto-review负责在后台检查代码和修改结果,属于典型的高频Agent任务。
结合模型升级和Luna降价,OpenAI预计其成本将降至原来的约十分之一。
便宜模型不再只负责分类、抽取这些传统「杂活」,而是开始进入代码审查、后台监控等需要判断和工具调用的环节。
目前三款模型的定位是:
预算敏感、调用量大的任务交给Luna;
普通日常工作交给Terra;
高难度任务继续使用Sol;
如果连等待都嫌慢,再花一倍的钱购买速度。
为啥突然降价?
OpenAI表示,原因是GPT-5.6 Sol参与了自家生产系统的优化。
它所提高的效率,进而转变成了价格表上打折的数字。
具体而言,GPT-5.6 Sol重写和优化了部分生产环境GPU Kernel,设计并运行数百次Token生成实验,还参与监控训练,在出现问题时介入。
最后成绩也很突出:生产GPU Kernel优化,让GPT-5.6端到端服务成本下降20%;改进推测解码,让Token生成效率提升15%以上。

GPU Kernel可以理解为模型在GPU上执行具体计算任务的底层程序。
模型本身不用变,只要这些程序写得更高效,同一块GPU就能更快完成计算,处理更多请求,单次调用成本也会跟着下降。
推测解码则是在生成答案时,先批量「猜」出接下来可能出现的Token,再交给主模型验证。猜得越准,需要逐个生成和等待的步骤就越少。
两项优化都没有降低模型能力,却能让同一个模型跑得更快、更便宜。
不过,这还不是GPT-5.6完全自主升级自己。
OpenAI特意强调,整个过程仍然由人类主导。
模型可以写代码、跑实验、监控异常,但目标怎么定、结果能不能用、代码是否进入生产环境,依然需要「Human in the Loop」。
最后,还有一个新变化。
这次降价有一个很具体的落点:Agent工作流。
打折最狠的Luna,并不只是用来做分类、抽取的传统小模型。
按照OpenAI的定位,它可以调用工具、执行多步任务,主要面向高频、成本敏感型工作负载。
因此,Luna降价80%,也是在降低Agent长期运行的门槛。
让原本因为成本太高而不能频繁执行的审查、验证和监控任务,有机会变成工作流里的常规步骤。
再结合GPT-5.6参与优化自身生产系统,一套新的循环出现了:
模型参与提高运行效率,成本下降;价格降低后,模型进入更多高频工作流;调用规模扩大,再推动下一轮效率优化。
OpenAI这套降价飞轮,已经雏形初现。
这一通操作下来,现在压力直接给到A社:
「轮到你了。」

参考链接:[1]https://x.com/OpenAI/status/2082878156483219672[2]https://x.com/sama/status/2082880720989532597
本文来自微信公众号“量子位”,作者:关注前沿科技