详情

首页手游攻略 突发,GPT-5.6今起大降价

突发,GPT-5.6今起大降价

佚名 2026-07-31 12:55:55

入门款Luna直接打骨折,每百万Token输入价格从1美元降到0.2美元,输出价格从6美元降到1.2美元。

换算成rmb,相当于输入价格从约6.8元降到1.35元,输出价格从约40.6元降到8.1元。

定位「日常干活主力」的Terra也降价20%,输入、输出价格分别降到2美元和12美元。

换算成rmb,分别约为13.5元和81.2元。

只有旗舰模型Sol,稳坐原价,但推出了Fast mode,速度最高达到标准模式的2.5倍,加速不加价。

自Codex猛猛重置用量之后,降价也给立马安排上了,OpenAI你是要卷死谁…

这价格战直接白热化了。

OpenAI表示,降价是因为GPT-5.6 Sol自己帮自己省了钱

GPT-5.6 Sol参与自身改进,效率取得了飞跃式提升,故特此回馈新老用户~

左脚踩右脚原地飞升这套,OpenAI你也是玩上了

两款降价,一款加速

现在,GPT-5.6三款模型的API价格分别是:

GPT-5.6 Luna:每百万Token输入0.2美元、输出1.2美元;

GPT-5.6 Terra:每百万Token输入2美元、输出12美元;

GPT-5.6 Sol:每百万Token输入5美元、输出30美元。

降价之后,Luna属于一手大跳水。

其输入价格已经和上一代GPT-5.4 nano持平,输出价格甚至还便宜0.05美元

但两款模型干的活不完全一样,GPT-5.4 nano主要面向分类、信息抽取和排序等简单高频任务。

GPT-5.6 Luna则被OpenAI定位为一款面向成本敏感型工作负载的模型,可以调用工具、处理长上下文,执行多步工作流。

概括来看,OpenAI正在把支撑Agent干活的模型,卖到过去简单小模型的价位

Terra相对克制,降价20%。

Sol则保持原价,新增了Fast mode,速度最高达到标准模式的2.5倍,价格则是标准模式的2倍,模型智能水平不变。

它还会取代此前的Priority Processing。原本使用priority标签的API请求,可以自动切换到Fast mode。

官方表示,这轮调整也会进入Codex和ChatGPT Work。

订阅价格不会下调,用户的额度总量也不会增加,但调用Terra和Luna时,消耗的额度将相应减少。

同样一笔订阅费,可以让模型多干几次活。

OpenAI还顺手把ChatGPT和Codex CLI里的Auto-review模型从GPT-5.4换成了GPT-5.6 Luna。

Auto-review负责在后台检查代码和修改结果,属于典型的高频Agent任务。

结合模型升级和Luna降价,OpenAI预计其成本将降至原来的约十分之一

便宜模型不再只负责分类、抽取这些传统「杂活」,而是开始进入代码审查、后台监控等需要判断和工具调用的环节。

目前三款模型的定位是:

预算敏感、调用量大的任务交给Luna

普通日常工作交给Terra

高难度任务继续使用Sol

如果连等待都嫌慢,再花一倍的钱购买速度。

GPT-5.6开始参与给自己降本

为啥突然降价?

OpenAI表示,原因是GPT-5.6 Sol参与了自家生产系统的优化

它所提高的效率,进而转变成了价格表上打折的数字。

具体而言,GPT-5.6 Sol重写和优化了部分生产环境GPU Kernel,设计并运行数百次Token生成实验,还参与监控训练,在出现问题时介入。

最后成绩也很突出:生产GPU Kernel优化,让GPT-5.6端到端服务成本下降20%;改进推测解码,让Token生成效率提升15%以上。

GPU Kernel可以理解为模型在GPU上执行具体计算任务的底层程序。

模型本身不用变,只要这些程序写得更高效,同一块GPU就能更快完成计算,处理更多请求,单次调用成本也会跟着下降。

推测解码则是在生成答案时,先批量「猜」出接下来可能出现的Token,再交给主模型验证。猜得越准,需要逐个生成和等待的步骤就越少。

两项优化都没有降低模型能力,却能让同一个模型跑得更快、更便宜。

不过,这还不是GPT-5.6完全自主升级自己。

OpenAI特意强调,整个过程仍然由人类主导。

模型可以写代码、跑实验、监控异常,但目标怎么定、结果能不能用、代码是否进入生产环境,依然需要「Human in the Loop」

OMT

最后,还有一个新变化。

这次降价有一个很具体的落点:Agent工作流

打折最狠的Luna,并不只是用来做分类、抽取的传统小模型。

按照OpenAI的定位,它可以调用工具、执行多步任务,主要面向高频、成本敏感型工作负载。

因此,Luna降价80%,也是在降低Agent长期运行的门槛

让原本因为成本太高而不能频繁执行的审查、验证和监控任务,有机会变成工作流里的常规步骤。

再结合GPT-5.6参与优化自身生产系统,一套新的循环出现了:

模型参与提高运行效率,成本下降;价格降低后,模型进入更多高频工作流;调用规模扩大,再推动下一轮效率优化。

OpenAI这套降价飞轮,已经雏形初现。

这一通操作下来,现在压力直接给到A社:

「轮到你了。」

参考链接:[1]https://x.com/OpenAI/status/2082878156483219672[2]https://x.com/sama/status/2082880720989532597

相关资讯
点击查看更多
游戏推荐
推荐专题
热门阅读
推荐下载