OpenAI突然杀疯!GPT 5.6系列价格最高暴降80%,AI竟开始自己改代码实现原地飞升

按照OpenAI说法是真正无限使用且极其廉价的AI时代正在加速到来。

OpenAI今天突然宣布GPT 5.6系列全面大降价。

最快最便宜的模型Luna价格直接暴跌百分之八十。主打日常办公的Terra模型价格也下调了百分之二十。连带应用程序里帮你检查代码的自动批准模式,成本也直接降了十倍。

此外,主打最高智商的Sol模型推出了极速模式。速度最高飙升两点五倍。

按照OpenAI说法是真正无限使用且极其廉价的AI时代正在加速到来。

降价细节

先看价格表,我做了个小统计

Sol的价格没有调整,但速度上有单独的提升,也就是下面要说的快速模式。DeepSeek V4 Pro的输入价格是缓存未命中时的报价,如果缓存命中,价格会降到0.003625美元每百万token。

拿智能水平和成本一起看会更直观。第三方评测机构Artificial Analysis给DeepSeek V4 Pro(Max推理模式)打出的智能指数是44.27分,单个任务的成本大约是0.0448美元。换算成成本和智能的比值,DeepSeek V4 Pro比GPT-5.6 Luna High模式高出1.9倍,也就是说同等智能水平下,Luna High更划算。

新价格从7月30日开始生效,随后会陆续同步到AWS平台。ChatGPT和Codex的订阅价格和额度都没有变化,但用Terra和Luna处理任务时,消耗的额度会更少。

一个新功能:快速模式

OpenAI在API里加入了快速模式,用来替代之前的优先处理功能。

对于Sol来说,快速模式下的速度最高可以达到标准模式的2.5倍,价格是标准模式的两倍,智能水平完全没有变化。快速模式向下兼容,之前标记为优先处理的请求会自动切换到快速模式,不需要用户额外操作。

在Codex里,这个功能对应的是/fast模式。

自动批准模式,成本降了十倍

针对智能体的自动批准功能(也就是App里的替我审核),成本降到了原来的十分之一左右。

这个功能现在会用Luna模型来提前拦截高风险操作,避免主智能体直接执行可能有问题的动作。

降价的核心秘密:AI开始自己优化自己

这么大幅度的降价和提速到底怎么做到的。

核心秘密在于模型开始自己优化自己了。

在人类工程师的带领下,Sol模型自主重写并优化了底层生产内核。它自己设计并跑了数百个实验来提升token的生成效率,甚至还在监控模型训练,遇到问题直接自己介入解决。

这套操作直接让模型端到端的运行成本降低了百分之二十,token生成效率提高了百分之十五。

底层的路由变得更聪明,软件生成token更高效,上下文管理也让AI避免了重复劳动。相同的算力现在能办更多的事。

这形成了一个正向循环:模型越强,就越能自主参与优化工作,而优化工作反过来又能让下一代模型更便宜、更高效。

谁能用上这次降价

Terra和Luna在ChatGPT Work、Codex和OpenAI API里都能用。

Free和Go用户可以使用Terra,Plus、Pro、Business和Enterprise用户则可以在Terra和Luna之间自由选择。

为什么要这么做

OpenAI把这次降价放在了一个更大的思路里:根据任务的重要程度、出错代价、紧急程度和规模,匹配合适的模型。

比如一个典型的编程流程,可以先用Sol理清需求、定好方案,再交给Luna去写代码、跑测试、核对结果,这样能在保证质量的同时把整体成本压下来。

OpenAI还表示,会继续同时投入更强的算力和更高效的算力使用方式,一边是Luna和Terra这样让大规模任务变得更便宜的路线,一边是Sol配合快速模式,让最重要的任务能跑得更快。