降的全是按token计费的那部分。也就是说,API调用量越大的人,省得越多。
到底能省多少钱?
Sol 此前的API定价是每百万token输入5美元、输出30美元,是GPT-5.6家族里最贵的。
现在翻开定价页,输入4美元,输出20美元。
输入降了两成,没毛病。但输出这一刀从30美元砍到20美元,整整砍掉三分之一。

所以,官方说降价「超过 20%」还算克制。真正最贵的输出 token,一下子降了 33%。
假设一个大型 Agent 每月消耗 1 亿输入 token、2000 万输出 token,原来要 1100 美元,现在只要 800 美元,综合降幅约27.3%。
具体省多少,全看你的输入输出比。批量处理文档那种重输入的活儿,大概省两成多;而Codex里疯狂写代码、输出占大头的场景,能省到三成往上。

一句话,越是把Sol当生产力工具往死里用的人,这次省得越多。
缓存那一档也跟着调整:缓存输入从0.5美元降到0.4美元,缓存写入从6.25美元降到5美元。长上下文档位同样下调,输入从10美元降到8美元,输出从45美元降到30美元。

OpenAI Developers随后跟帖表示,价格能降是因为现在Sol跑起来更有效率了。

ASI双雄决赛:价格成了第二战场
OpenAI 上一轮降价时,Sol是唯一没动的那个模型。
Luna一口气砍掉80%,主力Terra降两成。只有旗舰Sol稳坐原价,只是多给了一个加速不加价的Fast mode。
当时 OpenAI 的算盘打得很清楚:便宜的模型负责走量,最贵的那张牌撑起场面。
这一次,轮到Sol自己下场了。而在这个时间节点,怎么看都不像巧合。
科技大v博主Chubby的判断很直接:这是明摆着冲着Anthropic来的。
OpenAI 这时候大降价,就是要挖 Anthropic 的用户墙角。
科技记者tae kim说得更狠:OpenAI这是在Anthropic的IPO路演里,使了点商战手腕。
这话可不是空穴来风。
Anthropic今年6月1日向SEC递交了S-1机密文件,正式启动IPO流程。据多家媒体报道,承销银行从7月中旬就开始安排管理层与潜在投资者的会面,路演窗口恰好就是8月到9月。
目标上市时间:最快10月,纳斯达克,估值瞄着2万亿美元。
路演路上,最怕的就是竞争对手搞事情。
跑分站打完之后,价格成了ASI双雄决赛的第二战场。
OpenAI 敢疯狂砍价,也不是一时冲动。
他们早前激进的自建算力、押注更高效的模型架构,现在开始显现出威力了。
就在几天前,OpenAI刚宣布在俄亥俄州Pike County的PORTS-Pike园区锁定约8 IT-GW算力,OpenAI签下20年租约;NVIDIA独家提供AI计算基础设施。
此前,OpenAI还与Oracle达成超过3000亿美元、对应最高4.5GW新增容量的五年合作,并与AMD签下6GW GPU部署协议。
OpenAI今年4月已确认,锁定的AI基础设施容量超过10GW,目标到2030年扩至30GW。
基础设施越完善,边际成本越低,降价空间越大。这是一个正向飞轮:模型效率提升→推理成本下降→价格空间释放→用户涌入→收入增长→再投基建。

可以说,OpenAI 这个飞轮正在起飞。他们自己也说了,GPT-5.6 Sol参与优化了自己的生产推理内核,把端到端服务成本砍了20%,token生成效率提升超过15%。
但这次降价除了主动制造压力,也有被迫的成分。
DeepSeek V4 Flash在7月31日正式发布,价格跟不要钱似的。
更刺激的是两天前冒出来的一个代号为「Ox Alpha」的神秘模型。1M上下文窗口,支持文本、图片和视频输入,免费用一周。
现在,中国的开源模型不光便宜,能力也在不断逼近前沿模型。
所以Sol这波降价,既是对Anthropic的主动进攻,也是对中国低价模型的防守反击。
Codex破2000万
同一天还有另一组数字。
Codex 负责人 Tibo 宣布,Codex本周活跃用户突破2000万。

为了庆祝这个里程碑,团队给所有Codex和ChatGPT Work用户统一发放了一次BANKED重置额度。
不过,对社区反映的额度消耗过快问题,Tibo说目前没有发现异常,但正式调查已经启动,有结果会第一时间同步。
一个包月账号拆开卖给一百个人用,这条路堵死了。
通过官方客户端,或者Pi、OpenCode这些开源客户端正常使用,则完全没问题。
本文来自转载新智元 ,观点仅代表作者本人,发现AI平台仅提供信息存储空间服务。
如若转载,请联系原作者;如有侵权,请联系编辑删除。

微信扫一扫

