GPT-5.6今起大降价,最大幅度80%!

GPT-5.6今起大降价,最大幅度80%!

💡 原文中文,约2300字,阅读约需6分钟。
📝

内容提要

OpenAI宣布GPT-5.6系列降价,Luna模型降80%,Terra降20%,Sol保持原价但推出加速模式。降价源于模型自我优化降低成本,旨在降低Agent工作流门槛,推动高频任务应用,形成效率与成本良性循环。

🔎

延伸解读

降价背后的技术逻辑

OpenAI称此次降价源于GPT-5.6 Sol对自身生产系统的优化,包括重写GPU Kernel和改进推测解码,分别使服务成本下降20%、Token生成效率提升15%以上。这些优化不降低模型能力,而是通过提高硬件利用率和生成速度来摊薄单次调用成本。值得注意的是,OpenAI强调整个过程仍由人类主导,模型仅辅助编写代码、运行实验和监控异常,关键决策仍需人工介入。

价格定位与市场策略

降价后,Luna的输入价格与上一代GPT-5.4 nano持平,但输出价格更低,且Luna支持工具调用和多步工作流,而nano仅面向简单高频任务。这表明OpenAI正将具备Agent能力的模型定价至传统小模型水平,以吸引成本敏感型用户。Terra降价20%保持中端定位,Sol则通过新增Fast mode(速度提升至2.5倍,价格翻倍)提供差异化选择,同时取代原有的Priority Processing。

对Agent工作流的影响

Luna降价80%直接降低了Agent长期运行的成本门槛,使原本因成本过高而难以频繁执行的审查、验证和监控任务可能成为常规步骤。OpenAI已将ChatGPT和Codex CLI中的Auto-review模型从GPT-5.4更换为Luna,预计成本降至原来的约十分之一。这标志着便宜模型开始进入需要判断和工具调用的环节,而不再局限于分类、抽取等传统任务。

Q&A

GPT-5.6系列降价的具体幅度是多少?

GPT-5.6系列中,Luna模型降价80%,Terra降价20%,Sol保持原价但推出加速模式。

GPT-5.6 Luna降价后的价格是多少?

Luna的输入价格从每百万Token 1美元降至0.2美元,输出价格从6美元降至1.2美元。

GPT-5.6 Sol的Fast mode是什么?

Sol的Fast mode是新增的加速模式,速度最高达到标准模式的2.5倍,价格是标准模式的2倍,但模型智能水平不变。

OpenAI为什么对GPT-5.6进行降价?

降价是因为GPT-5.6 Sol参与了自身生产系统的优化,通过重写GPU Kernel和改进推测解码,使服务成本下降20%,Token生成效率提升15%以上,从而降低了成本。

GPT-5.6降价对Agent工作流有什么影响?

降价降低了Agent长期运行的门槛,使原本因成本高而无法频繁执行的审查、验证和监控任务成为常规步骤,推动高频任务应用。

GPT-5.6 Luna和GPT-5.4 nano有什么区别?

GPT-5.4 nano主要面向分类、信息抽取和排序等简单高频任务,而GPT-5.6 Luna定位为成本敏感型工作负载,可以调用工具、处理长上下文、执行多步工作流。

GPT-5.6降价后,订阅用户的额度会有什么变化?

订阅价格不会下调,用户的额度总量也不会增加,但调用Terra和Luna时消耗的额度会相应减少,因此同样一笔订阅费可以让模型多干几次活。

GPT-5.6 Sol在优化自身生产系统时具体做了什么?

GPT-5.6 Sol重写和优化了部分生产环境GPU Kernel,设计并运行数百次Token生成实验,还参与监控训练,在出现问题时介入。

🏷️

标签

➡️

继续阅读