⁡⁤‬‍⁤‬​‌‍⁢⁡⁢⁣‌‌⁡⁡​⁤​​⁢⁡‬⁡‬​‍⁣​​⁤⁡‍​⁡‬‌‬⁣⁡⁣​⁡‬⁤刚刚,GPT-6 新模型掀桌!「白菜价」杀进 DeepSeek 腹地

⁡⁤‬‍⁤‬​‌‍⁢⁡⁢⁣‌‌⁡⁡​⁤​​⁢⁡‬⁡‬​‍⁣​​⁤⁡‍​⁡‬‌‬⁣⁡⁣​⁡‬⁤刚刚,GPT-6 新模型掀桌!「白菜价」杀进 DeepSeek 腹地

💡 原文中文,约4500字,阅读约需11分钟。
📝

内容提要

OpenAI发布GPT-6 Sol与Luna,API价格降至上代一半,Luna输入每百万Token仅0.1美元,已进入DeepSeek价格区间。Sol主打专业推理与编程,Luna承接高频低成本任务,二者能力接近上代但成本大降。OpenAI还优化缓存与产品体系,低价不再是DeepSeek独有优势。

🔎

延伸解读

价格战升级:OpenAI 攻入 DeepSeek 腹地

GPT-6 Luna 的输入输出价格已与 DeepSeek V4.1 Flash 的普通请求价格区间重叠,且无峰谷定价波动。这意味着 DeepSeek 长期依赖的低价标签不再独有,OpenAI 通过基础设施优化实现了成本下探,直接挑战其价格护城河。

能力与成本权衡:Sol 和 Luna 的定位差异

Sol 面向专业推理与编程,在多项基准中接近或超越竞品且成本更低;Luna 则以极低价格承接高频任务,能力接近上代但成本大降。两者并非追求绝对性能上限,而是强调每美元完成的工作量,适合需要大量 Agent 并发或长期运行的工作流。

缓存优化:隐藏的成本节省关键

OpenAI 更新了提示词缓存机制,默认提高命中率,缓存输入读取可享 90% 折扣,并允许开发者查看缓存比例和设置断点。对于持续读取代码库、文档的 Agent,缓存节省的费用可能比公开单价下降更重要,这进一步增强了 OpenAI 在规模化场景下的成本优势。

实测反馈:效率提升与视觉短板并存

开发者试用显示 Sol 能大幅缩短任务时间并减少 Token 消耗,但在部分视觉创意任务中,Claude Opus 5.5 的完成度更高。这表明 Sol 和 Luna 在效率与成本上优势明显,但追求单次最佳效果的创意任务可能仍需考虑其他模型。

Q&A

GPT-6 Sol 和 Luna 的 API 价格具体是多少?

GPT-6 Sol 输入每百万 Token 2 美元,输出 10 美元;GPT-6 Luna 输入每百万 Token 0.1 美元,输出 0.5 美元。

GPT-6 Sol 和 Luna 与 DeepSeek V4.1 Flash 相比,价格上有何优劣?

Luna 的普通请求价格已低于 DeepSeek V4.1 Flash 闲时价格,且无峰谷定价;但 DeepSeek 的闲时缓存命中输入价更低,仅每百万 Token 0.02 元。

GPT-6 Sol 在编程和 Agent 任务上的表现如何?

Sol 在 AutomationBench 中得分 33.2%,高于 Claude Opus 5 的 26.9%,成本仅 9%;在 Agents’ Last Exam 中得分 56.4%,成本低约 60%;DeepSWE v1.1 得分 68.8%,接近 Claude Fable 5 的 69.9%,成本低约 80%。

OpenAI 如何通过缓存优化降低使用成本?

OpenAI 更新了提示词缓存,提高默认缓存命中率,缓存输入读取可享 90% 折扣;开发者可查看缓存比例,调整推理强度和工具,并设置显式断点优化复用。

GPT-6 Sol 和 Luna 在 ChatGPT 中的可用性如何?

从发布当天起,面向 Plus、Pro、Business、Enterprise 和 Edu 用户登陆 ChatGPT Work 与 Codex;Free 和 Go 用户可在桌面应用中使用 Luna;暂未进入普通 Chat 对话,API 用户可通过 gpt-6-sol 和 gpt-6-luna 调用。

GPT-6 Sol 和 Luna 的发布对 DeepSeek 有何影响?

Luna 的普通输入输出价格进入 DeepSeek V4.1 Flash 区间,缩小了价格鸿沟;OpenAI 凭借更完善的产品体系,使低价不再是 DeepSeek 独有优势,低价成为头部模型必答题。

🏷️

标签

➡️

继续阅读