炸裂!Tibo首发GPT-5.6 Sol百万Token上下文解锁指南

炸裂!Tibo首发GPT-5.6 Sol百万Token上下文解锁指南

💡 原文中文,约3500字,阅读约需9分钟。
📝

内容提要

OpenAI的GPT-5.6 Sol模型宣称支持百万token上下文,但实际Codex仅提供约25万token,远低于宣传。用户可通过修改配置文件尝试解锁,但可能导致崩溃。官方因成本限制调低默认值,且Luna模型性价比更高。文章揭露了宣传与实际性能的差距。

🔎

延伸解读

宣传数字与实际可用窗口的差距

文章指出,GPT-5.6 Sol 官方标称 105 万 token 上下文,但 Codex 实际暴露的窗口从 37.2 万降至 27.2 万,有效可用仅约 25.8 万,仅为宣传的 25.9%。这种差异源于官方对成本和性能的权衡,而非单纯技术限制。用户应关注实际产品中的参数,而非仅依赖宣传规格。

修改配置的潜在风险

社区流传的修改 config.toml 方法看似能解锁百万上下文,但实测在接近 40 万 token 时会话崩溃,自动压缩失效。官方不禁止修改,但也不保证稳定性。用户需自行承担性能下降、配置损坏等后果,且修改后可能仍受产品逻辑的硬性限制,无法真正达到宣传值。

Luna 的性价比对比

GPT-5.6 系列中,Luna 虽为轻量版,但上下文窗口达 150 万,输入输出价格仅为 Sol 的五分之一,且在 Terminal-Bench 2.1 上得分超过 Terra。这表明上下文长度与推理深度并非线性关系,用户在选择模型时,应结合任务需求与成本,而非盲目追求旗舰型号。

Q&A

GPT-5.6 Sol 在 Codex 中实际可用的上下文窗口是多少?

根据文章,GPT-5.6 Sol 在 Codex 中实际可用的上下文窗口约为 258,400 token(经过 95% 有效比例折算),远低于宣传的 1,050,000 token。

如何通过修改配置文件尝试解锁 GPT-5.6 Sol 的百万 token 上下文?

在 ~/.codex/config.toml 文件中,在任意 [section] 头部之前添加以下三行:model = "gpt-5.6-sol"、model_context_window = 1000000、model_auto_compact_token_limit = 900000。保存后重启 Codex 客户端并开启新会话。也可以使用 CLI 命令:codex -m gpt-5.6-sol -c model_context_window=1000000 -c model_auto_compact_token_limit=900000。

为什么 OpenAI 在 Codex 中默认不提供 GPT-5.6 Sol 的完整百万 token 上下文?

因为运行百万 token 上下文的推理成本极高,OpenAI 为了控制成本,故意将默认值调低。官方表示默认值在性能和成本之间是最优的,因此没有直接给用户开满。

GPT-5.6 Sol 的上下文窗口在 Codex 中经历了怎样的变化?

2026年7月9日发布时,Codex 中 Sol 的 context_window 为 372,000,实际可用约 353,400 token;7月13日更新后降至 272,000,实际可用约 258,400 token。两次暗砍后,用户实际可用上下文仅为宣传值的 25.9%。

GPT-5.6 Luna 与 Sol 相比有哪些优势?

Luna 的上下文窗口为 1,500,000 token,比 Sol 多 50 万;输入价格 $1/百万 token,输出价格 $6/百万 token,均为 Sol 的五分之一。在 Terminal-Bench 2.1 上得分 84.3%,超过 Terra 的 82.5%。

修改配置文件后,实际使用中会遇到什么问题?

修改配置可能导致性能下降、会话中断,甚至配置崩溃需要重装。有用户实测将 model_context_window 改为 998,000 后,跑到接近 400,000 token 时会话直接崩溃,自动压缩也失败。

Codex 的自动压缩机制在 Sol 上有效吗?

无效。配置中的 model_auto_compact_token_limit = 900000 在 Codex 实际只提供 25 万窗口的情况下永远不会触发。Codex 自身的压缩机制在接近窗口上限时触发,但压缩会导致信息丢失,窗口越小压缩越频繁,形成死亡螺旋。

Codex 中 GPT-5.6 Sol 的定价规则是怎样的?

官方模型页面显示,输入超过 272,000 token 的请求按 2 倍输入价格和 1.5 倍输出价格计费。但 Codex 将原始窗口卡在 272,000,用户无法选择更长上下文,因此实际上无法触发额外计费。

🏷️

标签

➡️

继续阅读