OpenAI于2026年8月将旗舰模型GPT-5.6 Sol降价20%以上,轻量级Luna降价80%,以应对Anthropic和中国模型的竞争。降价后,Sol和Luna在性能与成本上占据帕累托前沿,但降价仅限三个月。文章指出,真正的竞争在于Token效率,而非单纯价格,未来市场格局仍存变数。
GPT-5.6模型系列已集成至Kiro软件开发代理,包含Sol、Terra和Luna,助力开发者高效规划、构建、审查和测试代码。该模型提升代码质量,降低成本,测试显示Terra在Terminal-Bench 2.1上节省约82%费用。Kiro通过规范驱动开发,提供结构化上下文,支持复杂多步任务,并获OpenAI与AWS合作优化。
OpenClaw beta.2更新修复多项安全漏洞,包括API密钥裸奔、插件恶意来源、macOS配置共享等问题,并新增GPT-5.6三档运行时和SQLite备份功能。但默认配置仍不安全,用户需手动加固,且高成本模型默认启用,存在烧钱风险。
Codex现支持通过修改config.toml配置文件启用GPT-5.6模型的1M上下文窗口,默认272K,可在900K时自动压缩。但技术经理建议不修改,因1M窗口会更快消耗配额,当前配置已是最佳。ChatGPT订阅用户现也可体验此功能。
OpenAI的GPT-5.6 Sol模型宣称支持百万token上下文,但实际Codex仅提供约25万token,远低于宣传。用户可通过修改配置文件尝试解锁,但可能导致崩溃。官方因成本限制调低默认值,且Luna模型性价比更高。文章揭露了宣传与实际性能的差距。
GPT-5.6后,通用Skill(如Superpowers)价值下降,因模型和Runtime已内化规划、测试等能力。Comet Native实验显示,去掉固定流程后质量不降,Token和成本降约75%。长期保留的是垂直Skill,含私有知识、执行能力和业务边界,而非通用方法论。
OpenAI推出GPT-5.6 Sol UltraFast超快模式预览,面向企业,速度提升14倍,每秒生成750 tokens,适合实时语音、客服、金融等场景。该模式由Cerebras支持,需企业申请并经OpenAI审核,预览阶段资源有限,未来将扩大覆盖。
本文总结了Hacker News上的多个科技新闻:GLM-5.3开源模型在编程和网络安全上表现突出,但缺乏安全限制引发担忧;Google发布Gemini 3.7 Flash,性能提升且价格减半;Qwen3.8-27B多模态模型增强但资源占用高;Opus 5能力更强但体验差,因擅自猜测;Cerebras与OpenAI推出超快GPT-5.6;Count Binface在补选中获26.9%选票;建议选择成熟技术;理解代码成新瓶颈;Mistral OCR 4.1发布。
GPT-5.6模型系列大幅降低前沿智能体成本,提升性价比。通过模型选择、持久化推理、原生压缩、多智能体编排及程序化工具调用等新API功能,在保持性能的同时显著减少token消耗。例如Luna以1/18成本保持98%精度,Sol在ARC-AGI-3上性能提升近3倍且输出减少6倍。提示缓存延长至30分钟,进一步优化效率。
Grok 4.6发布,性能与GPT-5.6持平,价格减半,并免费接入开发者工具。Grok 4.7将用SpaceX全量内部数据训练,参数达2.1万亿,学习真实工程经验,提升实战能力。此举旨在将企业数据转化为可调用的数字资产,重新定义AI“懂行”标准。
作者用85万行代码库实测本地DeepSeek V4与云端GPT-5.6的审计能力。首轮GPT发现32个漏洞,DeepSeek仅8个且5个错误,原因是工具链配置缺陷:代理指令过期、缺乏证据验证、回合预算不足。修复后DeepSeek准确率从37%升至近90%,找到GPT遗漏的问题。结论:本地模型适合边界明确任务,前沿模型擅长跨层综合,工具链比模型权重更关键。
OpenAI发布GPT-5.6系列模型,包含Sol、Terra和Luna三个版本。开发者反馈Sol在生成和纠错方面优于Claude Opus 5,但专家认为需对照真实数据验证。有用户用Sol解决多个数学难题,其“超强推理”模式表现突出。总体评价因任务而异,Sol有时过度设计,部分前端任务仍需其他模型。
OpenAI将ChatGPT免费用户的默认模型升级为GPT-5.6 Luna,取消聊天次数限制,并新增思考按钮以应对复杂问题。Plus和Pro用户获得GPT-5.6 Sol专精升级,提升事实准确性和回答质量,同时引入滑块调节思考量。更新旨在优化聊天体验,减少幻觉,覆盖更广泛用户需求。
OpenAI更新了ChatGPT中的GPT-5.6 Sol模型,优化日常聊天,但Work和Codex版本不变。新模型减少事实错误,Plus和Pro用户可调节思考深度。API未变,实际效果需测试验证。
OpenAI宣布,ChatGPT免费及Go层级用户下周起可无限次文本聊天,并新增“Think”按钮以处理难题,默认模型升级为GPT-5.6 Luna。Plus和Pro用户则获得更可靠的GPT-5.6 Sol,减少事实错误,并提供调节思考深度的滑块,即日起可用。
微软因AI token成本飙升,自7月起为各部门设预算,将默认模型改为更便宜的GPT-5.6,并监控员工使用量,以遏制“Tokenmaxxing”现象。此前硅谷多家公司鼓励员工大量消耗token,导致成本失控,现纷纷转向关注工作成果而非用量。
OpenAI宣布GPT-5.6系列降价,Luna模型降80%,Terra降20%,Sol保持原价但推出加速模式。降价源于模型自我优化降低成本,旨在降低Agent工作流门槛,推动高频任务应用,形成效率与成本良性循环。
OpenAI发布GPT-5.6家族,包含Sol、Terra、Luna三个模型,其中Sol性能超越Claude且成本减半。通过推理栈优化、负载均衡、推测解码、内核重写及缓存提升,效率增加20%。Sol能自我优化代码,实现AI优化AI,智能体套件减少重复开销,推动效率曲线陡升。
OpenAI在GPT-5.6发布三周后大幅降价:Luna模型降价80%,Terra降价20%,Sol价格不变但推出快模式。此举源于基础设施优化,旨在应对中国低成本开源模型的竞争,吸引开发者使用其API,使成本优化成为竞争优势。
OpenAI在技术报告中披露,GPT-5.6已投入生产,通过流量分析、内核改写、优化推测解码和部署参数,实现端到端成本降低20%、Token效率提升15%,初显递归自进化(RSI)特征。同时,OpenAI用Rust构建Agent Harness,减少循环重复开销,人类仍掌控优化目标。内部研究Token用量激增,显示AI效率提升反而增加使用量。
完成下面两步后,将自动完成登录并继续当前操作。