内容提要
OpenAI向ChatGPT免费及Go用户推送GPT-6 Luna,付费用户使用GPT-6 Sol。新版支持生成图表、按钮等交互界面,并可边思考边作答。安全报告显示,模型在网络安全等领域仍为High级,多轮越狱防护提升,但自伤、色情及未成年人相关评测出现回退。
延伸解读
免费用户升级:GPT-6 Luna 的可用性与限制
OpenAI 从 10 月 8 日起向 ChatGPT 免费和 Go 用户推送 GPT-6 Luna,替换原有的 GPT-5.6 Luna。付费用户则从 10 月 7 日起使用 GPT-6 Sol。此次更新仅针对 ChatGPT 的 Chat 体验,Work 和 Codex 的模型不会同步切换。免费用户虽能体验新模型,但需注意 Luna 在部分安全评测上出现回退,实际表现可能因使用场景而异。
交互界面升级:从文字聊天到动态工具
GPT-6 引入 Intelligent UI,能根据问题生成图表、按钮、计算器等交互组件,并支持边思考边输出部分答案。例如询问自行车运作原理时,回答会呈现可点击查看的部件界面。OpenAI 称,在需要网页搜索的问题上,GPT-6 Instant 开始回答的时间平均比上一代早 44%。这使聊天框逐渐变为随问题变化的界面,提升信息获取效率。
安全表现:进步与退步并存
安全报告显示,GPT-6 在网络安全、生物化学领域仍为 High 级,多轮越狱防护优于 GPT-5.6,指令层级抵抗率接近满分。但自伤、色情及未成年人相关评测出现显著回退,例如 Luna 的自伤评分从 0.932 降至 0.901。OpenAI 解释称模型更愿回答敏感话题中的信息性问题,且评测使用困难样本,不能直接推断普通用户遇到违规内容的频率。
回答变长:信息量增加与评分调整
GPT-6 的回答明显变长,在 HealthBench Professional 上,Luna 平均回答长度从 2,920 字符增至 5,289 字符。长回答能覆盖更多评分点,但可能稀释信息密度。OpenAI 为此引入长度惩罚:超过 2,000 字符后每多 500 字符扣 1.47 分。调整后 Luna 得分从 57.8 降至 48.2,仍高于上一代的 44.1。用户需留意回答冗长可能影响阅读效率。
Q&A
GPT-6 免费用户什么时候能用上?
免费和 Go 用户从 10 月 8 日起陆续用上 GPT-6 Luna。
GPT-6 的 Intelligent UI 是什么?
Intelligent UI 是 GPT-6 的新功能,能根据问题生成图表、按钮和交互工具,比如解释概念时给出可点击图示,做比较时并排展示选项,还能生成计算器、分账工具或小游戏。
GPT-6 在安全方面有哪些进步?
多轮越狱防护提升,指令层级抵抗率 Sol 达 99.99%、Luna 达 99.79%;事实性在医疗、法律、金融等指标上优于 GPT-5.6;Codex Auto-review 测试中 GPT-6 无绕过审查案例。
GPT-6 有哪些退步或风险?
自伤内容评测中 Sol 从 0.934 降到 0.896,Luna 从 0.932 降到 0.901;Luna 在血腥(0.867 到 0.812)和色情(0.971 到 0.899)评测中回退;面向未成年人的评测在年龄限制、色情和情感依赖项目上也有显著回退。
GPT-6 的回答长度有什么变化?
回答明显变长。在 HealthBench Professional 上,Luna 平均回答长度从 2,920 字符涨到 5,289 字符,Sol 从 2,894 涨到 4,360。OpenAI 设了长度惩罚:超过 2,000 字符后每多 500 字符扣 1.47 分。
GPT-6 在网络安全和生物化学领域的风险等级如何?
GPT-6 Sol 和 Luna 在网络安全、生物化学领域均达到 High 门槛,尚未达到 Critical 门槛;在 AI 自我改进领域,两款模型都没到 High。