狙击Gemini 3!OpenAI发布GPT-5.1-Codex-Max

💡 原文中文,约2000字,阅读约需5分钟。
📝

内容提要

OpenAI发布了GPT-5.1-Codex-Max,突破了上下文窗口限制,支持长达24小时的连续工作,显著提升了任务效率。该模型在软件工程任务中表现优异,能够处理复杂任务并减少token消耗,尤其适合长时间运行的任务,并支持与多种工具结合使用。

🎯

关键要点

  • OpenAI发布了GPT-5.1-Codex-Max,突破上下文窗口限制,支持长达24小时的连续工作。

  • 新模型在软件工程任务中表现优异,能够处理复杂任务并减少token消耗。

  • GPT-5.1-Codex-Max在METR指标上达到新SOTA,能以50%的概率完成原本需要人类2小时42分钟的任务。

  • 模型在PR创建、代码审查等任务中训练,推理速度更快,性能优于之前版本。

  • 新版本支持压缩,突破上下文窗口限制,能够连贯处理数百万个token。

  • GPT-5.1-Codex-Max已支持与CLI、IDE扩展、云端和代码审查工具结合使用。

  • OpenAI还发布了GPT-5.1 Pro版本,指令遵循能力更强。

🔎

延伸解读

长时间任务的优势

GPT-5.1-Codex-Max在处理长时间运行的任务时表现出色,能够连续工作超过24小时。这一特性使其在需要长时间分析的任务中,如书籍和长文档的处理,避免了信息割裂带来的理解偏差,提升了整体效率。

与其他模型的比较

与Claude Code相比,GPT-5.1-Codex-Max在token消耗上更为友好,尽管Claude在速度上占优。两者的结合可能会在实际应用中产生更好的效果,尤其是在复杂编程任务中。

新功能的实用性

新版本支持与CLI、IDE扩展及云端工具结合使用,提升了开发者的工作效率。API接口的即将上线将进一步增强其在软件开发中的应用潜力,值得开发者关注。

延伸问答

GPT-5.1-Codex-Max的主要特点是什么?

GPT-5.1-Codex-Max突破了上下文窗口限制,支持长达24小时的连续工作,显著提升了任务效率。

GPT-5.1-Codex-Max在软件工程任务中的表现如何?

该模型在软件工程任务中表现优异,能够处理复杂任务并减少token消耗,尤其适合长时间运行的任务。

GPT-5.1-Codex-Max如何处理长时间运行的任务?

模型支持压缩,能够跨多个上下文窗口连贯工作,避免信息割裂,适合长文档分析等超长篇幅任务。

与之前版本相比,GPT-5.1-Codex-Max有哪些性能提升?

新版本在推理速度和性能上优于之前版本,且思考token使用减少了30%。

GPT-5.1-Codex-Max支持哪些工具的结合使用?

该模型已支持与CLI、IDE扩展、云端和代码审查工具结合使用。

OpenAI还发布了哪些与GPT-5.1相关的版本?

OpenAI还发布了GPT-5.1 Pro版本,指令遵循能力更强。

🏷️

标签

➡️

继续阅读