JetBrains Junie现已支持Google最新编码模型Gemini 3.8 Flash,该模型专为多步骤工程任务设计,通过分解子任务、运行测试和验证来确保答案可靠,虽每步较慢但整体更快。在DeepSWE v1.1基准测试中表现优于多数大型模型且成本更低。限时提供75%折扣,用户可在IDE插件或CLI中直接选用。
Z.ai的GLM 5.2开源编码模型,拥有100万token上下文窗口,现通过Blackbox AI在AI Gateway上免费提供给eve代理,截止8月27日。新eve代理默认使用该模型,现有代理可通过修改agent/ts文件或运行eve set命令切换。此优惠不适用于Fast模式,到期后按标准费率计费。
VS Code团队推出轻量级编码模型MAI-Code-1-Flash,与GitHub Copilot集成,在保证编码质量的同时降低token使用量。生产数据显示其质量优于Claude Haiku 4.5和GPT-5.4 Mini,且比大型模型更高效。A/B测试表明用户参与度更高,token消耗更低。该模型适合简单迭代任务,未来将推出更大版本。
Opus 4.7是最新的编码模型,改进了模糊处理和代码审查能力,适合大多数编码任务。它在交互式编码中表现更好,建议用户提前明确任务以减少交互次数。新模型支持自适应思维,根据上下文决定思考深度,提升响应速度。
JetBrains发布了Mellum2,这是一个开源的12B参数编码模型,专注于AI系统的基础设施层。Mellum2支持更广泛的任务,如模型协调和子代理工作负载,采用混合专家架构以提升推理速度。该模型在代码生成任务中表现优异,但在广泛推理和知识评估方面略逊于其他模型。目前已在Hugging Face上发布,企业可选择自我托管。
文章讨论了人工智能领域的最新动态,包括Cursor发布的新编码模型Composer 2、OpenAI的应用程序合并,以及国会提出的特朗普美国AI法案。各大公司通过战略整合增强竞争力,AI工具成本迅速下降,但安全性和代码质量问题日益突出。法案旨在统一AI监管,要求开发者报告因AI导致的裁员,标志着AI行业规则的逐步建立。
Cursor公司发布了Composer 2,这是其第三代编码模型,性能超越Anthropic的Opus 4.6,成本更低。在Terminal-Bench 2.0基准测试中得分61.7%,尽管仍落后于OpenAI的GPT-5.4,但显示出Cursor迅速追赶的能力。Composer 2采用自我总结的训练技术,显著提高了长任务表现,减少了50%的压缩错误。
Cursor公司发布了Composer 2,这是其第三代编码模型,性能超越Anthropic的Opus 4.6,成本更低。在Terminal-Bench 2.0基准测试中得分61.7%,虽然仍落后于OpenAI的GPT-5.4(75.1%),但显示出快速追赶的潜力。Composer 2采用自我总结的训练技术,显著提高了长任务表现,减少了50%的压缩错误。
OpenAI推出的GPT-5.3-Codex模型是其最强大的编码模型,具备编码和推理能力,速度提升25%。该模型能够构建复杂的游戏和应用,理解用户意图,并处理网络安全任务。尽管在编码基准测试中表现优异,OpenAI强调其在实际应用中的进步,标志着向通用智能体的迈进。
GPT-5.3-Codex是最新的编码模型,性能提升25%,支持复杂任务和实时交互,表现优异,能够生成高质量代码和网页,覆盖软件开发全生命周期,并增强网络安全能力以防止滥用。
GPT-5.3-Codex是最新的编码模型,结合了GPT-5.2的编码性能和推理能力,能够处理复杂任务。该模型在生物学和网络安全领域表现出色,并已采取相应的安全措施。尽管尚无确凿证据证明其达到高能力阈值,但出于谨慎考虑,已启动保护措施。
英国警方因调查“非法动漫艺术作品”引发言论自由担忧。文章指出本地编码模型在成本和隐私上有优势,但无法完全替代云端服务。同时,传统日志在分布式系统中失效,需改进为结构化日志。微软被指强制推销Windows 11,剥夺用户选择。此外,文章探讨职业生涯设计的重要性,强调寻找生命意义以重建动力。Flock AI摄像头存在隐私风险,迪士尼发布新机器人奥拉夫。
GPT-5.2-Codex是最新的编码模型,优化了复杂软件工程,尤其在网络安全方面表现更佳。它在长时间任务、代码重构和迁移中表现突出,并更好地适应Windows环境。尽管网络能力尚未达到“高”水平,但其增强的安全功能和逐步部署策略旨在平衡可访问性与安全性。
今天发布的GPT-5.2-Codex是最先进的编码模型,优化了复杂软件工程能力,尤其在网络安全方面表现突出。它在长时间任务、代码重构和迁移中更为强大,特别适用于Windows环境。尽管网络能力尚未达到“高”水平,但未来的能力增长将被纳入部署考虑,以确保安全性与可及性并重。
GPT-5.2-Codex是最新的编码模型,优化了复杂软件工程,提升了长时间任务和Windows环境的性能,并增强了网络安全能力。该模型实施了全面的安全措施,针对有害任务进行训练和网络访问配置。尽管在网络安全领域表现良好,但能力尚未达到顶尖水平。
GPT-5.1-Codex-Max是新一代编码模型,具备更快、更智能和更高的令牌效率,适合长时间复杂任务,尤其在代码审查和开发中表现优异,提升开发者生产力,预计带来实际节省。
GPT-5.1-Codex-Max是新一代编码模型,专注于多任务处理,经过安全性培训,具备一定的网络安全能力,但尚未达到高水平。
Anthropic发布了Claude Sonnet 4.5,这是其最新的编码模型,显著提升了代理任务和计算机使用能力。该模型在安全性和训练方法上有显著改进,减少了谄媚和欺骗倾向,安全评分达到98.7%。用户反馈表明编码工作流显著提升,建议所有用户升级。
Anthropic推出Claude Sonnet 4.5,称其为“世界最佳编码模型”。新版本在指令执行和代码重构方面更可靠,得分显著提高。同时,Claude Code也更新,增加了VS Code扩展和实时修改功能。新实验“Imagine with Claude”展示了实时生成软件的能力,目前仅限Claude Max用户使用。
本文探讨了适合本地工作流程的编码大型语言模型(LLMs),如GLM-4、DeepSeekCoder V2和Qwen3-Coder。这些模型通过增强数据隐私和降低API成本,成为开发者的个人编码助手,支持代码生成、调试和推理等功能,帮助提高工作效率。
完成下面两步后,将自动完成登录并继续当前操作。