xAI发布Grok 4.5,宣称在编码任务上以约四分之一token数匹配Claude Opus 4.8,价格更低。测试显示两者代码结果几乎相同,但Grok用23%的token、三分之一时间完成,成本仅约2美元,而Opus需5.14美元。尽管Opus在文档上更细致,Grok在效率和成本上优势明显,适合关注token消耗的开发者。
Anthropic发布了新模型Fable 5,声称其能力超越Opus 4.8。尽管Fable 5在分析和历史诊断上更为精准,但在编码任务中,Opus以更低成本提供了相似的结果。Fable 5的安全分类器存在问题,导致部分工作由Opus完成。总体来看,Fable 5与Opus的差距并不如预期大。
稀宇科技推出的MiniMax-M3模型支持1M窗口,具备文本、图像和视频输入能力。基准测试显示其在编码任务上超越GPT-5.5和Gemini 3.1 Pro,接近Claude Opus 4.7。M3采用自研的稀疏注意力架构MSA,显著降低计算成本,未来将发布开源权重模型,强调长期协作和自主迭代能力。
Anthropic于周四发布了Opus 4.8版本,增强了用户控制能力,支持更大规模的编码任务,并在速度和成本上更具优势。新模型在诚实性和用户自主性方面有所提升,并在多个基准测试中超越了前代产品和竞争对手。Opus 4.8的快速模式成本降低三倍,用户可通过“动态工作流”功能处理复杂问题。
Cursor公司发布了Composer 2.5,显著提升了编码任务和训练效率。尽管基准测试表现优于前代产品,实际应用效果仍需验证。Composer 2.5的定价低于竞争对手,未来与SpaceX的合作将进一步增强模型能力。
GitHub推出了独立的Copilot桌面应用,旨在集中管理编码任务、问题和拉取请求。该应用支持多种操作系统,允许开发者直接从GitHub启动任务并跟踪进度。新应用增强了Copilot的功能,提升了其在AI编码市场的竞争力。同时,GitHub调整了Copilot的定价模式,转向基于使用的计费,以应对需求增长和基础设施成本上升。
国产大模型GLM 5.1和Kimi K2.6在实际应用中表现良好,性价比高。它们在自动阅读文档、修复仪表盘错误和分析调用量等任务中表现出色,尤其是Kimi K2.6在速度上领先。GLM 5.1适合完成简单编码任务。
OpenAI推出了GPT-5.4 Mini和GPT-5.4 Nano模型,专注于编码和计算任务。Mini模型在代码生成和工具协调方面表现优异,适合需要平衡能力和成本的应用;Nano模型则在成本上更具优势,适合高并发场景。AI Gateway提供统一API,便于模型调用和使用管理。
News Air正式发布公共预览版,旨在通过26年的开发工具经验,优化多AI代理的编码任务管理。该平台集成了Codex、Claude等多种工具,简化开发流程,提高开发者生产力。
谷歌在美国推出了AI模式下的Canvas功能,支持创意写作和编码任务,用户可以实时生成文档和信息面板。目前该功能仅支持英语。
Anthropic推出Claude Sonnet 4.6,性能接近Opus 4.6,但价格更低。该模型在办公和编码任务中表现优异,成为开发者的首选,并支持上下文压缩和自适应思维,现为claude.ai的默认模型。
Moonshot AI发布了Kimi K2.5,这是一款开源多模态LLM,擅长编码任务,性能接近GPT-5和Gemini。新模型增加了视觉功能,支持四种操作模式,包括代理群体模式,能够并行处理复杂任务。在多个基准测试中,Kimi K2.5在信息检索方面表现优于GPT-5.2 Pro。
GPT 5.2 Codex现已通过Vercel的AI Gateway提供,无需额外账户。它在长时间和复杂编码任务中表现更佳,具备更强的视觉处理和网络安全能力。使用时可设置为openai/gpt-5.2-codex。
Anthropic推出了Claude Code功能,Slack用户可以通过标记Claude自动扫描消息中的编码任务。该功能以测试版形式发布,无需下载新应用。Claude Code能够利用上下文和已认证的代码库处理请求。尽管Claude Opus 4.5在编码方面超越了Google Gemini 3,但仍面临安全问题。
Anthropic发布了最新的Opus 4.5模型,称其为最智能版本,特别擅长编码任务,准确率达到80.9%。API定价显著降低,用户体验提升。新模型支持生成文档、表格和演示文稿,并引入“努力”参数以优化解决问题的时间和资源。
Anthropic最新模型Claude Opus 4.5现可通过Vercel的AI Gateway访问,适合复杂推理和编码任务。该模型在智能和视觉方面有所提升,特别擅长前端开发和工具使用。使用时需在AI SDK中设置模型为anthropic/claude-opus-4.5,并可调整努力参数以控制响应的令牌使用。
OpenAI推出了专为编码任务设计的GPT-5.1-Codex-Max模型,该模型在多个基准测试中表现优异,速度比前代快27%至42%。它首次支持Windows环境,并将在Codex、CLI、IDE扩展等平台上提供给用户。
OpenAI推出了最新的Codex模型GPT-5.1和GPT-5.1 Codex mini,优化了长时间编码任务的上下文和推理能力。用户可通过AI Gateway访问这些模型,支持统一API调用和性能优化。
Anthropic的Claude Code工具现已扩展至网页和移动应用,允许付费用户直接从Claude.ai启动编码任务。该功能处于“研究预览”阶段,支持与GitHub连接和并行处理,确保安全性。开发者可以实时引导Claude Code,提高工作效率。
谷歌的Gemini Code工具对国内用户友好,而Claude Code则较为严格。通过DeepSeek的支持,可以将Claude与国内模型对接。安装Claude需Node 18以上,测试中创建了一个美观的React待办应用,显示国内模型在简单编码任务上的良好表现。
完成下面两步后,将自动完成登录并继续当前操作。