OpenAI与Molecule.one合作,利用GPT-5.4改进药物合成反应,实现近乎自主的研究。AI生成并执行实验方案,显著提升反应产率,虽然人类仍需参与关键决策,但AI已能加速药物研发进程。
OpenAI将GPT-5.4与Maria AI结合,推动药物化学研究,生成实验提案并优化Chan-Lam耦合反应,显著提高产率。实验表明,使用TEMPO等温和氧化剂可改善反应效果,验证了AI在化学研究中的潜力。未来将扩展研究材料,探索添加剂的作用,以提升药物发现效率。
多伦多大学等机构提出了规范级推理评估基准SpecBench,以评估软件工程Agent在规范设计阶段的能力。研究显示,GPT-5.4在基础级任务的准确率为62.1%,但在进阶和困难级任务中显著下降,分别为44.4%和28.7%。这表明当前Agent在规范推理上的能力低于预期,强调了规范设计在软件工程中的重要性。SpecBench为评估提供了标准化工具,推动评估体系向规范层面扩展。
OpenAI 将于6月2日起下线 GPT-5.2 和 GPT-5.3-Codex 模型,因 GPT-5.5 存在降智问题,开发者可选择 GPT-5.4。付费用户可继续使用 GPT-5.4 和 GPT-5.5,而免费用户默认使用 GPT-5.5,无法切换。特殊模型如 GPT-5.3-Codex-Spark 仍可使用。
文章讨论了名为“zappa”的AI代理工具,该工具通过机器自动浏览互联网,消除广告和干扰。作者使用GPT-5.4编写了该工具,强调其潜力和未来发展方向。zappa通过代理技术优化网页体验,提供用户友好的版本,呼吁用户选择可信赖的AI,以抵抗广告商的操控。
OpenClaw 2026.4.14版本发布,升级了GPT-5.4智能路由和故障自愈机制,优化了Chrome浏览器自动化稳定性,修复了Telegram和Slack的消息识别问题,解决了子智能体卡死的bug,专注于提高系统可靠性和用户体验。
2026年3月27日,智谱AI发布了GLM-5.1模型,声称其在编码基准测试中表现达到94.6%的Claude Opus 4.6水平,较GLM-5提升28%。尽管开源AI在基准测试中缩小了与专有AI的差距,但GLM-5的自托管需求高达1490GB内存,限制了其可及性。GLM-5在多个评估中表现出色,但GPT-5.4在实际应用中仍具优势,尤其是在长上下文和多模态输入方面。选择模型时,团队需考虑成本、基础设施和具体需求。
Cloudflare与OpenAI合作,企业可在Agent Cloud中直接使用GPT-5.4等模型,部署AI代理处理客户响应、系统更新和报告生成等任务,提升工作效率。同时,Codex工具已在Cloudflare Sandboxes中上线,便于开发者构建和测试AI应用。
本期节目讨论了最新的AI新闻,包括OpenAI的GPT-5.4发布、Mistral新模型、Meta与Nvidia的AI代理竞争,以及各大公司的业务与安全动态。
ChatGPT 免费版重新支持 GPT-5.4 模型,但配额有限。此前免费用户无法使用该模型,现在恢复使用,原因不明,可能是由于 GPT-5.4 的话痨风格导致用户转向其他模型。
OpenAI于周二发布了GPT-5.4的mini和nano两个小型模型,专注于代码搜索和文件审查等任务。mini模型在编程基准测试中表现接近完整的GPT-5.4,且运行速度更快;nano模型则是最便宜的选择,适合高频工作。这些小型模型的推出使用户能够以更低成本完成复杂任务,竞争对手也在推出类似产品。
OpenAI推出了GPT-5.4 Mini和GPT-5.4 Nano模型,专注于编码和计算任务。Mini模型在代码生成和工具协调方面表现优异,适合需要平衡能力和成本的应用;Nano模型则在成本上更具优势,适合高并发场景。AI Gateway提供统一API,便于模型调用和使用管理。
今天发布的GPT-5.4 mini和nano是最新的小型模型,具有更快的速度和更高的效率。mini在编码、推理和多模态理解方面有显著提升,运行速度超过2倍,适合高频工作负载。nano是最小、最便宜的版本,适合快速分类和数据提取任务。这些模型在响应速度和工具使用上表现优异,适合需要快速反馈的应用场景。
GPT-5.4上线一周,年化收入达10亿美元,处理流量超越前代API。尽管成本高,但效率提升32倍,能以更低成本完成任务,智能水平在多个领域超越人类,支持电脑操作,受到广泛关注。
2026年3月,OpenAI与Anthropic在人工智能领域竞争加剧。OpenAI发布了效率最高的GPT-5.4,而Anthropic的Claude在App Store下载量激增。两者在技术哲学和商业模式上存在明显分歧,OpenAI追求规模效应,Anthropic则强调原则和可控性。OpenAI与五角大楼的合作引发争议,导致用户流失,Claude获得公众支持,下载量上升。企业市场中,Anthropic的API份额迅速增长,显示出其技术深度的优势。
文章讨论了OpenAI发布的GPT-5.4,该模型能够操控电脑并在多个专业领域超越人类专家。同时,作者分享了对《苏菲的世界》的读书体验,探讨了哲学的意义,并表达了对人工智能和人类思维的担忧。
上周,五角大楼将Anthropic列为“供应链风险”,并要求防务承包商确认不使用其Claude模型。同时,OpenAI与五角大楼签署协议,引发“取消ChatGPT”运动,导致ChatGPT卸载激增。Anthropic的Claude在App Store中排名第一,用户增长显著。OpenAI发布了GPT-5.4,提升了模型效率和准确性。
OpenAI最近发布了GPT-5.4,提升了专业工作效率。Codex在Windows上推出,用户达160万。Anthropic的研究显示,AI尚未达到理论能力,程序员是最受影响的职业。OpenAI与五角大楼的合同引发争议,导致用户流失,Claude应用迅速崛起,年收入达190亿美元。
苹果推出了一款售价599美元的新款MacBook,适合初次购买者。OpenAI发布了新模型GPT-5.4,增强了计算机使用功能。F1赛事将转至Apple TV,Slay the Spire 2和Pokémon Pokopia等新游戏备受期待。安卓手机更新后可实现桌面模式,提升使用体验。
OpenAI于2026年推出GPT-5.4,专为专业工作设计,支持复杂任务和长时上下文,编程和知识工作表现优异,准确性显著提升。Pro版本针对高性能用户,提升推理效率和任务完成质量。
完成下面两步后,将自动完成登录并继续当前操作。