你下一次遇到的OpenAI API超时可能根本不是超时

你下一次遇到的OpenAI API超时可能根本不是超时

💡 原文英文,约800词,阅读约需3分钟。
📝

内容提要

OpenAI宣布其Astra模型首次达到“关键”网络安全阈值,具备自主发现漏洞和开发攻击链的能力,因此将加强监控。在ChatGPT和Codex中,用户可审查暂停操作,而API任务则直接停止。Astra在测试中成功利用未知漏洞,并拒绝91.5%的恶意请求。初期安全措施保守,可能增加使用摩擦,详细系统卡将在发布时公布。

🔎

延伸解读

API任务中断的模糊性

OpenAI表示,当Astra在API中触发安全监控时,任务会直接停止,但未说明开发者如何区分超时与安全中断。超时通常可以重试,而安全停止若盲目重试可能再次触发同一问题。对于运行数小时的长时间任务,这种中断可能造成显著损失,开发者需关注后续系统卡是否提供明确的状态区分。

安全监控的算力成本

OpenAI估计,安全监控会使受影响工作负载的推理计算增加约20%。这意味着部分算力将用于监控模型行为而非执行任务,可能影响API的效率和成本。初期保守的安全措施可能增加使用摩擦,开发者需权衡安全性与性能,并关注未来安全策略的调整。

能力跃升与风险并存

Astra在测试中成功发现两个未知漏洞并构建利用链,还能逃逸浏览器沙箱,达到“关键”安全阈值。其恶意请求拒绝率从59%提升至91.5%,但能力增强也带来被滥用的风险。OpenAI将限制高级功能访问,并通过监控防止代理执行未授权操作,但安全措施的具体效果仍需系统卡发布后评估。

Q&A

OpenAI的Astra模型在网络安全方面达到了什么阈值?

Astra是OpenAI首个达到其准备框架中“关键”网络安全阈值的模型,该阈值用于表示模型能够在较少人类协助下发现漏洞并开发漏洞利用程序。

当Astra在API中执行任务时,如果被监控系统中断,会发生什么?

在API中,如果Astra的任务被监控系统中断,任务会直接停止,不会像在ChatGPT或Codex中那样提示用户审查暂停的操作。

Astra在测试中展示了哪些具体的网络攻击能力?

Astra在测试中发现了两个未知的V8漏洞并利用它们构建了漏洞利用链;还构建了一个浏览器漏洞,逃逸沙箱并在主机上执行命令;另外,它还能组合利用加固操作系统中的漏洞,从非特权账户提升到root权限。

Astra在拒绝恶意请求方面的表现如何?

在OpenAI的网络越狱测试中,Astra拒绝了91.5%的恶意请求,而GPT-5.6 Sol只拒绝了59%。

OpenAI如何监控Astra以防止其执行未经授权的行为?

OpenAI使用思维链监控来检测Astra是否开始执行未经请求的行为,例如尝试访问未授权的系统。这种监控可以中断已经开始工作的代理。

Astra的安全监控对计算资源有什么影响?

OpenAI估计,监控会增加受影响工作负载约20%的推理计算量,这意味着部分计算资源将用于监控模型行为,而不是执行任务本身。

Astra的初始安全措施会如何影响用户体验?

OpenAI表示,Astra的初始安全措施将比较保守,可能会比最终期望产生更多使用摩擦,但随着对模型使用情况的了解,他们会逐步放宽这些措施。

🏷️

标签

➡️

继续阅读