内容提要
OpenAI宣布推迟发布最强模型Astra,因其在网络安全评估中可能达到“关键”级别,存在被滥用于网络攻击的风险。公司已采取隔离测试、限制访问等安全措施,并与政府合作评估。此举被质疑为营销策略,类似Anthropic推迟Mythos的做法,用户反应冷淡,发布时间未定。
延伸解读
安全评估的“关键”门槛
OpenAI的Preparedness Framework将模型网络能力分为不同等级,此前包括GPT-5.6 Sol在内的模型均被评为“高”,而Astra可能触及“关键”级。该级别意味着模型能在无人干预下自主发现并利用针对加固系统的零日漏洞,或仅凭高层目标描述设计端到端攻击。这一评估基于内部测试和专家意见,但尚未最终确认,OpenAI仍在进行基准测试。
推迟发布与竞争策略的争议
OpenAI以安全为由推迟Astra发布,被外界质疑为营销策略,类似Anthropic推迟Mythos的做法。奥特曼曾批评后者为“恐惧营销”,如今OpenAI自身也采取类似行动。有观点认为,安全叙事可能成为前沿AI公司针对开源模型的竞争手段,通过渲染风险来限制开源对手的发展。用户对此反应冷淡,评论区质疑声居多。
安全措施与外部合作
为应对潜在风险,OpenAI已采取多项内部措施,包括隔离测试环境、限制网络和工具访问、增强模型权重保护、部署监测系统,并暂停未达安全标准的Astra活动。同时,OpenAI将与政府机构和AI安全组织合作进行外部能力测试,并向第三方测试伙伴提供安全控制指南。这些措施旨在确保模型在开放前得到充分评估。
Q&A
OpenAI为什么推迟发布Astra模型?
OpenAI推迟发布Astra是因为在内部评估中发现该模型在网络安全方面可能达到“关键”级别,存在被滥用于网络攻击的风险,因此需要更多时间确保安全。
Astra模型在网络安全评估中达到了什么级别?
Astra在网络安全评估中可能达到“关键”(Critical)级别,这是OpenAI Preparedness Framework中的最高风险等级,意味着模型可能自主开发针对关键系统的零日漏洞利用或设计新型网络攻击。
OpenAI针对Astra的安全风险采取了哪些措施?
OpenAI采取了多项措施,包括隔离测试环境、限制网络和工具访问、增强模型权重保护、部署监测系统、暂停未达标活动、在智能体应用中部署风险行为监控、与政府合作外部测试,并向第三方提供安全控制指南。
Astra模型在数学方面有什么突破?
Astra在数学领域一次性解决了10项长期未解的公开难题,涵盖高维几何、编码理论、群论、算子代数、量子复杂度和极值组合学等领域,被一些数学家称为“菲尔茨奖”级突破。
Astra与Hugging Face被攻击事件有关吗?
OpenAI官方澄清,Astra并未参与Hugging Face被攻击事件。尽管此前有猜测,但OpenAI明确否认了关联。
OpenAI推迟Astra发布与Anthropic推迟Mythos有何相似之处?
两者都以网络安全风险为由推迟发布,且都引发了外界对“安全威胁叙事”作为营销策略的质疑。OpenAI CEO奥特曼曾批评Anthropic的做法是“恐惧营销”,如今OpenAI自己也采取了类似策略。
业界对OpenAI推迟Astra发布有什么看法?
有观点认为,安全威胁叙事可能成为前沿AI公司针对开源模型的竞争策略,通过渲染风险来限制开源对手。用户对此并不买账,评论区质疑声居多。黄仁勋也指出,对开源模型的攻击大多是无稽之谈,公开发布更有利于安全。
Astra模型什么时候发布?
OpenAI尚未给出Astra的具体发布时间,奥特曼表示正在努力让模型向所有用户开放,但未提供时间表。