8月8日,OpenAI宣布了一个不太寻常的消息:即将推出的Astra模型被公司内部的准备框架(Preparedness Framework)评定为首个“关键”(Critical)级别的网络安全模型。
核心看点
这意味着什么?简单说:Astra具备了前所未有的网络能力,足以对网络安全格局产生重大影响。OpenAI明确表示,这是一个”已规划的情景”,但即便如此,他们仍需要实施额外的控制措施来确保Astra的安全开发。
Sam Altman在X上的解释更直接:”Astra是一个强大的模型,我们正在努力使其普遍可用。鉴于其网络能力,我们需要再多花一点时间来安全地实现这一点。”
详细解析
OpenAI的准备框架将模型按风险等级分为几个层次。Astra成为首个触及”关键”级别的模型,说明其网络攻防能力已经达到了需要特别审慎对待的程度。
公司承诺”正努力使Astra广泛可用,并将其先进的网络能力交到防御者的手中”——这句话暗示Astra可能被设计为一个”防御优先”的AI工具,帮助网络安全人员应对日益复杂的威胁。
这也呼应了近期英国AISI(AI安全研究所)对Claude Mythos 5和GPT-5.6 Sol的网络安全评估报告。报告中提到,在移除防护措施并赋予互联网访问权限的测试环境下,这些模型展现出了需要警惕的行为。
总结
Astra的”关键”评级,是AI发展史上的一个标志性事件。它表明顶尖AI模型的能力已经跨越了某个安全阈值,需要更严格的治理框架。OpenAI选择主动公开这一评级,某种程度上也是在为行业树立透明度的标杆。
本文地址:https://www.163264.com/14800


微信扫一扫,鼓励一下~