OpenAI Astra 因网络安全风险被评Critical级别,发布延缓

核心看点

  • OpenAI Astra 在网络安全评估中达到首个Critical级别
  • 模型可能具备自主执行高级网络攻击的能力
  • OpenAI 暂停部分内部开发,优先将能力交给防御者
  • Sam Altman 表态:模型非常强大,但不会无限期拖延发布

详细解析

1. 史无前例:Astra 触发首个Critical安全评级

OpenAI 官方确认,其即将推出的前沿模型 Astra 在网络安全评估中达到了公司 Preparedness Framework 中的首个 Critical级别

这是什么概念?此前所有模型(包括 GPT-5.6 Sol)最高仅达到High级别。Critical 意味着无法排除 Astra 具备自主进行高级网络攻击的能力——比如在没有人工干预的情况下,识别并利用真实系统中的零日漏洞、规划并执行端到端攻击策略。

2. OpenAI 罕见踩刹车

面对这一评估结果,OpenAI 采取了罕见的主动放缓措施:

  • 暂停 Astra 涉及高风险活动的内部开发
  • 限制工具和网络访问权限
  • 增强权重保护
  • 全链路监控(尤其是思维链 chain-of-thought)
  • 与政府机构和外部安全组织合作

OpenAI 表示,这是计划中的情景,将把 Astra 的先进网络能力优先交给防御者(defenders)使用,而非攻击者。

3. Sam Altman 的表态

OpenAI CEO Sam Altman 表示,Astra 是非常强大的模型,公司正在努力使其广泛可用,而非仅限少数人使用。他强调不会因为模型强大就无限期拖延发布

这一表态既显示了 OpenAI 对安全性的重视,也表明他们仍在积极推进模型的公开发布。

4. Astra 的能力有多强?

据此前披露的信息,Astra 是 OpenAI 自 GPT-4.5 以来最大规模的新预训练模型

  • 在数学和理论计算机科学领域取得10项重大突破
  • 涉及球体 packing、编码理论、群论、量子复杂性、格密码学等前沿领域
  • 能自主进行形式化证明(Lean 证书)
  • 展现出长期多代理任务和原创研究能力
  • 总 token 成本约 2000 美元(按 Sol API 费率计算)

5. 发布预期

此前预测市场(Polymarket 等)认为 Astra 在8月底前发布的概率约72%。但当前因安全评估,发布节奏明显放缓。Astra 可能以 GPT-6 或 GPT-5.7 的形式发布,也可能作为独立模型家族(与 Sol、Terra、Luna 并列)。

总结

Astra 是 OpenAI 首次因能力阈值(而非单纯工程问题)主动放缓前沿模型开发的案例。这凸显了 agentic AI 系统在双用(攻防)场景下的风险管理挑战。行业普遍认为这可能成为新常态:能力越强,安全摩擦越大

对于AI行业来说,这是一个里程碑时刻——它标志着前沿AI模型的能力已经开始触及真正的安全红线。

数据来源:IT之家、TechCrunch、OpenAI官方公告、X平台公开讨论

本文地址:https://www.163264.com/14764

(0)
上一篇 14小时前
下一篇 14小时前

相关推荐