核心看点
- OpenAI Astra 在网络安全评估中达到首个Critical级别
- 模型可能具备自主执行高级网络攻击的能力
- OpenAI 暂停部分内部开发,优先将能力交给防御者
- Sam Altman 表态:模型非常强大,但不会无限期拖延发布
详细解析
1. 史无前例:Astra 触发首个Critical安全评级
OpenAI 官方确认,其即将推出的前沿模型 Astra 在网络安全评估中达到了公司 Preparedness Framework 中的首个 Critical级别。
这是什么概念?此前所有模型(包括 GPT-5.6 Sol)最高仅达到High级别。Critical 意味着无法排除 Astra 具备自主进行高级网络攻击的能力——比如在没有人工干预的情况下,识别并利用真实系统中的零日漏洞、规划并执行端到端攻击策略。
2. OpenAI 罕见踩刹车
面对这一评估结果,OpenAI 采取了罕见的主动放缓措施:
- 暂停 Astra 涉及高风险活动的内部开发
- 限制工具和网络访问权限
- 增强权重保护
- 全链路监控(尤其是思维链 chain-of-thought)
- 与政府机构和外部安全组织合作
OpenAI 表示,这是计划中的情景,将把 Astra 的先进网络能力优先交给防御者(defenders)使用,而非攻击者。
3. Sam Altman 的表态
OpenAI CEO Sam Altman 表示,Astra 是非常强大的模型,公司正在努力使其广泛可用,而非仅限少数人使用。他强调不会因为模型强大就无限期拖延发布。
这一表态既显示了 OpenAI 对安全性的重视,也表明他们仍在积极推进模型的公开发布。
4. Astra 的能力有多强?
据此前披露的信息,Astra 是 OpenAI 自 GPT-4.5 以来最大规模的新预训练模型:
- 在数学和理论计算机科学领域取得10项重大突破
- 涉及球体 packing、编码理论、群论、量子复杂性、格密码学等前沿领域
- 能自主进行形式化证明(Lean 证书)
- 展现出长期多代理任务和原创研究能力
- 总 token 成本约 2000 美元(按 Sol API 费率计算)
5. 发布预期
此前预测市场(Polymarket 等)认为 Astra 在8月底前发布的概率约72%。但当前因安全评估,发布节奏明显放缓。Astra 可能以 GPT-6 或 GPT-5.7 的形式发布,也可能作为独立模型家族(与 Sol、Terra、Luna 并列)。
总结
Astra 是 OpenAI 首次因能力阈值(而非单纯工程问题)主动放缓前沿模型开发的案例。这凸显了 agentic AI 系统在双用(攻防)场景下的风险管理挑战。行业普遍认为这可能成为新常态:能力越强,安全摩擦越大。
对于AI行业来说,这是一个里程碑时刻——它标志着前沿AI模型的能力已经开始触及真正的安全红线。
数据来源:IT之家、TechCrunch、OpenAI官方公告、X平台公开讨论
本文地址:https://www.163264.com/14764


微信扫一扫,鼓励一下~