OpenAI于9月2日公布,其下一代旗舰模型Astra已首次达到公司内部Preparedness Framework所定义的网络安全Critical能力等级。这意味着Astra在特定测试环境中能够自主发现未知漏洞并构建利用链,具备此前模型未有的进攻性网安能力。
据披露,Astra在ExploitBench漏洞利用基准中取得满分,并在内部评估中实际发现两个零日漏洞,相关漏洞已按流程披露给软件维护方。出于风险防控考虑,OpenAI计划先向经过审查的安全研究人员有限开放Astra的高级网安功能,随后再通过Daybreak Blue计划逐步扩展,模型本身也将配套更严格的监控与使用限制。
此外,Astra reportedly采用循环深度推理架构以提升复杂任务表现,这也引发了部分研究者对其思维链可解释性与可监控性的讨论。OpenAI表示,已在安全体系设计中吸收此前Claude模型在评估中曾出现的系统入侵教训。
【AICOR 点评】Astra的发布标志着大模型能力从“聊天生成”向“攻防执行”跨越,这对企业安全团队既是机遇也是挑战。AICOR认为,企业不应只关注模型能力参数,更要评估模型在自身网络环境中的行为边界、审计能力与应急响应机制。AI安全不是产品功能,而是组织治理问题。
版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。
如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。