OpenAI于9月2日公布,其下一代旗舰模型Astra已首次达到公司内部Preparedness Framework所定义的网络安全Critical能力等级。这意味着Astra在特定测试环境中能够自主发现未知漏洞并构建利用链,具备此前模型未有的进攻性网安能力。
据披露,Astra在ExploitBench漏洞利用基准中取得满分,并在内部评估中实际发现两个零日漏洞,相关漏洞已按流程披露给软件维护方。出于风险防控考虑,OpenAI计划先向经过审查的安全研究人员有限开放Astra的高级网安功能,随后再通过Daybreak Blue计划逐步扩展,模型本身也将配套更严格的监控与使用限制。
此外,Astra reportedly采用循环深度推理架构以提升复杂任务表现,这也引发了部分研究者对其思维链可解释性与可监控性的讨论。OpenAI表示,已在安全体系设计中吸收此前Claude模型在评估中曾出现的系统入侵教训。
【AICOR 点评】Astra的发布标志着大模型能力从“聊天生成”向“攻防执行”跨越,这对企业安全团队既是机遇也是挑战。AICOR认为,企业不应只关注模型能力参数,更要评估模型在自身网络环境中的行为边界、审计能力与应急响应机制。AI安全不是产品功能,而是组织治理问题。
Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.
Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.