OpenAI暂缓Astra模型全面开放,因网络安全能力达到"Critical"级别
OpenAI暂缓Astra模型全面开放,因网络安全能力达到"Critical"级别
OpenAI于8月7日宣布暂缓Astra模型全面开放,内部评估显示该模型在Agent编程和网络安全能力上有明显进步,可能达到其Preparedness Framework定义的Critical级别。
事件概述
2026年8月7日,OpenAI官方宣布,暂缓让具备更强网络安全能力的Astra模型全面开放。内部安全评估显示,这款尚未发布的新模型在Agent编程和网络安全领域取得显著进步,暂时不能排除达到其Preparedness Framework所定义的"Critical"网络安全能力级别。
关键要点
- 安全评估收紧:OpenAI决定收紧Astra的测试环境、网络与工具权限、权重保护和监控措施
- Critical能力定义:官方定义的Critical门槛包括模型能在许多真实加固系统中独立发现并开发各级别零日漏洞,或仅凭高层目标完成新型网络攻击
- 能力显著提升:Astra在Agent编程和网络安全方面相比前代模型有明显进步
- 负责任AI原则:此次暂缓开放体现了OpenAI在AI安全治理方面的谨慎态度
官方声明
OpenAI表示,在确保模型安全可控之前,不会向公众全面开放Astra。公司将继续进行严格的安全测试和评估,与外部安全研究人员合作,确保AI技术的发展不会带来不可控的网络安全风险。
这一决定再次引发了行业对前沿AI模型安全治理的讨论,如何在技术快速迭代的同时确保安全可控,成为全行业共同面临的课题。