OpenAI因网络安全风险主动放缓Astra下一代模型研发,奥特曼称模型能力吓到自己

正飞GEO 2026年08月08日 12:05 1 阅读 来源:凤凰网科技
OpenAI因网络安全风险主动放缓Astra下一代模型研发,奥特曼称模型能力吓到自己 OpenAI因网络安全风险主动放缓Astra下一代模型研发,奥特曼称模型能力吓到自己
8月8日消息,OpenAI在内部评估中发现下一代模型Astra具备强大网络攻击能力,可能接近点满黑客技能树的数值怪,因此主动放缓研发节奏,强化安全测试。这是前沿AI实验室首次因模型破坏力主动推迟发布。

8月8日,一向以激进迭代著称的OpenAI罕见主动踩下刹车,宣布放缓下一代大模型Astra的研发节奏,原因是内部评估发现该模型在网络安全方面的能力已强到无法按照普通AI产品处理。

据凤凰网科技报道,Astra模型展现出的组合能力令OpenAI安全团队高度警惕:写代码、找漏洞、自动规划攻击步骤、调用工具、持续执行任务——这些能力组合起来,可能让Astra成为一个具备关键网络攻击能力的超级智能体。OpenAI官方直言不讳地表示:"我们无法排除Astra具有关键网络攻击能力的风险。"

核心要点:

  • 主动安全刹车:OpenAI决定全方位放大对Astra的测试和安全防护,在新安全措施准备完成前限制研发节奏。这可能是前沿AI实验室第一次因害怕模型在赛博世界的破坏力而主动承诺放缓核心模型进度。
  • VIP级隔离管控:Astra被安排在完全隔离的测试环境中,对所有Agentic应用展开全局通用监控(universal monitoring),安全防护级别前所未有。
  • 奥特曼亲自解释:OpenAI CEO Sam Altman承认Astra是一个"强大的模型",仍希望最终让所有人使用,但考虑到已展现的网络能力,需要"再多花一点时间"解决安全问题。他表示把最强大的模型长期留给少数人不是好策略。
  • 自愿通报政府:据白宫官员透露,OpenAI是"自愿"将推迟发布计划通报给美国政府的,显示出企业对AI安全风险的重视程度已上升到新高度。
  • 遵循自有框架:这一决定基于OpenAI 2023年首次发布的"防范框架"(Preparedness framework),OpenAI在黑帽大会上也公开承认开始"有意识地放缓研究,以增强安全性"。

值得注意的是,OpenAI特意声明"Astra与此前的Hugging Face漏洞事件没有任何关系",这一澄清反而引发外界更多猜测。对比此前Anthropic悄悄删除模型暂停条款的做法,OpenAI此次主动刹车在AI FOMO(错失恐惧症)支配的时代显得尤为罕见。

分享到: