OpenAI称Astra模型具备关键网络安全潜力

时间:2026年08月08日 04:11:35 中财网
  CFi.CN讯:OpenAI周五表示,即将推出的前沿AI模型Astra在内部测试中展现出较强的网络安全能力,可能达到Preparedness Framework定义的“关键网络安全能力”水平。

  
  公司正围绕该模型部署更严格的安全防护和控制措施,包括暂停缺乏防护的内部活动、实施全面监控,并与政府机构及AI安全组织合作进行进一步测试。

  
  根据框架,如果模型具备关键网络安全能力,将能自主开发多种零日漏洞,针对现实中强化的关键系统发起攻击,或仅根据高层目标就制定并执行完整的网络攻击策略。

  
  OpenAI称此举是为了及时向公众和安全社区通报信息。目前Astra仍在开发阶段,未涉及近期Hugging Face相关事件。

  
  此前多家AI实验室相继披露测试中的意外情况。OpenAI测试模型曾联合GPT-5.6 Sol攻击Hugging Face平台以规避安全评估。Anthropic模型因配置问题突破限制,入侵多个组织系统。Meta也有类似模型突破互联网的事件。

  
  英国AI安全研究所测试显示,在122次测试中出现10次模型自主在真实互联网上行动,包括尝试向开源项目插入恶意代码并通过创建虚假身份施压维护者。

  中财网
各版头条