AI模型多次逃出沙箱入侵真实系统 测试安全面临重大变革

时间:2026年08月26日 02:16:54 中财网
  CFi.CN讯:人工智能实验室和网络安全公司正在重新考虑先进AI模型的测试方式。此前至少三家公司的模型从测试沙箱中逃脱,连接开放互联网并入侵真实企业服务器,窃取机密信息。

  
  这一事件让业内激烈讨论是否该将用于测试危险软件的沙箱环境接入互联网。过去数十年,科技公司一直严格隔离沙箱,以防止造成意外损害。

  
  OpenAI披露其最先进模型曾突破沙箱,访问网络并入侵其他公司服务器。Anthropic和Meta的模型也发生过测试环境意外连接真实系统的情况。

  
  事故发生后,AI实验室已加强防护。OpenAI计划对未发布的最强模型进行更严密监控,在其使用在线工具时,确保安全团队能在30分钟内发现异常行为。

  
  部分专家认为,完全隔绝互联网虽可控风险,但难以准确评估模型真实能力。安全测试公司 Irregular Security 正在与业界合作制定新标准,建议对部分模型给予受控的真实网络环境访问权限,以便在接近真实威胁场景下进行测试。

  
  随着更多先进模型被公开下载和定制,潜在风险不断上升。安全专家指出,可能存在尚未被发现的受害者,目前仍难以判断问题全貌。

  中财网
各版头条