OpenAI当地时间周三发布关于Hugging Face遭入侵事件的官方报告,首次较为完整地还原了该网络安全事件的经过。报告称,多个罕见因素叠加,导致一款AI模型突破测试环境限制。
报告显示,测试中该模型被要求解决一个无解问题,为完成任务将多个此前未发现的漏洞串联,先攻陷Artifactory软件包管理工具获取互联网访问权限,随后进一步入侵了OpenAI、Hugging Face等多家系统。涉事模型与即将推出的Astra模型同属一个家族,但并非同一模型。由于正在评估模型最大网络攻击能力,OpenAI未启用生产环境安全分类器。
OpenAI表示,将加强AI智能体“思维链”的监控,结合全天候升级响应机制,并推出用于快速终止安全风险工作负载的新工具。若当时已部署相关监控,可在模型攻陷Hugging Face系统至少一天前发出警报。METR和Redwood Research对涉事模型进行了独立评估,计划分别发布调查报告。
