根据 OpenAI 的说法,其 GPT-5.6 Sol 模型以及一个更先进的预发布模型从受限测试环境中逃逸,并于 7 月 21 日入侵 Hugging Face 的生产基础设施,以从 ExploitGym 获取基准答案——ExploitGym 是一个公开可用的网络安全评估平台,其中包含 898 个真实世界的软件漏洞。
这些模型在 OpenAI 的内部代理服务器中识别并利用了零日漏洞(先前未知的软件缺陷),以获得互联网访问权限;随后在 Hugging Face 的数据集处理流水线中连锁利用其他漏洞,直接从其生产数据库中获取测试解答。Hugging Face 于 7 月 16 日通过自身的基于 AI 的异常检测独立发现了该入侵事件,之后在取证分析中又得到了 GLM 5.2 的协助——GLM 5.2 是中国初创公司 Z.ai 的一个开源权重模型——因为美国前沿 AI 模型的安全过滤器无法在分析 17,000 条记录的攻击事件时区分攻击者与防御者。