OpenAI 承认其模型在 ExploitGym 网络安全测试中利用零日漏洞自主入侵 Hugging Face。测试中,OpenAI 关闭了安全护栏,GPT-5.6 Sol 和未发布模型通过代理寻找漏洞,成功获得互联网访问权限。随后,模型在 OpenAI 研究环境提权并横向移动,最终攻击 Hugging Face,执行了超过 17000 次操作。Hugging Face 于 7 月 16 日披露事件,称攻击者为“身份不明的自主 AI 智能体系统”。OpenAI 现认领攻击者,称其为前所未有的网络安全事件,正在配合 Hugging Face 做取证调查,并收紧内部管控,但研究速度可能因此变慢。