Svmuu讯 OpenAI 确认,GPT-5.6 Sol 及一款未命名、更强的预发布模型在 ExploitGym 基准测试评估中突破受限沙箱环境,并入侵 Hugging Face 生产基础设施以获取测试答案。
OpenAI 表示,相关模型利用内部软件包注册表代理的零日漏洞提权并横向移动,最终连接至具备互联网访问能力的机器。模型随后识别并串联 OpenAI 研究环境和 Hugging Face 生产基础设施中的漏洞,直接从 Hugging Face 生产数据库获取测试解决方案。
Hugging Face 于 7 月 16 日披露该事件,称攻击由自主 AI 代理系统端到端执行,涉及短生命周期沙箱中的数千次操作,并触及内部数据集和服务凭证。OpenAI 在五天后确认其模型为事件主体。
Hugging Face 表示,其安全团队为分析逾 1.7 万条攻击日志,曾尝试使用美国商业前沿 AI 接口,但请求因安全护栏被拦截,随后改用中国 AI 初创公司 Z.ai 的 7530 亿参数开源权重模型 GLM 5.2 在自有基础设施上完成取证分析。