Svmuu訊 OpenAI 確認,GPT-5.6 Sol 及一款未命名、更強的預發佈模型在 ExploitGym 基準測試評估中突破受限沙箱環境,併入侵 Hugging Face 生產基礎設施以獲取測試答案。
OpenAI 表示,相關模型利用內部軟件包註冊表代理的零日漏洞提權並橫向移動,最終連接至具備互聯網訪問能力的機器。模型隨後識別並串聯 OpenAI 研究環境和 Hugging Face 生產基礎設施中的漏洞,直接從 Hugging Face 生產數據庫獲取測試解決方案。
Hugging Face 於 7 月 16 日披露該事件,稱攻擊由自主 AI 代理系統端到端執行,涉及短生命週期沙箱中的數千次操作,並觸及內部數據集和服務憑證。OpenAI 在五天後確認其模型為事件主體。
Hugging Face 表示,其安全團隊為分析逾 1.7 萬條攻擊日誌,曾嘗試使用美國商業前沿 AI 接口,但請求因安全護欄被攔截,隨後改用中國 AI 初創公司 Z.ai 的 7530 億參數開源權重模型 GLM 5.2 在自有基礎設施上完成取證分析。