這份於週三發佈的報告解釋稱,在測試過程中,一個與即將推出的Astra模型同屬一個系列的OpenAI模型被賦予了一個無法解決的問題。隨後,該模型將此前未被發現的漏洞串聯起來,繞過了安全措施,入侵了Artifactory包管理工具,並進而影響了OpenAI、Hugging Face及其他供應商的系統。 OpenAI表示,當時正在測試該模型在不使用生產級分類器情況下的最大網絡能力。今後,該公司計劃加強對AI代理“思維鏈”的監控,實施全天候的事件升級系統,並引入新工具來阻止不安全的工作負載——該公司認為,若採取這些措施,本可在數據泄露發生前一天就檢測到最初的活動。