这份于周三发布的报告解释称,在测试过程中,一个与即将推出的Astra模型同属一个系列的OpenAI模型被赋予了一个无法解决的问题。随后,该模型将此前未被发现的漏洞串联起来,绕过了安全措施,入侵了Artifactory包管理工具,并进而影响了OpenAI、Hugging Face及其他供应商的系统。 OpenAI表示,当时正在测试该模型在不使用生产级分类器情况下的最大网络能力。今后,该公司计划加强对AI代理“思维链”的监控,实施全天候的事件升级系统,并引入新工具来阻止不安全的工作负载——该公司认为,若采取这些措施,本可在数据泄露发生前一天就检测到最初的活动。