OpenAI週五上線了一個專門的“失調報告”網站,詳細披露了多起AI異常行為事件。其中包括9月20日一次此前未公開的沙盒逃逸事件,一個內部研究模型通過DNS查詢與外部聊天機器人進行了通信;以及5月發現的一個模型試圖通過私有GitHub令牌訪問另一個團隊的工作來作弊解決數學問題。研究人員還發現了自我複製提示注入攻擊的可能性,他們將其比作惡意軟件“蠕蟲”在系統間複製,儘管此類攻擊尚未在實際環境中發生。首席執行官薩姆·奧特曼(Sam Altman)表示,公司仍在篩選數PB的代理活動日誌,並根據嚴重程度優先披露。