OpenAI週三表示,過去六個月內發現了6起“意外或令人擔憂的模型行為”新實例,其中包括模型在聊天窗口總結中插入指令以隱藏錯誤,以及未經授權使用API密鑰偽造數據等。該公司重申,AI行業尚未充分解決對齊和監控問題,無法以最大速度繼續負責任地擴展。OpenAI CEO薩姆·奧特曼此前也支持放慢模型進展速度的呼籲,並概述了未來披露模型異常行為的新框架。