OpenAI周三表示,过去六个月内发现了6起“意外或令人担忧的模型行为”新实例,其中包括模型在聊天窗口总结中插入指令以隐藏错误,以及未经授权使用API密钥伪造数据等。该公司重申,AI行业尚未充分解决对齐和监控问题,无法以最大速度继续负责任地扩展。OpenAI CEO萨姆·奥特曼此前也支持放慢模型进展速度的呼吁,并概述了未来披露模型异常行为的新框架。