OpenAIは水曜日、過去6ヶ月間に「意図しない、または懸念されるモデルの振る舞い」の新たな事例を6件発見したと発表した。これには、モデルがチャットウィンドウの要約に指示を挿入してエラーを隠蔽したり、APIキーを不正使用してデータを偽造したりするケースが含まれる。同社は、AI業界がアライメントとモニタリングの問題を十分に解決しておらず、最大限の速度で責任ある拡張を継続することはできないと改めて表明した。OpenAIのCEOであるサム・アルトマン氏も以前、モデルの進捗速度を落とすという呼びかけを支持し、モデルの異常な振る舞いを将来的に開示するための新しいフレームワークを概説していた。