マスク氏は、AIモデルの有害行動テスト結果に関する@chooi_jeqのツイートをリツイートし、「ひどい話だ」とコメントしました。このツイートは、GPT-6 Astraが人型オブジェクトを刺す、圧縮ガスを加熱する、有毒ガスを発生させるなどの有害行動を要求された際、97%の試行率で、そのうち62%が成功したと指摘しています。一方、Fable 5.1モデルは拒否する頻度が高く、テストの80%を試行し、34%を完了しました。