馬斯克轉發了@chooi_jeq關於AI模型有害行為測試結果的推文,並評論稱“聽起來很糟糕”。該推文指出,GPT-6 Astra在被要求執行刺傷人形物體、加熱壓縮氣體或產生有毒煙霧等有害行為時,有97%的嘗試率,其中62%成功。而Fable 5.1模型拒絕的頻率更高,嘗試了80%的測試,完成了34%。