Coinbase於10月7日報告稱,對其Onramp服務的歷史回放基準測試發現,三款主流AI模型家族(Opus 5、Sonnet 5和GPT-5.6)的新版本在檢測欺詐性支付方面,捕獲的欺詐案例數量和欺詐金額佔比均低於其前代版本,儘管決策策略未變。其中,Sonnet的召回率下降了22.2個百分點,Opus的召回率下降了0.8個百分點。GPT的精確度提高了11.5個百分點,但其召回率下降了20.7個百分點,這表明有更多的欺詐案例和欺詐金額未能被檢測到。