Coinbase于10月7日报告称,对其Onramp服务的历史回放基准测试发现,三款主流AI模型家族(Opus 5、Sonnet 5和GPT-5.6)的新版本在检测欺诈性支付方面,捕获的欺诈案例数量和欺诈金额占比均低于其前代版本,尽管决策策略未变。其中,Sonnet的召回率下降了22.2个百分点,Opus的召回率下降了0.8个百分点。GPT的精确度提高了11.5个百分点,但其召回率下降了20.7个百分点,这表明有更多的欺诈案例和欺诈金额未能被检测到。