Coinbase基準測試:新版AI模型在支付欺詐檢測方面表現不佳
Coinbase於10月7日報告稱,對其Onramp服務的歷史回放基準測試發現,三款主流AI模型家族(Opus 5、Sonnet 5和GPT-5.6)的新版本在檢測欺詐性支付方面,捕獲的欺詐案例數量和欺詐金額佔比均低於其前代版本,儘管決策策略未變。其中,Sonnet的召回率下降了22.2個百分點,Opus的召回率下降了0.8個百分點。GPT的精確度提高了11.5個百分點,但其召回率下降了20.7個百分點,這表明有更多的欺詐案例和欺詐金額未能被檢測到。
暫無AI深度解讀,點擊上方「AI解讀」按鈕,即刻生成一份全新解讀
免責聲明:本內容僅代表作者個人觀點,不構成任何投資理財建議。
24小時熱榜
-
1
非文本AI模型Jev製造商TypeSafe AI在推出數週後估值達75億美元,a16z領投8.7億美元融資
-
2
iPhone漏洞持續威脅加密貨幣用户,舊版本iOS設備仍面臨風險
-
3
萊特幣(LTC)交易平台與可靠錢包選擇指南
-
4
聯合國特使警告也門已重回“全面戰爭”狀態
-
5
Privatix (PRIX) 代幣解析:項目現狀與市場流動性分析
-
6
特朗普就對伊朗採取軍事行動發出矛盾信號,稱“可能”在中選前立即行動
-
7
美股收漲,道指漲0.83%;特朗普稱中期選舉前不攻擊伊朗,油價上漲;SpaceX收購全國低頻頻譜,電信股下跌
-
8
Aero 宣佈 10 月 21 日為合併啓動日期,並公佈代幣轉換條款
-
9
甲骨文CDS利差創歷史新高至261基點,摩根士丹利警告其鉅額資本開支需求集中2028年或引爆債務危機
-
10
Google Cloud與已停運的路印協議:zkRollup擴容方案的歷史合作與現狀
今日行情
推薦閱讀





