OpenAI發佈LifeSciBench:衡量AI系統在真實科研場景中的能力
Svmuu訊 OpenAI 發佈全新評測基準 LifeSciBench,旨在衡量 AI 系統在真實科研場景中的能力。據悉,LifeSciBench 基於 750 道專家編寫任務,覆蓋 7 類科研工作流與 7 個生物學領域,任務來源於 173 名具有博士背景並具備生物科技或製藥行業經驗的科研人員,該基準強調複雜科研能力評估,包括證據整合、實驗設計、數據分析、科學推理與科研溝通等能力,而非單一事實性問題。超過 79%的任務包含多步驟推理,平均每道題需約 4 個推理步驟,並包含 1,062 個真實科研相關數據附件(如論文、圖表、序列數據及結構文件等)。
來源:Odaily · 原文連結
免責聲明:本內容僅代表作者個人觀點,不構成任何投資理財建議。如有發現違規內容點擊舉報
24小時熱榜
-
1
Uniswap去中心化交易所何時上線?其起源與核心機制解析
-
2
ANTS是什麼幣種?多項目共用符號,投資前需辨明
-
3
HTX(原火幣)平台概覽與正規比特幣交易及錢包軟件推薦
-
4
全球主流加密貨幣行情軟件與交易平台盤點
-
5
TB幣價值解析:多重項目共用代碼,投資潛力各異
-
6
KNC幣是什麼?Kyber Network核心代幣KNC的功能與交易平台解析
-
7
LTC萊特幣近七年價格走勢與減半事件回顧(2019-2026)
-
8
VSC是什麼幣種?Vyvo Coin (VSC) 項目概覽與市場現狀
-
9
回顧2021年:影響比特幣價格波動的五大關鍵因素
-
10
GHC (Galaxy Heroes Coin) 價值分析:項目概況與投資考量
今日行情
推薦閱讀












