OpenAI近年持續建立科學研究用 AI 評測工具,GeneBench-Pro 聚焦基因體學等計算生物學任務,檢驗模型能否理解資料、選擇分析方法並作出研究判斷。此類基準可補足一般問答測驗,協助研究機構辨識模型在真實研究流程中的能力與限制。
OpenAI 於 2026 年 7 月公布 GeneBench-Pro,以合成資料設計研究級題目,並交由領域專家審查,降低資料外洩與背題風險。截至 7 月 20 日,官方尚未揭露完整題數或模型排名;目前已知測試橫跨基因體學等多個領域,評估重點是分析推理而非知識記憶。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。