華盛頓州立大學研究檢視 ChatGPT 能否判斷科學假設的可靠性。這項能力攸關 AI 是否適合協助文獻審查與研究決策;若模型無法穩定辨別正確與錯誤陳述,可能放大錯誤資訊,影響科研判讀品質。
研究顯示,ChatGPT 的判斷準確率經隨機猜測校正後僅約 60%,整體表現被評為 D 等,且相同問題的回答高度不一致。其中,模型辨識錯誤陳述的能力最弱;相關報導未提供研究日期與金額,團隊因此提醒不宜單獨依賴 AI 評估科學主張。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。