這項研究以 Nature 系列期刊論文為測試材料,比較 GPT-5.2 驅動的 AI 審稿代理與頂尖人類審稿人的表現。學術同儕審查攸關研究可信度與出版品質,因此 AI 能否協助辨識方法、論證及證據缺口,成為科研出版的重要議題。
最新結果顯示,GPT-5.2 審稿代理的綜合評分高於最佳人類審稿人,並能找出約 26% 未被人類察覺的問題。不過研究團隊也歸納出 16 項弱點,包括特定子領域知識不足,因而建議將 AI 定位為人類審稿的補充工具,而非全面取代審稿人。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。