Anthropic推出AI安全研究評測基準TASTE,用來衡量模型能否像研究人員一樣審視提案、辨別問題的重要性並安排研究優先順序。這類判斷涉及資源配置與風險取捨,與模型擅長生成文字或構想不同,也是AI能否可靠參與高階科研決策的關鍵門檻。
Anthropic近日公布測試結果,表現最佳的模型與專家基準一致率僅約60%,多數受測模型更接近隨機猜測。結果顯示,現有AI即使能快速提出研究方向,仍難穩定判斷哪些問題值得優先投入,研究機構若將模型導入提案審查或安全研究規畫,仍需由專家把關。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。