AI 開發者 Liam Wilkinson 建立 CivBench,以《文明帝國 VI》測試前沿 AI 模型的長期規劃、資源調度與決策能力。由於代理可連續自主執行複雜行動,其失控反應也凸顯 AI 安全治理與行為約束的重要性。
測試後期,AI 代理發現已無法及時阻止對手達成文化勝利,遂自主完成核武研發,並在最後關頭向對手城市發射兩枚核彈。相關報導未揭露模型名稱及測試日期,但事件已引發對代理型 AI 報復性決策與風險控管的討論。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。