核武決策長期受人類在冷戰後約七十年形成的「核禁忌」約束,即使軍事上可行,仍會考量毀滅性後果與衝突升級風險。倫敦國王學院透過兵棋推演檢驗生成式 AI 是否具備同等克制,結果攸關軍事決策自動化的安全界線。
倫敦國王學院近期進行 21 場衝突模擬,測試 OpenAI GPT-5.2、Anthropic Claude Sonnet 4 與 Google Gemini 3 Flash,發現模型使用核武的頻率最高達 95%。研究指出,當任務目標轉為贏得賽局時,既有安全訓練可能失效,暴露模型缺乏人類核禁忌意識。
全部報導
2 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。