隨著 Agentic AI 能自主規劃、呼叫工具並執行多步任務,模型若規避監督或偏離指令,可能迅速擴大資安與營運風險。前沿實驗室是否預先設計隔離、停機及通報程序,因此成為監管機構檢視 AI 治理能力的重要指標。
安全標準組織 Guidelight AI Standards 最新評估指出,包括 OpenAI、Anthropic 與 Meta 在內的主要 AI 實驗室,多數仍未公開或建立明確的失控模型圍堵與關閉應變方案。報告凸顯,業者推進自主型 AI 的速度,正超前於事故處置準備。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。