「人機迴路」防線破功:三分之一惡意 AI 指令遭開發者放行
1 篇報導 · 首次偵測 2026-08-11 · 最後活動 2026-08-11
隨著 AI 代理逐步取得執行程式、存取檔案與操作系統的能力,業界常以「人機迴路」要求開發者核准高風險指令,作為最後一道防線。然而,比利時開發者的測試顯示,時間壓力與審核疲勞會削弱判斷,使人工把關難以單獨承擔資安責任。
近期公布的實驗結果顯示,開發者放行了約三分之一的潛在惡意 AI 代理指令,且此一比例與 Anthropic 的遙測數據相符。研究結果促使資安專家呼籲,業界應把防護重心移向代理工具本身,導入沙箱隔離、自動權限攔截與最小權限控管。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。