馬克雷達MARK RADAR
關於
EN
登入

研究指出極端組織系統化濫用 AI 聊天機器人繞過防護機制

1 篇報導 · 首次偵測 2026-07-23 · 最後活動 2026-07-23

生成式 AI 過去遭極端組織濫用時,多被視為宣傳、招募與翻譯工具;劍橋大學「AI 科學與政策計畫」(CASP)的田野研究則顯示,博科聖地已將聊天機器人納入作戰。這項轉變可能降低取得戰術、武器與後勤知識的門檻,使模型防護漏洞從產品安全問題升高為現實反恐風險。

2026 年 7 月 10 日,劍橋 CASP 發布報告,依據 2025 至 2026 年對 27 名前成員的 57 次訪談,稱博科聖地兩派系主要自 2024 年起使用 ChatGPT、Gemini 等工具。5 至 20 人專責小組據稱用於策畫攻擊、武器排障與爆裂物設計,並曾繞過防護;惟部分說法尚未獲獨立核實。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
ChatGPT 安全防護漏洞遭繞過產生危險圖片首見 2026-06-25 · 1 報導 · 相似 0.74 · 同主題:ChatGPT

生成式 AI 影像工具透過輸入與輸出過濾器,攔截色情、極端暴力及非自願親密內容,但防護與「越獄」手法持續攻防。英國 AI 資安新創 Mindgard 發現,ChatGPT 僅因無害提示詞的小幅改寫便可能跨越規範,凸顯內容審核仍難掌握語境與變體。

Mindgard 於2026年5月9日發現漏洞,5月14日向 OpenAI 提交完整技術報告。OpenAI 6月8日稱已部署緩解措施,但研究人員6月10日僅微調提示詞便重現露骨暴力與性暗示圖片;BBC 6月18日報導後,OpenAI 再索取測試連結並新增防護,事件未揭露相關金額或財務損失。

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)