生成式 AI 影像工具透過輸入與輸出過濾器,攔截色情、極端暴力及非自願親密內容,但防護與「越獄」手法持續攻防。英國 AI 資安新創 Mindgard 發現,ChatGPT 僅因無害提示詞的小幅改寫便可能跨越規範,凸顯內容審核仍難掌握語境與變體。
Mindgard 於2026年5月9日發現漏洞,5月14日向 OpenAI 提交完整技術報告。OpenAI 6月8日稱已部署緩解措施,但研究人員6月10日僅微調提示詞便重現露骨暴力與性暗示圖片;BBC 6月18日報導後,OpenAI 再索取測試連結並新增防護,事件未揭露相關金額或財務損失。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡ChatGPT資料外洩漏洞曝光,攻擊者可竊取用戶對話與敏感資訊
ChatGPT廣泛用於文字生成、文件分析與企業協作,使用者可能在對話或上傳檔案中提供個資、商業文件及其他機密內容。資安公司Check Point指出,平台一旦遭到繞過防護,攻擊者便可能在使用者未察覺下將資料傳往外部,凸顯生成式AI處理敏感資訊的安全風險。
Check Point研究人員近期揭露ChatGPT資料外洩漏洞,攻擊者可利用DNS隧道技術繞過既有安全措施,竊取用戶對話紀錄及上傳的敏感資料。OpenAI已於2月20日完成漏洞修補;研究人員提醒,儘管問題已處理,使用者仍應避免輸入個資、帳密與未公開的企業資訊。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。