馬克雷達MARK RADAR
關於
EN
登入

OpenAI 以紅隊模型 GPT-Red 強化大語言模型防禦力

1 篇報導 · 首次偵測 2026-07-16 · 最後活動 2026-07-16

隨著生成式AI應用普及,AI代理系統面臨的安全威脅日益嚴峻,其中「提示注入攻擊」能惡意操縱模型輸出,成為企業部署的最大隱憂。為此,OpenAI開發出內部紅隊模型GPT-Red,透過模擬駭客攻擊主動找出系統弱點,這對建立安全可靠的商用AI生態系具有指標性意義。

OpenAI於2026年7月16日公布最新技術進展,該公司利用自我對戰強化學習技術,讓GPT-Red自動產生提示注入攻擊以測試防禦力。在將攻擊模式納入訓練後,最新發表的模型GPT-5.6 Sol對直接提示注入攻擊的防禦成功率大幅提升,其漏洞率已降至僅剩0.05%。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡

這個訊號沒有歷史回聲

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)