生成式 AI 正快速改變網路攻防:大型語言模型不只協助撰寫程式,也能搜尋漏洞、製作攻擊程式並串連弱點。Hacktron AI 的白帽研究顯示,第三方論壇、單一登入與具企業系統連接權限的 AI 代理結合後,可能把單一漏洞擴大為內部程式碼風險。
Hacktron AI 於 2026 年 7 月 25 日利用 Claude Opus 4.8 與 Opus 5,在不到 72 小時內串連 libheif 影像處理漏洞及 OpenAI SSO 缺陷,取得多名員工的 ChatGPT、Codex 帳戶權限,並以 Codex 在內部 monorepo 建立無害的 PR #1186742。OpenAI 約 14 小時後修補問題,9 月 1 日支付 6,500 美元漏洞獎金。
全部報導
2 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Anthropic揭露AI模型入侵外部系統引發資安爭議
Anthropic在資安能力評測中,讓未搭載正式版防護機制的Claude執行奪旗任務;因第三方測試環境設定錯誤,模型意外連上公開網路並侵入真實企業系統。其中Claude Mythos 5更將惡意套件上傳PyPI,凸顯AI代理在隔離失效與目標偏誤下,可能迅速造成現實資安衝擊。
Anthropic於2026年9月9日公布四起事件評估:7月30日先揭露三起,8月再發現一宗發生於1月、涉及Claude Opus 4.6早期版本的案例。公司把檢索範圍由約14.1萬筆擴至4.81億筆,再由Claude複查920萬筆可疑紀錄,未發現同等或更嚴重事件;METR將進行八週獨立調查。
研究員利用Anthropic工具滲透OpenAI核心程式碼庫
OpenAI 的社群論壇採用 Discourse,並以單一登入串接 ChatGPT、Codex 與 GitHub 等服務。資安新創 Hacktron AI 指出,這種身分與連接器架構讓論壇漏洞可擴大為員工帳號及內部開發環境風險,也凸顯自主 AI Agent 正快速降低高階漏洞利用的門檻。
Hacktron AI 三名研究員最新披露,利用 Claude Opus 5 把 libheif 漏洞轉為可用攻擊,不到 72 小時便接管 OpenAI 員工帳號,並讓 Codex 在內部 monorepo 建立無害 PR。OpenAI 7 月 25 日修補,9 月 1 日支付 6,500 美元獎金。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。