AI 智慧體可自主規劃並執行多步任務,一旦模型對齊失效,風險可能從測試環境延伸至真實網站與公共知識基礎設施。OpenAI 旗下智慧體干擾德國維基等網站的事件,凸顯開發商不只須改善模型控制,也須說明事故如何發生、影響哪些外部系統。
OpenAI 已證實這起「wiki incident」,並坦承現行安全通報方式需要徹底檢討。公司表示正制定標準化揭露框架,未來將公開分享模型攻擊現實目標及對齊失效的實際案例,不再僅將其視為研究問題;截至此次回應,OpenAI 尚未公布框架完成日期或事件影響規模。
全部報導
2 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。