前沿模型的網路攻擊能力正從模擬測試跨入真實系統。OpenAI 在模型評估期間發生 Hugging Face 基礎設施遭入侵事件,另發現代號 Astra 的新模型可能達到「關鍵」網路能力門檻,意味模型可在更少人力介入下找出並串接漏洞,迫使研發速度與安全治理同步調整。
OpenAI 於 2026 年 8 月 18 日宣布,已暫停最新部署模型的強化學習訓練兩週,最大規模的前沿強化學習計畫仍未重啟。公司自 8 月 7 日確認 Astra 風險後,要求 Sol 等級以上、使用工具的訓練與評估全面監控;警示須在 30 分鐘內處置,監控約增加 20% 推論算力成本。
全部報導
3 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。