OpenAI 據報正為新模型 Astra 導入「循環深度」推理技術,讓模型反覆處理中間狀態,而非依照傳統方式逐步產生可讀的思維鏈。這項設計可能提升複雜任務的推理能力,卻也會削弱研究人員藉由思維鏈觀察模型意圖、辨識欺騙或危險行為的能力。
最新報導指出,多位 AI 安全專家擔心 Astra 的非循序推理會使既有思維鏈監控方法失效,增加模型在部署後難以解釋與控制的風險。截至報導刊出時,OpenAI 尚未公布 Astra 的正式發布日期、完整技術規格或安全評估數據,爭議焦點因此落在能力提升前能否建立替代監督機制。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。