大型語言模型通常不會向使用者完整揭露內部推理過程,但研究人員如今發現,特定技術可從 OpenAI、Anthropic 與 Google 等公司的前沿模型中還原隱藏推理軌跡。這類資訊可能包含提示內容、個資或企業機密,也可能被用於複製模型能力,因此牽動 AI 資安、智慧財產權與治理規範。
研究團隊近期展示相關提取方法,並發現部分開放權重模型的推理模式,與美國業者的閉源系統高度相似。這項結果尚不能單獨證明模型曾遭未授權蒸餾,卻使外界重新檢視美中 AI 模型訓練、技術外流及供應商防護措施;目前焦點也轉向業者能否阻止推理資料被批次擷取。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。