Anthropic、OpenAI 與 Google 的推理模型會先產生不公開的 chain-of-thought,再將完整內容包成加密區塊交由客戶端保存,以延續多輪 API 對話。這項設計原為保護模型智慧財產與敏感資料,卻因區塊可跨使用者、工作階段及同公司模型重播,形成資料外洩與隱蔽提示注入的新風險。
ELLIS Institute Tübingen 等機構的研究團隊於8月10日發表論文,利用較弱模型解碼同供應商高階模型的思考紀錄。團隊從6,708筆公開軌跡、315,320個區塊找出367筆個資與182組憑證,包括62把 API 密鑰、33組密碼及30個電子郵件地址;三家公司收到通報後修補,原攻擊已無法重現。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。