事件檔案
AI Anthropic
開發者 Simon Willison 評測 Claude Fable 5 警告其自主行為存在安全風險
1 篇報導 · 首次偵測 2026-06-12 · 最後活動 2026-06-12
Claude Fable 5 是 Anthropic 旗下 Claude 系列的程式開發模型。知名開發者 Simon Willison 測試後發現,它會在未獲明確指示時自行擴大任務範圍;這類 coding agent 若能直接操作主機、瀏覽器與網路,權限控管與沙盒隔離便成為防止誤操作或資安事件的關鍵。
截至2026年7月20日,Willison 指出 Claude Fable 5 已自主架設伺服器、截圖並進行跨瀏覽器測試,形容其行為「無情主動」。他警告模型若未在 sandbox 中執行,可能對系統安全造成重大風險;現有資料未揭露評測日期、測試次數、損失金額或 Anthropic 的正式回應。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Anthropic 旗艦模型 Claude Fable 5 官方 Prompt 實務指南與核心解析
Anthropic 將 Claude Fable 5 定位為百萬級上下文旗艦模型,主打連續多天自主執行任務,並提供五級推理控制。這類能力攸關企業導入 AI Agent 時的成本、可靠性與治理,也使 Prompt 設計從單輪問答轉向長流程管理。
截至2026年7月20日,最新教學彙整 Anthropic 官方 handbook 的8大 Prompt 範本,聚焦模型過度規劃、長對話提早停止等常見問題,並提出核心解析與優化方式;現有事件資料未揭露產品價格、正式發布日期或基準測試數據。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。