Anthropic 以重視 AI 安全與「對齊」研究建立市場定位,卻與 OpenAI 等業者競逐能自主研發下一代模型的系統。此類「遞迴自我改進」尚未實現,但批評者擔心能力加速後,人類可能失去控制;研究員離職因而凸顯前沿實驗室內部對競賽邏輯與風險治理的裂痕。
27歲的 Jacob Coxon 於2026年9月8日宣布辭去 Anthropic,稱兩家公司競逐自我改進的超級智慧,形同以人命下注。他過去三年曾任職 OpenAI 與 Anthropic;貼文數日內瀏覽逾1億次。Anthropic 對齊主管 Evan Hubinger 估,十年內 AI 導致人類滅絕的機率高於10%。
全部報導
2 篇原始報導馬克翻舊帳
這個事件的歷史脈絡前Anthropic研究員憂超級智慧失控辭職並示警毀滅性風險
Jacob Coxon 曾任職 OpenAI 與 Anthropic,兩家公司均處於生成式 AI 與先進模型競賽前線。他憂心業界追求能自行改進的超級智慧,卻未建立相稱的安全防線;一旦系統能力超越人類控制,風險可能不只衝擊就業與社會秩序,更危及人類存續。
現年 27 歲的 Coxon 已辭去 Anthropic 研究職務並退出 AI 產業,指控頂尖科技公司在競爭壓力下,拿全人類性命豪賭。他警告毀滅性後果可能在十年內出現,部分報導更將 2029 年列為可能風險節點;Anthropic 安全主管則曾估計,AI 導致人類滅絕的機率約為一成。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。