Anthropic於2023年推出Responsible Scaling Policy(RSP),以AI Safety Level能力門檻約束前沿模型,若訓練進度超過既有安全措施,原則上暫停擴大訓練或部署。這套自願框架曾被視為AI業界最明確的安全承諾,也影響OpenAI與Google DeepMind建立類似制度。
2026年2月24日,Anthropic發布RSP 3.0,取消無法事先確保風險緩解時即停止訓練的硬性承諾,改採Frontier Safety Roadmap及每3至6個月公布Risk Report。公司同月募得300億美元、估值達3,800億美元,新制獲執行長Dario Amodei與董事會一致支持。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。