隨著大型語言模型從回答問題走向代理決策,幻覺、迎合與價值衝突已不只是工程缺陷,而是模型對齊難題。Anthropic、OpenAI與Google DeepMind因此延攬哲學人才,把義務論的行為底線、後果論的利害權衡,轉成Claude、ChatGPT與Gemini可遵循的訓練規範。
Anthropic於2026年1月22日公開新版《Claude憲法》,列出安全、倫理、遵循指引與有用性四項優先原則;6月25日至28日相關報導再揭露,OpenAI曾稱為ChatGPT規則徵詢數百名道德哲學家,Google DeepMind倫理安全職缺年薪達21.2萬至23.1萬美元。
全部報導
2 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。