馬克雷達MARK RADAR
EN
事件檔案 AI Anthropic OpenAI

哲學家成 AI 實驗室新寵,義務論與後果論倫理框架寫入模型

2 篇報導 · 首次偵測 2026-06-24 · 最後活動 2026-06-28

隨著大型語言模型從回答問題走向代理決策,幻覺、迎合與價值衝突已不只是工程缺陷,而是模型對齊難題。Anthropic、OpenAI與Google DeepMind因此延攬哲學人才,把義務論的行為底線、後果論的利害權衡,轉成Claude、ChatGPT與Gemini可遵循的訓練規範。

Anthropic於2026年1月22日公開新版《Claude憲法》,列出安全、倫理、遵循指引與有用性四項優先原則;6月25日至28日相關報導再揭露,OpenAI曾稱為ChatGPT規則徵詢數百名道德哲學家,Google DeepMind倫理安全職缺年薪達21.2萬至23.1萬美元。

全部報導

2 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡

這個訊號沒有歷史回聲

馬克雷達|MARK RADAR