馬克雷達MARK RADAR
EN

Grok 因無法準確回答《柏德之門 3》遭馬斯克凍結更新,救火後準確率升至 92%

1 篇報導 · 首次偵測 2026-02-27 · 最後活動 2026-02-27

xAI 的聊天機器人 Grok 與 OpenAI 的 ChatGPT、Anthropic 的 Claude 競逐通用 AI 能力;《柏德之門 3》由 Larian Studios 開發,劇情與規則繁複,卻有大量公開攻略可查。Grok 仍答錯細節,因此成為檢驗模型知識可靠度與 xAI 產品決策方式的案例。

2025 年,伊隆·馬斯克因 Grok 答錯《柏德之門 3》問題,將 xAI 模型更新延後數天,並抽調多名資深工程師救火。2026 年 2 月,BaldurBench 以 5 題比較 Grok、ChatGPT、Claude 與 Gemini;優化後的 Grok 準確率達 92%,回答偏用表格與玩家術語。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡

這個訊號沒有歷史回聲

馬克雷達|MARK RADAR