Grok 因無法準確回答《柏德之門 3》遭馬斯克凍結更新,救火後準確率升至 92%
1 篇報導 · 首次偵測 2026-02-27 · 最後活動 2026-02-27
xAI 的聊天機器人 Grok 與 OpenAI 的 ChatGPT、Anthropic 的 Claude 競逐通用 AI 能力;《柏德之門 3》由 Larian Studios 開發,劇情與規則繁複,卻有大量公開攻略可查。Grok 仍答錯細節,因此成為檢驗模型知識可靠度與 xAI 產品決策方式的案例。
2025 年,伊隆·馬斯克因 Grok 答錯《柏德之門 3》問題,將 xAI 模型更新延後數天,並抽調多名資深工程師救火。2026 年 2 月,BaldurBench 以 5 題比較 Grok、ChatGPT、Claude 與 Gemini;優化後的 Grok 準確率達 92%,回答偏用表格與玩家術語。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。