馬克雷達MARK RADAR
EN
事件檔案 AI Anthropic Claude

Anthropic 發表 Mythos Preview 模型,研究決策能力超越人類專家

1 篇報導 · 首次偵測 2026-06-04 · 最後活動 2026-06-04

Anthropic將AI研究中「下一步該做什麼」轉化為決策測試,拿新模型Mythos Preview與領域專家比較。這類能力關係到AI能否協助設計實驗、選擇研究方向,甚至加速下一代模型開發,因此比單純答題成績更直接牽動研發速度與安全治理。

Anthropic最新報告稱,Mythos Preview在AI研究決策測試中有64%的比較結果勝過人類專家。報告未交代發布日期、樣本數、測試成本或金額,但警告模型正加速接近「遞迴自我提升(RSI)」;若AI能持續改進自身研發流程,可能推動科技突破,也提高能力失控風險。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
Anthropic 推 Claude Mythos 模型搶攻日本資安市場2026-05-29 · 1 報導 · 相似 0.80

Anthropic以新世代AI模型Claude Mythos切入日本資安市場,主打漏洞偵測,並鎖定日本政府與金融機構。此布局牽動關鍵算力與資安能力的跨境依賴,也引發美國政府對算力主權的關注,促使日本加快建立本土高階資安模型。

截至2026年7月20日,最新報導指出Anthropic正積極卡位日本政府與金融市場,Claude Mythos的漏洞偵測能力成為競爭焦點;日本政府與產業也同步推進自主模型開發。現有資料未揭露模型發布日、投資金額、採購規模或正式合作機構。

Anthropic 與歐盟官員探討 AI 模型 Mythos 資安疑慮2026-05-12 · 3 報導 · 相似 0.80

Anthropic 的 AI 模型 Mythos 被定位為具高度資安能力的系統,但強大攻防能力也可能遭濫用,因而引起歐盟執委會與金融監理官員關注。Anthropic 已承諾遵守歐盟 AI 行為準則,評估模型風險並採取降低措施。

最新進展是歐盟官員已與 Anthropic 會面,聽取 Mythos 網路安全疑慮簡報;歐元區財長另提出銀行存取相關要求。現有資訊未揭露會面確切日期、受影響銀行數量或任何交易金額,後續焦點將是存取權限與風險控管標準。

Anthropic 發布 Claude Mythos 系統卡:首度納入精神科評估且防禦反應率新低2026-04-26 · 1 報導 · 相似 0.81

Anthropic 在 Claude Mythos Preview 系統卡中,首度引入臨床精神科醫師評估,檢視模型長時間對話呈現的人格組織、現實檢驗與心理防禦反應。這項做法擴大 AI 安全評估範圍,也為模型互動穩定性提供新的觀察指標。

最新評估由臨床精神科醫師與 Claude Mythos 進行共 20 小時互動,結果認為其人格組織相對健康、現實檢驗能力優秀;對話中的心理防禦反應率僅 2%,創 Anthropic 歷代模型新低。系統卡未揭露評估確切日期,模型目前仍為 Preview 階段。

馬克雷達|MARK RADAR