馬克雷達MARK RADAR
關於
EN
登入

OpenAI 疑似秘密測試 GPT-5.6 模型,ChatGPT 輸出品質與推理能力大幅提升

1 篇報導 · 首次偵測 2026-06-23 · 最後活動 2026-06-23

OpenAI 尚未公開證實 GPT-5.6,但 ChatGPT 使用者本週普遍感受到回應更連貫、推理更深入,同時等待時間變長,因而推測平台正以部分帳號進行 A/B 測試。若消息屬實,代表 OpenAI 正為下一代模型驗證效能與運算成本,並可能影響生成式 AI 市場競爭。

最新實測顯示,疑似新模型在 3D 遊戲生成、機器人模擬等複雜任務表現突出,並被部分使用者形容優於 Fable 5。市場傳聞 GPT-5.6 最快將於 6 月 25 日發布;不過截至目前,OpenAI 尚未公布測試規模、模型參數、價格或確切時程,相關說法仍待官方確認。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
ChatGPT 升級 GPT-5.6 Sol 模型並擴增免費用戶存取權限2026-08-07 · 5 報導 · 相似 0.81

OpenAI 於2026年7月9日全面推出 GPT-5.6 系列,Sol 定位旗艦推理模型,Luna 主打高速與低成本。ChatGPT 每週服務10億人,這次將新一代模型下放至每月0美元的 Free 方案,意味競爭焦點不只在效能,也延伸至普及率與使用門檻。

OpenAI 8月6日宣布,Plus、Pro 用戶即日起由新版 Sol 統一處理 Instant 與深度推理;內部財經、醫療、法律測試顯示,其含事實錯誤回答較 GPT-5.5 Instant 少68%,Luna 少62%。Free、Go 本週改用 Luna,下週起享不限量文字對話與 Think 按鈕,檔案與圖片仍受限。

OpenAI 發表 GPT-5.6 家族推出三款新模型2026-06-29 · 4 報導 · 相似 0.80

OpenAI將GPT-5.6劃分為三個可獨立演進的能力層級:旗艦Sol、兼顧日常效能與成本的Terra,以及主打速度與低價的Luna。此設計讓企業能依任務難度配置成本;其中Sol強化長時程代理、程式開發與網路安全研究,也因潛在濫用風險採取更嚴格防護。

OpenAI於2026年6月26日應美國政府要求,先向約20家核准夥伴有限預覽,7月9日起於ChatGPT、Codex與API上線。每百萬token輸入/輸出價為Sol 5/30美元、Terra 2.5/15美元、Luna 1/6美元;Sol在BrowseComp達92.2%、OSWorld 2.0達62.6%,皆創新高。

OpenAI GPT-5.5 模型效能大幅提升,並更新 Codex 通用運算能力2026-05-09 · 3 報導 · 相似 0.80

OpenAI於2026年4月23日推出GPT-5.5,並把Codex定位由程式開發延伸至研究、資料分析、文件與試算表製作及軟體操作。這代表AI代理不再只協助寫程式,而能跨工具完成較長的通用電腦工作流程;模型也於4月24日開放API。

英國AI安全研究院(AISI)於2026年4月30日公布評估:GPT-5.5在95項、四個難度層級的網路安全任務中,能力已與Anthropic的Claude Mythos Preview相近,並成為第二個端到端完成企業網路攻擊模擬的模型;該測試估計人類需20小時。API每百萬輸入與輸出token定價5美元、30美元。

OpenAI 發布 ChatGPT 5.5 Instant,大幅降低幻覺並提升回應精準度2026-05-06 · 4 報導 · 相似 0.83

OpenAI 持續以 Instant 系列作為 ChatGPT 的日常對話核心,主打快速、精簡與低延遲。生成式 AI 在醫療、法律及財務等高風險主題可能捏造資訊,因此降低幻覺、改善上下文理解,是提升服務可信度與使用者黏著度的關鍵。

截至 2026 年 7 月 19 日,OpenAI 已向全體使用者推出 GPT-5.5 Instant,並取代 GPT-5.3 成為 ChatGPT 預設模型。官方數據顯示,新模型在高風險場景的幻覺率降低 52.5%,同時強化個人化記憶與上下文掌握,讓回答更簡潔且貼近需求。

OpenAI 發布 GPT-5.3 Instant 模型提升 ChatGPT 對話品質與準確度2026-03-05 · 2 報導 · 相似 0.83

GPT-5.3 Instant 是 OpenAI 為 ChatGPT 日常對話打造的快速模型,承接 GPT-5.2 Instant,重點不在延長推理,而是改善使用者最常感受到的語氣、相關性與對話流暢度。此更新也回應過度拒答、冗長警語與網路搜尋脈絡不足等問題,攸關 ChatGPT 最廣泛使用情境的可靠度。

OpenAI 於 2026 年 3 月 3 日向所有 ChatGPT 用戶推出 GPT-5.3 Instant,API 名稱為 gpt-5.3-chat-latest,未另公布更新金額。內部評測顯示,高風險領域幻覺率在啟用網路時降 26.8%、未連網降 19.7%;使用者回報錯誤案例則分別降 22.5% 與 9.6%。

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)