OpenAI於2026年4月23日推出GPT-5.5,並把Codex定位由程式開發延伸至研究、資料分析、文件與試算表製作及軟體操作。這代表AI代理不再只協助寫程式,而能跨工具完成較長的通用電腦工作流程;模型也於4月24日開放API。
英國AI安全研究院(AISI)於2026年4月30日公布評估:GPT-5.5在95項、四個難度層級的網路安全任務中,能力已與Anthropic的Claude Mythos Preview相近,並成為第二個端到端完成企業網路攻擊模擬的模型;該測試估計人類需20小時。API每百萬輸入與輸出token定價5美元、30美元。
全部報導
3 篇原始報導馬克翻舊帳
這個事件的歷史脈絡OpenAI 疑似秘密測試 GPT-5.6 模型,ChatGPT 輸出品質與推理能力大幅提升
OpenAI 尚未公開證實 GPT-5.6,但 ChatGPT 使用者本週普遍感受到回應更連貫、推理更深入,同時等待時間變長,因而推測平台正以部分帳號進行 A/B 測試。若消息屬實,代表 OpenAI 正為下一代模型驗證效能與運算成本,並可能影響生成式 AI 市場競爭。
最新實測顯示,疑似新模型在 3D 遊戲生成、機器人模擬等複雜任務表現突出,並被部分使用者形容優於 Fable 5。市場傳聞 GPT-5.6 最快將於 6 月 25 日發布;不過截至目前,OpenAI 尚未公布測試規模、模型參數、價格或確切時程,相關說法仍待官方確認。
OpenAI 發布 GPT-5.5:主打代理式運算與 12M 脈絡視窗
大型語言模型正從單次問答轉向能自行規劃、操作工具並完成多步任務的代理式系統。OpenAI將GPT-5.5定位為ChatGPT與Codex的工作主力,鎖定程式開發、資料分析、文件製作與科學研究,反映模型競爭已延伸至企業工作流與研究產出。
OpenAI於2026年4月23日發布GPT-5.5,4月24日開放API;官方規格為API 100萬tokens、Codex 40萬tokens脈絡視窗,並非1,200萬。模型登頂Artificial Analysis Intelligence Index,Terminal-Bench 2.0得82.7%;每百萬輸入、輸出tokens收費5美元與30美元。
OpenAI Codex 展開六週密集更新抗衡 Anthropic Claude Code
OpenAI 與 Anthropic 正爭奪 AI 程式開發工具市場,Codex 直接對上 Claude Code。OpenAI 總裁 Greg Brockman 要求工程團隊以 AI 代理為日常開發核心,藉此縮短寫碼、測試與部署週期,提升模型在企業軟體流程的滲透率,並鞏固 ChatGPT 生態系。
OpenAI 近期啟動為期六週的產品衝刺,密集推出 Codex 桌面版、GPT-5.4 與安全代理功能,並規畫把 ChatGPT、Codex 和 Atlas 瀏覽器整合成桌面「超級 App」。這輪更新未揭露投資金額與確切發布日期,核心目標是抗衡 Anthropic 的 Claude Code。
OpenAI 發布 GPT-5.4:新增原生電腦操作與強化 AI 代理人功能
自 GPT-5 系列問世後,OpenAI 持續把大型語言模型從對話工具推向可執行多步任務的 AI 代理人。2026 年 3 月 5 日發布的 GPT-5.4,是該公司首款原生支援電腦操作的通用模型,可依螢幕截圖下達滑鼠與鍵盤動作,跨網站、試算表及文件完成工作,降低專業流程自動化的整合門檻。
OpenAI 同日將 GPT-5.4 Thinking 導入 ChatGPT、API 與 Codex;API 每百萬輸入、輸出 Token 定價為 2.50、15 美元。GDPval 專業工作評測勝出或平手率 83.0%;Tool Search 以 250 項任務測試,在準確率不變下減少 47% Token 用量。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。