中國人工智慧公司 Z.ai 推出 GLM-5.3,瞄準開放權重的程式設計模型市場。新模型沿用 743B 基礎模型,未重新訓練底座,而是擴大 Post-training 規模,強化複雜編程、工具操作及需要多步推理的長程任務,反映業界競爭正由預訓練規模延伸至後訓練效率。
Z.ai 表示,GLM-5.3 已在 Terminal-Bench 3.0 與 CyberGym 等基準測試取得顯著突破,但本次公布的資訊未列出完整分數。模型目前已透過 API 與 GLM Coding Plan 開放使用;公司並承諾在發布後兩週內公開權重,供開發者獨立評測、部署及調整。
全部報導
2 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Z.ai 發布 GLM-5.3-Flash 原生多模態大模型
Z.ai 推出的 GLM-5.3-Flash,是以低推論成本與開放權重切入大型模型市場的原生多模態模型。其混合專家架構僅在每次運算啟用部分參數,兼顧模型規模與效率;100 萬 Token 上下文視窗則有利於處理大型程式庫、長篇文件及跨模態資料。
Z.ai 最新正式發布 GLM-5.3-Flash,模型採用 3,200 億總參數、180 億啟用參數的 MoE 架構,並支援最長 100 萬 Token 上下文。公司以 MIT 授權釋出模型權重,主打低成本部署,且表示其程式碼能力在相關評測中已逼近頂級模型水準。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。