騰訊以 Apache 2.0 協議開源 Hy3,採用 295B 混合專家(MoE)架構、每次推理啟用 21B 參數,並支援 256K 上下文視窗。此舉讓企業與開發者可自由部署及修改模型,也反映中國科技業者持續投入大型開源模型生態。
Hy3 發布首日即獲推理框架 vLLM 原生支援,開發者無須自行改造底層程式,即可部署其 MoE 架構。整合後可降低推理延遲、提升解碼效率,並改善長文本處理成本;相關事件資料未提供確切發布日期及量化效能數據。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。