AMD 發布開源大語言模型 Instella-MoE-16B-A3B
1 篇報導 · 首次偵測 2026-08-02 · 最後活動 2026-08-02
AMD 正加速布局生成式 AI 軟硬體生態,除以 Instinct GPU 挑戰資料中心運算市場,也透過開放模型降低研究門檻。Instella-MoE-16B-A3B 鎖定學術界與企業研發團隊,讓開發者能檢視並重現從資料到模型的完整流程。
AMD 最新發布 Instella-MoE-16B-A3B,模型採 Mixture-of-Experts 架構,總規模達 160 億個參數,但處理每個 Token 時僅活化 28 億個參數,以兼顧模型容量與運算效率。模型以 Instinct GPU 訓練,AMD 並同步公開完整訓練資料、配置及模型權重。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。