生成式 AI 需求正從模型訓練擴大至大規模推論,資料中心業者因而更重視效能、能源效率與整套系統整合。AMD 正以 EPYC 伺服器 CPU、Instinct AI GPU 與 ROCm 軟體生態系,挑戰既有市場格局,並把產品規劃延伸至 2030 年。
AMD 執行長蘇姿丰在 Advancing AI 大會公布最新藍圖,預計藉由第六代 EPYC 處理器及 Instinct MI500、MI600 系列,於未來四年把 AI 推論吞吐量提升 2,000 倍。公司也公開 HELIOS 機櫃系統,強化從晶片、機櫃到軟體的 AI 基礎設施布局。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡AMD發表Instinct MI400系列 GPU 與 Helios 平台攻 AI 推論市場
隨著生成式 AI 從模型訓練轉向大規模推論與代理式工作負載,資料搬移、記憶體頻寬及每美元 Token 產出已成為 AI 資料中心擴展的關鍵。AMD 正整合 Instinct、EPYC、Pensando 與 ROCm,試圖在 Nvidia 主導的市場提供開放式全端替代方案。
AMD 於2026年7月23日在舊金山發布 MI400 系列與 Helios;單櫃整合72顆 MI455X、18顆第六代 EPYC「Venice」CPU及31TB HBM4,FP4算力達2.9 EF。AMD稱其每美元推論 Token 多30%;OpenAI預計第四季上線,Meta已展開驗證,Microsoft也將在Azure大規模部署。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。