生成式 AI 的競爭正從模型訓練延伸至推論效率,尤其 AI 代理需要持續處理多步驟任務,對低延遲與高速輸出提出更高要求。輝達推出 Groq 3 LPX,藉由專攻 token 生成的 LPU 架構,強化大型語言模型的即時執行能力。
輝達近期宣布 Groq 3 LPX 機櫃正式進入量產,系統搭載 256 顆 LPU 晶片,並全數採用三星電子 4 奈米製程代工。AI 雲端服務商 Nebius 將成為首位客戶,率先部署於其推論平台;雙方尚未公布合約金額及確切交付日期。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡NVIDIA 公布整合 Groq 技術之新推論晶片並由三星代工
生成式 AI 市場正由模型訓練轉向大規模推論,晶片能否以低延遲、高吞吐量產生 Token,已成為雲端業者控制成本的關鍵。NVIDIA(輝達)整合 Groq 的 LPU 架構,意在補強 GPU 之外的推論產品線,迎戰 CSP 自研 ASIC。
黃仁勳於 2026 年 GTC 大會公布 NVIDIA Groq 3 LPU,為輝達首款整合 Groq 技術的推論晶片,由三星代工並預計第三季出貨;相關報導稱技術授權交易規模達 200 億美元。他並預期大型語言模型將依 Token 品質分層定價,由 AI 工廠動態分配訓練與推論負載。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。