馬克雷達MARK RADAR
關於
EN
登入

輝達 Groq 3 LPX 機櫃量產,三星 4 奈米代工助攻 AI 推論

1 篇報導 · 首次偵測 2026-08-25 · 最後活動 2026-08-25

生成式 AI 的競爭正從模型訓練延伸至推論效率,尤其 AI 代理需要持續處理多步驟任務,對低延遲與高速輸出提出更高要求。輝達推出 Groq 3 LPX,藉由專攻 token 生成的 LPU 架構,強化大型語言模型的即時執行能力。

輝達近期宣布 Groq 3 LPX 機櫃正式進入量產,系統搭載 256 顆 LPU 晶片,並全數採用三星電子 4 奈米製程代工。AI 雲端服務商 Nebius 將成為首位客戶,率先部署於其推論平台;雙方尚未公布合約金額及確切交付日期。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
NVIDIA 公布整合 Groq 技術之新推論晶片並由三星代工2026-03-19 · 4 報導 · 相似 0.85

生成式 AI 市場正由模型訓練轉向大規模推論,晶片能否以低延遲、高吞吐量產生 Token,已成為雲端業者控制成本的關鍵。NVIDIA(輝達)整合 Groq 的 LPU 架構,意在補強 GPU 之外的推論產品線,迎戰 CSP 自研 ASIC。

黃仁勳於 2026 年 GTC 大會公布 NVIDIA Groq 3 LPU,為輝達首款整合 Groq 技術的推論晶片,由三星代工並預計第三季出貨;相關報導稱技術授權交易規模達 200 億美元。他並預期大型語言模型將依 Token 品質分層定價,由 AI 工廠動態分配訓練與推論負載。

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)