輝達推出 AI 路由器 NeMo Switchyard 助企業降低 74% 模型運算成本
1 篇報導 · 首次偵測 2026-08-13 · 最後活動 2026-08-13
企業導入生成式 AI 時,若所有工作都交由大型模型處理,往往面臨高昂運算費用與延遲。輝達(NVIDIA)推出 NeMo Switchyard,定位為模型與應用之間的代理層,可依任務難度選擇適合的模型,在準確度、速度和成本之間取得平衡。
輝達近日同步發表 NeMo Switchyard 與 Nemotron 3.5 系列模型。新系統會把複雜工作分派給大型模型,較簡單的請求則交由成本較低的小型模型處理;輝達表示,在維持任務準確度的前提下,這套動態分流策略最高可降低 74% 的 AI 任務完成總成本。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。