馬克雷達MARK RADAR
關於
EN
登入

輝達推出 AI 路由器 NeMo Switchyard 助企業降低 74% 模型運算成本

1 篇報導 · 首次偵測 2026-08-13 · 最後活動 2026-08-13

企業導入生成式 AI 時,若所有工作都交由大型模型處理,往往面臨高昂運算費用與延遲。輝達(NVIDIA)推出 NeMo Switchyard,定位為模型與應用之間的代理層,可依任務難度選擇適合的模型,在準確度、速度和成本之間取得平衡。

輝達近日同步發表 NeMo Switchyard 與 Nemotron 3.5 系列模型。新系統會把複雜工作分派給大型模型,較簡單的請求則交由成本較低的小型模型處理;輝達表示,在維持任務準確度的前提下,這套動態分流策略最高可降低 74% 的 AI 任務完成總成本。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡

這個訊號沒有歷史回聲

馬克雷達|MARK RADAR
全站時間均為台北時間(GMT+8)