代理式 AI 會反覆呼叫工具、維持狀態並驗證結果,推論成本與延遲往往隨任務拉長而攀升。NVIDIA 因此以開放模型、NeMo 軟體與 DGX、RTX 硬體組成完整堆疊,藉可自行部署與調校的模型,鞏固開發者對其運算平台的採用。
NVIDIA 於 2026 年 8 月 11 日推出 Nemotron 3.5 Lightning,MoE 架構共300億參數,每次啟用30億;NeMo Switchyard 負責智慧路由。CodeRabbit 測試顯示,後訓練花費低於100美元,1,000項任務服務成本由2.34美元降至1.16美元。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Nvidia開源Nemotron 3.5 Lightning與Switchyard路由工具
NVIDIA於2025年12月推出Nemotron 3開放模型家族,主攻需要長時間推理、工具呼叫與多步協作的代理型AI。這類系統若一律倚賴大型模型,推論成本與延遲容易升高,因此兼顧速度、準確度與可自訂性的輕量模型及路由層,正成為企業部署關鍵。
NVIDIA於2026年8月11日開源Nemotron 3.5 Lightning與NeMo Switchyard。Lightning採30B參數的混合專家架構,每次僅啟用3B,鎖定高頻代理任務,輸出速度最高提升4倍;Switchyard依任務自動選派合適模型,以縮短執行時間並降低成本。公司未公布價格或投資金額。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。