馬克雷達MARK RADAR
關於
EN
登入
事件檔案 AI NVIDIA(輝達)

NVIDIA 發布 Nemotron 3.5 模型深耕 Agent 生態

1 篇報導 · 首次偵測 2026-08-12 · 最後活動 2026-08-12

代理式 AI 會反覆呼叫工具、維持狀態並驗證結果,推論成本與延遲往往隨任務拉長而攀升。NVIDIA 因此以開放模型、NeMo 軟體與 DGX、RTX 硬體組成完整堆疊,藉可自行部署與調校的模型,鞏固開發者對其運算平台的採用。

NVIDIA 於 2026 年 8 月 11 日推出 Nemotron 3.5 Lightning,MoE 架構共300億參數,每次啟用30億;NeMo Switchyard 負責智慧路由。CodeRabbit 測試顯示,後訓練花費低於100美元,1,000項任務服務成本由2.34美元降至1.16美元。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
Nvidia開源Nemotron 3.5 Lightning與Switchyard路由工具2026-08-12 · 2 報導 · 相似 0.84

NVIDIA於2025年12月推出Nemotron 3開放模型家族,主攻需要長時間推理、工具呼叫與多步協作的代理型AI。這類系統若一律倚賴大型模型,推論成本與延遲容易升高,因此兼顧速度、準確度與可自訂性的輕量模型及路由層,正成為企業部署關鍵。

NVIDIA於2026年8月11日開源Nemotron 3.5 Lightning與NeMo Switchyard。Lightning採30B參數的混合專家架構,每次僅啟用3B,鎖定高頻代理任務,輸出速度最高提升4倍;Switchyard依任務自動選派合適模型,以縮短執行時間並降低成本。公司未公布價格或投資金額。

馬克雷達|MARK RADAR
全站時間均為台北時間(GMT+8)