馬克雷達MARK RADAR
EN

NVIDIA 發表 Nemotron 3 Nano Omni 開源多模態模型

4 篇報導 · 首次偵測 2026-04-29 · 最後活動 2026-04-29

目前 AI agent 通常分別呼叫視覺、語音與語言模型,資料轉接不僅增加延遲,也可能遺失脈絡。NVIDIA 將影音、影像、文字與文件理解整合至單一開放模型,鎖定電腦操作、客服及監控等應用,攸關企業部署成本與 AI 軟體生態競爭。

2026 年 4 月 28 日,NVIDIA 發布 Nemotron 3 Nano Omni;模型採 30B-A3B 混合專家架構,總參數 300 億、推論時約啟用 30 億,支援 256K 脈絡。官方稱吞吐量最高可達同類開放模型 9 倍;鴻海科技集團、Palantir 等 7 家業者已採用。

全部報導

4 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
NVIDIA 發布 Cosmos 3 與 Nemotron 3 Ultra 推動開源實體 AI 生態2026-06-05 · 2 報導 · 相似 0.81

實體 AI 要讓機器人、自駕車與視覺代理理解環境並採取行動,長期受限於真實訓練資料不足及模擬工具分散。NVIDIA 將世界模型與代理推理模型開放權重、資料及訓練配方,意在降低開發門檻,並把 GPU、DGX Cloud 與軟體工具納入共同生態。

2026年5月31日,NVIDIA 於 GTC Taipei 發布 Cosmos 3,原生整合文字、影像、影片、環境聲音與動作,並與 Runway 等成立 Cosmos Coalition;6月4日再釋出 Nemotron 3 Ultra,總參數 5,500 億、啟用 550 億,推論吞吐最高增至 5 倍,代理任務成本最多降低 30%。

馬克雷達|MARK RADAR
全站時間均為台北時間(GMT+8)