NVIDIA 發表 Nemotron 3 Nano Omni 開源多模態模型
4 篇報導 · 首次偵測 2026-04-29 · 最後活動 2026-04-29
目前 AI agent 通常分別呼叫視覺、語音與語言模型,資料轉接不僅增加延遲,也可能遺失脈絡。NVIDIA 將影音、影像、文字與文件理解整合至單一開放模型,鎖定電腦操作、客服及監控等應用,攸關企業部署成本與 AI 軟體生態競爭。
2026 年 4 月 28 日,NVIDIA 發布 Nemotron 3 Nano Omni;模型採 30B-A3B 混合專家架構,總參數 300 億、推論時約啟用 30 億,支援 256K 脈絡。官方稱吞吐量最高可達同類開放模型 9 倍;鴻海科技集團、Palantir 等 7 家業者已採用。
全部報導
4 篇原始報導馬克翻舊帳
這個事件的歷史脈絡NVIDIA 發布 Cosmos 3 與 Nemotron 3 Ultra 推動開源實體 AI 生態
實體 AI 要讓機器人、自駕車與視覺代理理解環境並採取行動,長期受限於真實訓練資料不足及模擬工具分散。NVIDIA 將世界模型與代理推理模型開放權重、資料及訓練配方,意在降低開發門檻,並把 GPU、DGX Cloud 與軟體工具納入共同生態。
2026年5月31日,NVIDIA 於 GTC Taipei 發布 Cosmos 3,原生整合文字、影像、影片、環境聲音與動作,並與 Runway 等成立 Cosmos Coalition;6月4日再釋出 Nemotron 3 Ultra,總參數 5,500 億、啟用 550 億,推論吞吐最高增至 5 倍,代理任務成本最多降低 30%。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。