微軟持續透過 Microsoft AI 擴大自研模型版圖,降低企業導入生成式 AI 時對單一外部供應商的依賴。此次補上影像生成、語音辨識與語音合成,並整合 Microsoft Foundry、Copilot、Bing、PowerPoint 與 Azure Speech,讓企業可在既有工作流部署「看、聽、說」能力。
2026年4月2日,微軟宣布MAI-Transcribe-1、MAI-Voice-1與MAI-Image-2進駐Foundry。轉錄模型支援25種語言,每小時0.36美元起;語音模型以單一GPU在1秒內生成60秒音訊,每百萬字元22美元起;影像模型登Arena.ai同類榜第3名。
全部報導
5 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。