Meta 旗下超級智慧實驗室推出 Muse Voice Transcribe,將串流語音辨識、說話者分離與語句結束點偵測整合在單一即時模型中,省去開發者串接多套系統的複雜度。這項整合有助降低語音助理、會議記錄與即時字幕的延遲,也反映 Meta 正加速布局多語言音訊 AI 基礎設施。
Muse Voice Transcribe 可辨識超過 70 種語言,並在多人情境中區分逾 20 位說話者,目前已透過 Meta Model API 開放開發者使用。Meta 同時將模型帶到 Mac,使用者按住 Fn 鍵即可啟動系統層級語音輸入,讓即時轉錄能力直接覆蓋不同應用程式與文字欄位。
全部報導
3 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。