語音辨識系統產出的逐字稿,往往保留贅字、重複語句與口誤,也缺乏適當標點,仍需額外編修才能成為可讀文章。語音應用開發商 Superwhisper 因此將文字正規化獨立成模型,瞄準會議紀錄、語音輸入與離線轉錄等重視隱私及即時性的應用場景。
Superwhisper 近日推出開放權重文字正規化模型 S1-mini,以 Qwen3-0.6B 為基礎微調,模型容量僅 462 MB,可直接在筆電 CPU 上流暢執行。它能把 ASR 原始逐字稿去除贅字、修正口誤並補上精確標點,轉換為連貫的書面文本,降低雲端運算與人工後製需求。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。