馬克雷達MARK RADAR
關於
EN
登入

OpenAI與Google推高速AI模型,推論速度成新賣點

1 篇報導 · 首次偵測 2026-08-15 · 最後活動 2026-08-15

生成式AI競爭過去多以模型能力與價格為焦點,但企業導入客服、程式代理與金融分析後,等待時間直接影響生產力與使用率,推論延遲遂成為可收費的產品差異。OpenAI今年1月14日與Cerebras簽署多年合作,採用750MW低延遲運算,交易據報逾100億美元並分階段部署至2028年。

8月13日,OpenAI預覽Ultrafast服務,以Cerebras晶片讓GPT-5.6 Sol最高每秒輸出750個token,較Standard快至14倍;首波僅供特定API客戶,價格未公布。同日Google推出Gemini 3.7 Flash,年底前每百萬輸入、輸出token收0.75、3.75美元,2027年1月起加倍。

全部報導

1 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡

這個訊號沒有歷史回聲

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)