生成式AI競爭過去多以模型能力與價格為焦點,但企業導入客服、程式代理與金融分析後,等待時間直接影響生產力與使用率,推論延遲遂成為可收費的產品差異。OpenAI今年1月14日與Cerebras簽署多年合作,採用750MW低延遲運算,交易據報逾100億美元並分階段部署至2028年。
8月13日,OpenAI預覽Ultrafast服務,以Cerebras晶片讓GPT-5.6 Sol最高每秒輸出750個token,較Standard快至14倍;首波僅供特定API客戶,價格未公布。同日Google推出Gemini 3.7 Flash,年底前每百萬輸入、輸出token收0.75、3.75美元,2027年1月起加倍。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。