馬克雷達MARK RADAR
關於
EN
登入

Google 發布 Gemini 3.1 Flash-Lite 模型,主打低成本與大規模工作負載

3 篇報導 · 首次偵測 2026-03-04 · 最後活動 2026-03-04

Google DeepMind 的 Gemini 3 系列涵蓋 Pro、Flash 與 Flash-Lite,分別對應高階推理、速度及成本需求。Flash-Lite 鎖定翻譯、內容審核與資料標記等高頻工作,降低企業大量呼叫生成式 AI 的部署門檻。

Google 於 2026 年 3 月 3 日推出 Gemini 3.1 Flash-Lite 預覽版,開放 Google AI Studio 與 Vertex AI 使用。API 每 100 萬輸入、輸出 token 分別收費 0.25 與 1.50 美元,約為 Pro 版八分之一;官方稱輸出速度提高 45%。

全部報導

3 篇原始報導
NEWS.SMOL.AI 2026-03-03
not much happened today

馬克翻舊帳

這個事件的歷史脈絡
Google 內測 Gemini 3.8 Flash,旗艦 3.5 Pro 屢遭延宕2026-09-03 · 5 報導 · 相似 0.80

Google 正加速 Gemini 模型迭代,以兼顧低延遲、成本與推理能力的 Flash 系列迎戰 OpenAI、Anthropic。相較之下,定位旗艦的 Gemini 3.5 Pro 傳因底層架構重構及推理瓶頸三度延後,凸顯前沿模型擴展面臨的工程挑戰。

截至 2026 年 9 月 3 日,Google 已發表先前進入內部測試的 Gemini 3.8 Flash,宣稱軟體工程與推理能力全面提升,但更高強度運算可能推升使用成本。另推出同核心的 Gemini 3.8 Flash Cyber,採限制開放模式;早鳥價格據報約為 Anthropic Opus 5 的六分之一,Gemini 3.5 Pro 上線日仍未公布。

Google 發表 2026 年 8 月最新 AI 進展與 Gemini 3.7 Flash2026-09-02 · 1 報導 · 相似 0.83

Google 長期把 Gemini 模型、Pixel 硬體與 Workspace 服務整合為同一套 AI 生態系。這次月度回顧的重要性,在於公司不再只追求模型能力,而是同步壓低開發成本、把語音與代理功能帶入日常工作,並以裝置端 AI 擴大消費者觸及。

Google 於 2026 年 9 月 1 日彙整 8 月進展:Gemini 3.7 Flash 在前代推出僅三週後問世,每百萬 token 上市價為 3.6 Flash 原價一半;同月另推 Gemini 3.5 Transcribe 與 Pixel 11 系列。Gemini App 月活突破 10 億,Omni 1.1 Flash 也新增 4K 升頻等影片功能。

Google 傳推出 Gemini 3.7 Flash 且 API 價格砍半2026-08-17 · 9 報導 · 相似 0.85

Google 的 Flash 系列定位為兼顧速度、成本與推理能力的「主力」模型,服務大量程式開發與 AI 代理工作。模型迭代週期縮短、推論費用下探,正成為 Google 與 OpenAI 等業者爭奪開發者和企業工作負載的關鍵。

Google 於 2026年8月13日推出 Gemini 3.7 Flash,距7月21日發布 3.6 Flash 僅三週。Gemini API 優惠價至12月31日為每百萬輸入、輸出 token 0.75美元與3.75美元,均為原價一半;2027年1月1日起恢復1.50美元與7.50美元。

Google 發布 2026 年 7 月最新 AI 成果與 Gemini 模型2026-08-05 · 1 報導 · 相似 0.83

Google 以 Gemini 為核心,將生成式 AI 從聊天工具推向可規劃、呼叫工具並完成多步驟任務的 Agent,應用也逐步延伸至搜尋、開發平台與機器人。Flash 系列強調速度、成本與推理能力的平衡,攸關企業能否大規模部署 AI 工作流程。

Google DeepMind 7 月 21 日推出 Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite。前者輸出 Token 較 3.5 Flash 少 17%,每百萬輸入/輸出 Token 定價 1.50/7.50 美元;後者每秒輸出 350 Token,定價 0.30/2.50 美元,並開始導入 Google Search。

Google發表三款Gemini新模型2026-07-29 · 9 報導 · 相似 0.84

生成式 AI 競爭正從聊天機器人轉向可連續呼叫工具、執行多步任務的 AI 代理,企業因而更重視 Token 成本、回應速度與資安能力。Google 以 Gemini Flash 系列補強輕量模型陣容,藉此擴大 Gemini API 生態系並提高大規模部署的經濟性。

截至 2026 年 7 月 29 日,Google 發表 Gemini 3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber 三款模型,主打更快運算與更高 Token 效率。其中 Cyber 微調模型已進入漏洞修補試點;3.5 Pro 仍在測試,下一代 Gemini 4 則已啟動預訓練。

Google 推出平價 AI 資安模型 Gemini 3.5 Flash Cyber2026-07-22 · 2 報導 · 相似 0.80

生成式 AI 已能加速找出、驗證並修補軟體漏洞,也可能被用於開發攻擊工具,使資安模型的成本與存取控管成為焦點。Google 以 Gemini 3.5 Flash 為基礎打造 Cyber 版本,主打較低的每代幣價格,挑戰 Anthropic 的 Mythos 等大型資安模型。

Google 於 2026 年 7 月 21 日發表 Gemini 3.5 Flash Cyber,搭配 CodeMender 以多個代理協作並整合成單一報告,在 CyberGym 基準測試達到前沿競爭水準。模型將於近期先向政府與可信賴夥伴展開限量試行;Google 尚未公布實際定價或公開上市日期。

Google 發表 Gemini 3.5 Flash 模型,主打自主代理與程式開發2026-05-21 · 7 報導 · 相似 0.87

Google於2026年Google I/O開發者大會推出Gemini 3.5 Flash,延續Gemini多模態模型布局,鎖定高頻調用、長上下文與即時回應的AI應用。其重要性在於以Flash級成本提供超越前代Pro的效能,並強化自主代理與程式開發能力。

最新公布的Gemini 3.5 Flash在多項agent評測中超越上一代Pro,推理與處理速度提升4倍。Google並展示模型可在12小時內完成作業系統開發,總成本低於1,000美元;公司同步重申加碼AI基礎建設,反映市場已有實際需求。

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)