Google發表三款Gemini新模型
企業部署 AI 代理時,模型往往需反覆呼叫工具並處理大量 Token,成本、延遲與資安能力因此成為規模化應用的關鍵。Google 以 Gemini Flash 系列補強輕量、高速產品線,意在鞏固開發者生態系,並與 OpenAI、Anthropic 等業者競逐企業市場。
Google 於 2026 年 7 月 22 日發表 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 與 Gemini 3.5 Flash Cyber 共三款模型,主打更低 Token 成本與更快運算;其中 Cyber 為漏洞修補等網路安全工作微調,現已進入試點。Google 同時表示 3.5 Pro 正在測試,Gemini 4 預訓練也已啟動。
全部報導
8 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Google 推出平價 AI 資安模型 Gemini 3.5 Flash Cyber
隨著 AI 代理程式找出漏洞的速度逐漸超過防禦團隊修補能力,資安模型的運算成本與部署規模成為關鍵。Google DeepMind 以 Gemini 3.5 Flash 為基礎打造 Flash Cyber,鎖定快速尋找、驗證與修補漏洞,定位為 Anthropic Mythos 等大型模型之外的低成本選項。
Google DeepMind 於 2026 年 7 月 21 日公布,模型將於近期透過 CodeMender 限量提供政府與可信賴夥伴,公司尚未公布獨立定價。V8 測試中,它找出 55 個獲確認問題,高於 Gemini 3.5 Flash 的 47 個及 Claude Opus 4.6 的 36 個,其中 10 個未被另兩款模型發現。
Google 發布 Gemma 4 開放模型強化開源 AI 市場布局
Google 以 Gemma 系列作為可下載、自行部署的開放模型產品線,藉由多種參數規模降低企業與開發者採用生成式 AI 的門檻。Gemma 4 進一步對準 Meta 的 Llama、阿里巴巴的 Qwen,競爭本地端推論、工具整合及開發者生態地位。
Google 最新釋出 Gemma 4,涵蓋 2B 至 31B 四種規格,支援超過 140 種語言及多模態處理,並針對 NVIDIA H100 優化。其中 12B 版本可在配備 16GB VRAM 的消費型筆電本地運行,採 Apache 2.0 授權;現有資料未揭露確切發布日期與商業金額。
Google 發表 Gemini 3.5 Flash 模型,主打自主代理與程式開發
Google於2026年Google I/O開發者大會推出Gemini 3.5 Flash,延續Gemini多模態模型布局,鎖定高頻調用、長上下文與即時回應的AI應用。其重要性在於以Flash級成本提供超越前代Pro的效能,並強化自主代理與程式開發能力。
最新公布的Gemini 3.5 Flash在多項agent評測中超越上一代Pro,推理與處理速度提升4倍。Google並展示模型可在12小時內完成作業系統開發,總成本低於1,000美元;公司同步重申加碼AI基礎建設,反映市場已有實際需求。
Google 推出 Gemini 3.1 Pro 並擴展至雲端與企業平台
Google於2025年11月18日推出Gemini 3 Pro後,持續把生成式AI從消費端延伸至企業工作流程。Gemini 3.1 Pro聚焦複雜、多步驟推理,能整合表格與非結構化資料;對Google而言,這是以Vertex AI與Gemini Enterprise爭取企業AI基礎設施市場的關鍵布局。
Google於2026年2月19日發布3.1 Pro預覽版,並導入Vertex AI與Gemini Enterprise。ARC-AGI-2得分77.1%,是3 Pro逾兩倍;JetBrains測得最高15%改善,Databricks稱其OfficeQA成績領先業界,Google未公布授權金額。
Google 發布 Gemini 3.1 Flash-Lite 模型,主打低成本與大規模工作負載
Google DeepMind 的 Gemini 3 系列涵蓋 Pro、Flash 與 Flash-Lite,分別對應高階推理、速度及成本需求。Flash-Lite 鎖定翻譯、內容審核與資料標記等高頻工作,降低企業大量呼叫生成式 AI 的部署門檻。
Google 於 2026 年 3 月 3 日推出 Gemini 3.1 Flash-Lite 預覽版,開放 Google AI Studio 與 Vertex AI 使用。API 每 100 萬輸入、輸出 token 分別收費 0.25 與 1.50 美元,約為 Pro 版八分之一;官方稱輸出速度提高 45%。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。