Gemini Flash 是 Google DeepMind 面向高頻、低延遲工作負載的主力模型系列,重點從一般生成式應用延伸到可自主規劃與執行的代理任務。Gemini 3.8 Flash 強化軟體工程與多步推理,並以同一核心衍生 Cyber 版,反映業界正把前沿模型能力導入防禦性資安,同時以存取管制降低遭濫用風險。
Google 於2026年9月2日發表 Gemini 3.8 Flash,每百萬 token 輸入、輸出定價0.75美元、3.75美元。Cyber 版跨20種語言的內部測試成功率逾70%,CWE-Bench 修補 pass@1達47.2%,僅透過 Fairwind Program 提供可信政府、基礎設施業者與軟體維護者。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Google 內測 Gemini 3.8 Flash,旗艦 3.5 Pro 屢遭延宕
Google 正加速 Gemini 模型迭代,以兼顧低延遲、成本與推理能力的 Flash 系列迎戰 OpenAI、Anthropic。相較之下,定位旗艦的 Gemini 3.5 Pro 傳因底層架構重構及推理瓶頸三度延後,凸顯前沿模型擴展面臨的工程挑戰。
截至 2026 年 9 月 3 日,Google 已發表先前進入內部測試的 Gemini 3.8 Flash,宣稱軟體工程與推理能力全面提升,但更高強度運算可能推升使用成本。另推出同核心的 Gemini 3.8 Flash Cyber,採限制開放模式;早鳥價格據報約為 Anthropic Opus 5 的六分之一,Gemini 3.5 Pro 上線日仍未公布。
Google 發表 2026 年 8 月最新 AI 進展與 Gemini 3.7 Flash
Google 長期把 Gemini 模型、Pixel 硬體與 Workspace 服務整合為同一套 AI 生態系。這次月度回顧的重要性,在於公司不再只追求模型能力,而是同步壓低開發成本、把語音與代理功能帶入日常工作,並以裝置端 AI 擴大消費者觸及。
Google 於 2026 年 9 月 1 日彙整 8 月進展:Gemini 3.7 Flash 在前代推出僅三週後問世,每百萬 token 上市價為 3.6 Flash 原價一半;同月另推 Gemini 3.5 Transcribe 與 Pixel 11 系列。Gemini App 月活突破 10 億,Omni 1.1 Flash 也新增 4K 升頻等影片功能。
Google發表三款Gemini新模型
生成式 AI 競爭正從聊天機器人轉向可連續呼叫工具、執行多步任務的 AI 代理,企業因而更重視 Token 成本、回應速度與資安能力。Google 以 Gemini Flash 系列補強輕量模型陣容,藉此擴大 Gemini API 生態系並提高大規模部署的經濟性。
截至 2026 年 7 月 29 日,Google 發表 Gemini 3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber 三款模型,主打更快運算與更高 Token 效率。其中 Cyber 微調模型已進入漏洞修補試點;3.5 Pro 仍在測試,下一代 Gemini 4 則已啟動預訓練。
Google 推出平價 AI 資安模型 Gemini 3.5 Flash Cyber
生成式 AI 已能加速找出、驗證並修補軟體漏洞,也可能被用於開發攻擊工具,使資安模型的成本與存取控管成為焦點。Google 以 Gemini 3.5 Flash 為基礎打造 Cyber 版本,主打較低的每代幣價格,挑戰 Anthropic 的 Mythos 等大型資安模型。
Google 於 2026 年 7 月 21 日發表 Gemini 3.5 Flash Cyber,搭配 CodeMender 以多個代理協作並整合成單一報告,在 CyberGym 基準測試達到前沿競爭水準。模型將於近期先向政府與可信賴夥伴展開限量試行;Google 尚未公布實際定價或公開上市日期。
Google 發表 Gemini 3.5 Flash 模型,主打自主代理與程式開發
Google於2026年Google I/O開發者大會推出Gemini 3.5 Flash,延續Gemini多模態模型布局,鎖定高頻調用、長上下文與即時回應的AI應用。其重要性在於以Flash級成本提供超越前代Pro的效能,並強化自主代理與程式開發能力。
最新公布的Gemini 3.5 Flash在多項agent評測中超越上一代Pro,推理與處理速度提升4倍。Google並展示模型可在12小時內完成作業系統開發,總成本低於1,000美元;公司同步重申加碼AI基礎建設,反映市場已有實際需求。
Google 發布 Gemini 3.1 Flash-Lite 模型,主打低成本與大規模工作負載
Google DeepMind 的 Gemini 3 系列涵蓋 Pro、Flash 與 Flash-Lite,分別對應高階推理、速度及成本需求。Flash-Lite 鎖定翻譯、內容審核與資料標記等高頻工作,降低企業大量呼叫生成式 AI 的部署門檻。
Google 於 2026 年 3 月 3 日推出 Gemini 3.1 Flash-Lite 預覽版,開放 Google AI Studio 與 Vertex AI 使用。API 每 100 萬輸入、輸出 token 分別收費 0.25 與 1.50 美元,約為 Pro 版八分之一;官方稱輸出速度提高 45%。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。