Google於2026年Google I/O開發者大會推出Gemini 3.5 Flash,延續Gemini多模態模型布局,鎖定高頻調用、長上下文與即時回應的AI應用。其重要性在於以Flash級成本提供超越前代Pro的效能,並強化自主代理與程式開發能力。
最新公布的Gemini 3.5 Flash在多項agent評測中超越上一代Pro,推理與處理速度提升4倍。Google並展示模型可在12小時內完成作業系統開發,總成本低於1,000美元;公司同步重申加碼AI基礎建設,反映市場已有實際需求。
全部報導
7 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Google 內測 Gemini 3.8 Flash,旗艦 3.5 Pro 屢遭延宕
Google 正加快 Gemini 模型迭代,以 Flash 系列兼顧推理能力、回應速度與部署成本,抗衡 OpenAI、Anthropic。相較之下,定位旗艦的 Gemini 3.5 Pro 傳因底層架構重構及推理瓶頸遲未就緒,使產品布局更倚重 Flash 路線。
最新報導顯示,Google DeepMind 已推進 Gemini 3.8 Flash,並以一般版與 Gemini 3.8 Flash Cyber 兩種存取方案提供同一核心模型。Google 稱新版會投入更多運算完成任務,成本可能上升;3.5 Pro 則已三度延後,截至目前仍無確切上線日期。
Google 發表 2026 年 8 月最新 AI 進展與 Gemini 3.7 Flash
Google 長期把 Gemini 模型、Pixel 硬體與 Workspace 服務整合為同一套 AI 生態系。這次月度回顧的重要性,在於公司不再只追求模型能力,而是同步壓低開發成本、把語音與代理功能帶入日常工作,並以裝置端 AI 擴大消費者觸及。
Google 於 2026 年 9 月 1 日彙整 8 月進展:Gemini 3.7 Flash 在前代推出僅三週後問世,每百萬 token 上市價為 3.6 Flash 原價一半;同月另推 Gemini 3.5 Transcribe 與 Pixel 11 系列。Gemini App 月活突破 10 億,Omni 1.1 Flash 也新增 4K 升頻等影片功能。
Google 發布 Gemini Omni 1.1 Flash 影片模型
Google 正式發布 Gemini Omni 1.1 Flash,進一步擴充其生成式 AI 影片工具。影片模型競爭正從單次短片生成,轉向可延續敘事、維持人物與場景一致性的製作流程;首尾影格控制與不同解析度方案,也讓創作者更容易規劃鏡位、成品質素與成本。
本次升級加入接拍功能,連續分段影片最長可延伸至 40 秒,並把續接時可參考的前文長度提高至 10 秒,以改善跨片段的人物一致性。Gemini Omni 1.1 Flash 同時支援指定首、尾影格,並導入四級解析度計價模式及 4K 升頻選項;Google 尚未在相關報導標題中揭露正式發布日期與各級價格。
Google 傳推出 Gemini 3.7 Flash 且 API 價格砍半
Google 的 Flash 系列定位為兼顧速度、成本與推理能力的「主力」模型,服務大量程式開發與 AI 代理工作。模型迭代週期縮短、推論費用下探,正成為 Google 與 OpenAI 等業者爭奪開發者和企業工作負載的關鍵。
Google 於 2026年8月13日推出 Gemini 3.7 Flash,距7月21日發布 3.6 Flash 僅三週。Gemini API 優惠價至12月31日為每百萬輸入、輸出 token 0.75美元與3.75美元,均為原價一半;2027年1月1日起恢復1.50美元與7.50美元。
Google 發布 2026 年 7 月最新 AI 成果與 Gemini 模型
Google 以 Gemini 為核心,將生成式 AI 從聊天工具推向可規劃、呼叫工具並完成多步驟任務的 Agent,應用也逐步延伸至搜尋、開發平台與機器人。Flash 系列強調速度、成本與推理能力的平衡,攸關企業能否大規模部署 AI 工作流程。
Google DeepMind 7 月 21 日推出 Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite。前者輸出 Token 較 3.5 Flash 少 17%,每百萬輸入/輸出 Token 定價 1.50/7.50 美元;後者每秒輸出 350 Token,定價 0.30/2.50 美元,並開始導入 Google Search。
Google發表三款Gemini新模型
生成式 AI 競爭正從聊天機器人轉向可連續呼叫工具、執行多步任務的 AI 代理,企業因而更重視 Token 成本、回應速度與資安能力。Google 以 Gemini Flash 系列補強輕量模型陣容,藉此擴大 Gemini API 生態系並提高大規模部署的經濟性。
截至 2026 年 7 月 29 日,Google 發表 Gemini 3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber 三款模型,主打更快運算與更高 Token 效率。其中 Cyber 微調模型已進入漏洞修補試點;3.5 Pro 仍在測試,下一代 Gemini 4 則已啟動預訓練。
Google 推出平價 AI 資安模型 Gemini 3.5 Flash Cyber
生成式 AI 已能加速找出、驗證並修補軟體漏洞,也可能被用於開發攻擊工具,使資安模型的成本與存取控管成為焦點。Google 以 Gemini 3.5 Flash 為基礎打造 Cyber 版本,主打較低的每代幣價格,挑戰 Anthropic 的 Mythos 等大型資安模型。
Google 於 2026 年 7 月 21 日發表 Gemini 3.5 Flash Cyber,搭配 CodeMender 以多個代理協作並整合成單一報告,在 CyberGym 基準測試達到前沿競爭水準。模型將於近期先向政府與可信賴夥伴展開限量試行;Google 尚未公布實際定價或公開上市日期。
Google 推出 Gemini 3.1 Flash Live 並將 Search Live 推向全球逾 200 個國家
Google自2025年9月先在美國推出Search Live,將生成式AI從文字搜尋延伸至語音與鏡頭連續追問。服務結合Google搜尋索引與AI Mode,可在對話中拆解問題並提供網頁連結,反映Google正以Gemini重塑核心搜尋入口;公司未公布本次部署的投資金額。
2026年3月26日,Google發布即時音訊模型Gemini 3.1 Flash Live,提升多語回應速度、自然度與穩定性,並同步將Search Live擴至AI Mode已上線的200多個國家與地區、支援98種語言。使用者可在Android或iOS版Google App點選Live,也能透過Google Lens以鏡頭搭配語音連續搜尋。
Google 發布 Gemini 3.1 Flash-Lite 模型,主打低成本與大規模工作負載
Google DeepMind 的 Gemini 3 系列涵蓋 Pro、Flash 與 Flash-Lite,分別對應高階推理、速度及成本需求。Flash-Lite 鎖定翻譯、內容審核與資料標記等高頻工作,降低企業大量呼叫生成式 AI 的部署門檻。
Google 於 2026 年 3 月 3 日推出 Gemini 3.1 Flash-Lite 預覽版,開放 Google AI Studio 與 Vertex AI 使用。API 每 100 萬輸入、輸出 token 分別收費 0.25 與 1.50 美元,約為 Pro 版八分之一;官方稱輸出速度提高 45%。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。