Google 內測 Gemini 3.8 Flash,旗艦 3.5 Pro 屢遭延宕 AI
Google 正加快 Gemini 模型迭代,以 Flash 系列兼顧速度、成本與大規模部署,對抗 OpenAI、Anthropic 的生成式 AI 產品。相較之下,定位旗艦的 Gemini 3.5 Pro 傳因底層架構重構及推理效能瓶頸,開發進度持續受阻。
Google DeepMind 在 2026 年 9 月公布 Gemini 3.8 Flash,主打軟體工程與推理能力提升,並推出採不同存取限制的 Gemini 3.8 Flash Cyber。該模型先前已進入內部測試;另一方面,Gemini 3.5 Pro 據報三度延後,截至 9 月 3 日仍無確定上線日期。
3 篇報導
舊帳 (3)
Google 發表 Gemini 3.5 Flash 模型,主打自主代理與程式開發
Google於2026年Google I/O開發者大會推出Gemini 3.5 Flash,延續Gemini多模態模型布局,鎖定高頻調用、長上下文與即時回應的AI應用。其重要性在於以Flash級成本提供超越前代Pro的效能,並強化自主代理與程式開發能力。
最新公布的Gemini 3.5 Flash在多項agent評測中超越上一代Pro,推理與處理速度提升4倍。Google並展示模型可在12小時內完成作業系統開發,總成本低於1,000美元;公司同步重申加碼AI基礎建設,反映市場已有實際需求。
完整脈絡 →Google 發表 2026 年 8 月最新 AI 進展與 Gemini 3.7 Flash
Google 長期把 Gemini 模型、Pixel 硬體與 Workspace 服務整合為同一套 AI 生態系。這次月度回顧的重要性,在於公司不再只追求模型能力,而是同步壓低開發成本、把語音與代理功能帶入日常工作,並以裝置端 AI 擴大消費者觸及。
Google 於 2026 年 9 月 1 日彙整 8 月進展:Gemini 3.7 Flash 在前代推出僅三週後問世,每百萬 token 上市價為 3.6 Flash 原價一半;同月另推 Gemini 3.5 Transcribe 與 Pixel 11 系列。Gemini App 月活突破 10 億,Omni 1.1 Flash 也新增 4K 升頻等影片功能。
完整脈絡 →Google發表三款Gemini新模型
生成式 AI 競爭正從聊天機器人轉向可連續呼叫工具、執行多步任務的 AI 代理,企業因而更重視 Token 成本、回應速度與資安能力。Google 以 Gemini Flash 系列補強輕量模型陣容,藉此擴大 Gemini API 生態系並提高大規模部署的經濟性。
截至 2026 年 7 月 29 日,Google 發表 Gemini 3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber 三款模型,主打更快運算與更高 Token 效率。其中 Cyber 微調模型已進入漏洞修補試點;3.5 Pro 仍在測試,下一代 Gemini 4 則已啟動預訓練。
完整脈絡 →