Google 正式發布 Gemini Omni 1.1 Flash,進一步擴充其生成式 AI 影片工具。影片模型競爭正從單次短片生成,轉向可延續敘事、維持人物與場景一致性的製作流程;首尾影格控制與不同解析度方案,也讓創作者更容易規劃鏡位、成品質素與成本。
本次升級加入接拍功能,連續分段影片最長可延伸至 40 秒,並把續接時可參考的前文長度提高至 10 秒,以改善跨片段的人物一致性。Gemini Omni 1.1 Flash 同時支援指定首、尾影格,並導入四級解析度計價模式及 4K 升頻選項;Google 尚未在相關報導標題中揭露正式發布日期與各級價格。
全部報導
3 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Google 發表多模態影音模型 Gemini Omni 支援對話式編輯
Google 在 I/O 2026 發表 Gemini Omni,主打整合文字、圖片、影音等多種輸入,生成高保真影片。其重要性在於將影片製作從一次性提示,推進至可用自然語言反覆調整的「對話式編輯」,降低專業剪輯與內容創作門檻。
最新版本 Gemini Omni Flash 可精準修改視角、光線與動作,首版影片輸出上限為 10 秒;Google 並稱模型在三項影片生成評測達到 SOTA。Gemini Omni API 即將上線,且預計於 I/O 2026 大會當週免費導入 YouTube Shorts。
Google 發表 Gemini 3.5 Flash 模型,主打自主代理與程式開發
Google於2026年Google I/O開發者大會推出Gemini 3.5 Flash,延續Gemini多模態模型布局,鎖定高頻調用、長上下文與即時回應的AI應用。其重要性在於以Flash級成本提供超越前代Pro的效能,並強化自主代理與程式開發能力。
最新公布的Gemini 3.5 Flash在多項agent評測中超越上一代Pro,推理與處理速度提升4倍。Google並展示模型可在12小時內完成作業系統開發,總成本低於1,000美元;公司同步重申加碼AI基礎建設,反映市場已有實際需求。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。