Google 在 I/O 2026 發表 Gemini Omni,主打整合文字、圖片、影音等多種輸入,生成高保真影片。其重要性在於將影片製作從一次性提示,推進至可用自然語言反覆調整的「對話式編輯」,降低專業剪輯與內容創作門檻。
最新版本 Gemini Omni Flash 可精準修改視角、光線與動作,首版影片輸出上限為 10 秒;Google 並稱模型在三項影片生成評測達到 SOTA。Gemini Omni API 即將上線,且預計於 I/O 2026 大會當週免費導入 YouTube Shorts。
全部報導
4 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Google 發布 Gemini Omni 1.1 Flash 影片模型
Google 正式發布 Gemini Omni 1.1 Flash,進一步擴充其生成式 AI 影片工具。影片模型競爭正從單次短片生成,轉向可延續敘事、維持人物與場景一致性的製作流程;首尾影格控制與不同解析度方案,也讓創作者更容易規劃鏡位、成品質素與成本。
本次升級加入接拍功能,連續分段影片最長可延伸至 40 秒,並把續接時可參考的前文長度提高至 10 秒,以改善跨片段的人物一致性。Gemini Omni 1.1 Flash 同時支援指定首、尾影格,並導入四級解析度計價模式及 4K 升頻選項;Google 尚未在相關報導標題中揭露正式發布日期與各級價格。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。