馬克雷達MARK RADAR
關於
EN
登入
事件檔案 AI Google

Google 發表多模態影音模型 Gemini Omni 支援對話式編輯

4 篇報導 · 首次偵測 2026-05-20 · 最後活動 2026-06-12

Google 在 I/O 2026 發表 Gemini Omni,主打整合文字、圖片、影音等多種輸入,生成高保真影片。其重要性在於將影片製作從一次性提示,推進至可用自然語言反覆調整的「對話式編輯」,降低專業剪輯與內容創作門檻。

最新版本 Gemini Omni Flash 可精準修改視角、光線與動作,首版影片輸出上限為 10 秒;Google 並稱模型在三項影片生成評測達到 SOTA。Gemini Omni API 即將上線,且預計於 I/O 2026 大會當週免費導入 YouTube Shorts。

全部報導

4 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
Google 發布 Gemini Omni 1.1 Flash 影片模型2026-08-30 · 3 報導 · 相似 0.87

Google 正式發布 Gemini Omni 1.1 Flash,進一步擴充其生成式 AI 影片工具。影片模型競爭正從單次短片生成,轉向可延續敘事、維持人物與場景一致性的製作流程;首尾影格控制與不同解析度方案,也讓創作者更容易規劃鏡位、成品質素與成本。

本次升級加入接拍功能,連續分段影片最長可延伸至 40 秒,並把續接時可參考的前文長度提高至 10 秒,以改善跨片段的人物一致性。Gemini Omni 1.1 Flash 同時支援指定首、尾影格,並導入四級解析度計價模式及 4K 升頻選項;Google 尚未在相關報導標題中揭露正式發布日期與各級價格。

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)