事件檔案
AI 字節跳動(ByteDance)
字節跳動推出 SeedRealtime 原生音視訊 AI 模型並於豆包 App 上線
2 篇報導 · 首次偵測 2026-08-06 · 最後活動 2026-08-10
生成式 AI 助理正從文字問答走向可持續感知環境的即時互動,關鍵在於能否把聽、看、理解與回應整合於同一模型。字節跳動的 SeedRealtime 採原生音視訊全雙工架構,意在降低多模態元件串接造成的延遲,並以更自然的互動體驗追趕 OpenAI 等對手。
字節跳動 Seed 團隊於 2026 年 8 月 5 日發布 SeedRealtime,讓單一模型同步處理音訊、影像與文字串流,並在說話時持續聆聽與觀看。模型已正式部署至豆包 App;使用者可開啟手機鏡頭,針對眼前場景即時對話,將技術從研究展示推向消費級應用。
全部報導
2 篇原始報導馬克翻舊帳
這個事件的歷史脈絡字節跳動豆包發布 Seed Audio 1.0 多模態音訊生成模型
生成式 AI 正從單一語音或音樂工具,走向可統籌完整聲音敘事的多模態系統。字節跳動旗下豆包推出 Seed Audio 1.0,鎖定影視與多媒體製作流程,讓創作者以同一模型協調人聲、配樂及環境音效,降低分別生成、剪輯與混音的門檻。
豆包團隊最新發布 Seed Audio 1.0,可在一次推理中生成並整合人聲、配樂與環境聲,形成單一且連貫的聲音場景。模型已於此次發布時同步上線火山方舟體驗中心開放測試,主打影視級 AI 音訊生成能力,但目前尚未公布商用定價與正式全面上線日期。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。