中國人工智慧新創 DeepSeek 持續以高效能模型挑戰歐美業者,此次把競爭從文字推理延伸至視覺理解。多模態能力可讓 AI 同時處理文字、圖片與介面截圖,是打造能操作軟體、理解文件及執行複雜任務的 Agent 關鍵,也使其與 Anthropic 高階模型的競爭更直接。
DeepSeek 推出實驗性模型 V4-Flash-Vision-Exp,加入圖像與截圖分析功能。公司表示,新模型在多模態 Agent 基準測試的表現大幅提升,整體性能已逼近 Anthropic 的 Claude Opus 4.8,但尚未公布具體分數。截至2026年8月24日,模型已在 DeepSeek API 平臺上線,開放開發者調用。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。