DeepSeek 正式推出 DeepSeek-V4 預覽版模型
DeepSeek 於 2025 年初以低成本 R1 震撼全球 AI 市場,並促使投資人重新評估高額算力投入。V4 是其新一代旗艦模型,重點轉向長文本、推理與 Agent 自主執行能力;能否以開源及低價策略追近 OpenAI、Anthropic 與 Google,牽動中國模型的競爭位置。
DeepSeek 於 2026 年 4 月 24 日正式上線並開源 V4 預覽版,推出 1.6 兆參數 Pro 與 2,840 億參數 Flash;兩者皆支援 100 萬 token 上下文及思考、非思考模式。API 每百萬 token 未命中快取輸入/輸出價,Flash 為人民幣 1/2 元,Pro 為 3/6 元。
全部報導
5 篇原始報導馬克翻舊帳
這個事件的歷史脈絡DeepSeek V4-Flash 登陸 Ollama Cloud 並支援多款 AI 開發工具
中國 AI 新創 DeepSeek 於 2026 年 4 月 24 日發布 V4 系列預覽版;其中 V4-Flash 採 MoE 架構,總參數 2,840 億、每次僅啟用 130 億,並支援 100 萬 token 脈絡。其意義在於以較少啟用參數處理程式碼與長文件,降低超長脈絡推論的算力與部署門檻。
截至 2026 年 7 月 20 日,Ollama Cloud 已上架 V4-Flash,開發者可用 ollama launch 一鍵串接 Claude Code、OpenClaw、Codex 與 OpenCode。雲端版提供 100 萬 token 脈絡,Ollama 尚未公布此模型的獨立計費金額。
DeepSeek 傳打破慣例,未向 Nvidia 與 AMD 展示最新 AI 模型 V4
中國 AI 新創 DeepSeek 以低成本大型語言模型受到關注,模型在不同晶片上的預先調校,會直接影響推論效能與硬體採用。過往開發商通常會在發布前向 Nvidia、AMD 提供模型;此次轉向華為,牽動中國降低美國先進晶片依賴的布局。
知情人士指出,DeepSeek 在旗艦模型 V4 發布前,未讓 Nvidia 與 AMD 取得預發布版本,反而優先開放華為等中國供應商存取。相關消息稱,V4 預定於 4 月下旬推出,支援百萬 token 視窗,並可能採用華為昇騰 950PR;另有報導宣稱其成本約為 GPT 的百分之一。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。