馬克雷達MARK RADAR
關於
EN
登入

DeepSeek V4-Flash 登陸 Ollama Cloud 並支援多款 AI 開發工具

2 篇報導 · 首次偵測 2026-04-24 · 最後活動 2026-04-27

中國 AI 新創 DeepSeek 於 2026 年 4 月 24 日發布 V4 系列預覽版;其中 V4-Flash 採 MoE 架構,總參數 2,840 億、每次僅啟用 130 億,並支援 100 萬 token 脈絡。其意義在於以較少啟用參數處理程式碼與長文件,降低超長脈絡推論的算力與部署門檻。

截至 2026 年 7 月 20 日,Ollama Cloud 已上架 V4-Flash,開發者可用 ollama launch 一鍵串接 Claude Code、OpenClaw、Codex 與 OpenCode。雲端版提供 100 萬 token 脈絡,Ollama 尚未公布此模型的獨立計費金額。

全部報導

2 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
DeepSeek 升級 V4-Flash,提升 Agent 與程式碼能力2026-08-03 · 3 報導 · 相似 0.84

中國 AI 新創 DeepSeek 以低價開放模型挑戰美國業者。V4-Flash 採 MoE 架構,共 284B 參數、啟用 13B,支援 100 萬 token 脈絡。美國國家標準暨技術研究院 CAISI 5 月評估顯示,V4 Pro 在七項測試中有五項成本低於 GPT-5.4 mini,凸顯價格競爭力。

2026年7月31日,DeepSeek發布 DeepSeek-V4-Flash-0731,維持284B架構與MIT授權,僅重做後訓練。Terminal Bench 2.1、DeepSWE達82.7、54.4;API同步公測,未快取輸入與輸出每百萬token收費0.14、0.28美元,支援自建部署。

DeepSeek 正式推出 DeepSeek-V4 預覽版模型2026-04-28 · 5 報導 · 相似 0.81

DeepSeek 於 2025 年初以低成本 R1 震撼全球 AI 市場,並促使投資人重新評估高額算力投入。V4 是其新一代旗艦模型,重點轉向長文本、推理與 Agent 自主執行能力;能否以開源及低價策略追近 OpenAI、Anthropic 與 Google,牽動中國模型的競爭位置。

DeepSeek 於 2026 年 4 月 24 日正式上線並開源 V4 預覽版,推出 1.6 兆參數 Pro 與 2,840 億參數 Flash;兩者皆支援 100 萬 token 上下文及思考、非思考模式。API 每百萬 token 未命中快取輸入/輸出價,Flash 為人民幣 1/2 元,Pro 為 3/6 元。

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)