馬克雷達MARK RADAR
關於
EN
登入

DeepSeek V4.1 Flash 將上線,效能超車 Pro 且費用砍三分之二

2 篇報導 · 首次偵測 2026-09-10 · 最後活動 2026-09-10

DeepSeek 以低成本、高效率模型挑戰大型 AI 業者,V4 Pro 原是其現行高階服務。新一代 V4.1 Flash 聚焦效能、推論速度與使用成本,若官方測試結果能在實際應用中重現,將降低開發者部署生成式 AI 的門檻,也可能加劇模型供應商之間的價格競爭。

DeepSeek 已於 9 月 10 日前後正式發布 V4.1 Flash,並自評其效能、成本與速度等關鍵指標全面超越 V4 Pro。過渡期間,所有 Pro 請求將自動改由 Flash 處理並套用新費率;其中離峰時段的輸出費用調降三分之二,可望明顯壓低高用量開發者的帳單。

全部報導

2 篇原始報導

馬克翻舊帳

這個事件的歷史脈絡
在這之前
DeepSeek 推出尖峰時段計費機制 旗艦 V4 模型價格調漲四倍首見 2026-08-14 · 2 報導 · 相似 0.84

DeepSeek 以低成本大型語言模型與 API 服務挑戰全球人工智慧業者,V4 為其旗艦模型,採每百萬 Token 計價。此次引入尖峰時段費率,顯示公司開始透過價格調節需求與運算資源;即使調價,其收費相較 Anthropic 等競爭對手仍偏低,可能牽動開發者的模型選擇與使用時段。

DeepSeek 宣布 V4 API 新制自 2026 年 8 月 17 日起生效,尖峰時段價格將調高至現行費率的四倍;相關報導並未列出調整前後每百萬 Token 的具體金額。這是該公司近期最顯著的定價變動,高峰期推論成本將大幅增加,但絕對價格仍低於 Anthropic 同級服務。

DeepSeek升級V4 Pro正式版 效能逼近Claude價格大幅降低首見 2026-08-13 · 3 報導 · 相似 0.83

中國人工智慧業者 DeepSeek 持續以低成本大型語言模型挑戰美國同業,旗艦產品 DeepSeek-V4-Pro 聚焦推理、程式開發與通用任務。其重要性在於,若能以接近 Anthropic 高階模型的效能大幅壓低使用成本,可能加速企業採用並加劇 AI 模型價格競爭。

DeepSeek 於 2026 年 8 月 13 日低調將 DeepSeek-V4-Pro 升級為「0813」正式版。相關測試顯示,其基準成績僅落後 Anthropic 的 Claude Fable 5 約 5.3%,但價格約便宜 46 倍,亦即對手成本高約 4,500%;報導未提供兩款模型每百萬 token 的具體美元費率。

DeepSeek 升級 V4-Flash,提升 Agent 與程式碼能力首見 2026-08-01 · 3 報導 · 相似 0.84

中國 AI 新創 DeepSeek 以低價開放模型挑戰美國業者。V4-Flash 採 MoE 架構,共 284B 參數、啟用 13B,支援 100 萬 token 脈絡。美國國家標準暨技術研究院 CAISI 5 月評估顯示,V4 Pro 在七項測試中有五項成本低於 GPT-5.4 mini,凸顯價格競爭力。

2026年7月31日,DeepSeek發布 DeepSeek-V4-Flash-0731,維持284B架構與MIT授權,僅重做後訓練。Terminal Bench 2.1、DeepSWE達82.7、54.4;API同步公測,未快取輸入與輸出每百萬token收費0.14、0.28美元,支援自建部署。

DeepSeek API 宣佈大幅降價:Cache Hit 價格降至一成,V4 Pro 折扣延期首見 2026-04-27 · 5 報導 · 相似 0.81

中國 AI 業者 DeepSeek 長期以低價 API 挑戰 OpenAI、Anthropic;其中輸入快取可重用既有內容,直接影響 RAG 與 Agent 等高重複請求服務的營運成本,因此價格調整備受開發者關注。

DeepSeek 最新宣布,全系列模型的「輸入 cache hit」API 費率降至原價十分之一;旗艦模型 V4 Pro 的 75% 限時折扣則延長至 2026 年 5 月 5 日,折後 API 輸出價格每百萬 Token 不到新台幣 30 元。

DeepSeek 正式推出 DeepSeek-V4 預覽版模型首見 2026-04-24 · 5 報導 · 相似 0.85

DeepSeek 於 2025 年初以低成本 R1 震撼全球 AI 市場,並促使投資人重新評估高額算力投入。V4 是其新一代旗艦模型,重點轉向長文本、推理與 Agent 自主執行能力;能否以開源及低價策略追近 OpenAI、Anthropic 與 Google,牽動中國模型的競爭位置。

DeepSeek 於 2026 年 4 月 24 日正式上線並開源 V4 預覽版,推出 1.6 兆參數 Pro 與 2,840 億參數 Flash;兩者皆支援 100 萬 token 上下文及思考、非思考模式。API 每百萬 token 未命中快取輸入/輸出價,Flash 為人民幣 1/2 元,Pro 為 3/6 元。

DeepSeek V4-Flash 登陸 Ollama Cloud 並支援多款 AI 開發工具首見 2026-04-24 · 2 報導 · 相似 0.80

中國 AI 新創 DeepSeek 於 2026 年 4 月 24 日發布 V4 系列預覽版;其中 V4-Flash 採 MoE 架構,總參數 2,840 億、每次僅啟用 130 億,並支援 100 萬 token 脈絡。其意義在於以較少啟用參數處理程式碼與長文件,降低超長脈絡推論的算力與部署門檻。

截至 2026 年 7 月 20 日,Ollama Cloud 已上架 V4-Flash,開發者可用 ollama launch 一鍵串接 Claude Code、OpenClaw、Codex 與 OpenCode。雲端版提供 100 萬 token 脈絡,Ollama 尚未公布此模型的獨立計費金額。

在這之後
DeepSeek 籌備科創板上市並將發布 V4.1 Flash首見 2026-09-10 · 1 報導 · 相似 0.81

DeepSeek 是中國人工智慧模型業者,若登上聚焦硬科技企業的上海證券交易所科創板,將可望拓展研發與算力所需的資本來源。此次上市籌備也反映中國本土 AI 公司在模型競爭升溫之際,正尋求資本市場支持長期投入。

市場消息指出,DeepSeek 已委託中信證券籌備科創板首次公開募股,雙方目前進入盡職調查階段,但上市時程與募資金額尚未披露。產品方面,公司預計於 9 月 10 日前後推出 V4.1 Flash,並稱新模型將全面提升效能與運行速度。

DeepSeek 發布 DeepSeek-V4.1-Flash 模型,支援 1M 長上下文首見 2026-09-10 · 1 報導 · 相似 0.84

DeepSeek AI 持續以開源模型挑戰高成本、封閉式的生成式 AI 路線。新推出的 DeepSeek-V4.1-Flash 是多模態混合專家模型,主打 100 萬 token 長上下文,可處理大型程式碼庫、長篇文件及跨模態內容;降低推論所需的記憶體與運算量,是其能否擴大開發者採用的關鍵。

DeepSeek-V4.1-Flash 採用因果編解碼器架構,藉此減少長文本預填充階段的運算,並導入 FP4 KV 快取及跨層注意力重用,大幅壓低 KV 快取的記憶體占用。DeepSeek AI 同時以 MIT 授權釋出模型權重,允許開發者研究、修改與商用;目前提供的報導資訊未載明確切發布日期、參數規模及效能基準。

馬克雷達|MARK RADAR

習慣在 Google 搜新聞的話,可以把馬克雷達設為偏好來源,搜尋結果會更常出現本站的整理。在 Google 設為偏好來源 →

全站時間均為台北時間(GMT+8)