DeepSeek 是中國人工智慧模型業者,若登上聚焦硬科技企業的上海證券交易所科創板,將可望拓展研發與算力所需的資本來源。此次上市籌備也反映中國本土 AI 公司在模型競爭升溫之際,正尋求資本市場支持長期投入。
市場消息指出,DeepSeek 已委託中信證券籌備科創板首次公開募股,雙方目前進入盡職調查階段,但上市時程與募資金額尚未披露。產品方面,公司預計於 9 月 10 日前後推出 V4.1 Flash,並稱新模型將全面提升效能與運行速度。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡DeepSeek V4.1 Flash 將上線,效能超車 Pro 且費用砍三分之二
DeepSeek 以低成本、高效率模型挑戰大型 AI 業者,V4 Pro 原是其現行高階服務。新一代 V4.1 Flash 聚焦效能、推論速度與使用成本,若官方測試結果能在實際應用中重現,將降低開發者部署生成式 AI 的門檻,也可能加劇模型供應商之間的價格競爭。
DeepSeek 已於 9 月 10 日前後正式發布 V4.1 Flash,並自評其效能、成本與速度等關鍵指標全面超越 V4 Pro。過渡期間,所有 Pro 請求將自動改由 Flash 處理並套用新費率;其中離峰時段的輸出費用調降三分之二,可望明顯壓低高用量開發者的帳單。
DeepSeek 正式推出 DeepSeek-V4 預覽版模型
DeepSeek 於 2025 年初以低成本 R1 震撼全球 AI 市場,並促使投資人重新評估高額算力投入。V4 是其新一代旗艦模型,重點轉向長文本、推理與 Agent 自主執行能力;能否以開源及低價策略追近 OpenAI、Anthropic 與 Google,牽動中國模型的競爭位置。
DeepSeek 於 2026 年 4 月 24 日正式上線並開源 V4 預覽版,推出 1.6 兆參數 Pro 與 2,840 億參數 Flash;兩者皆支援 100 萬 token 上下文及思考、非思考模式。API 每百萬 token 未命中快取輸入/輸出價,Flash 為人民幣 1/2 元,Pro 為 3/6 元。
DeepSeek 發布 DeepSeek-V4.1-Flash 模型,支援 1M 長上下文
DeepSeek AI 持續以開源模型挑戰高成本、封閉式的生成式 AI 路線。新推出的 DeepSeek-V4.1-Flash 是多模態混合專家模型,主打 100 萬 token 長上下文,可處理大型程式碼庫、長篇文件及跨模態內容;降低推論所需的記憶體與運算量,是其能否擴大開發者採用的關鍵。
DeepSeek-V4.1-Flash 採用因果編解碼器架構,藉此減少長文本預填充階段的運算,並導入 FP4 KV 快取及跨層注意力重用,大幅壓低 KV 快取的記憶體占用。DeepSeek AI 同時以 MIT 授權釋出模型權重,允許開發者研究、修改與商用;目前提供的報導資訊未載明確切發布日期、參數規模及效能基準。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。