DeepSeek正式發布V4.1 Flash模型,效能升/成本降

2026/09/10 15:17

MoneyDJ新聞 2026-09-10 15:17:40 新聞中心 發佈

綜合陸媒報導,中國人工智慧(AI)新創公司DeepSeek(深度求索)今(10)日正式發布 DeepSeek V4.1 Flash模型,其其全新模型結構系列中的最小尺寸的模型,具備原生多模態視覺理解能力,新模型結構的設計初衷是能力上限更高、推理速度更快、吞吐更大、可擴展至更大參數模型。

DeepSeek V4.1 Flash為552B參數的MoE模型,採用全新Causal-Encoder-Decoder 結構,輸入和輸出不對稱,輸入啟動僅8B,輸出啟動16B,成本顯著低於已知的同尺寸模型;並採用新的預訓練方式、經過更大規模的強化學習後訓練,在基準測試中,成功超越了包括DeepSeek V4 Pro等一眾旗艦模型的智慧水準。

與主流前瞻模型在Agentic Benchmark上的性能對比,呈現更少快取,更省成本。新一代模型大幅減少了KV Cache快取的大小,與上一代模型相比,對HBM的需求減少至四分之一,對SSD的需求減至八分之一;在Agent使用場景中,快取命中的費用往往占比較高,對KV Cache的壓縮大幅降低了Agent類任務的使用成本。

API支持方面,DeepSeek V4.1 Flash已同步上線DeepSeek API,原生支援多模態,將模型名稱更改為deepseek-flash即可調用最新的V4.1 Flash模型;舊版本模型 V4 Flash與V4 Flash Vision Exp現已下線,出於相容考量,模型名deepseek-v4-flash、deepseek-v4-flash-vision-exp將被暫時路由到V4.1 Flash。同時,V4.1 Flash 在性能、費用、速度、總用時等各項指標上已全面超越 V4 Pro,因此計畫有序下線V4 Pro 模型。

API定價調整方面,DeepSeek表示,受惠於模型架構創新,DeepSeek V4.1 Flash能夠以更低的成本服務更多的用戶,因此相應下調了V4.1 Flash的定價。同時,為更合理調配資源,仍採用峰谷定價,空閒時段價格為高峰時段價格的一半,鼓勵用戶根據實際使用情況調整任務時間;新價格於今日12:00開始生效。

(圖片來源:shutterstock)
個股K線圖-
熱門推薦