
就在剛剛,DeepSeek
V4 Pro 正式版來了。
最新的模型與價格頁面顯示,deepseek-v4-pro 對應模型版本已經更新為 DeepSeek-V4-Pro-0813。
從目前公布的資訊來看,deepseek-v4-pro 支持 1M 上下文長度,最大輸出長度達到 384K Token,同時支持非思考模式和思考模式,其中思考模式默認開啟。
對於長代碼庫、大規模文檔處理以及需要連續執行大量步驟的 Agent 任務來說,1M 上下文和 384K 最大輸出,意味著一次調用能夠容納和生成的內容規模都相當可觀。

配套能力也基本覆蓋了目前主流的 Agent 開發需求。
deepseek-v4-pro 支持 JSON Output、Tool Calls、Responses API、Anthropic API,同時支持 Beta 階段的對話前綴續寫與 FIM 補全,其中 FIM 補全僅限非思考模式使用。
API 接入方式則同時兼容 OpenAI 和 Anthropic 兩套格式。
更值得關注的還是價格。DeepSeek 此前發布公告,宣布計劃近期整體上調 API 服務定價,而當下的價格和原來的價格保持一致。
deepseek-v4-pro 當前每百萬 Token 的價格分別為:緩存命中輸入 0.025 元,緩存未命中輸入 3 元,輸出 6 元。
相比之下,deepseek-v4-flash 分別為 0.02 元、1 元和 2 元。也就是說,在緩存未命中輸入和輸出兩個主要計費項目上,Pro 的價格都是 Flash 的 3 倍。
兩者的並發限制也有所區別。deepseek-v4-flash 的並發限制為 2500,deepseek-v4-pro 則為 500。
跑分圖如下:

此外,從價格和並發配置來看,Flash 更明顯地面向高頻、大規模調用場景,而 Pro 則把資源進一步集中到規格更高的任務上。即便如此,V4 Pro 目前的絕對調用成本依舊不算太高。
隨著 DeepSeek-V4-Pro-0813 出現,V4 系列的產品結構也進一步清晰起來:
Flash 主打更低成本和更高並發,Pro 則提供更高規格的模型服務,並圍繞 Tool Calls、Responses API、Anthropic API 等能力繼續向 Agent 和 Coding 場景延伸。
今晚又是一個不眠夜。
官方部落格地址:
https://api-docs.deepseek.com/zh-cn/quick_start/pricing






