等了快4個月,DeepSeek V4 Pro終於轉正,官方卻預告接下來要漲價

2026年8月12日,DeepSeek的旗艦模型V4 Pro結束了長達將近4個月的預覽期,以「V4-Pro-0813」的正式版本身分,出現在OpenRouter的模型頁面與DeepSeek自家的API文件上。但就在這款模型終於「轉正」的同時,官方的公告裡已經先預告了一件事:接下來的價格,會有「顯著調漲」。
先從4月的預覽版說起
根據DeepSeek官方文件,V4系列是在2026年4月24日以預覽版形式首次登場的,一次推出兩顆模型:參數規模1.6兆、每次推論啟用490億參數的V4-Pro,以及參數規模2,840億、啟用130億參數的輕量版V4-Flash。兩者都採MIT授權開源、預設支援100萬token上下文,並且都提供「思考」與「非思考」雙模式,可以整合進Claude Code、OpenClaw、OpenCode等工具鏈使用。架構上,DeepSeek採用了「token級壓縮」搭配自家研發的DeepSeek Sparse Attention(DSA,稀疏注意力機制),訓練資料量超過32兆個token。
中間這幾個月發生了什麼事
根據其他媒體對這段期間官方更新日誌的追蹤報導,7月24日,DeepSeek正式讓舊版API別名deepseek-chat與deepseek-reasoner退場停用——這是三個月前就公告過的汰換排程。到了7月31日,情況出現了一個有趣的轉折:體型較小的V4-Flash先一步「轉正」,以「V4-Flash-0731」的身分進入公開測試版,官方更新日誌裡形容它「代理任務能力顯著提升,遠遠超越還在預覽階段的V4-Pro」;獨立驗證的成績單顯示,這個版本在Terminal-Bench 2.1拿下82.7分、DeepSWE拿下54.4分。至於體型更大的V4-Pro,當時官方的說法只有簡單一句:「(正式版)即將跟上」,沒有給出明確時間表。
Pro終於轉正了,效能提升在哪
一直到8月12日,V4-Pro-0813才真正補上這一步。跟前一代V3.2相比,DeepSeek表示在最大上下文設定下,新版把單一token的推論運算量壓縮到只剩27%、KV快取用量更只剩10%。效能方面,被稱為V4-Pro-Max的版本在SWE-bench Verified拿下80.6%、LiveCodeBench的pass@1達到93.5%、GPQA Diamond的pass@1是90.1%、MMLU-Pro為87.5%,Codeforces評分則來到3,206分。
打得贏誰、打不贏誰
放進競爭格局裡看,V4 Pro在Terminal Bench 2.0上目前還是落後GPT-5.4(67.9%對75.1%);在SWE-bench Verified上,V4 Pro的80.6%則是些微落後Gemini 3.1 Pro與Claude Opus 4.6——這兩者的分數都是80.8%,差距只有0.2個百分點,可以說是非常接近;在LiveCodeBench這項指標上,V4 Pro則是目前比較對象裡分數最高的一個。整體來說,這是一款在編碼類評測上緊咬頂尖對手、但還沒有全面超車GPT-5.4的模型。
價格看起來很美,但要小心
目前V4 Pro的API定價,延續預覽期的水準:快取未命中的輸入token每百萬收費0.435美元、快取命中降到0.003625美元,輸出token則是每百萬0.87美元——這個價位,放在同級模型裡仍然算便宜。但DeepSeek在官方通知裡已經明確預告,接下來價格會有「顯著調漲」,另外還公布了一項尖峰時段(北京時間9點到12點、14點到18點)雙倍計價的政策,只是目前還沒有正式生效。換句話說,現在看到的價格,很可能是這款模型「最便宜」的一個時間點。
開源這件事,還是個問號
4月釋出的預覽版權重目前仍掛在Hugging Face上,同樣採MIT授權。但DeepSeek到目前為止,還沒有明確說明這次8月正式轉正的0813版本,是否會另外釋出對應的開源權重——對一家長期以「開源」作為核心賣點的公司來說,這件事會不會落地,恐怕跟效能分數一樣,值得後續持續盯著看。



