DeepSeek V4 Pro偷偷上線,直接對比Fable 5:輸5%、卻便宜46倍

《聯合報》報導,DeepSeek在8月12日深夜「突襲」放上V4 Pro的正式版,沒有部落格文章、沒有官方公告,版本號悄悄跳到0813。獨立AI評論者Simon Willison也證實了這個說法:他是透過OpenRouter才發現這個新版本上線的,DeepSeek官網完全找不到對應的公告頁面。而這次DeepSeek端出來的比較對象,直接鎖定了Anthropic目前最貴的旗艦模型——Claude Fable 5。
對比的Fable 5,什麼來頭
根據其他科技媒體的報導,Claude Fable 5是Anthropic在2026年6月9日推出的「Mythos級」模型,等級被定位在比Opus 4.8更高一階,支援100萬token上下文、最高12.8萬token輸出。它的API定價是輸入token每百萬10美元、輸出token每百萬50美元——放眼目前市面上主流模型,這已經是最貴的等級之一。DeepSeek選擇拿自己的新旗艦,去對比業界公認最頂尖、也最昂貴的對手,本身就是一個很直接的表態。
差距只有5.3%,還是2.8%
根據DeepSeek官方公布的比較數據,在10項代理任務(agent benchmark)測試中,Claude Fable 5平均領先5.3%,DeepSeek則在其中2項測試反超。但如果把「Humanity’s Last Exam」這項差距特別大(拉開到10.6%)的測試單獨拿掉,剩下測試項目的平均差距會縮小到只剩2.8%。不過也不是每個項目差距都這麼小:在SWE-bench Verified這項指標上,Claude Fable 5拿下96%,DeepSeek V4 Pro是80.6%,兩者差了15.4個百分點,明顯比整體平均的差距要大得多。
價格差距才是真正誇張的地方
真正拉開差距的其實是價格。DeepSeek V4 Pro的定價是輸入token每百萬0.435美元(快取命中只要0.003625美元)、輸出token每百萬0.87美元;Claude Fable 5則是輸入10美元、輸出50美元。以混合費率估算,大約是30美元對0.65美元,價差來到46倍左右。《聯合報》引用AI基準測試機構Artificial Analysis的實測例子更具體:同一項基準測試任務,用Fable 5跑一次要價3.15美元,換成DeepSeek更輕量的V4 Flash只要0.03美元,等於便宜了99%。
這些數字其實還沒被真正驗證過
值得提醒的是,上面這些對比數字,全部來自DeepSeek自己公布的比較結果,目前還沒有獨立第三方對0813這個正式版本做過完整的重新測試。Simon Willison還觀察到一個更微妙的細節:這些效能數據最早是在一個微信群組裡流出的,接著被貼到Reddit,卻因為「內容太過陽春」被刪除,最後輾轉變成Hacker News上一張用ASCII字元拼出來的表格——流傳路徑相當克難,跟一家市值不小的AI公司理應具備的溝通方式,落差不小。
Willison也提到另一個他觀察到、之前沒在其他模型上見過的怪現象:V4 Pro在「低、中、高」三種不同推理強度設定下,同一個提示詞產生出來的圖像結果居然會有明顯差異——他形容這是自己「從沒在其他模型身上注意到的一種差異」。另外,先前4月的預覽版與7月的V4 Flash轉正版,權重都有公開在Hugging Face上、採MIT授權;但這次0813版本是否也會比照辦理釋出開源權重,包括Willison在內都還沒能得到確認。
人民幣定價與其他背景
《聯合報》也整理了DeepSeek在中國市場的人民幣定價:快取輸入每百萬token收0.025元、非快取輸入3元、輸出6元;相較之下,先前推出的V4 Flash分別是0.02元、1元、2元。V4 Pro的定價全面高於Flash版本,符合它作為旗艦、能力更強的定位。
這次的上線方式,跟DeepSeek過去幾次放出新模型的做法一脈相承:不打廣告、不辦發表會,選擇在深夜悄悄把模型換上線,卻同時放出一份直接叫板業界最貴模型的成績單。上線的動作有多低調,這份成績單丟出的挑戰,就有多不低調。



