DeepSeek 調漲倒數 3 天:現在用新模型、付舊價格,尖峰時段最高漲 12 倍!

Read this article in English →

DeepSeek 調漲倒數 3 天:現在用新模型、付舊價格,尖峰時段最高漲 12 倍!

2026 年 8 月 14 日下午 16:55,一封標題平淡的調漲通知信躺進了我的信箱:DeepSeek 即將調整 API 計費標準。翻開 DeepSeek 官方定價文件核對後才發現,這次調漲不只是漲價這麼簡單——它同時導入了「尖峰/離峰」雙軌計費,而且藏著一個對開發者相當有利的時間差:新價格要到北京時間 8 月 17 日凌晨 00:00 才生效,但新模型現在就已經在跑了。

現在用的其實已經是新模型

打開 DeepSeek API 文件會看到,deepseek-v4-pro 目前對應的底層模型版本是 DeepSeek-V4-Pro-0813——從版號就看得出來,這是 8 月 13 日才更新的最新版本。換句話說,任何在這幾天呼叫 deepseek-v4-pro 的人,實際上已經在用調漲前最新的模型能力,但帳單上算的仍然是調漲前的舊價格。這個「新模型、舊價格」的空窗期,正是這篇文章想提醒讀者把握的重點:從現在到 8 月 17 日 00:00 之前,是用同一組模型、卻能拿到明顯更低成本的最後機會。

完整新舊價格對照表

以下是 DeepSeek 官方文件列出的完整新舊計費標準(單位:人民幣元/百萬 tokens):

舊價格(現行,8/17 前有效)

模型輸入(快取命中)輸入(快取未命中)輸出併發限制
deepseek-v4-flash0.02 元1 元2 元2500
deepseek-v4-pro0.025 元3 元6 元500

新價格(8/17 00:00 起生效,分尖峰/離峰時段)

模型時段輸入(快取命中)輸入(快取未命中)輸出
deepseek-v4-flash離峰0.05 元1.5 元4.5 元
deepseek-v4-flash尖峰0.10 元3.0 元9.0 元
deepseek-v4-pro離峰0.15 元4.5 元13.5 元
deepseek-v4-pro尖峰0.30 元9.0 元27.0 元

DeepSeek 官方文件對尖峰時段的定義是北京時間每日 9:00–12:00 與 14:00–18:00,其餘時段一律算離峰;離峰價格固定為尖峰價格的一半。也就是說,同一個模型、同一種計費項目,一天之內就會出現兩種收費標準,這對過去習慣「單一價格」的 DeepSeek 用戶來說,是計費邏輯上的一次明顯轉向。

逐項拆解:到底漲了幾倍?

把新舊價格一項項對齊計算後,漲幅其實並不平均,差距最大的落在「快取命中」這個過去最便宜的項目上:

  • deepseek-v4-pro/輸入快取命中:0.025 元 → 離峰 0.15 元(6 倍)/尖峰 0.30 元(12 倍),是所有項目裡漲幅最誇張的一格。
  • deepseek-v4-flash/輸入快取命中:0.02 元 → 離峰 0.05 元(2.5 倍)/尖峰 0.10 元(5 倍)。
  • deepseek-v4-pro/輸出:6 元 → 離峰 13.5 元(2.25 倍)/尖峰 27 元(4.5 倍)。
  • deepseek-v4-flash/輸出:2 元 → 離峰 4.5 元(2.25 倍)/尖峰 9 元(4.5 倍)。
  • deepseek-v4-pro/輸入快取未命中:3 元 → 離峰 4.5 元(1.5 倍)/尖峰 9 元(3 倍)。
  • deepseek-v4-flash/輸入快取未命中:1 元 → 離峰 1.5 元(1.5 倍)/尖峰 3 元(3 倍)。

值得特別說明的是:快取命中輸入的單價原本就極低(0.025 元/百萬 tokens),倍數看起來驚人,但對整體帳單金額的實際衝擊,遠不如佔比通常最高的「輸出」與「快取未命中輸入」這兩項。以一般開發者最常參考的輸出定價來看,尖峰時段的實際漲幅落在 4.5 倍,這才是多數應用場景會真正感受到的成本增幅;把快取命中這種邊緣情境也算進去,帳面上「最高漲幅」則來到 12 倍。

為什麼要導入尖峰/離峰定價?

DeepSeek 沒有在文件中明說調漲背後的商業考量,但從計費結構本身可以合理推測:尖峰/離峰雙軌制是雲端運算與電力產業行之有年的做法,目的是把使用需求從尖峰時段導引到離峰時段,藉此平衡伺服器負載、拉高整體資源利用率。對 DeepSeek 而言,與其在尖峰時段硬扛所有流量、被迫擴充昂貴的 GPU 算力,不如用價格訊號鼓勵開發者把批次任務、非即時性請求挪到離峰執行。這也代表:對時效性要求不高的工作流(例如資料批次處理、離線內容生成),未來把排程改到離峰時段,仍然可以拿到接近目前價格的成本。

開發者現在能做什麼

窗口期只到 8 月 17 日 00:00(北京時間),對還在評估或已經在用 DeepSeek API 的團隊,這幾天有兩件事值得優先確認:第一,盤點目前呼叫量最大的計費項目——如果高度依賴 deepseek-v4-pro 的快取命中或輸出,調漲後的成本感受會最明顯,值得提前抓好預算;第二,如果應用場景本來就可以容忍延遲,這正是評估把排程改到離峰時段(每日 18:00 至隔日 9:00,以及 12:00–14:00)的好時機,長期下來能省下的差額並不小。至於現在到 8/17 之間要不要衝量、提前處理積壓的任務,則要回頭看自己帳號的併發限制(flash 2500、pro 500)夠不夠用——窗口期再短,也是短期內能拿到「新模型、舊價格」的唯一機會。

關於作者

我是 Ryan,RyanOps 的站主。平日的工作是軟體開發與自動化,在這裡整理 AI 模型、開發工具與軟體工程的重要變化,也記錄自己實際除錯、實作過的技術筆記。

關於本站與編輯流程 →