LLM

DeepSeek 把 V4 Pro 七五折降價常態化:前沿模型價格戰的底牌

2026 年 5 月 22 日,DeepSeek 宣布旗艦 V4 Pro 的 75% 折扣轉為常態價:輸出每百萬 token 0.87 美元,僅為原價四分之一,Flash 更只要 0.28 美元。本文解析降價常態化的成本邏輯與對 API 市場的連鎖影響。

DeepSeek 把 V4 Pro 七五折降價常態化:前沿模型價格戰的底牌 — 文章封面

2026 年 5 月 22 日,DeepSeek 在 X 上宣布:旗艦模型 V4 Pro 的 75% 折扣優惠「現在成為常態」。原訂 5 月 31 日 15:59 UTC 到期的促銷不再結束,官方定價直接調整為原價的四分之一。Bloomberg 隔日以「DeepSeek 將把旗艦 AI 模型的 75% 折扣常態化」為題報導,把這件事定性為定價策略,而不是短期行銷。

這不是一次普通的降價。對照定價文件,V4 Pro 的折後輸出價是每百萬 token 0.87 美元;常態化等於宣告原價正式走入歷史。一家以開放權重著稱的實驗室,把「促銷價」升格為「定價」,這個動作本身就是訊號。

促銷不結束了:折扣直接變成定價

DeepSeek 的定價文件寫得很直白:V4 Pro 的 75% 折扣促銷將於 2026 年 5 月 31 日 15:59 UTC 結束,而「促銷結束後,Pro 定價將正式調整為原價的四分之一」。換句話說,DeepSeek 不是延長促銷,而是把折後價格變成官方定價——促銷到期那一天,帳單上什麼都不會變。

開發者社群的反應熱烈:Hacker News 上直接連到定價文件的討論串拿到 621 點與 549 則留言,主流話題圍繞兩件事:這個價格能撐多久,以及競爭對手要不要跟。

帳面上的數字

攤開 5 月的定價頁,三個數字值得記住:

  • V4 Pro:輸入(cache miss)每百萬 token 0.435 美元、輸出 0.87 美元、cache hit 低到 0.003625 美元,併發上限 500
  • V4 Flash:輸入 0.14 美元、輸出 0.28 美元、cache hit 0.0028 美元,併發上限 2,500;兩個模型都有 1M context
  • 自 4 月 26 日起,cache hit 價格已降到發表價的十分之一

把折後價換算回原價:V4 Pro 原本輸出是每百萬 token 3.48 美元,現在帳面直接砍到四分之一。再疊加 cache hit 十分之一的定價,重度快取場景的邊際成本幾乎可以忽略——對 agent 這類反覆讀取同一批系統提示與文件的工作負載,這是專門設計出來的甜蜜點。

為什麼敢把折扣常態化

降價常態化通常有三種解釋:成本真的下降了、需求需要刺激,或兩者都有。DeepSeek 的情況三種都沾得上。開放權重模型靠 API 營收建立生態,價格是獲取開發者最直接的槓桿;而快取命中率高的推理架構,讓低價在單位經濟上說得通。

更值得注意的差異在供給結構:Pro 的併發上限只有 500,Flash 是 2,500。低價加高併發的 Flash 承接規模化流量,Pro 用低價維持旗艦定位但同時控制供給——這是產能管理,不是慈善。開發者若把關鍵服務壓在 Pro 上,併發上限會比價格先成為約束。

對開發者與產品團隊的意義

第一,預算規劃變簡單了。「促銷會不會結束」的不確定性消失,長期成本模型可以直接用常態價計算。第二,模型路由的策略空間變大:Flash 與 Pro 的輸出價差(0.28 對 0.87 美元)足以支撐「簡單任務走 Flash、難題升級 Pro」的分層架構。第三,這對同價帶的商業 API 構成直接壓力——當開放權重旗艦的輸出價壓在 1 美元以下,競爭對手的定價餘裕正在縮小。

我們在年初的展望裡提過 2026 年模型汰換與開源陣營分化的速度;這次降價常態化是同一條曲線上的最新數據點。對產品團隊來說,問題已經不是「要不要用便宜模型」,而是「路由架構有沒有準備好讓你用」。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

這篇內容對你有幫助嗎?

支持本站繼續整理實用的 AI 文章、教學與開發筆記。

請我喝杯咖啡
分享X電郵