跳至主要內容
● LIVE · TAIPEI SIGNAL 001
科技 產業分析

DeepSeek 再動 flash 系列價目表:一個月內第二張定價公告,算的是詞元成本那一欄

DeepSeek 官宣調整 flash 系列模型定價,本文從詞元成本結構、負載曲線與大模型市場定價權角度,拆解這次調價的傳導帳。

SUE NEWS 編輯台 閱讀約 4 分鐘

價目表又換了一頁。DeepSeek 官方宣布調整 flash 系列模型的定價,這是繼八月下旬的錯峯計費方案之後,短期內再一次觸碰 API 收費結構。對使用方而言,帳單金額的變動是結果;對產業觀察者而言,真正值得拆的是這次調整落在哪一個成本欄位,以及它對同價格帶競爭對手的擠壓會怎麼傳導。

先看這次動的是哪一條產品線

flash 系列在 DeepSeek 的產品矩陣中,定位偏向輕量與高頻呼叫場景:對話摘要、分類、批量處理、Agent 工具鏈裡的中間步驟調用。這類工作負載的特徵是單次請求的詞元量不一定大,但呼叫次數密集,對單價的敏感度遠高於旗艦模型的重度推理任務。

換句話說,flash 系列的價格調整,直接作用的客羣是企業客戶與開發者社羣裡把 DeepSeek 當基礎設施用的那一層。這批客戶的遷移成本主要綁在接口相容性與工程習慣上,對價格彈性卻是所有客層裡最高的一羣。調價公告一出,帳面上的影響會先反映在這些客戶的月度推理支出預算重算。

一個月內的第二次:頻率本身就是訊號

把時間軸拉回八月下旬。DeepSeek 自 2026 年 8 月 23 日起將週末全天統一按低谷時段價格計費,六天內兩度調整價目表,當時的邏輯是把負載曲線上的閒置算力折價出售,本站先前在DeepSeek 週末谷價的閒置算力帳中已做過拆解。

這次 flash 系列的調整,延續的是同一條思路的不同切面。錯峯計費處理的是時間維度的負載不均;產品線級別的定價調整,處理的則是模型規格維度的閒置產能。兩者共同的底層邏輯是:當訓練投入已經沉沒,推理側的算力折舊按小時計算,任何一張沒有被填滿的 GPU 排程表,都是帳本上的純損耗。降價換量,只要邊際收入高於電力與運維的邊際成本,帳就是算得過的。

從行業節奏看,這已經是大模型市場進入推理成本競爭階段的常態操作。MiniMax 創辦人閆俊傑先前提出「最小化推理成本,最大化智慧」的說法,本站在MiniMax 詞元成本的斬殺線分析中梳理過,這條線如今正被一連串具體的價目表調整逐一驗證。

影響推演:誰受惠,誰承壓

受惠方的名單相對清晰。第一層是高呼叫量的企業開發者與 Agent 應用開發商,他們的成本結構中推理支出佔比高,單位詞元價格的任何下移都直接改善毛利。第二層是建立在 DeepSeek 模型之上的中間層服務商,包含模型託管、微調與應用框架業者,上遊降價擴大了他們的定價緩衝空間。

承壓方的壓力則是結構性的。與 flash 系列處於同一價格帶、同一使用場景的輕量模型產品,面臨的是被動跟價或流失份額的二選一。跟價壓縮自身毛利;不跟,客戶的遷移評估會在下一個採購週期啟動。這種擠壓對現金流依賴 API 收入的新創團隊尤其明顯,對有多元收入結構的大廠則相對可吸收。

傳導鏈的末端在應用層。當上遊推理成本進入下行通道,終端 AI 應用的訂閱定價與免費額度策略都會獲得重算空間,這對刺激使用量、擴大整體市場規模是正向的。但同時也意味著,以「更便宜」作為核心賣點的應用產品,護城河會被上遊的降價直接侵蝕。

收束判斷

單次調價不值得過度解讀,但一個月內兩度調整價目表,說明定價決策的週期已經從季節性行為變成常態化的營運工具。這背後對應的是推理成本在財務模型中的權重上升:當算力供給相對需求出現階段性寬鬆,價格就是調節供需最直接的閥門。

後續值得追蹤的變數有兩個。一是這次調整是否引發同價格帶的連鎖跟價,這會決定輕量模型市場的整體毛利率水位;二是 DeepSeek 旗艦系列的定價是否維持不動,若輕量與旗艦之間的價差持續擴大,等於明確了需求分層的定價策略,這對企業客戶的模型選型組合會產生更長期的引導效果。在詞元單價仍處於下行通道的市場裡,價目表的更新頻率,本身就是競爭強度最誠實的指標。