DeepSeek API 推出峯谷定價方案 空閒時段費用減半

深度求索官方宣佈,DeepSeek 的 API 價格將採用峯谷定價,空閒時段價格將等於高峯時段的一半,並於今日正式生效。此舉針對企業與開發者在不同工作節奏下的成本壓力提供彈性,同時保留原有的 API 模型名與使用模式,方便用户在 APP、網頁端或 API 介面選擇一致的體驗。高峯時段界定為北京時間 9:00 至 12:00、14:00 至 18:00,其餘時段則歸為空閒時段。這種定價架構的改動,意味著在工作日中段的請求成本可能出現顯著變化,對於需要大量 token 的應用尤為關鍵。

CNMO 科技在多角度報導中指出,DeepSeek V4 系列在不同時段的成本分佈亦有所差異。就 V4-Flash 版本而言,空閒時段的輸入緩存命中成本大約為 0.05 元,輸入緩存未命中 1.5 元,輸出成本 4.5 元;高峯時段分別為 0.10 元、3.0 元與 9.0 元。V4-Pro 的成本曲線則更為顯著,空閒時段輸入緩存命中 0.15 元、未命中 4.5 元、輸出 13.5 元,高峯時段分別為 0.30 元、9.0 元與 27.0 元。這些具體數字為開發者在評估成本時提供關鍵參考,尤其在需要長時間連續推理或高併發的場景中。

值得注意的是,在新定價架構推出前,DeepSeek V4 Pro 的商業版在市場上已同步更新至 APP、網頁端與 API。用户可透過 APP 或網頁端選擇「專家模式」,以使用全新的 V4 Pro 正式版模型;API 模型名稱保持不變,確保既有開發者的整合成本最小化。與此同時,DeepSeek 也強調,現代化的推理過程中,成本計算會以實際呼叫量與緩存命中率為核心,促使企業在峯值期間維持穩定的用餐式服務水平。若你正在考慮遷移至 V4 Pro,以取得更高的生成品質,但又擔心成本波動,這次峯谷定價或許提供了相對可控的成本預測。

新定價機制下的商業策略與風險

從商業策略角度看,峯谷定價能在工作日的不同時段為用户提供更靈活的成本結構,特別是對於以內容產出、語言模型推理或問答服務為核心的 SaaS 廠商而言,能在非高峯時間降低運營成本,進而透過促銷或緩衝時間窗拉動用户需求。對 DeepSeek 而言,這也意味著官方需要更透明的成本與用量報表,讓企業客户能夠根據實際使用模式優化工作流程,例如將大量的批次作業安排在空閒時段,以降低整體支出。與此同時,對於開發者而言,熟悉不同版本在高峯與空閒時段的成本分佈,將有助於設計更有效的緩存與分佈式推理策略。

另外,雖然官方尚未公開長期的 SLA 細節,市場觀察者普遍關注高峯時段成本的上升幅度可能對即時互動應用造成影響。對於需要低延遲回應與高穩定性的場景,企業可考慮混用不同模型與排程策略,例如在用户請求集中時啟用專家模式,於低峯期回落到更具性價比的模型,以維持成本與性能的平衡。根據過去的定價變動經驗,透明的版本更新日、API 名稱穩定與良好的文檔支援,是降低遷移成本與風險的關鍵。至於模型的穩定性與長期更新,DeepSeek 的官方回應顯示,雖然「取外號」等現象引人關注,但其實是推理過程中的上下文佔位符,並不會被長期記憶化。此點對於用户信任與隱私保護具有重要啟示。

就技術細節而言,市場上最重要的變化在於緩存機制與輸出成本的定義。輸入緩存命中代表預先緩存的內容能迅速被模型利用,降低整體呼叫成本;未命中則需重新計算,成本自然提升。輸出成本則與文本長度、生成內容的複雜程度相關,對於需要長篇回覆或多輪對話的應用影響尤為顯著。對 DeepSeek 來説,這些數據點提供了優化空閒與高峯時段調度的基礎,並有助於開發者在設計 API 呼叫策略時,進行更精準的成本預測。未來若有更多版本的規格公開,開發者可以根據實際性能指標,制定更嚴謹的成本模型。

想睇更深入嘅 AI 模型與工程科技報道?
前往 The Base Principle 繁體中文 AI 新聞 →
Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)