DeepSeek 更新 V4-Pro 模型 具備 1M 上下文及 384K 輸出能力

DeepSeek 旗下的 deepseek-v4-pro 模型版本已更新為 DeepSeek-V4-Pro-0813。根據目前公佈的信息,此次更新並未伴隨價格調整。儘管 DeepSeek 之前曾發布公告表示計劃近期整體上調 API 服務定價,但當前各檔位價格仍與此前保持一致。

DeepSeek-V4-Pro-0813 更新帶來的核心規格提升

在核心規格方面,deepseek-v4-pro 支持 1M 上下文長度,最大輸出長度達到 384K Token,同時支持非思考模式和思考模式,其中思考模式預設為開啟。對於長代碼庫處理、大規模文檔分析以及需要連續執行大量步驟的 Agent 任務來説,1M 上下文窗口和 384K 最大輸出意味著單次調用能夠容納和生成的內容規模相當可觀,減少了多輪拆分和拼接的開銷。

在配套能力方面,deepseek-v4-pro 基本覆蓋了目前主流的 Agent 開發需求。該模型支持 JSON Output、Tool Calls、Responses API 和 Anthropic API,同時支持處於 Beta 階段的對話前綴續寫與 FIM 補全功能,其中 FIM 補全僅限在非思考模式下使用。

在 API 接入方式上,deepseek-v4-pro 同時兼容 OpenAI 和 Anthropic 兩套格式,開發者可以根據自身技術棧靈活選擇接入路徑。價格方面,deepseek-v4-pro 當前每百萬 Token 的計費標準分別為:緩存命中輸入為 0.025 元,緩存未命中輸入為 3 元,輸出為 6 元。

DeepSeek 的 Pro 版本在價格和性能上的比較

作為對比,同系列的 deepseek-v4-flash 每百萬 Token 價格分別為緩存命中輸入 0.02 元、緩存未命中輸入 1 元、輸出 2 元。也就是説,在緩存未命中輸入和輸出這兩個主要計費項目上,Pro 版本的價格均為 Flash 版本的 3 倍。雖然 Pro 的絕對價格高於 Flash,但考慮到其更大的上下文窗口和輸出能力,單位 Token 的性價比依然具備競爭力。

兩個版本在並發限制上也有所區分。deepseek-v4-flash 的並發限制為 2500,deepseek-v4-pro 則為 500。從這一配置差異來看,Flash 更明顯地面向高頻、大規模的調用場景,適合需要快速響應和大量並行請求的應用;而 Pro 則將資源進一步集中到規格更高的任務上,優先保障單次調用的深度和複雜度。

想睇更深入嘅 AI 模型與工程科技報道?
前往 The Base Principle 繁體中文 AI 新聞 →
Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)