DeepSeek 更新 V4-Pro 模型 具備 1M 上下文及 384K 輸出能力

DeepSeek 旗下的 deepseek-v4-pro 模型版本已更新為 DeepSeek-V4-Pro-0813。根據目前公佈的信息,此次更新並未伴隨價格調整。儘管 DeepSeek 之前曾發布公告表示計劃近期整體上調 API 服務定價,但當前各檔位價格仍與此前保持一致。

DeepSeek-V4-Pro-0813 更新帶來的核心規格提升

在核心規格方面,deepseek-v4-pro 支持 1M 上下文長度,最大輸出長度達到 384K Token,同時支持非思考模式和思考模式,其中思考模式預設為開啟。對於長代碼庫處理、大規模文檔分析以及需要連續執行大量步驟的 Agent 任務來説,1M 上下文窗口和 384K 最大輸出意味著單次調用能夠容納和生成的內容規模相當可觀,減少了多輪拆分和拼接的開銷。

在配套能力方面,deepseek-v4-pro 基本覆蓋了目前主流的 Agent 開發需求。該模型支持 JSON Output、Tool Calls、Responses API 和 Anthropic API,同時支持處於 Beta 階段的對話前綴續寫與 FIM 補全功能,其中 FIM 補全僅限在非思考模式下使用。

在 API 接入方式上,deepseek-v4-pro 同時兼容 OpenAI 和 Anthropic 兩套格式,開發者可以根據自身技術棧靈活選擇接入路徑。價格方面,deepseek-v4-pro 當前每百萬 Token 的計費標準分別為:緩存命中輸入為 0.025 元,緩存未命中輸入為 3 元,輸出為 6 元。

DeepSeek 的 Pro 版本在價格和性能上的比較

作為對比,同系列的 deepseek-v4-flash 每百萬 Token 價格分別為緩存命中輸入 0.02 元、緩存未命中輸入 1 元、輸出 2 元。也就是説,在緩存未命中輸入和輸出這兩個主要計費項目上,Pro 版本的價格均為 Flash 版本的 3 倍。雖然 Pro 的絕對價格高於 Flash,但考慮到其更大的上下文窗口和輸出能力,單位 Token 的性價比依然具備競爭力。

兩個版本在並發限制上也有所區分。deepseek-v4-flash 的並發限制為 2500,deepseek-v4-pro 則為 500。從這一配置差異來看,Flash 更明顯地面向高頻、大規模的調用場景,適合需要快速響應和大量並行請求的應用;而 Pro 則將資源進一步集中到規格更高的任務上,優先保障單次調用的深度和複雜度。

Henderson
Henderson

Henderson 是 The Base Principle 的編輯,負責 AI 與工程科技報道的選題與編輯,並監督本站的自動化編譯流程。關注範圍包括大型語言模型、半導體與運算、太空與能源工程。

The Base Principle 是一個繁體中文(香港)科技媒體,專注報道人工智能與工程前沿。我們持續追蹤 OpenAI、Anthropic Claude、Google Gemini、Grok(xAI)、Meta AI、DeepSeek 等主要 AI 模型與公司,並涵蓋電動車與工程技術趨勢,每日精選與分析。

友情網站:手機・開箱・評測 → TechRitualTechNippon 日本語版