13 日,深度求索宣布对 DeepSeek API 实施大幅调价,部分模型价格涨幅超过三倍,同步推出 V4 Pro 正式版。
根据官方公告,新价格将于北京时间 2026 年 8 月 17 日零时生效,同时引入峰谷定价机制。以旗舰模型 deepseek-v4-pro 为例,高峰时段每百万 tokens 输出价格将升至 27 元,较现行 6 元上涨约 350%;即便是空闲时段的 13.5 元,亦是现价的 2.25 倍。
调价消息与 V4 Pro 正式版发布同步释出。DeepSeek 官方表示,V4 Pro 在 Agent 工作流能力上取得重大升级,并新增灵活推理强度设置,支持原生 OpenAI Responses API,为企业级应用场景提供更强性能支撑。

根据深度求索公布的新定价方案,两款主力 API 模型均面临实质性涨价。
以 deepseek-v4-flash 为例,高峰时段百万 tokens 输出价格从现行的 2 元升至 9 元,涨幅达 350%;缓存未命中输入价格从 1 元升至 3 元。deepseek-v4-pro 涨幅同样显著,高峰时段百万 tokens 输出价格从 6 元升至 27 元,涨幅同为 350%;缓存未命中输入价格从 3 元升至 9 元。
缓存命中场景下的涨幅相对较小,但绝对价格同样大幅提升。v4-flash 缓存命中输入价格从 0.02 元升至高峰时段 0.10 元,v4-pro 则从 0.025 元升至 0.30 元。
若选择在空闲时段调用,用户可享受高峰价格的五折优惠,一定程度上为对时延要求不敏感的批量处理场景提供了成本缓冲空间。

在宣布调价的同时,深度求索于 8 月 13 日正式推出 DeepSeek V4 Pro 正式版,模型版本号为 DeepSeek-V4-Pro-0813,API 模型名保持不变。

技术规格方面,V4 Pro 上下文长度达 100 万 tokens,最大输出长度 384K tokens,支持 Json Output、Tool Calls、Responses API、Anthropic API 及对话前缀续写等功能,并发限制为 500 路。相比之下,定位更轻量的 deepseek-v4-flash 并发限制达 2500 路,更适合高吞吐量场景。