
而根据一家美国研究机构的最新测试数据,DeepSeek-V4-Flash 已成为全球知名模型中运行成本最低的一款,其运行成本甚至只有 Anthropic 旗舰模型 Claude Fable 5 的不到 1/100。
DeepSeek 的 R1 模型于 2025 年初在全球引发轰动,不仅触发了全球科技股的抛售潮,也引发了人们对美国企业在 AI 领域巨额支出的质疑。而如今,V4-Flash 近乎无敌的性价比,再度令不少美国业界人士刮目相看。
研究公司 Artificial Analysis 表示,DeepSeek-V4-Flash 对每百万输入 Token 收费 0.14 美元,对每百万输出 Token 收费 0.28 美元。
Artificial Analysis 据此估算了其每项智能指数任务的成本——即按 Token 类型划分的每项 AI 分析智能指数任务的加权平均成本,数值越低越好。最终,V4-Flash 的平均测试成本为 3 美分。

Artificial Analysis 表示,与仅看定价相比,这种比较方式能更真实地衡量价值,因为它考虑了模型为完成一项任务必须处理和生成的数据量。如果一个模型需要显著更多的步骤才能得出答案,那么即使其标价较低,实际成本仍可能很高。
Artificial Analysis 还表示,DeepSeek-V4-Flash 模型在该机构的 " 智能指数 " 中获得了 50 分 ( 满分 100 分 ) ,该指数综合了涵盖编码、推理和职场风格任务等九项基准测试的结果。

毫无疑问,对于 API 用户而言,随着 DeepSeek-V4-Flash 的发布,Token 成本有了进一步的大幅降低。事实上,在过去一年里,DeepSeek 已经凭借极低的 API 价格和优秀的模型能力,在全球开发者市场迅速建立影响力。
越来越多全球企业也开始接入 DeepSeek API,大量海外开发者迁移至其平台,其调用量快速增长。
据全球多模型聚合平台 OpenRouter 发布的最新一周 AI 大模型调用量榜单,排名前五的产品全部由中国企业研发,登顶榜首的是小米 MiMo-V2.5,单周调用量达到 10.5 万亿 Token,DeepSeek-V4-Flash、腾讯 HY3、智谱 GLM-5.2 以及 DeepSeek-V4Pro 则分别位列第二至第五位。