上周五(7月31日),DeepSeek官宣其最新大语言模型DeepSeek-V4-Flash正式版API(接口)开启公测。DeepSeek表示,DeepSeek-V4-Flash正式版大幅升级其代理能力,相关基准测试得分已远超V4-pro预览版。
而根据一家美国研究机构的最新测试数据,DeepSeek-V4-Flash已成为全球知名模型中运行成本最低的一款,其运行成本甚至只有Anthropic旗舰模型Claude Fable 5的不到1/100。
DeepSeek的R1模型于2025年初在全球引发轰动,不仅触发了全球科技股的抛售潮,也引发了人们对美国企业在AI领域巨额支出的质疑。而如今,V4-Flash近乎无敌的性价比,再度令不少美国业界人士刮目相看。
研究公司Artificial Analysis表示,DeepSeek-V4-Flash对每百万输入Token收费0.14美元,对每百万输出Token收费0.28美元。
Artificial Analysis据此估算了其每项智能指数任务的成本——即按Token类型划分的每项AI分析智能指数任务的加权平均成本,数值越低越好。最终,V4-Flash的平均测试成本为3美分。

作为对比,其中国竞争对手月之暗面旗下最新模型的Kimi K3为86美分,OpenAI的GPT-5.6 Sol为1.86美元,Claude Fable 5为3.15美元。
Artificial Analysis表示,与仅看定价相比,这种比较方式能更真实地衡量价值,因为它考虑了模型为完成一项任务必须处理和生成的数据量。如果一个模型需要显著更多的步骤才能得出答案,那么即使其标价较低,实际成本仍可能很高。
Artificial Analysis还表示,DeepSeek-V4-Flash模型在该机构的“智能指数”中获得了50分(满分100分),该指数综合了涵盖编码、推理和职场风格任务等九项基准测试的结果。

这一分数与谷歌的Gemini 3.6 Flash持平,比Meta的Muse Spark 1.1以及智谱的GLM-5.2低1分;在其他业界旗舰模型方面,Kimi K3的得分为57分,而Anthropic的Claude Opus 5、Fable 5以及OpenAI的GPT-5.6则达到了59分或更高。
毫无疑问,对于API用户而言,随着DeepSeek-V4-Flash的发布,Token成本有了进一步的大幅降低。事实上,在过去一年里,DeepSeek已经凭借极低的API价格和优秀的模型能力,在全球开发者市场迅速建立影响力。
越来越多全球企业也开始接入DeepSeek API,大量海外开发者迁移至其平台,其调用量快速增长。
据全球多模型聚合平台OpenRouter发布的最新一周AI大模型调用量榜单,排名前五的产品全部由中国企业研发,登顶榜首的是小米MiMo-V2.5,单周调用量达到10.5万亿Token,DeepSeek-V4-Flash、腾讯HY3、智谱GLM-5.2以及DeepSeek-V4Pro则分别位列第二至第五位。









