互联网

DeepSeek-V4-Flash登顶全球调用量榜首,国产大模型包揽前五

来源:TechWeb 作者:果青 2026-08-04 19:59:34 我要评论

8月4日消息,7月31日,DeepSeek正式开放V4-Flash正式版API公测。短短一周之内,这款国产大模型便在全球AI开发者市场掀起了一场风

8月4日消息,7月31日,DeepSeek正式开放V4-Flash正式版API公测。短短一周之内,这款国产大模型便在全球AI开发者市场掀起了一场风暴。

发布即登顶

根据全球最大模型聚合平台OpenRouter的最新数据,上周(7月28日至8月3日),DeepSeek-V4-Flash以7.1万亿Token的周调用量登顶全球大模型调用量榜首。排名第二至第五位均为中国产品:小米MiMo-V2.5以5.4万亿Token位列第二,腾讯Hy3以4.89万亿Token位居第三,DeepSeek-V4-Pro以3.1万亿Token排在第四,智谱GLM-5.2以2.87万亿Token位列第五。7月31日最新发布的DeepSeek-V4-Flash正式版(DeepSeek-V4-Flash 0731版)以2.33万亿Token的调用量强势登上榜单第八。

DeepSeek-V4-Flash 0423版和DeepSeek-V4-Flash 0731版合计调用量断层领先。

仅8月3日一天,DeepSeek-V4-Flash 0731版的调用量就达到1.02万亿Token,超过此前霸榜的DeepSeek-V4-Flash 0423版。

更令人瞩目的是,OpenCode平台的数据显示,仅8月1日一天,DeepSeek V4 Flash在其平台上的Token处理量就达到了8万亿,其中5万亿为免费试用额度,3万亿为付费调用。

综合测算,上周全球AI大模型总调用量为56.8万亿Token,中国AI大模型周调用量达28.13万亿Token,已连续十四周超过美国,稳居全球首位。在全球十大热门模型榜单中,中国模型占据了九个席位。

Agent能力暴涨、性价比碾压

DeepSeek-V4-Flash正式版与预览版模型结构、参数规模完全一致,采用MoE架构,总参数量2840亿,实际激活参数约130亿,支持100万Token上下文窗口。底层基座未做改动,仅完成新一轮后训练优化。

正是这轮“后训练”,带来了Agent能力的飞跃。在Agent智能体终极测试中,V4-Flash正式版得分达25.2分,接近Claude Opus-4.8的25.7分,远高于V4-Pro预览版的15.8分。在Terminal Bench 2.1基准测试中,正式版拿下82.7分,而预览版仅为61.8分。测评机构Artificial Analysis的Intelligence Index智能指数中,V4 Flash获得50分,比预览版提升10分,追平了Gemini 3.6 Flash。

价格方面,V4-Flash的竞争力几乎无人能敌。每百万输入Token定价0.14美元,每百万输出Token定价0.28美元。美国研究机构Artificial Analysis的加权测试显示,V4-Flash单任务平均成本仅3美分,而Kimi K3为86美分,GPT-5.6 Sol高达1.86美元,Claude Fable 5更是达到3.15美元。其运行成本不到Anthropic旗舰模型Claude Fable 5的百分之一。换算成人民币,V4-Flash每百万未命中缓存输入Token仅1元,输出Token 2元,缓存命中输入成本更低至2分钱。

有海外开发者反馈,单次任务调用成本甚至低至0.0005美元。

海外开发者集体沸腾

DeepSeek V4-Flash正式版上线后,海外开发者社区的反应堪称热烈。X平台上,有开发者直言“马斯克需要亲自试试V4 Flash。它就像魔法一样”。随后,网友发现埃隆·马斯克真的关注了DeepSeek官方账号。这一细节迅速引爆海外社区讨论,有人调侃“下一代编程模型可能会基于DeepSeek构建”,更有网友直接调侃Grok:“你的爹要给你买个小弟弟吗?”

玩笑背后是真实的市场转向。据报道,DeepSeek的访问流量中,美国、欧洲开发者占比接近半数,大量Agent自动化项目、代码辅助工具、长文本处理应用主动将默认模型切换至DeepSeek。多名海外AI初创创始人在X平台公开复盘,团队全线迁移至DeepSeek之后,月度推理成本下降60%至85%。对于尚未盈利、现金流紧绷的小微AI公司,这样的成本差异足以决定项目能否继续。

日本科技媒体Gizmodo Japan也发文称V4-Flash为“爆安Gemini级AI”,指出其性能与价格“完全颠覆”。研究机构Artificial Analysis更直言,DeepSeek-V4-Flash已成为全球知名模型中运行成本最低的一款。

行业分析认为,DeepSeek在全球开发者市场划出的是一条清晰的“斩杀线”,不是单纯的性能分水岭,而是性能与价格的平衡临界值:同一能力梯队中,定价显著高于DeepSeek的模型将持续流失中小开发者;性能弱于DeepSeek、成本却更高的产品,生存空间将快速萎缩。很长一段时间,全球大模型市场规则由硅谷巨头书写,OpenAI、Anthropic、谷歌划定性能标尺并牢牢掌控定价话语权。如今,这条“斩杀线”正由中国AI划定。

与此同时,海外闭源头部模型的市场份额持续收缩,Claude主流版本、Gemini旗舰模型调用增速持续放缓。OpenAI也感受到了压力,GPT-5.6 Luna上线不到三周便宣布价格下调80%。有分析指出,中国开源模型快速迭代,模型差距不断缩小,价格差距却逐渐拉大,美国头部模型也不得不重新思考性价比。

从7月31日API公测到8月3日登顶全球调用量榜首,DeepSeek-V4-Flash仅用了不到一周时间。这款不堆参数、不靠发布会PPT的“小杯”模型,正在用实打实的调用量改写全球AI市场的竞争规则。

 

转载请注明出处。

本站页面、图片和视频等资料部分由互联网编辑生成,版权归原创者所有,本网站只提供web页面服务,并不提供资源存储,若本站收录的页面无意侵犯了贵司版权,请 联系我们

网友点评
0相关评论