DeepSeek-V4-Flash登顶全球调用榜

8月10日,一个数据让AI圈沉默了。

DeepSeek-V4-Flash,周调用量8.83万亿Token,登顶全球。

环比增长570%。不是57%,是570%。

更扎心的是:它打败的不是别人,是它自己的大哥——DeepSeek-V4-Pro。

Flash版凭什么?

V4-Flash不是DeepSeek最强的模型。它是个轻量版。便宜、快、参数少。

但它在Agent编码任务上,跑赢了Pro旗舰。

开发者的脚很诚实——便宜又好用,凭什么不用?

这不是个案。整个行业都在发生同一件事:小模型正在吃掉大模型的地盘。

Meta的Muse Glimmer,300亿参数,单卡本地跑,工具调用性能碾压更大号的竞品。Qwen的Flash版本,性价比打到同行的骨折价。如今DeepSeek-V4-Flash直接登顶调用量榜首。

“大就是好”的时代,结束了。

谁在用?

8.83万亿Token是什么概念?

如果全部是AI Agent在跑任务,这意味着全球开发者已经大规模把DeepSeek接入了生产管线。

OpenRouter的数据显示:Agent类应用和Coding类应用只占调用次数的19%,却吃掉了81.2%的Token量。

翻译一下:AI Agent不是聊天的玩具,它是吃Token的怪兽。一个Agent跑一次任务,Token消耗量是聊天的几十倍甚至上百倍。

而开发者把这种”怪兽级”任务押在了DeepSeek身上。

中国的”便宜好用”杀招

中国大模型连续十五周调用量超美国。这不是偶然。

从DeepSeek到Qwen到MiniMax H3,中国模型有一个共同的标签:性价比拉到极致。

当OpenAI在烧2000美元让Astra解数学题的时候,DeepSeek在让全球几百万开发者用几分钱跑一次Agent任务。

一个在秀肌肉,一个在铺管道。

铺管道的那个,拿到了全球最多的调用量。

开发者不关心谁最聪明

他们只关心三件事:

1. 能不能把我的活干了?

2. 跑一次多少钱?

3. 稳不稳定?

DeepSeek-V4-Flash三条全中。

这场登顶不是技术突破的故事,是产品哲学的故事。不是”我的模型比你聪明”,而是”我的模型帮开发者赚到钱了”。

说得更直白一点:AI竞赛的下半场,拼的不是谁在排行榜上最高,而是谁被用得最多。

用得最多的那个,才能定义下一代AI的形态。

而现在的王座上,坐着一个Flash版。