
8月10日,一个数据让AI圈沉默了。
DeepSeek-V4-Flash,周调用量8.83万亿Token,登顶全球。
环比增长570%。不是57%,是570%。
更扎心的是:它打败的不是别人,是它自己的大哥——DeepSeek-V4-Pro。
Flash版凭什么?
V4-Flash不是DeepSeek最强的模型。它是个轻量版。便宜、快、参数少。
但它在Agent编码任务上,跑赢了Pro旗舰。
开发者的脚很诚实——便宜又好用,凭什么不用?
这不是个案。整个行业都在发生同一件事:小模型正在吃掉大模型的地盘。
Meta的Muse Glimmer,300亿参数,单卡本地跑,工具调用性能碾压更大号的竞品。Qwen的Flash版本,性价比打到同行的骨折价。如今DeepSeek-V4-Flash直接登顶调用量榜首。
“大就是好”的时代,结束了。
谁在用?
8.83万亿Token是什么概念?
如果全部是AI Agent在跑任务,这意味着全球开发者已经大规模把DeepSeek接入了生产管线。
OpenRouter的数据显示:Agent类应用和Coding类应用只占调用次数的19%,却吃掉了81.2%的Token量。
翻译一下:AI Agent不是聊天的玩具,它是吃Token的怪兽。一个Agent跑一次任务,Token消耗量是聊天的几十倍甚至上百倍。
而开发者把这种”怪兽级”任务押在了DeepSeek身上。
中国的”便宜好用”杀招
中国大模型连续十五周调用量超美国。这不是偶然。
从DeepSeek到Qwen到MiniMax H3,中国模型有一个共同的标签:性价比拉到极致。
当OpenAI在烧2000美元让Astra解数学题的时候,DeepSeek在让全球几百万开发者用几分钱跑一次Agent任务。
一个在秀肌肉,一个在铺管道。
铺管道的那个,拿到了全球最多的调用量。
开发者不关心谁最聪明
他们只关心三件事:
1. 能不能把我的活干了?
2. 跑一次多少钱?
3. 稳不稳定?
DeepSeek-V4-Flash三条全中。
这场登顶不是技术突破的故事,是产品哲学的故事。不是”我的模型比你聪明”,而是”我的模型帮开发者赚到钱了”。
说得更直白一点:AI竞赛的下半场,拼的不是谁在排行榜上最高,而是谁被用得最多。
用得最多的那个,才能定义下一代AI的形态。
而现在的王座上,坐着一个Flash版。
留言 0
还没有留言,快来抢沙发