DeepSeek悄悄放了个大招,Agent能力暴增7.5倍

7月31日,DeepSeek没有开发布会,只是在API文档里悄悄更新了一行字:V4-Flash正式版上线公测。

不声不响,但数据吓人。

最夸张的是DeepSWE评分,从7.3直接飙到54.4,涨了7.5倍。这意味着什么?以前让AI修代码,它可能是个实习生水平;现在,它已经接近一个靠谱的高级工程师了。

模型架构没变,还是2840亿参数的MoE。DeepSeek做了什么?纯靠后训练,把模型”教”聪明了。这比堆参数高明得多,也省钱得多。

Terminal-Bench跑分82.7,逼近Claude Opus 4.8的85分。要知道Opus可是OpenAI的旗舰,价格是V4-Flash的几十倍。花几十块就能买到接近顶级的Agent能力,这种性价比,谁扛得住?

还有个细节值得注意:V4-Flash首次原生支持Responses API,适配了Codex。这不是简单的功能添加,而是让AI从”对话机器”变成了”行动者”。它不再只是给你建议,而是可以直接在你的开发环境里动手干活。

国家超算互联网平台已经同步上线了这个模型。从发布到国家级平台部署,几乎没有时间差。

DeepSeek这波操作传递的信号很明确:Agent能力不再是旗舰模型的专属。高效、便宜、能干活,才是接下来AI竞争的主旋律。

V4-Pro正式版也快来了。这场AI Agent的竞赛,刚刚开始热身。