DeepSeek V4 Pro 正式版

8月13日凌晨,DeepSeek 悄悄把 V4 Pro 转正了。

距离预览版发布,已经过去四个月。

没换架构,没加参数,就是重新后训练了一轮。

结果,Agent 能力原地起飞。

代码工程测试 DeepSWE,从 12.8 分干到 62.7 分,涨了近四倍。

终端操作测试 87.9 分,离 Anthropic 的 Claude Fable 5 只差 0.1 分。

网络安全攻防、自动化任务,直接反超。

一句话:这模型从”会答题”,进化成了”会干活”。

它现在能自己拆任务、调工具、写代码、验结果,整套流程跑下来,不用人盯着。

上下文拉到 100 万 token,单次最多能吐 38 万。

什么概念?一本大型代码仓库,一次读进去,还能接着写。

价格,还是地板价。

输出 6 块钱一百万 token。

听着不便宜?海外旗舰模型的定价,是它的 60 倍。

DeepSeek 还整了个新花样:峰谷计价。

工作日早九点到十二点、下午两点到六点,高峰期涨价,闲时半价。

好家伙,把大模型当电卖。

再配上那个消息:重启第二轮融资,计划募资 500 亿,投前估值约 5000 亿。

资本市场的态度,说明了一切。

所以,这轮 AI 竞赛的风向已经变了。

卷参数的时代过去了,卷”干活”的时代来了。

谁能让 AI 真正替人把活干了,谁就赢了。

DeepSeek 这一手,把标杆又往前推了一截。