
8月13日凌晨,DeepSeek 悄悄把 V4 Pro 转正了。
距离预览版发布,已经过去四个月。
没换架构,没加参数,就是重新后训练了一轮。
结果,Agent 能力原地起飞。
代码工程测试 DeepSWE,从 12.8 分干到 62.7 分,涨了近四倍。
终端操作测试 87.9 分,离 Anthropic 的 Claude Fable 5 只差 0.1 分。
网络安全攻防、自动化任务,直接反超。
一句话:这模型从”会答题”,进化成了”会干活”。
它现在能自己拆任务、调工具、写代码、验结果,整套流程跑下来,不用人盯着。
上下文拉到 100 万 token,单次最多能吐 38 万。
什么概念?一本大型代码仓库,一次读进去,还能接着写。
价格,还是地板价。
输出 6 块钱一百万 token。
听着不便宜?海外旗舰模型的定价,是它的 60 倍。
DeepSeek 还整了个新花样:峰谷计价。
工作日早九点到十二点、下午两点到六点,高峰期涨价,闲时半价。
好家伙,把大模型当电卖。
再配上那个消息:重启第二轮融资,计划募资 500 亿,投前估值约 5000 亿。
资本市场的态度,说明了一切。
所以,这轮 AI 竞赛的风向已经变了。
卷参数的时代过去了,卷”干活”的时代来了。
谁能让 AI 真正替人把活干了,谁就赢了。
DeepSeek 这一手,把标杆又往前推了一截。
留言 0
还没有留言,快来抢沙发