
7月31日,DeepSeek悄然上线了V4-Flash正式版API。这个时间点很微妙——Kimi刚发K3、MiniMax刚亮H3,国产大模型混战白热化,DeepSeek选在这时候出手,意思很明确:谁才是C位,你们说了不算。
最有意思的是这次升级的逻辑。按常规认知,Flash是轻量版、Pro是满血版,Flash永远比Pro弱。但DeepSeek偏不按套路。同一个模型骨架(2840亿总参数、130亿激活参数),只重新做了后训练,Agent能力就全面反超了自家V4-Pro预览版。TerminalBench 82.7分、Cybergym 76.7分——几个硬核指标都压Pro一头。
这说明什么?模型能力的天花板不再只是参数量的游戏了。训练策略、数据配比、强化学习路线,这些”看不见的手”才是真正拉开差距的地方。
另一个信号:DeepSeek Harness首次公开亮相。90后ACM金牌得主崔添翼带队的Agent框架,这意味着DeepSeek不只在追模型性能,而是在悄悄铺开Agent生态——毕竟模型做得再好,最终是要干活的。
资本也给了回应:两个月前刚融74亿美元,估值超500亿。钱到位了,技术就开始兑现。
Flash已反超Pro,正式版Pro还会远吗?
留言 0
还没有留言,快来抢沙发