DeepSeek AI 人工智能

DeepSeek V4 Flash 终于来了。网友说,漫长的”七月中旬”,总算过完了。

7月中旬是DeepSeek自己定的发布时间。结果拖到7月下旬,没影。拖到7月最后一天,V4 Flash正式版才姗姗来迟。梁文锋的”网络评级”在这半个月里,从”梁圣”一路跌到”梁子”,差点就要变成”牢梁”。但现在,风向又变了。

V4 Flash正式版最狠的地方在于:模型参数和架构完全没变。架构没动,参数没加,纯靠后训练优化,性能直接超越自家V4 Pro预览版,顺带把GLM 5.2也超了,逼近Anthropic的Opus 4.8。

这是什么概念?等于同一台发动机,没换零件没扩缸,只调了调参数,马力凭空涨了一截。

更微妙的是发布时间点。就在V4 Flash发布不到24小时前,OpenAI推出了GPT-5.6 Luna,号称”美国闭源模型中的性价比之王”,套餐价低到离谱。但稍微一算就知道,那是赔本抢客户的路子。套餐价不等于API真实成本,属于典型的烧钱换市场。

而DeepSeek这边,网传他们还有80%的毛利。

80%毛利还能卖这么便宜,说明人家真不是打价格战。是把成本结构打穿了。中国开源模型和美国闭源模型之间的竞争,已经从”谁跑分高”变成了”谁成本更低还能跑分高”。

V4 Flash在轻量化模型这个维度上的意义,可能比Pro版更大。因为绝大多数真实场景不需要最强模型,一个够用、够便宜、够稳的模型,才是真正走量的东西。从各平台的使用量数据也能看出来,flash级别的模型调用量一直碾压旗舰版。

这件事还有一个隐藏信号:中国开源阵营正在从”追赶者”变成”定价者”。GLM 5.2、Kimi K3、DeepSeek V4,在不同层级上对硅谷形成了全面压力。美国AI巨头的策略已经开始出现混乱——一边降价抢客户,一边在国会山游说限制中国开源模型。

但真正可怕的不是某个模型跑分多高,是中国团队用更少的卡、更低的成本,做出同等甚至更强的模型。这才是让硅谷坐不住的根本原因。

DeepSeek重新定义了”七月中旬”。下次梁文锋再预告发布时间,估计没人敢信了。但大家还是会等。