
昨天晚上,阿里突然放了个大招:Qwen3.8-Flash-Next 开源了。
名字有点绕,但读懂它,基本就读懂了一半的 Qwen4。
一句话说清楚:这是 Qwen4 的“预告片”。
模型总参数 1250 亿,但处理每个 token,只激活 60 亿。约等于 95% 的参数在“摸鱼”——省力,自然省钱。
训练成本直接降到上一代 Qwen3.7-Plus 的九分之一。
以前大厂发模型,都是“成品先上,架构后扒”。阿里这次反着来:正式版 Qwen4 还没影,先把架构开源,让全世界的开发者提前上车。
这一手,跟当年 Qwen3-Next 给 Qwen3.5 铺路的路数一模一样。玩法重演,野心加倍。
再上几个硬数字:
原生 26 万 token 上下文,一键能扩到 100 万;定价每百万 token,输入 1 元、输出 3 元;6B 激活的小身板,14 项基准里 8 项冲到最优,coding 和办公任务直接掀桌。
至于架构为什么牛,其实也不玄乎:
GDN 加稀疏注意力,长文本的“注意力”只盯重点,不再从头扫到尾;四路残差门控,信息在层与层之间传得更稳;51B 的 N-gram 词表,塞进内存不当显存,等于白捡了一块容量。
说到底,大模型卷到 2026 年,风向悄悄变了。
以前拼“谁参数多”,现在拼“谁花的钱最少、干的活一样好”。
参数竞赛退场,成本竞赛登场。
对普通用户来说,这是实打实的好消息:AI 只会越来越便宜,越来越用得起。
至于 Qwen4 正式版什么时候来?骨架都公开了,正主还会远吗。
留言 0
还没有留言,快来抢沙发