
今天,阿里干了件值得说的事。
它开源了一个新模型,名字叫 Qwen3.8-Flash-Next。
名字有点绕口,但里面的信息量很大。
先说身材:1250亿参数,妥妥的巨无霸。
但有意思的地方在于——它每次干活,只唤醒其中60亿参数。
剩下1200多亿参数,都在“睡觉”。
这就是“混合专家”的玩法:不是把所有参数都用一遍,而是按需叫醒最会干那件事的专家。
大块头,却有小身板的速度和成本。
重点来了——这个模型,其实是一支“预告片”。
名字里的“Next”说得很明白:它是下一代大模型 Qwen4 的一次提前亮相。
新架构还没捂热乎,先开源出来给全世界用,让大家帮忙验货,顺便攒口碑。
等于发了个“试吃装”。
这次试吃装,主打两个词:快,和便宜。
官方给的数据很直接,超长文本场景下,处理速度最高能快10倍;训练成本,大约是上一代旗舰的九分之一。
API 价格也报了:输入每百万 token 只要 0.16 美元(约一块一人民币),基本是白菜价。
当别的巨头还在卷“谁家模型更大、更聪明”的时候,阿里走的这条路很清醒:把效率做到极致,把价格打到地板。
大模型的竞争,正从“比力气”,变成“比谁更会省钱”。
而开源,就是这场擂台赛最好的路演——不吹牛,直接给代码,行不行你自己跑。
说实话,这已经不是阿里第一次这么干了。
从通义千问一路开源过来,每一代都在拉低“顶级 AI”的使用门槛。
今天,门槛又被压低了一截。
对开发者和普通人来说,这是好事:更便宜、更快的顶级模型,意味着更多可能性。
至于 Qwen4 到底长什么样?
答案,就藏在这支“预告片”里。
留言 0
还没有留言,快来抢沙发