8月10日,Meta悄悄放了个大招。
不是那个憋了很久的超级模型,而是一个”小”家伙——Muse Glimmer,30B参数,开源,免费。
小到什么程度?4位量化后不到20个G,一张消费级显卡就装得下,Mac也能跑。

这模型是干嘛的?一句话:专门在本地替你干”Agent”的活。
啥叫Agent的活?就是那种多步骤的苦差事——规划任务、调用工具、出错了自己爬起来重试,一气呵成。
它不是从零练出来的,是从自家更猛的Muse Spark模型”蒸馏”的,等于大号带小号,把本事浓缩进小身板。
速度也不含糊:RTX 5090上每秒吐233个token,比没优化快3倍。平时挂电脑里待命,随叫随到。
这事看着只是发了个模型,信号其实很重。
过去两年,最强AI都住在云端的”大别墅”里,你按token买门票、按月交”房租”。
现在Meta告诉你:小户型也能住,关键是——不用联网、数据不出门、断网照样干活。
对普通人和开发者来说,诱惑是实打实的:隐私(敏感数据不用再上传给第三方)、省钱(没API费没订阅费,一张显卡买断)、离线(没网也能用)。

当然,30B跟顶配大模型比智商还差一截,别指望它跟GPT扳手腕。
但”够用+私有+免费”这三样凑一起,就足够让一堆场景松动。
以后你电脑里那个常驻的AI助手,可能真不是云端的”大爷”,而是显卡里养着的”小兄弟”。
大模型卷完智商,开始卷”回家”了。谁能把AI塞进普通人的设备里,谁就拿到下一张入场券。
留言 0
还没有留言,快来抢沙发