每天被调用10亿次的模型,微信说开源就开源了

j
jxgzhc
1小时前 2 分钟阅读

微信开源WeMM-Embedding多模态模型

微信干了一件少见的事:把自家“压箱底”的多模态模型,开源了。

这个模型叫 WeMM-Embedding,2B、4B、9B 三个版本,基于 Qwen3.5 架构。文本、图片、视频、文档,混在一起的输入它也能接。

名字有点技术,话糙理不糙:它就是让 AI 学会“真的看懂”不同形态的内容,再放到同一个语义空间里去比大小。

你在视频号刷到的推荐、朋友圈搜到的那条动态、微信电商里看到的商品,背后都有它的影子。

真正狠的地方在于——这不是实验室里挑出来的“候选模型”,是每天被真实调用 10 亿次的生产级模型。

10 亿次什么概念?你我天天用的微信,可能已经碰过它无数次。它不是 PPT 上的模型,是流水线上跑了好几年的老员工。

这次开源,配置还特别全:完整代码、模型权重、技术报告,全都摊开给你看。

为什么稀罕?因为大厂开源,多数是拿“次要的、可放弃的”来博名声。把主营收业务背后的模型交出来,很少见。

这背后藏着一个信号:嵌入模型(Embedding),正在成为巨头们新的必争之地。

聊天模型已经卷成红海了,谁都能聊。但“让系统真正理解你想要什么”,这活儿还没卷到头。

微信这一手,等于是在说:我连最核心的家底都敢公开,你们随意。

对开发者来说更是好事。9B 版本在权威榜单 MMEB-v2 上拿了第一,还是开源免费。等于把行业里目前最能“听懂人话”的脑子,直接送给了所有人。

AI 的下半场,可能不再比谁更会聊,而是比谁更懂你。

微信这步棋,走得挺直白,也挺大气。