智谱GLM-5.3-Flash 牛来

一周前,海外AI圈突然炸出一个“匿名大佬”。

没有名字,没有公司,只有一个代号:Ox-Alpha。

它一上线,OpenRouter(全球最大的模型调用平台)榜首直接易主。OpenCode上,它把DeepSeek压了56天的榜首,一脚踹了下来。

谁家出的?全网都在猜。

有人扒它的“指纹”:分词器、报错码、视频编码器token消耗……线索一条条对齐,答案指向同一家——智谱。

8月26日晚,智谱终于认领:对,这是我家的GLM-5.3-Flash。

中文社区早就给它起好了外号:“牛来”。

“牛来”为啥能火?两个字:够强,够便宜。

参数320B,激活只要18B。能力追平Claude Opus 4.8,价格却只有人家的四十分之一。每百万token,输入8毛、输出2块8。

翻译成人话:同样的活,国际大厂收你100块,它收你2块5。前沿智能,第一次不用省着用。

但真正让整个行业坐不住的,是另一个细节——

支撑“牛来”全部流量的,是10万张国产芯片。

你没看错。国产芯片。

过去我们总说,国产芯片能做大模型,但扛不住全球级别的真实流量。这次,智谱直接把10万张国产卡拉出来,跑了整整一周,处理了62万亿token,一天100万亿token的洪峰,硬是顶住了。

官方说法是:端到端性能提升3倍,单token成本追平英伟达GPU。

这就不是“能用”的问题了,是“够用”的问题。

换句话说,“牛来”这波,不只是模型赢了,更是国产算力在全球眼皮子底下,亮了一次肌肉。

以前是中国模型便宜,现在是:又便宜、又能打、还算力自主。

别忘了,就在这几天,OpenRouter榜单前五,已经全是中国模型。

评论区里有人说了句大实话:英伟达的卡,以后可能不再是“刚需”了。

至于“牛来”为什么叫“牛来”?因为它的内部代号Ox-Alpha,Ox就是牛。又恰逢电影《牛来》上映,这个外号就这么叫开了。

叫得还挺吉利——国产AI,真的牛起来了。