腾讯混元Hy4大模型

8月28日,腾讯把新一代大模型 Hy4 preview 开源了。

770B参数,MoE架构,激活49B,上下文拉到100万token,Apache 2.0协议,权重随便用。这数据本身就很能打。

但真正让我觉得有意思的,不是参数。是这次,模型开始”自己优化自己”了。

根据官方介绍,Hy4 preview 介入了自己的训练方法、数据策略、评估体系,甚至底层算子的优化——它自己提方案、跑实验、看结果、再迭代。一个直接的成果:它给自己优化了推理系统,端到端吞吐量比基线提升31.8%。

也就是说,同样一堆算力,现在能接更多请求了。模型开始反过来改造承载自己的那套基础设施。

这事的信号很明确:AI的下半场,比的不是谁更能”憋大招”,而是谁的模型更会干活、更能自己把成本打下来。

几个侧面数据也印证了这一点。在163名专家、203个工程任务的盲测里,Hy4 preview 均分2.99,压过GLM-5.3的2.92和Kimi K3的2.94。Terminal-Bench从Hy3的70.8冲到85.4,DeepSWE更是从28.0跳到64.3。

工程能力,涨得比通用能力猛得多。翻译一下:写代码、跑命令、操作电脑这些”动手活”,它真的在变强。

还有一个不容忽视的布局:Hy4 preview 发布当天,就完成了对沐曦曦云C系列等国产GPU的Day0适配,还和燧原做了”芯模协同”。国产模型配国产芯片,走全栈自主可控,瞄准的是政府采购、国企上云这块高毛利市场。

一边开源不设限,一边死磕国产算力,腾讯这步棋,显然不只是想卷一个模型出来。

最后说句掏心窝的话:当模型开始自己改自己、自己省算力,AI行业拼的不再是发布会PPT,而是谁家系统跑得又稳又便宜。这场仗,才刚开始。