
上周AI圈出了件怪事。
一个7440亿参数的模型,挂上了Hugging Face。没有发布会,没有预热海报,没有媒体通稿,连论文都是三天后才补的。
发布方是上海人工智能实验室,就是做InternLM的那拨人。模型叫Atria Dawn Preview。
按理说,这个量级的模型,够别的厂商开三场发布会了。但它就是安静地出现在权重平台上,然后被开发者发现、转发、讨论。
为什么值得看?三个点。
第一,它是目前全球最大的开源智能体模型。
744B参数,MoE架构,底座是智谱的GLM-5.2。78层网络、256个路由专家,每个token只激活8个。
它不跟你闲聊,它是干活的:接一个科研问题,自己拆解、自己查资料、自己写代码跑实验、自己读结果。失败了不退出,自己改,循环到交付为止。
第二,它用的是MIT协议,这可能是最狠的地方。
MIT意味着什么?代码和权重双开源,商用、修改、再分发,全部免费,不设限制,不用找法务审批。
以前前沿模型是什么套路?商业授权、API依赖、一堆使用协议。现在这个,医院、律所、金融机构,只要有GPU,拉到自己集群上就能跑,数据不出门。
第三,它在好几个硬核基准上,把GPT-5.6和Claude比下去了。
16项基准拿了5项第一:浏览检索BrowseComp 92.5(GPT-5.6 Sol是92.2)、深度搜索DeepSearchQA 96.0、网络安全CyberGym 86.5、工具调用BFCL v4 77.0、自动化执行AutomationBench 53.8。
这背后是上海AI实验室拉着复旦、中科院软件所、人大、中科院自动化所、华东师大、哈工大一起干的。
但别急着吹。
短板也明摆着:写代码的SWE-bench Pro只有59.6,Claude Opus 5是74.7;所有跑分都是自报数据,还没有第三方独立复现。
而且权重是真的重:BF16版本1.5TB,FP8也要756GB。想本地部署,先掂量掂量自己的显卡。
那这事的真正信号是什么?
不是”又一个国产模型刷榜了”。
而是发布方式本身:没有发布会,没有PPT,没有”遥遥领先”。
当别的厂商还在把模型发布当营销事件来做,有人已经开始把模型当基础设施来发了。
就像Linux那样——不吆喝,放上去,谁要用谁拿。
从”会聊天”到”能干活”,从”租API”到”拥有模型”,AI的玩法,正在被改写。
(来源:Hugging Face internlm/Atria-Dawn-Preview、arXiv技术报告及公开评测数据)