
你可能还在消化GPT-5.6免费的消息,字节跳动已经在做一件更疯狂的事了。
8月8日,《金融时报》爆料:字节跳动正式启动了一个10万亿参数超大模型的预训练。
10万亿。这个数字是什么概念?Anthropic刚刚开训的Mythos 5,8万亿参数,已经被业界惊呼”疯狂”。字节直接跳到了10万亿。
这不是炫技
很多人看到这个数字,第一反应是:又来一个”参数竞赛”的选手。
但你仔细想想,字节不是那种为了PR烧钱的公司。张一鸣在7月那篇著名的不蒸馏宣言里,说得够清楚了:要做独立的技术路线。
字节的AI布局其实非常有章法:豆包大模型切C端,SeedRealtime打交互体验,Seedance做视频生成,火山引擎铺B端。现在这个10万亿模型,很可能是所有产品线的统一底座。
逻辑很简单:当你的应用场景覆盖了聊天、视频、音乐、办公、电商、游戏,没有一个足够强大的底层模型,每个产品线各自为战,效率只会越来越低。
但真正的看点,不是参数
这些年我们见证了一个规律:参数越大,不一定越强。DeepSeek V3.1用混合推理架构,参数量远小于GPT-5.6,但特定任务上不落下风。
真正的看点有三个。
第一,算力从哪来。10万亿参数的训练,需要的算力规模是天文数字。字节被美国列入实体清单后,高端GPU获取受限。如果这都能跑起来,说明国产芯片和自研算力集群已经悄悄达到了新高度。
第二,什么时候能跑完。Anthropic的Mythos 5从宣布开训到现在,大半年了还没动静。10万亿的工期只会更长。这是一场马拉松,比的不是谁先开枪,而是谁能跑到终点。
第三,到底给谁用。这是最关键的问题。10万亿参数的模型,推理成本高到离谱。如果只是发论文说”我做到了”,那毫无意义。字节必须找到能覆盖成本的落地场景——可能是豆包的超级大脑,可能是企业级私有化部署,也可能是一个我们现在还想象不到的新产品形态。
AI竞赛进入下半场
把视野拉远一点看,这个夏天发生的事其实很有标志性:
OpenAI把GPT-5.6免费了,开始抢用户;DeepSeek把推理成本打到了脚底板,开始抢开发者;Anthropic签了千亿美元算力大单,开始抢基础设施;字节直接开训10万亿参数模型,开始抢下一个时代。
每家都在用自己最擅长的方式,打一场没有回头路的仗。
对普通人来说,好消息是:无论谁赢,AI只会变得更便宜、更强大、更无处不在。豆包的语音交互已经能”边看边听边说”了,再过一年会变成什么样?
坏消息是:这场竞赛的门槛高到离谱。10万亿参数的入场券,已经把99.9%的创业者挡在了门外。AI行业正在从”百花齐放”走向”寡头对决”。
这不是危言耸听。当训练一个大模型的成本以十亿美元为单位计算时,能留在牌桌上的玩家,一只手就数得过来了。
最后
参数竞赛这个词,在2024年被嘲讽了一年。但2026年的现实告诉我们:当参数跃升伴随着架构创新、工程优化和清晰的商业闭环时,它就不是竞赛,是门槛。
字节这步棋,赌的不是谁能调出更好的模型,赌的是下一个时代的门票。
就是不知道,这张门票的价格,谁能付得起。
留言 0
还没有留言,快来抢沙发