阶跃星辰StepAudio3语音大模型

9月15日,阶跃星辰一口气发了五款语音大模型。

全都叫StepAudio3,各管一摊:实时对话、语音识别、语音生成、音频生成、音乐创作。

关键是榜单成绩:

StepAudio3 Realtime,在ArtificialAnalysis拿了98.9%的高分,全球第一;语音推理准确率99.7%,还是全球第一。

StepAudio3 ASR,词错误率只有1.7%,并列全球第一。

三个第一,全是一家公司。

过去聊起语音AI,大家想到的多半是GPT的语音模式、谷歌的Gemini Live,标杆都在海外。这一回,中国团队直接站上了榜单最顶端。

这事为什么值得说?

因为语音,是AI走进日常最自然的一扇门。

打字要动手,语音只要开口。手机助手、车载系统、耳机、客服,全在等一个又好又快的语音模型。谁能把”会听会说”的底座做好,谁就抓住了下一个入口。

更值得注意的是,五款模型全部上线开放平台,说明阶跃不只是秀肌肉,是真要商用。

AI的下半场,不只比谁会写代码,还要比谁会”说话”。

语音这个战场,热闹起来了。