
数字人赛道,终于有人把门槛踩平了。
7月31日,科大讯飞在北京发布了一项新技术——星火超拟人数字人实时生成。核心卖点就一句话:只需要一张照片,就能实时生成数字人,并且支持自然交互。
以前做数字人,需要专业设备采集、建模、渲染,成本动辄数万元,周期按周计算。讯飞这次的技术突破在于:用一张自拍照片,几秒钟内就能生成一个可以实时对话、表情自然、口型同步的数字分身。
技术底层依托讯飞星火大模型的多模态能力,融合了语音合成、面部驱动、情感计算三条技术线。数字人不仅能说,还能根据对话内容做出对应的微表情——点头、眨眼、嘴角上扬,这些细节让交互体验大幅提升。
应用场景方面,讯飞重点展示了三个方向:电商直播带货、在线教育虚拟老师、以及个人数字分身。尤其是个人数字分身,用户只需上传一张照片,就能在视频会议、社交平台上用自己的数字人形象出镜。
价格方面,讯飞给出了颇具竞争力的方案:基础版免费开放给个人用户,企业版按调用量计费。这一策略直接对标当前市场上按年收费、动辄数万元的数字人SaaS产品。
讯飞同时还发布了数字人开放平台,第三方开发者可以调用API将数字人能力集成到自己的应用中。这意味着未来我们可能在各种APP里看到基于讯飞技术的数字人形象。
从技术演示来看,实时生成的数字人在光线均匀的正面照片下效果最佳,侧脸、遮挡、极端光影条件下仍有提升空间。但整体而言,这项技术已经把数字人的使用门槛拉到了一个前所未有的低点。
留言 0
还没有留言,快来抢沙发