为什么它是数字人落地的核心卡点
很多人以为,数字人就是捏个好看的脸,套上衣服就能用。 不对。 用户对“像真人”的感知,90%来自面部表情,而表情的核心,是肌肉牵动的皮肤形变。 传统的数字人方案,大多用的是Blend Shape混合变形技术,提前做好几十个预设表情,用的时候按权重拼出来就行。速度够快,但细节根本不对。 你笑的时候苹果肌向上挤压,眼轮匝肌收缩带动眼尾纹路变化,法令纹的深浅变化会联动脸颊脂肪层的位移,这些连锁反应根本不是靠十几个预设表情块拼出来的。拼出来的表情,永远带着一股塑料感,观众一眼就能看出不对劲。
技术路线演进,现在走到了哪一步
数字人面部肌肉模拟,本质就是还原人类面部的运动逻辑。目前两条主流路线,各有优劣。 一条是基于解剖学的物理模拟路线。按照真人面部解剖结构,一块块重建出几十块骨骼肌、皮下脂肪层和真皮层,每一次表情变化都按照物理规则计算肌肉收缩、脂肪位移,最后输出皮肤的形变。 这种方法做出来的表情最自然,细节最准,缺点就是计算量太大。放在十年前,跑一帧高清画面就要好几秒,根本不可能做实时。 另一条是数据驱动的深度学习路线。用大量真人面部动捕数据训练神经网络,输入驱动点的位置,直接输出面部形变结果。速度快,能做到实时,但泛化性差,换个身份、换个没训练过的表情,直接崩掉,细节也经不起推敲。
产业落地的真实障碍,不是技术是成本

风险隐忧与未来三年判断
技术成熟得越快,风险来得也越快。 当数字人面部实时肌肉模拟能做到以假乱真的时候,深度伪造的门槛直接降到了普通人就能玩的程度。原来换脸需要专业软件后期修半天,现在实时视频通话就能生成完全同步的假表情,诈骗分子可以直接冒充你的亲友、同事,普通人根本分不出来。 现在监管已经开始要求数字人内容必须标注,但是技术跑在规则前面,灰色地带的应用早就已经出现了。 对未来三年,我有几个判断: 第一,入门级的实时肌肉模拟会变成标准化的基础设施,开放给所有开发者用,成本会降到几百块甚至免费,小团队也能做自己的实时数字人。 第二,实时互动场景会率先落地,24小时数字人直播、虚拟客服、线上虚拟会议这些场景,会率先用上成熟的方案,取代现在的僵硬塑料皮数字人。 第三,原生虚拟偶像的体验会迎来大升级,偶像的表情会越来越自然,和粉丝实时连麦互动的时候,再也不会出现表情卡顿歪嘴的尴尬。 最后,行业会洗牌,那些靠炒数字人概念割韭菜的公司,会很快被淘汰,剩下能把肌肉模拟这块做扎实的,才能吃到真正的产业红利。作者|大讲堂
排版|大讲堂
审核|满满
大讲堂