英伟达昨日(9 月 24 日)发布博文,宣布开源生成式 AI 面部动画模型 Audio2Face,涵盖模型、软件开发工具包(SDK)及完整训练框架,希望能在游戏和 3D 应用中,加速开发 AI 智能虚拟角色。
该技术通过分析音频中的音素、语调等声学特征,实时驱动虚拟角色面部动作,生成精准的口型同步和自然的情感表情,可广泛应用于游戏、影视制作和客户服务等领域。
Audio2Face 支持两种运行模式:预录制音频的离线渲染和动态 AI 角色的实时流式处理。IT之家援引博文介绍,英伟达此次开源了多个核心组件:
【来源:IT之家】



