共收录 1 个相关网站
www.microsoft.com
VASA-1是微软亚洲研究院开发的AI生成模型,可结合单张静态人像照片与输入音频,生成唇形精准同步、适配音频语调的真人头肩口播视频,能自然还原头部微动与面部情绪变化,当前已公开完整技术论文与官方效果演示样例。