共收录 1 个相关网站
dreamtalk-project.github.io
基于扩散模型的音频驱动表达性头部生成开源框架,可将静态人物照片结合音频输入,生成人物自然说话、表情同步匹配的逼真视频,支持自定义图像与音频素材,助力开发者快速实现数字人相关功能开发与技术验证,适合AI数字内容生成方向研究学习。