SadTalker

SadTalker

一张照片加音频生成说话视频

AI官网

应用介绍

想让一张人像照片开口说话,传统方法要么嘴型对不上,要么头部僵硬不动。SadTalker 从音频中学习真实的三维运动系数,让单张照片生成自然的说话头像视频。

口型、表情和头部姿态都随声音变化,支持多种风格,有网页界面和 Stable Diffusion WebUI 插件,论文收录于 CVPR 2023。

软件功能



单图驱动:一张照片即可。

口型同步:音频驱动。

自然头动:三维运动系数。

WebUI 插件:集成到 SD。