搜索

+

95

-

回答

有个项目叫Lip2Wav ，它可以根据无声视频画面嘴唇的动作，进行“读唇”，给你音频配音结果。

算法原理就是根据面部特征，对唇部进行编码，再使用 LSTM 进行音频合成。

Lip2Wav 项目地址：

https://github.com/Rudrabha/Lip2Wav
还有一个项目是相反的，就是根据音频声音来让图像或视频中的人物按照你的声音来说话。

你还可以在线体验，只要上传一段视频和一段声音，谈就会自动同步视频与声音。

在线体验地址：https://bhaasha.iiit.ac.in/lipsync/example_upload1

Wav2Lip 项目地址：

https://github.com/Rudrabha/Wav2Lip

网友回复

我知道答案，我要回答

我有问题

最新提问