有个项目叫Lip2Wav ,它可以根据无声视频画面嘴唇的动作,进行“读唇”,给你音频配音结果。

算法原理就是根据面部特征,对唇部进行编码,再使用 LSTM 进行音频合成。

Lip2Wav 项目地址:
https://github.com/Rudrabha/Lip2Wav
还有一个项目是相反的,就是根据音频声音来让图像或视频中的人物按照你的声音来说话。

你还可以在线体验,只要上传一段视频和一段声音,谈就会自动同步视频与声音。
在线体验地址:https://bhaasha.iiit.ac.in/lipsync/example_upload1
Wav2Lip 项目地址:
https://github.com/Rudrabha/Wav2Lip
网友回复
如何将linux服务器的文件目录映射到windows电脑磁盘?
Docling 与 MarkItDown 两个库有啥不同?
豆包收费后国产其他ai软件也会跟进收费吗?
JPEG 与 HEIF图片格式区别?
centos7版本太旧无法安装python3.11,如何在docker中运行python3.11?
python如何做个RPA按键精灵的程序?
写一个windows的cmd的python代码如何在命令行中捕获获取复制粘贴的图片?
如何将别人爆款的抖音短视频短剧文案提取为seedance2的提示词?
阿里云域名dns云解析10万次日限额如何应对?
windows电脑如何提交上架ipa苹果应用?


