有个项目叫Lip2Wav ,它可以根据无声视频画面嘴唇的动作,进行“读唇”,给你音频配音结果。
算法原理就是根据面部特征,对唇部进行编码,再使用 LSTM 进行音频合成。
Lip2Wav 项目地址:
https://github.com/Rudrabha/Lip2Wav
还有一个项目是相反的,就是根据音频声音来让图像或视频中的人物按照你的声音来说话。
你还可以在线体验,只要上传一段视频和一段声音,谈就会自动同步视频与声音。
在线体验地址:https://bhaasha.iiit.ac.in/lipsync/example_upload1
Wav2Lip 项目地址:
https://github.com/Rudrabha/Wav2Lip
网友回复
如何编写一个chrome插件实现多线程高速下载大文件?
cdn版本的vue在网页中出现typeerror错误无法找到错误代码位置怎么办?
pywebview能否使用webrtc远程控制共享桌面和摄像头?
pywebview6.0如何让窗体接受拖拽文件获取真实的文件路径?
如何在linux系统中同时能安装运行apk的安卓应用?
python有没有离线验证码识别ocr库?
各家的ai图生视频及文生视频的api价格谁最便宜?
openai、gemini、qwen3-vl、Doubao-Seed-1.6在ui截图视觉定位这款哪家更强更准?
如何在linux上创建一个沙箱隔离的目录让python使用?
pywebview如何使用浏览器自带语音识别与webspeech 的api?