有个项目叫Lip2Wav ,它可以根据无声视频画面嘴唇的动作,进行“读唇”,给你音频配音结果。
算法原理就是根据面部特征,对唇部进行编码,再使用 LSTM 进行音频合成。
Lip2Wav 项目地址:
https://github.com/Rudrabha/Lip2Wav
还有一个项目是相反的,就是根据音频声音来让图像或视频中的人物按照你的声音来说话。
你还可以在线体验,只要上传一段视频和一段声音,谈就会自动同步视频与声音。
在线体验地址:https://bhaasha.iiit.ac.in/lipsync/example_upload1
Wav2Lip 项目地址:
https://github.com/Rudrabha/Wav2Lip
网友回复
python如何实现torrent的服务端进行文件分发p2p下载?
如何在浏览器中录制摄像头和麦克风数据为mp4视频保存下载本地?
go如何编写一个类似docker的linux的虚拟容器?
python如何写一个bittorrent的种子下载客户端?
ai能通过看一个网页的交互过程视频自主模仿复制网页编写代码吗?
ai先写功能代码通过chrome mcp来进行测试功能最后ai美化页面这个流程能行吗?
vue在手机端上下拖拽元素的时候如何禁止父元素及body的滚动导致无法拖拽完成?
使用tailwindcss如何去掉响应式自适应?
有没有直接在浏览器中运行的离线linux系统?
nginx如何保留post或get数据进行url重定向?