python如何根据音频自动给视频底部增加字幕变成新视频?
网友回复
这是一款python源码,实现将没有文字字幕的视频,通过语音识别技术识别为文本,然后重写将字幕添加到视频底部的效果代码。
注意调用的是google语音识别服务,确保你的网络能访问谷歌。
import os import speech_recognition as sr from moviepy.editor import VideoFileClip, TextClip, CompositeVideoClip from pydub import AudioSegment def extract_audio(video_path): video = VideoFileClip(video_path) audio = video.audio audio.write_audiofile("temp_audio.wav") return "temp_audio.wav" def transcribe_audio(audio_path): recognizer = sr.Recognizer() audio = AudioSegment.from_wav(audio_path) # 将音频分割成较小的片段 chunk_length_ms = 10000 # 10秒 chunks = [audio[i:i+chunk_length_ms] for i in range(0, len(audio), chunk_length_ms)] transcriptions = [] for i, chunk in enumerate(chunks): chunk.export(f"temp_chunk_{i}.wav", format="wav") with sr.AudioFile(f"temp_chunk_{i}.wav") as source: audio_data = ...
点击查看剩余70%
threejs如何引入中文字体json?
FLUX.1 Kontext如何api调用?
腾讯混元模型广场里都是混元模型的垂直小模型,如何api调用?
为啥所有的照片分辨率提升工具都会修改照片上的图案细节?
js如何在浏览器中将webm视频的声音分离为单独音频?
微信小程序如何播放第三方域名url的mp4视频?
ai多模态大模型能实时识别视频中的手语为文字吗?
如何远程调试别人的chrome浏览器获取调试信息?
为啥js打开新网页window.open设置窗口宽高无效?
浏览器中js的navigator.mediaDevices.getDisplayMedia屏幕录像无法录制SpeechSynthesisUtterance产生的说话声音?