+
98
-

回答

3D-Speaker 这个项目可以实现,3D-Speaker 是一个开源工具包,用于单 modal 和多 modal 的扬声器验证、扬声器识别和扬声器分割。可以为每个人说话声音生成声纹。

该项目提供了多种预训练模型,并附有详细的安装和使用说明,支持多个数据集,如 3D-Speaker、VoxCeleb 和 CN-Celeb。

此外,还提供了语言识别和语音活动检测等功能的训练和推理配方,以及一个大规模的 3D-Speaker 语音语料库。

https://github.com/modelscope/3D-Speaker

网友回复

我知道答案,我要回答