logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

音频人声分离

语音分离:语音和非语音(噪音);人声分离:多个说话者的声音分离。Speaker Separation:输入一段声音序号,输出两段声音序号。目前聚焦在两个说话者声音序号混在一起、单一麦克风的情况下,训练和测试是不同的语者;输入和输出的声音长度是一样的,所以一般不用Seq2Seq模型。一、评估1.Signal-to-noise ratio(SNR)模型的输出和真实语音越接近就代表模型的性能越好;E越小

#音视频#语音识别#人工智能
到底了