一种语音合成模型的训练、语音合成方法及相关装置.pdf
佳宁****么啦
亲,该文档总共32页,到这已经超出免费预览范围,如果喜欢就直接下载吧~
相关资料
一种语音合成模型的训练、语音合成方法及相关装置.pdf
本发明提供了一种语音合成模型的训练、语音合成方法及相关装置,该方法包括:获取原始频谱信号、说话者的音色嵌入特征,原始频谱信号转换自说话者按照文本信息说话时记录的原始语音信号,在声纹网络中,将原始频谱信号编码为声纹特征,声纹特征用于验证说话者的身份,在音色支持网络中,将原始频谱信号编码为音色补充特征,音色补充特征为声纹特征在音色上缺失的特征,将声纹特征与音色补充特征融合为音色总量特征,在音色嵌入特征修正音色总量特征的条件下,根据音色总量特征、原始频谱信号训练声学网络、音色支持网络。保证特征在音色上的全面性,
语音转换的方法、训练语音合成模型的方法及装置.pdf
本申请提供一种语音转换的方法、训练语音合成模型的方法及装置,该方法包括,获取目标用户的待转换文本;通过语音合成模型对待转换文本进行转换,得到待转换文本对应的语音,其中,语音合成模型是根据目标用户的语言能力等级,通过语言能力等级对应的预设比例的多个语种的语音样本、多个语种的字词语音样本和多个语种的发音因素样本对基础模型进行训练得到的,不同的语言能力等级对应的预设比例不同,基础模型是通过基础预设比例的多个语种的语音样本以及多个语种的混合语音样本对通用模型进行训练得到的。通过该方法可以达到提高语音转换的准确率的
语音合成模型训练和语音合成方法、装置、设备及介质.pdf
本发明公开了一种语音合成模型训练和语音合成方法、装置、设备及介质。由于样本集中的任一第一语音样本对应的文本特征,均是根据预先配置的第一语言的语音单元集合与第二语言的语音单元集合的对应关系确定的,从而实现了将第一语音样本转换为第二语言的语音样本,增加了第二语言的语音样本的数量,后续基于样本集中的第一语音样本对应的文本特征样本和第一语音样本的第一声学特征,即可对原始语音合成模型进行训练,从而获取到第二语言对应的目标语音合成模型,从而实现无需大量的采集第二语言的语音样本,即可获取到第二语言的目标语音合成模型。
一种语音合成方法及语音合成模型的训练方法.pdf
本公开提供了一种语音合成方法及语音合成模型的训练方法,涉及人工智能技术领域,具体涉及深度学习、语音技术等领域。具体实现方案为:获取待合成文本和至少两个待合成语音;获取至少两个待合成语音中的第一待合成语音的音色隐向量,以及第二待合成语音的风格隐向量;获取所述待合成文本的文本隐向量;将所述音色隐向量、所述风格隐向量和所述文本隐向量进行拼接,并基于拼接后的隐向量,生成所述待合成文本的目标合成语音。由此,本公开能够针对同一个待合成文本,结合音色隐向量和风格隐向量的多种不同的组合,从而生成多种不同的目标合成语音,实
一种语音合成模型、模型的训练方法以及语音合成方法.pdf
本发明公开了一种语音合成模型、模型的训练方法以及语音合成方法,语音合成模型包括:嵌入模块、时长预测模块、能量预测模块、音高预测模块、情感强度预测模块、编码器、特征组合模块以及解码器。对该模型进行训练包括:获取多条情感音频以及与每条情感音频对应的文本;分析情感音频,提取情感音频对应的音素;获取情感音频的真实特征;将真实特征、情感音频对应的音素以及文本输入至初始化语音合成模型完成训练。通过训练完成的语音模型完成语音合成,包括:获取目标情感音频对应的音素以及目标文本;将目标情感音频对应的音素以及目标文本输入至语