欢迎来到知嘟嘟! 联系电话:13336804447 卖家免费入驻,海量在线求购! 卖家免费入驻,海量在线求购!
知嘟嘟
我要发布
联系电话:13336804447
知嘟嘟经纪人
收藏
专利号: 2018106225488
申请人: 百度在线网络技术(北京)有限公司
专利类型:发明专利
专利状态:已下证
专利领域: 乐器;声学
更新日期:2024-02-23
缴费截止日期: 暂无
价格&联系人
年费信息
委托购买

摘要:

权利要求书:

1.一种歌声生成方法,其特征在于,包括:

获取用户录入的与歌曲对应的语音信号;

从预先建立的声学特征模板中获取所述歌曲对应的标准声学特征信息,根据所述标准声学特征信息对所述语音信号进行声学特征信息的更新;其中,所述声学特征模板中保存有至少一首歌曲的标准声学特征信息;

将具有更新后的声学特征信息的语音信号作为目标语音信号进行存储或输出;

其中,根据所述标准声学特征信息对所述语音信号进行声学特征信息的更新,包括:获取所述语音信号对应的音长信息,根据所述音长信息将所述语音信号进行音元划分,根据所述标准声学特征信息中的标准基频信息、标准音长信息和标准能量信息对音元划分后的所述语音信号进行时域音频变换,以使经时域音频变换后的语音信号的基频信息与所述标准基频信息一致、经时域音频变换后的语音信号的音长信息与所述标准音长信息一致、以及经时域音频变换后的语音信号的能量信息与所述标准能量信息一致;

将具有更新后的声学特征信息的语音信号作为目标语音信号进行存储或输出,包括:将进行时域音频变换后得到的语音信号作为目标语音信号进行存储或输出。

2.根据权利要求1所述的方法,其特征在于,获取所述语音信号对应的音长信息,包括:通过语音识别得到所述语音信号中包含的歌词信息,根据所述歌词信息得到所述语音信号对应的音长信息。

3.根据权利要求1或2所述的方法,其特征在于,在获取用户录入的与歌曲对应的语音信号之前还包括:分别提取录制的多个歌曲的声学特征信息作为对应歌曲的标准声学特征信息;

将所述多个歌曲的标识信息与对应的标准声学特征信息保存在声学特征模板中。

4.一种歌声生成方法,其特征在于,包括:

获取用户录入的与歌曲对应的语音信号;

提取所述语音信号的频谱信息;

从预先建立的声学特征模板中获取所述歌曲对应的标准声学特征信息,根据所述标准声学特征信息对所述语音信号进行声学特征信息的更新;其中,所述声学特征模板中保存有至少一首歌曲的标准声学特征信息;

将具有更新后的声学特征信息的语音信号作为目标语音信号进行存储或输出;

其中,根据所述标准声学特征信息对所述语音信号进行声学特征信息的更新,包括:获取所述语音信号对应的音长信息,根据所述音长信息将所述语音信号进行音元划分;将音元划分后的所述语音信号进行时域到频域的转换,使用所述标准声学特征信息中的标准基频信息替换转换后得到的频域上的语音信号的基频信息,使用所述标准声学特征信息中的标准音长信息替换转换后得到的频域上的语音信号的音长信息,使用所述标准声学特征信息中的标准能量信息替换转换后得到的频域上的语音信号的能量信息;

将具有更新后的声学特征信息的语音信号作为目标语音信号进行存储或输出,包括:根据更新后得到的声学特征信息和所述频谱信息获得目标语音信号,将目标语音信号进行存储或输出。

5.根据权利要求4所述的方法,其特征在于,根据更新后得到的声学特征信息和所述频谱信息获得目标语音信号,包括:将更新后得到的声学特征信息和所述频谱信息输入给声码器,得到所述声码器还原出的目标语音信号。

6.根据权利要求4所述的方法,其特征在于,获取所述语音信号对应的音长信息,包括:通过语音识别得到所述语音信号中包含的歌词信息,根据所述歌词信息得到所述语音信号对应的音长信息。

7.根据权利要求4-6中任一项所述的方法,其特征在于,在获取用户录入的与歌曲对应的语音信号之前还包括:分别提取录制的多个歌曲的声学特征信息作为对应歌曲的标准声学特征信息;

将所述多个歌曲的标识信息与对应的标准声学特征信息保存在声学特征模板中。

8.一种歌声生成装置,其特征在于,包括:

语音信号获取模块,用于获取用户录入的与歌曲对应的语音信号;

声学特征信息更新模块,用于从预先建立的声学特征模板中获取所述歌曲对应的标准声学特征信息,根据所述标准声学特征信息对所述语音信号进行声学特征信息的更新;其中,所述声学特征模板中保存有至少一首歌曲的标准声学特征信息;

目标语音信号确定模块,用于将具有更新后的声学特征信息的语音信号作为目标语音信号进行存储或输出;

其中,声学特征信息更新模块包括:

第一音长信息获取单元,用于获取语音信号对应的音长信息;

时域音频变换单元,用于根据音长信息将语音信号进行音元划分,根据标准声学特征信息中的标准基频信息、标准音长信息和标准能量信息对音元划分后的语音信号进行时域音频变换,以使经时域音频变换后的语音信号的基频信息与标准基频信息一致、经时域音频变换后的语音信号的音长信息与标准音长信息一致、以及经时域音频变换后的语音信号的能量信息与标准能量信息一致;

目标语音信号确定模块包括:

第一目标语音信号确定单元,用于将进行时域音频变换后得到的语音信号作为目标语音信号进行存储或输出。

9.一种歌声生成装置,其特征在于,包括:

语音信号获取模块,用于获取用户录入的与歌曲对应的语音信号;

声学特征信息更新模块,用于从预先建立的声学特征模板中获取所述歌曲对应的标准声学特征信息,根据所述标准声学特征信息对所述语音信号进行声学特征信息的更新;其中,所述声学特征模板中保存有至少一首歌曲的标准声学特征信息;

目标语音信号确定模块,用于将具有更新后的声学特征信息的语音信号作为目标语音信号进行存储或输出;

频谱信息提取模块,用于在获取用户录入的与歌曲对应的语音信号之后、根据标准声学特征信息对语音信号进行声学特征信息的更新之前,提取语音信号的频谱信息;

其中,声学特征信息更新模块,包括:

第二音长信息获取单元,用于获取语音信号对应的音长信息;

频域音频变换单元,用于根据音长信息将语音信号进行音元划分;将音元划分后的语音信号进行时域到频域的转换,使用标准声学特征信息中的标准基频信息替换转换后得到的频域上的语音信号的基频信息,使用标准声学特征信息中的标准音长信息替换转换后得到的频域上的语音信号的音长信息,使用标准声学特征信息中的标准能量信息替换转换后得到的频域上的语音信号的能量信息;

第二目标语音确定单元,用于根据更新后得到的声学特征信息和频谱信息获得目标语音信号,将目标语音信号进行存储或输出。

10.一种歌声生成终端,其特征在于,包括:

一个或多个处理器;

存储装置,用于存储一个或多个程序,

当所述一个或多个程序被所述一个或多个处理器执行,使得所述一个或多个处理器实现如权利要求1-7中任一所述的歌声生成方法。

11.一种计算机可读存储介质,其上存储有计算机程序,其特征在于,该程序被处理器执行时实现如权利要求1-7中任一所述的歌声生成方法。