利索能及
我要发布
收藏
专利号: 2019108832136
申请人: 平安科技(深圳)有限公司
专利类型:发明专利
专利状态:已下证
更新日期:2026-08-04
缴费截止日期: 2026-10-19
联系人

摘要:

权利要求书:

1.一种语音交互方法,其特征在于,包括:

在播放对话语音时,获取客户通道的音频信号,并判断所述音频信号的指定参数是否大于第一预设阈值;所述指定参数为音量,所述第一预设阈值为音量阈值;

若所述音频信号的指定参数大于第一预设阈值,则中止播放所述对话语音;

对所述音频信号进行解析并获取所述音频信号的解析结果,根据所述解析结果确定应答语句;获取与所述解析结果对应的第二预设阈值;

当所述客户通道的音频信号的指定参数小于所述第二预设阈值时,根据所述应答语句生成应答语音,并将所述应答语音发送给与所述客户通道对应的客户;

所述对所述音频信号进行解析并获取所述音频信号的解析结果,根据所述解析结果确定应答语句,包括:解析所述客户通道的音频信号并获取所述音频信号的解析结果,其中,所述解析结果包括所述音频信号包含人声或所述音频信号不包含人声;

若获取的所述解析结果为所述音频信号不包含人声,则选取与不包含人声的所述解析结果对应的连接语句和第一语音调节参数;

根据所述连接语句和所述对话语音生成所述应答语句,并使所述应答语句与所述第一语音调节参数关联;或,若获取的所述解析结果为所述音频信号包含人声,通过语音识别引擎将所述客户通道的音频信号转化为文本数据,并通过预设的语气识别模型识别所述客户通道的音频信号的语气类型;

通过语义理解引擎识别所述文本数据的语义信息;

从预设的应答语句数据库选取与所述语义信息匹配的所述应答语句,并获取与所述语气类型匹配的第二语音调节参数,所述第二语音调节参数与所述应答语句关联。

2.如权利要求1所述的语音交互方法,其特征在于,所述在播放对话语音时,获取客户通道的音频信号,并判断所述音频信号的指定参数是否大于第一预设阈值之前,还包括:获取客户资料;

根据所述客户资料建立与所述客户的通话连接;

根据所述客户资料和预设的交互任务确定初始语音参数及初始对话文本;

根据所述初始语音参数和所述初始对话文本生成初始对话语音;

将所述初始对话语音发送给所述客户。

3.如权利要求1所述的语音交互方法,其特征在于,所述当所述客户通道的音频信号的指定参数小于第二预设阈值时,根据所述应答语句生成应答语音,并将所述应答语音发送给与所述客户通道对应的客户,包括:识别所述客户通道的音频信号的背景噪音类型;

获取与所述背景噪音类型匹配的所述第二预设阈值;

当所述客户通道的音频信号的指定参数小于第二预设阈值时,根据所述应答语句和所述第一语音调节参数生成所述应答语音,并将所述应答语音发送给与所述客户通道对应的客户。

4.一种语音交互装置,其特征在于,包括:

音频判断模块,用于在播放对话语音时,获取客户通道的音频信号,并判断所述音频信号的指定参数是否大于第一预设阈值;所述指定参数为音量,所述第一预设阈值为音量阈值;

中止播放模块,用于若所述音频信号的指定参数大于第一预设阈值,则中止播放所述对话语音;

确定应答语句模块,用于对所述音频信号进行解析并获取所述音频信号的解析结果,根据所述解析结果确定应答语句;获取与所述解析结果对应的第二预设阈值;

发送应答语音模块,用于当所述客户通道的音频信号的指定参数小于所述第二预设阈值时,根据所述应答语句生成应答语音,并将所述应答语音发送给与所述客户通道对应的客户;

所述确定应答语句模块包括:

解析单元,用于解析所述客户通道的音频信号并获取所述音频信号的解析结果,其中,所述解析结果包括所述音频信号包含人声或所述音频信号不包含人声;

选取连接语句单元,用于若获取的所述解析结果为所述音频信号不包含人声,则选取与不包含人声的所述解析结果对应的连接语句和第一语音调节参数;

第一生成应答语句单元,用于根据所述连接语句和所述对话语音生成所述应答语句,并使所述应答语句与所述第一语音调节参数关联;或,语音识别单元,用于若获取的所述解析结果为所述音频信号包含人声,通过语音识别引擎将所述客户通道的音频信号转化为文本数据,并通过预设的语气识别模型识别所述客户通道的音频信号的语气类型;

语义理解单元,用于通过语义理解引擎识别所述文本数据的语义信息;

第二生成应答语句单元,用于从预设的应答语句数据库选取与所述语义信息匹配的所述应答语句,并获取与所述语气类型匹配的第二语音调节参数,所述第二语音调节参数与所述应答语句关联。

5.如权利要求4所述的语音交互装置,其特征在于,还包括:获取资料模块,用于获取客户资料;

建立通话连接模块,用于根据所述客户资料建立与所述客户的通话连接;

确定对话文本模块,用于根据所述客户资料和预设的交互任务确定初始语音参数及初始对话文本;

生成初始对话语音模块,用于根据所述初始语音参数和所述初始对话文本生成初始对话语音;

发送初始对话语音模块,用于将所述初始对话语音发送给所述客户。

6.一种计算机设备,包括存储器、处理器以及存储在所述存储器中并可在所述处理器上运行的计算机程序,其特征在于,所述处理器执行所述计算机程序时实现如权利要求1至

3中任一项所述语音交互方法。

7.一种计算机可读存储介质,所述计算机可读存储介质存储有计算机程序,其特征在于,所述计算机程序被处理器执行时实现如权利要求1至3中任一项所述语音交互方法。