利索能及
我要发布
收藏
专利号: 2019102998829
申请人: 平安科技(深圳)有限公司
专利类型:发明专利
专利状态:已下证
更新日期:2026-08-04
缴费截止日期: 2027-05-17
联系人

摘要:

权利要求书:

1.一种录音文件格式转换方法,其特征在于,所述录音文件格式转换方法包括如下步骤:获取录音源文件;

根据预设音频转码数据库中选择用于对所述录音源文件进行编码的音频文件编码器,并按照预设的采样率、码率、通道数对所述录音源文件进行编码以生成预置格式录音文件;

所述预设的采样率、码率、通道数基于所述预置格式录音文件进行确定,所述预置格式录音文件的格式基于springboot中的自定义进行确定;

存储所述预置格式录音文件并发送至语音智能质检平台;

使用ASR对所述预置格式录音文件进行检测评估,所述检测评估包括音频预处理、特征提取、端点检出以及后处理;

所述获取录音源文件的步骤,包括如下步骤:

通过SFTP传送协议从至少一个电话平台中获取所述录音源文件;

或所述获取录音源文件的步骤,包括如下步骤:

通过Node.js采集来自客户端的录音源文件;

其中,所述通过Node.js采集来自客户端的录音源文件,包括:通过Node.js的HTTP模块对客户端上传的录音音频数据进行采集以将录音音频数据对应的声音转换成电信号,将电信号转换为数字信号对应的录音音频文件以作为录音源文件。

2.如权利要求1所述的录音文件格式转换方法,其特征在于,所述预置格式录音文件为WAV格式,所述按照预设的采样率、码率、通道数对所述录音源文件进行编码以生成预置格式录音文件的步骤,包括如下步骤:调用ffmpeg指令调整所述录音源文件得到预置格式录音文件。

3.一种录音文件格式转换装置,其特征在于,所述录音文件格式转换装置包括:获取单元,用于获取录音源文件;

转换单元,用于根据预设音频转码数据库中选择用于对所述录音源文件进行编码的音频文件编码器,并按照预设的采样率、码率、通道数对所述录音源文件进行编码以生成预置格式录音文件;所述预设的采样率、码率、通道数基于所述预置格式录音文件进行确定,所述预置格式录音文件的格式基于springboot中的自定义进行确定;

存储发送单元,用于存储所述预置格式录音文件并发送至语音智能质检平台;

检测评估单元,用于使用ASR对预置格式录音文件进行检测评估,所述检测评估包括音频预处理、特征提取、端点检出以及后处理;

所述获取单元包括:

第一获取单元,用于接收采用SFTP传送协议上传的来自至少一个电话平台的录音源文件;

或所述获取单元包括:

第二获取单元,用于通过Node.js采集来自前端的录音源文件;

其中,所述第二获取单元用于:

通过Node.js的HTTP模块对客户端上传的录音音频数据进行采集以将录音音频数据对应的声音转换成电信号,将电信号转换为数字信号对应的录音音频文件以作为录音源文件。

4.一种计算机设备,包括存储器、处理器及存储在所述存储器上并可在所述处理器上运行的计算机程序,其特征在于,所述处理器执行所述计算机程序时实现如权利要求1‑2任一项所述的录音文件格式转换方法。

5.一种计算机可读存储介质,其特征在于,所述计算机可读存储介质存储有一个或者一个以上计算机程序,所述一个或者一个以上计算机程序可被一个或者一个以上的处理器执行,以实现如权利要求1‑2任一项所述的录音文件格式转换方法。