您所在的位置: 成果库 一种基于音素信息的声纹识别方法及电子设备

一种基于音素信息的声纹识别方法及电子设备

发布时间: 2023-09-11

基本信息

合作方式: 技术服务
成果类型: 发明专利
行业领域:
电子信息技术
成果介绍
本申请提供一种基于音素信息的声纹识别方法及电子设备,该方法包括:对待识别音频进行端点检测,得到有效语音片段;有效语音片段通过预训练的自动语音识别模型,实现音素标定及确定有效语音片段中的音素级别语音片段;根据音素标定结果,判断有效语音片段中标出的所有音素是否满足音素覆盖率条件,若满足音素覆盖率条件,则采用音素级别声纹识别;若不满足音素覆盖率条件,则采用句子级别声纹识别。该方案采用融合句子级别和音素级别的说话人嵌入的声纹识别,可以提高声纹识别系统在复杂实际环境中准确率和可靠性。
成果亮点
1.一种基于音素信息的声纹识别方法,其特征在于,所述方法包括: 对待识别音频进行端点检测,得到有效语音片段; 所述有效语音片段通过预训练的自动语音识别模型,实现音素标定及确定所述有效语音片段中的音素级别语音片段; 根据音素标定结果,判断有效语音片段中标出的所有音素是否满足音素覆盖率条件,若满足所述音素覆盖率条件,则采用音素级别声纹识别;若不满足所述音素覆盖率条件,则采用句子级别声纹识别。 2.根据权利要求1所述的方法,其特征在于,所述有效语音片段通过预训练的自动语音识别模型,实现音素标定及确定所述有效语音片段中的音素级别语音片段,包括: 采用预训练的自动语音识别模型确定所述有效语音片段中每个语音帧关于不同音素标签的后验概率; 根据每个语音帧的最大后验概率,切分得到单个音素的有效语音段; 滤除所述有效语音段中静音标记的语音段及片段总帧数小于长度阈值的音素段,得到音素级别语音片段。 3.根据权利要求2所述的方法,其特征在于,所述根据每个语音帧的最大后验概率,切分得到单个音素的有效语音段,
团队介绍
中国科学院深圳先进技术研究院提升了粤港地区及我国先进制造业和现代服务业的自主创新能力,推动我国自主知识产权新工业的建立,成为国际一流的工业研究院。 深圳先进院目前已初步构建了以科研为主的集科研、教育、产业、资本为一体的微型协同创新生态系统,由九个研究平台,国科大深圳先进技术学院,多个特色产业育成基地、多支产业发展基金、多个具有独立法人资质的新型专业科研机构等组成。开展先进技术研究,促进科技发展。信息、电子、通讯技术研究新材料、新能源技术研究高性能计算、自动化、精密机械研究生物医学与医疗仪器研究相关学历教育、博士后培养与学术交流。
成果资料
产业化落地方案
点击查看