仪器仪表学报

北大核心,CA,JST,EI,CSCD

国内刊号:11-2179/TH

国际刊号:0254-3087

仪器仪表学报杂志2023年第5期:基于感知条件网络的可控语音增强模型

发布日期:

作者:袁文浩,屈庆洋,梁春燕,夏 斌

单位:袁文浩,1.山东理工大学计算机科学与技术学院,,屈庆洋,1.山东理工大学计算机科学与技术学院,,梁春燕,1.山东理工大学计算机科学与技术学院,,夏 斌,1.山东理工大学计算机科学与技术学院,

关键词:语音增强;深度学习;深度神经网络;条件网络;损失函数

基金:山东省自然科学基金(ZR2022MF330,ZR2021MF017)、国家自然科学基金(61701286)项目资助

为了给不同听者在不同场景下提供更好的语音增强主观听觉感受,提出了一种基于感知条件网络的可控语音增强模型。首先设计分位数损失函数来对语音的高估和低估进行权衡,并以此来指导网络的训练,通过调节网络输出中的语音损失和噪声残留水平,来控制模型的输出特性。然后为了让单个网络具有可变的输出特性,引入条件网络,利用分位数损失函数中与听者感知相关的分位值产生条件信息来对含噪语音特征进行调制,建立了可控的语音增强模型。实验结果表明,设计的分位数损失函数能够有效调节增强语音中的语音损失和噪声残留水平;基于感知条件网络建立的可控语音增强模型,能够提供可由听者主动控制的增强语音输出特性,使听者获得更好的语音增强体验。

来源:2023年第5期

《仪器仪表学报》期刊编辑部

查看仪器仪表学报杂志2023年第5期

联系我们

  • 地址:北京市东城区北河沿大街79号
  • 电话:010-64044400
  • E-mail:cjsiedit@cis.org.cn

咨询工作人员