PAAPLos: 声光声频拉声频参数损失,用于增强语言能力 (PAAPLoss: A Phonetic-Aligned Acoustic Parameter Loss for Speech Enhancement) - 专知论文

会员服务 ·

0

语音增强 · Analysis · 损失 · MoDELS · 可辨认的 ·

2023 年 2 月 16 日

PAAPLoss: A Phonetic-Aligned Acoustic Parameter Loss for Speech Enhancement

翻译：PAAPLos: 声光声频拉声频参数损失,用于增强语言能力

Muqiao Yang,Joseph Konan,David Bick,Yunyang Zeng,Shuo Han,Anurag Kumar,Shinji Watanabe,Bhiksha Raj

from arxiv, Accepted at ICASSP 2023

Despite rapid advancement in recent years, current speech enhancement models often produce speech that differs in perceptual quality from real clean speech. We propose a learning objective that formalizes differences in perceptual quality, by using domain knowledge of acoustic-phonetics. We identify temporal acoustic parameters -- such as spectral tilt, spectral flux, shimmer, etc. -- that are non-differentiable, and we develop a neural network estimator that can accurately predict their time-series values across an utterance. We also model phoneme-specific weights for each feature, as the acoustic parameters are known to show different behavior in different phonemes. We can add this criterion as an auxiliary loss to any model that produces speech, to optimize speech outputs to match the values of clean speech in these features. Experimentally we show that it improves speech enhancement workflows in both time-domain and time-frequency domain, as measured by standard evaluation metrics. We also provide an analysis of phoneme-dependent improvement on acoustic parameters, demonstrating the additional interpretability that our method provides. This analysis can suggest which features are currently the bottleneck for improvement.

翻译：尽管近年来取得了迅速的进展,但目前的语音增强模型往往产生与真实清洁的语音在感知质量上不同的声音。我们提出了一个学习目标,通过使用声频-语音学领域知识,将感知质量的差异正式化。我们确定了非差别性的时间声学参数,如光度倾斜、光谱通量、闪烁等,我们开发了一个神经网络估计器,可以准确预测其跨语句的时间序列值。我们还为每个特征制作了电话特定重量模型,因为声学参数已知在不同电话中显示不同行为。我们可以将这一标准作为辅助损失添加到任何生成语音的模型中,优化语音输出以适应这些特征中清洁言语的价值。我们实验性地表明,它改进了时间-空间和时频域的语音增强工作流程,用标准评价指标衡量。我们还分析了对声学参数的视线性改进,展示了我们的方法所提供的额外解释性。我们的分析可以表明,目前哪些特征是改进的瓶颈。

0

相关内容

语音增强

语音增强是指当语音信号被各种各样的噪声干扰、甚至淹没后，从噪声背景中提取有用的语音信号，抑制、降低噪声干扰的技术。一句话，从含噪语音中提取尽可能纯净的原始语音。

ICLR 2022杰出论文公布：7篇论文获得，清华朱军课题组摘得

ICLR 2022杰出论文公布：7篇论文获得，清华朱军课题组摘得

专知会员服务

60+阅读 · 2022年4月22日

50+篇《神经架构搜索NAS》2020论文合集

专知会员服务

61+阅读 · 2020年3月19日

100+篇《自监督学习(Self-Supervised Learning)》论文最新合集

100+篇《自监督学习(Self-Supervised Learning)》论文最新合集

专知会员服务

166+阅读 · 2020年3月18日

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

专知会员服务

19+阅读 · 2019年10月22日

Auto-Sizing the Transformer Network: Improving Speed, Efficiency, and Performance for Low-Resource Machine Translation

Auto-Sizing the Transformer Network: Improving Speed, Efficiency, and Performance for Low-Resource Machine Translation

专知会员服务

49+阅读 · 2019年10月17日

强化学习最新教程，17页pdf

强化学习最新教程，17页pdf

专知会员服务

182+阅读 · 2019年10月11日

[综述]深度学习下的场景文本检测与识别

[综述]深度学习下的场景文本检测与识别

专知会员服务

78+阅读 · 2019年10月10日

【CMU卡内基梅隆大学】深度学习在计算机视觉的应用：方法，解释，因果与公平性

【CMU卡内基梅隆大学】深度学习在计算机视觉的应用：方法，解释，因果与公平性

专知会员服务

83+阅读 · 2019年10月9日

【哈佛大学商学院课程Fall 2019】机器学习可解释性

【哈佛大学商学院课程Fall 2019】机器学习可解释性

专知会员服务

105+阅读 · 2019年10月9日

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

专知会员服务

41+阅读 · 2019年10月9日

直播 | Interpretable and Trustworthy Graph Geometric Deep Learning

直播 | Interpretable and Trustworthy Graph Geometric Deep Learning

图与推荐

2+阅读 · 2022年11月2日

VCIP 2022 Call for Demos

VCIP 2022 Call for Demos

CCF多媒体专委会

1+阅读 · 2022年6月6日

Hierarchically Structured Meta-learning

Hierarchically Structured Meta-learning

CreateAMind

27+阅读 · 2019年5月22日

Transferring Knowledge across Learning Processes

Transferring Knowledge across Learning Processes

CreateAMind

29+阅读 · 2019年5月18日

深度自进化聚类：Deep Self-Evolution Clustering

深度自进化聚类：Deep Self-Evolution Clustering

我爱读PAMI

15+阅读 · 2019年4月13日

强化学习的Unsupervised Meta-Learning

强化学习的Unsupervised Meta-Learning

CreateAMind

18+阅读 · 2019年1月7日

Unsupervised Learning via Meta-Learning

Unsupervised Learning via Meta-Learning

CreateAMind

43+阅读 · 2019年1月3日

A Technical Overview of AI & ML in 2018 & Trends for 2019

A Technical Overview of AI & ML in 2018 & Trends for 2019

待字闺中

18+阅读 · 2018年12月24日

vae 相关论文表示学习 1

vae 相关论文表示学习 1

CreateAMind

12+阅读 · 2018年9月6日

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

专知

23+阅读 · 2018年1月18日

Anderson型多酸的不对称修饰及可控组装研究

国家自然科学基金

1+阅读 · 2014年12月31日

c-MET信号通路与肝癌耐药机制的研究

国家自然科学基金

0+阅读 · 2014年12月31日

贵金属微纳球壳阵列构筑、表面增强Raman散射性能及对多氯联苯的检测

国家自然科学基金

0+阅读 · 2013年12月31日

石墨烯纳米天线红外光谱增强机理研究

国家自然科学基金

0+阅读 · 2013年12月31日

基于1,6-二氮杂萘骨架的新型c-Met激酶小分子抑制剂的发现和结构功能研究

国家自然科学基金

0+阅读 · 2013年12月31日

配体的原位合成制备功能无机配位聚合物材料

国家自然科学基金

0+阅读 · 2012年12月31日

环糊精酯化交联天然生物质材料强化吸附水中典型HOCs的机理研究

国家自然科学基金

0+阅读 · 2012年12月31日

云计算环境下数据安全基础问题研究

国家自然科学基金

1+阅读 · 2011年12月31日

基于有机-无机原位电化学杂化的聚苯胺一维生长控制及传感性能研究

国家自然科学基金

0+阅读 · 2009年12月31日

多酸-配位聚合物互为主客体的结构化学

国家自然科学基金

0+阅读 · 2008年12月31日

Deep Reinforcement Learning with Importance Weighted A3C for QoE enhancement in Video Delivery Services

Arxiv

0+阅读 · 2023年4月10日

Feature Representation Learning with Adaptive Displacement Generation and Transformer Fusion for Micro-Expression Recognition

Arxiv

0+阅读 · 2023年4月10日

Parameter-Expanded ECME Algorithms for Logistic and Penalized Logistic Regression

Arxiv

0+阅读 · 2023年4月8日

Large language models effectively leverage document-level context for literary translation, but critical errors persist

Arxiv

0+阅读 · 2023年4月6日

Training a Two Layer ReLU Network Analytically

Arxiv

0+阅读 · 2023年4月6日

Logistic-Normal Likelihoods for Heteroscedastic Label Noise in Classification

Arxiv

0+阅读 · 2023年4月6日

A practical model-based segmentation approach for improved activation detection in single-subject functional Magnetic Resonance Imaging studies

Arxiv

0+阅读 · 2023年4月4日

Tunable Convolutions with Parametric Multi-Loss Optimization

Arxiv

0+阅读 · 2023年4月3日

Balanced Multimodal Learning via On-the-fly Gradient Modulation

Arxiv

13+阅读 · 2022年3月29日

Class-Balanced Loss Based on Effective Number of Samples

Arxiv

12+阅读 · 2019年1月16日

VIP会员

文章信息

相关主题

相关VIP内容

ICLR 2022杰出论文公布：7篇论文获得，清华朱军课题组摘得

ICLR 2022杰出论文公布：7篇论文获得，清华朱军课题组摘得

专知会员服务

60+阅读 · 2022年4月22日

50+篇《神经架构搜索NAS》2020论文合集

专知会员服务

61+阅读 · 2020年3月19日

100+篇《自监督学习(Self-Supervised Learning)》论文最新合集

100+篇《自监督学习(Self-Supervised Learning)》论文最新合集

专知会员服务

166+阅读 · 2020年3月18日

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

专知会员服务

19+阅读 · 2019年10月22日

Auto-Sizing the Transformer Network: Improving Speed, Efficiency, and Performance for Low-Resource Machine Translation

Auto-Sizing the Transformer Network: Improving Speed, Efficiency, and Performance for Low-Resource Machine Translation

专知会员服务

49+阅读 · 2019年10月17日

强化学习最新教程，17页pdf

强化学习最新教程，17页pdf

专知会员服务

182+阅读 · 2019年10月11日

[综述]深度学习下的场景文本检测与识别

[综述]深度学习下的场景文本检测与识别

专知会员服务

78+阅读 · 2019年10月10日

【CMU卡内基梅隆大学】深度学习在计算机视觉的应用：方法，解释，因果与公平性

【CMU卡内基梅隆大学】深度学习在计算机视觉的应用：方法，解释，因果与公平性

专知会员服务

83+阅读 · 2019年10月9日

【哈佛大学商学院课程Fall 2019】机器学习可解释性

【哈佛大学商学院课程Fall 2019】机器学习可解释性

专知会员服务

105+阅读 · 2019年10月9日

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

专知会员服务

41+阅读 · 2019年10月9日

热门VIP内容

开通专知VIP会员享更多权益服务

【牛津博士论文】零样本强化学习综述

《美军条令：陆军指挥官与规划人员地理空间指南》60页

战术边缘指挥控制：防务面临的核心挑战

迈向开放世界检测：综述

相关资讯

直播 | Interpretable and Trustworthy Graph Geometric Deep Learning

直播 | Interpretable and Trustworthy Graph Geometric Deep Learning

图与推荐

2+阅读 · 2022年11月2日

VCIP 2022 Call for Demos

VCIP 2022 Call for Demos

CCF多媒体专委会

1+阅读 · 2022年6月6日

Hierarchically Structured Meta-learning

Hierarchically Structured Meta-learning

CreateAMind

27+阅读 · 2019年5月22日

Transferring Knowledge across Learning Processes

Transferring Knowledge across Learning Processes

CreateAMind

29+阅读 · 2019年5月18日

深度自进化聚类：Deep Self-Evolution Clustering

深度自进化聚类：Deep Self-Evolution Clustering

我爱读PAMI

15+阅读 · 2019年4月13日

强化学习的Unsupervised Meta-Learning

强化学习的Unsupervised Meta-Learning

CreateAMind

18+阅读 · 2019年1月7日

Unsupervised Learning via Meta-Learning

Unsupervised Learning via Meta-Learning

CreateAMind

43+阅读 · 2019年1月3日

A Technical Overview of AI & ML in 2018 & Trends for 2019

A Technical Overview of AI & ML in 2018 & Trends for 2019

待字闺中

18+阅读 · 2018年12月24日

vae 相关论文表示学习 1

vae 相关论文表示学习 1

CreateAMind

12+阅读 · 2018年9月6日

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

专知

23+阅读 · 2018年1月18日

相关论文

Deep Reinforcement Learning with Importance Weighted A3C for QoE enhancement in Video Delivery Services

Arxiv

0+阅读 · 2023年4月10日

Feature Representation Learning with Adaptive Displacement Generation and Transformer Fusion for Micro-Expression Recognition

Arxiv

0+阅读 · 2023年4月10日

Parameter-Expanded ECME Algorithms for Logistic and Penalized Logistic Regression

Arxiv

0+阅读 · 2023年4月8日

Large language models effectively leverage document-level context for literary translation, but critical errors persist

Arxiv

0+阅读 · 2023年4月6日

Training a Two Layer ReLU Network Analytically

Arxiv

0+阅读 · 2023年4月6日

Logistic-Normal Likelihoods for Heteroscedastic Label Noise in Classification

Arxiv

0+阅读 · 2023年4月6日

A practical model-based segmentation approach for improved activation detection in single-subject functional Magnetic Resonance Imaging studies

Arxiv

0+阅读 · 2023年4月4日

Tunable Convolutions with Parametric Multi-Loss Optimization

Arxiv

0+阅读 · 2023年4月3日

Balanced Multimodal Learning via On-the-fly Gradient Modulation

Arxiv

13+阅读 · 2022年3月29日

Class-Balanced Loss Based on Effective Number of Samples

Arxiv

12+阅读 · 2019年1月16日

相关基金

Anderson型多酸的不对称修饰及可控组装研究

国家自然科学基金

1+阅读 · 2014年12月31日

c-MET信号通路与肝癌耐药机制的研究

国家自然科学基金

0+阅读 · 2014年12月31日

贵金属微纳球壳阵列构筑、表面增强Raman散射性能及对多氯联苯的检测

国家自然科学基金

0+阅读 · 2013年12月31日

石墨烯纳米天线红外光谱增强机理研究

国家自然科学基金

0+阅读 · 2013年12月31日

基于1,6-二氮杂萘骨架的新型c-Met激酶小分子抑制剂的发现和结构功能研究

国家自然科学基金

0+阅读 · 2013年12月31日

配体的原位合成制备功能无机配位聚合物材料

国家自然科学基金

0+阅读 · 2012年12月31日

环糊精酯化交联天然生物质材料强化吸附水中典型HOCs的机理研究

国家自然科学基金

0+阅读 · 2012年12月31日

云计算环境下数据安全基础问题研究

国家自然科学基金

1+阅读 · 2011年12月31日

基于有机-无机原位电化学杂化的聚苯胺一维生长控制及传感性能研究

国家自然科学基金

0+阅读 · 2009年12月31日

多酸-配位聚合物互为主客体的结构化学

国家自然科学基金

0+阅读 · 2008年12月31日

微信扫码咨询专知VIP会员