Preserving the linguistic content of input speech is essential during voice conversion (VC). The star generative adversarial network-based VC method (StarGAN-VC) is a recently developed method that allows non-parallel many-to-many VC. Although this method is powerful, it can fail to preserve the linguistic content of input speech when the number of available training samples is extremely small. To overcome this problem, we propose the use of automatic speech recognition to assist model training, to improve StarGAN-VC, especially in low-resource scenarios. Experimental results show that using our proposed method, StarGAN-VC can retain more linguistic information than vanilla StarGAN-VC.


翻译:在语音转换期间,必须保留输入语言的语言内容。星体基因对抗网络VC方法(StarGAN-VC)是最近开发的一种方法,允许许多到许多不平行的VC。虽然这种方法很有力,但当现有培训样本数量极小时,它可能无法保留输入语言的语言内容。为了解决这一问题,我们提议使用自动语音识别来协助模式培训,改进StarGAN-VC,特别是在低资源情况下。实验结果表明,使用我们提议的方法,StarGAN-VC可以保留比香草StarGAN-VC更多的语言信息。

0
下载
关闭预览

相关内容

生成对抗网络GAN在各领域应用研究进展(中文版),37页pdf
专知会员服务
150+阅读 · 2020年12月30日
专知会员服务
39+阅读 · 2020年9月6日
最新《生成式对抗网络》简介,25页ppt
专知会员服务
173+阅读 · 2020年6月28日
生成式对抗网络GAN异常检测
专知会员服务
114+阅读 · 2019年10月13日
已删除
将门创投
11+阅读 · 2019年8月13日
Adversarial Variational Bayes: Unifying VAE and GAN 代码
CreateAMind
7+阅读 · 2017年10月4日
Auto-Encoding GAN
CreateAMind
7+阅读 · 2017年8月4日
Arxiv
0+阅读 · 2021年10月7日
Teacher-Student Training for Robust Tacotron-based TTS
VIP会员
相关资讯
已删除
将门创投
11+阅读 · 2019年8月13日
Adversarial Variational Bayes: Unifying VAE and GAN 代码
CreateAMind
7+阅读 · 2017年10月4日
Auto-Encoding GAN
CreateAMind
7+阅读 · 2017年8月4日
Top
微信扫码咨询专知VIP会员