{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,10,22]],"date-time":"2024-10-22T20:08:18Z","timestamp":1729627698204,"version":"3.28.0"},"reference-count":33,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2016,12]]},"DOI":"10.1109\/apsipa.2016.7820716","type":"proceedings-article","created":{"date-parts":[[2017,1,19]],"date-time":"2017-01-19T21:38:58Z","timestamp":1484861938000},"page":"1-5","source":"Crossref","is-referenced-by-count":2,"title":["Deep neural network based voice conversion with a large synthesized parallel corpus"],"prefix":"10.1109","author":[{"given":"Zhengqi","family":"Wen","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kehuang","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jianhua","family":"Tao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chin-Hui","family":"Lee","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2011.5947408"},{"article-title":"WEB-based listening test system for speech synthesis and speech conversion evaluation","year":"0","author":"blin","key":"ref32"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/TASSP.1985.1164550"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1016\/S0167-6393(98)00085-5"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/MSP.2012.2205597"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2010.2047683"},{"key":"ref12","first-page":"3052","article-title":"Joint Spectral Distribution Modeling Using Restricted Boltzmann Machines for Voice Conversion","author":"chen","year":"0"},{"key":"ref13","first-page":"2313","article-title":"Voice Conversion Using Generative Trained Deep Neural Networks with Multiple Frame Spectral Envelopes","author":"chen","year":"0"},{"key":"ref14","first-page":"1859","article-title":"Voice Conversion Using Deep Neural Networks With Layer-Wise Generative Training","volume":"22","author":"chen","year":"0"},{"key":"ref15","first-page":"369","article-title":"Voice Conversion in high-order eigen space using deep belief nets","author":"nakashika","year":"0"},{"key":"ref16","first-page":"2283","article-title":"Sequence Error (SE) Minimization Training of Neural Network for Voice Conversion","author":"xie","year":"0"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/SLT.2014.7078543"},{"journal-title":"The CMU ARCTIC databases for speech synthesis","year":"2003","author":"kominek","key":"ref18"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2010.2041688"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2000.861820"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1016\/0167-6393(94)00058-I"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/5.18626"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1992.225951"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2007.907344"},{"key":"ref29","first-page":"1.10.1","article-title":"Line spectrum pair (UP) and speech data compression","volume":"1","author":"soong","year":"0"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1016\/0167-6393(94)00051-B"},{"key":"ref8","first-page":"7","article-title":"A Regression Approach to Speech Enhancement Based on Deep Neural Networks","volume":"23","author":"xu","year":"0"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2010.2041699"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/89.661472"},{"key":"ref9","doi-asserted-by":"crossref","first-page":"504","DOI":"10.1126\/science.1127647","article-title":"Reducing the dimensionality of data with neural networks","volume":"313","author":"hinton","year":"2006","journal-title":"Science"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1250\/ast.11.71"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2003.1318521"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1016\/j.specom.2009.04.004"},{"article-title":"Text-independent cross-language voice conversion","year":"0","author":"sundermann","key":"ref21"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2014.6853605"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1996.541110"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1162\/neco.2006.18.7.1527"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1002\/j.1538-7305.1981.tb00272.x"}],"event":{"name":"2016 Asia-Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA)","start":{"date-parts":[[2016,12,13]]},"location":"Jeju, South Korea","end":{"date-parts":[[2016,12,16]]}},"container-title":["2016 Asia-Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7803478\/7820670\/07820716.pdf?arnumber=7820716","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,17]],"date-time":"2019-09-17T15:47:50Z","timestamp":1568735270000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7820716\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,12]]},"references-count":33,"URL":"https:\/\/doi.org\/10.1109\/apsipa.2016.7820716","relation":{},"subject":[],"published":{"date-parts":[[2016,12]]}}}