{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,9,10]],"date-time":"2025-09-10T21:37:36Z","timestamp":1757540256569},"reference-count":29,"publisher":"Springer Science and Business Media LLC","issue":"2","license":[{"start":{"date-parts":[[2015,7,24]],"date-time":"2015-07-24T00:00:00Z","timestamp":1437696000000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Sign Process Syst"],"published-print":{"date-parts":[[2016,2]]},"DOI":"10.1007\/s11265-015-1025-1","type":"journal-article","created":{"date-parts":[[2015,7,23]],"date-time":"2015-07-23T01:29:18Z","timestamp":1437614958000},"page":"141-150","update-policy":"http:\/\/dx.doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":8,"title":["Speech Enhancement Based on Analysis\u2013Synthesis Framework with Improved Parameter Domain Enhancement"],"prefix":"10.1007","volume":"82","author":[{"given":"Bin","family":"Liu","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jianhua","family":"Tao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhengqi","family":"Wen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Fuyuan","family":"Mo","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2015,7,24]]},"reference":[{"issue":"2","key":"1025_CR1","doi-asserted-by":"crossref","first-page":"113","DOI":"10.1109\/TASSP.1979.1163209","volume":"27","author":"S Boll","year":"1979","unstructured":"Boll, S. (1979). Suppression of acoustic noise in speech using spectral subtraction. IEEE Transactions on Acoustics, Speech and Signal Processing, 27(2), 113\u2013120.","journal-title":"IEEE Transactions on Acoustics, Speech and Signal Processing"},{"issue":"6","key":"1025_CR2","doi-asserted-by":"crossref","first-page":"1109","DOI":"10.1109\/TASSP.1984.1164453","volume":"32","author":"Y Ephraim","year":"1984","unstructured":"Ephraim, Y., & Malah, D. (1984). Speech enhancement using a minimum-mean square error short-time spectral amplitude estimator. IEEE Transactions on Acoustics, Speech and Signal Processing, 32(6), 1109\u20131121.","journal-title":"IEEE Transactions on Acoustics, Speech and Signal Processing"},{"issue":"2","key":"1025_CR3","doi-asserted-by":"crossref","first-page":"282","DOI":"10.1016\/j.specom.2011.09.003","volume":"54","author":"K Paliwal","year":"2012","unstructured":"Paliwal, K., Schwerin, B., & W\u00f3jcicki, K. (2012). Speech enhancement using a minimum mean-square error short-time spectral modulation magnitude estimator. Speech Communication, 54(2), 282\u2013305.","journal-title":"Speech Communication"},{"issue":"5","key":"1025_CR4","doi-asserted-by":"crossref","first-page":"845","DOI":"10.1109\/TSA.2005.851927","volume":"13","author":"R Martin","year":"2005","unstructured":"Martin, R. (2005). Speech enhancement based on minimum mean-square error estimation and super gaussian priors. IEEE Transactions on Speech and Audio Processing, 13(5), 845\u2013856.","journal-title":"IEEE Transactions on Speech and Audio Processing"},{"issue":"4","key":"1025_CR5","doi-asserted-by":"crossref","first-page":"113","DOI":"10.1109\/97.1001645","volume":"9","author":"I Cohen","year":"2002","unstructured":"Cohen, I. (2002). Optimal speech enhancement under signal presence uncertainty using log-spectral amplitude estimator. IEEE Signal Processing Letters, 9(4), 113\u2013116.","journal-title":"IEEE Signal Processing Letters"},{"issue":"5","key":"1025_CR6","doi-asserted-by":"crossref","first-page":"383","DOI":"10.1109\/89.536932","volume":"4","author":"TV Sreenivas","year":"1996","unstructured":"Sreenivas, T. V., & Kirnapure, P. (1996). Codebook constrained Wiener filtering for speech enhancement. IEEE Transactions on Speech and Audio Processing, 4(5), 383\u2013389.","journal-title":"IEEE Transactions on Speech and Audio Processing"},{"issue":"3","key":"1025_CR7","doi-asserted-by":"crossref","first-page":"253","DOI":"10.1109\/LSP.2013.2242467","volume":"20","author":"N Mohammadiha","year":"2013","unstructured":"Mohammadiha, N., Martin, R., & Leijon, A. (2013). Spectral domain speech enhancement using HMM state-dependent super-Gaussian priors. IEEE Signal Processing Letters, 20(3), 253\u2013256.","journal-title":"IEEE Signal Processing Letters"},{"key":"1025_CR8","unstructured":"Xie, F., & Compernolle, D. V. (1994). A family of MLP based nonlinear spectral estimators for noise reduction. In Acoustics, Speech, and Signal Processing (ICASSP) (pp. 53\u201356). Australia."},{"key":"1025_CR9","doi-asserted-by":"crossref","unstructured":"Dahl, G. E., Sainath, T. N., Hinton, G. E. (2013). Improving deep neural networks for LVCSR using rectified linear units and dropout. In Acoustics, Speech, and Signal Processing (ICASSP) (pp. 8609\u20138613). Canada.","DOI":"10.1109\/ICASSP.2013.6639346"},{"key":"1025_CR10","unstructured":"Chen, R. F., Chan, C. F., So H. C. (2010). Noise suppression based on an analysis\u2013synthesis approach. In Proc. Eur. Signal Process. Conf. (EUSIPCO) (pp. 1539\u20131543)."},{"key":"1025_CR11","doi-asserted-by":"crossref","first-page":"1917","DOI":"10.1121\/1.1458024","volume":"111","author":"A Cheveigne","year":"2002","unstructured":"Cheveigne, A., & Kawahara, H. (2002). YIN, a fundamental frequency estimator for speech and music. Journal of the Acoustical Society of America, 111, 1917\u20131930.","journal-title":"Journal of the Acoustical Society of America"},{"key":"1025_CR12","doi-asserted-by":"crossref","first-page":"1638","DOI":"10.1121\/1.2951592","volume":"124","author":"A Camacho","year":"2008","unstructured":"Camacho, A., & Harris, J. (2008). A sawtooth waveform inspired pitch estimator for speech and music. Journal of the Acoustical Society of America, 124, 1638\u20131652.","journal-title":"Journal of the Acoustical Society of America"},{"key":"1025_CR13","doi-asserted-by":"crossref","first-page":"191","DOI":"10.1016\/S0167-6393(97)00002-2","volume":"21","author":"J Rouat","year":"1997","unstructured":"Rouat, J., Liu, Y., & Morissette, D. (1997). A pitch determination and voiced\/unvoiced decision algorithm for noisy speech. Speech Communication, 21, 191\u2013207.","journal-title":"Speech Communication"},{"key":"1025_CR14","unstructured":"Tan, L. N., Alwan, A. (2011). Noise-robust F0 estimation using SNRweighted summary correlograms from multi-band comb filters. In Proc. IEEE ICASSP (pp. 4464\u20134467)."},{"issue":"4","key":"1025_CR15","doi-asserted-by":"crossref","first-page":"1324","DOI":"10.1109\/TASL.2011.2177821","volume":"20","author":"RF Chen","year":"2012","unstructured":"Chen, R. F., Chan, C. F., & So, H. C. (2012). Model-based speech enhancement with improved spectral envelope estimation via dynamics tracking. IEEE Transactions on Speech and Audio Processing, 20(4), 1324\u20131336.","journal-title":"IEEE Transactions on Speech and Audio Processing"},{"key":"1025_CR16","doi-asserted-by":"crossref","unstructured":"Toda T., Saruwatari, H., Shikano, K. (2001). Voice conversion algorithm based on gaussian mixture model with dynamic frequency warping of straight spectrum. In Proc of ICASSP (pp. 941\u2013944).","DOI":"10.1109\/ICASSP.2001.941046"},{"key":"1025_CR17","first-page":"1843","volume":"4","author":"KY Park","year":"2000","unstructured":"Park, K. Y., & Kim, H. S. (2000). Narrowband to wideband conversion of speech using GMM based transformation. Proceeding of IEEE International Conference on Acoustics, Speech, Signal Processing, 4, 1843\u20131846.","journal-title":"Proceeding of IEEE International Conference on Acoustics, Speech, Signal Processing"},{"issue":"7","key":"1025_CR18","doi-asserted-by":"crossref","first-page":"1527","DOI":"10.1162\/neco.2006.18.7.1527","volume":"18","author":"GE Hinton","year":"2006","unstructured":"Hinton, G. E., Osindero, S., & Teh, Y. W. (2006). A fast learning algorithm for deep belief nets. Neural Computation, 18(7), 1527\u20131554.","journal-title":"Neural Computation"},{"key":"1025_CR19","unstructured":"Bengio, Y., Yao, L., Alain, G., et al. (2013). Generalized denoising autoencoders as generative models. In Advances in Neural Information Processing Systems (pp: 899\u2013907). USA."},{"key":"1025_CR20","doi-asserted-by":"crossref","unstructured":"Tan, L. N., Alwan, A. (2013). Multi-band summary correlogram-based pitch detection for noisy speech. In Speech communication (pp. 841\u2013856).","DOI":"10.1016\/j.specom.2013.03.001"},{"issue":"2","key":"1025_CR21","doi-asserted-by":"crossref","first-page":"443","DOI":"10.1109\/TASSP.1985.1164550","volume":"33","author":"Y Ephraim","year":"1985","unstructured":"Ephraim, Y., & Malah, D. (1985). Speech enhancement using a minimum mean-square error log-spectral amplitude estimator. IEEE Transactions on Speech and Audio Processing, 33(2), 443\u2013445.","journal-title":"IEEE Transactions on Speech and Audio Processing"},{"key":"1025_CR22","doi-asserted-by":"crossref","unstructured":"Supplee, L. M., Cohn, R. P., Collura, J. S., McCree, A. V. (1997). MELP: the new federal standard at 2400bps. In Acoustics Speech and Signal Processing (1591\u20131594). Germany.","DOI":"10.1109\/ICASSP.1997.596257"},{"key":"1025_CR23","unstructured":"Garofolo, J. S. (1993). TIMIT: Acoustic-phonetic Continuous Speech Corpus, Linguistic Data Consortium."},{"key":"1025_CR24","unstructured":"Rice University, NOISEX-92 Database, [Online] Available: http:\/\/spib.rice.edu\/spib\/select noise.html."},{"key":"1025_CR25","unstructured":"Chu, W., Alwan, A. (2009). reducing F0 frame error of F0 tracking algorithm under noisy condition with an unvoiced\/voiced classification frontend. In Acoustics Speech and Signal Processing (3969-3972). Germany"},{"issue":"6","key":"1025_CR26","doi-asserted-by":"crossref","first-page":"700","DOI":"10.1109\/TSA.2003.818031","volume":"11","author":"F Jabloun","year":"2003","unstructured":"Jabloun, F., & Champagne, B. (2003). Incorporating the human hearing properties in the signal subspace approach for speech enhancement. IEEE Transactions on Speech and Audio Processing, 11(6), 700\u2013708.","journal-title":"IEEE Transactions on Speech and Audio Processing"},{"key":"1025_CR27","doi-asserted-by":"crossref","unstructured":"Rix, A. W., Beerends, J. G., Hollier, M. P., et al. (2001). Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs. In Acoustics, Speech, and Signal Processing (ICASSP) (pp. 749\u2013752). USA.","DOI":"10.1109\/ICASSP.2001.941023"},{"key":"1025_CR28","unstructured":"Talkin, D. (1995). Speech Coding and Synthesis. Elsevier (pp. 497\u2013518)."},{"key":"1025_CR29","doi-asserted-by":"crossref","unstructured":"Kotnik, B., Hoge, H., Kacic, Z. (2006). Evaluation of Pitch Detection Algorithms in Adverse Conditions. Proc. 3rd International Conference on Speech Prosody (pp. 149\u2013152). Dresden, Germany.","DOI":"10.21437\/SpeechProsody.2006-50"}],"container-title":["Journal of Signal Processing Systems"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11265-015-1025-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11265-015-1025-1\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11265-015-1025-1","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,10]],"date-time":"2024-06-10T04:15:29Z","timestamp":1717992929000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11265-015-1025-1"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2015,7,24]]},"references-count":29,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2016,2]]}},"alternative-id":["1025"],"URL":"https:\/\/doi.org\/10.1007\/s11265-015-1025-1","relation":{},"ISSN":["1939-8018","1939-8115"],"issn-type":[{"value":"1939-8018","type":"print"},{"value":"1939-8115","type":"electronic"}],"subject":[],"published":{"date-parts":[[2015,7,24]]}}}