{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,2,21]],"date-time":"2025-02-21T21:01:37Z","timestamp":1740171697168,"version":"3.37.3"},"reference-count":78,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2015,12,1]],"date-time":"2015-12-01T00:00:00Z","timestamp":1448928000000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/creativecommons.org\/licenses\/by\/4.0"}],"funder":[{"DOI":"10.13039\/501100001659","name":"Deutsche Forschungsgemeinschaft","doi-asserted-by":"publisher","award":["KE 890\/4-2"],"award-info":[{"award-number":["KE 890\/4-2"]}],"id":[{"id":"10.13039\/501100001659","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["EURASIP J. Adv. Signal Process."],"published-print":{"date-parts":[[2015,12]]},"DOI":"10.1186\/s13634-015-0287-x","type":"journal-article","created":{"date-parts":[[2015,12,2]],"date-time":"2015-12-02T12:55:53Z","timestamp":1449060953000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["A Bayesian view on acoustic model-based techniques for robust speech recognition"],"prefix":"10.1186","volume":"2015","author":[{"given":"Roland","family":"Maas","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Christian","family":"Huemmer","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Armin","family":"Sehr","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Walter","family":"Kellermann","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2015,12,2]]},"reference":[{"key":"287_CR1","first-page":"1561","volume-title":"Proc. ICSLP","author":"JA Arrowood","year":"2002","unstructured":"JA Arrowood, MA Clements, in Proc. ICSLP. Using Observation Uncertainty in HMM Decoding (ISCABaixas, France, 2002), pp. 1561\u20131564."},{"issue":"3","key":"287_CR2","doi-asserted-by":"publisher","first-page":"412","DOI":"10.1109\/TSA.2005.845814","volume":"13","author":"L Deng","year":"2005","unstructured":"L Deng, J Droppo, A Acero, Dynamic compensation of HMM variances using the feature enhancement uncertainty computed from a parametric model of speech distortion. IEEE Trans. Speech Audio Process.13(3), 412\u2013421 (2005).","journal-title":"IEEE Trans. Speech Audio Process."},{"key":"287_CR3","first-page":"57","volume-title":"Proc. ICASSP","author":"J Droppo","year":"2002","unstructured":"J Droppo, A Acero, L Deng, in Proc. ICASSP, 1. Uncertainty Decoding with SPLICE for Noise Robust Speech Recognition (IEEENew Jersey, USA, 2002), pp. 57\u201360."},{"key":"287_CR4","unstructured":"H Liao, Uncertainty decoding for noise robust speech recognition, PhD thesis (Univ. of Cambridge, 2007). http:\/\/mi.eng.cam.ac.uk\/~mjfg\/thesis_hl251.pdf ."},{"key":"287_CR5","volume-title":"Proc. Int. Conf. on Digital Signal Process","author":"R Maas","year":"2013","unstructured":"R Maas, W Kellermann, A Sehr, T Yoshioka, M Delcroix, K Kinoshita, T Nakatani, in Proc. Int. Conf. on Digital Signal Process. Formulation of the REMOS Concept from an Uncertainty Decoding Perspective (IEEENew Jersey, USA, 2013)."},{"issue":"3","key":"287_CR6","doi-asserted-by":"publisher","first-page":"267","DOI":"10.1016\/S0167-6393(00)00034-0","volume":"34","author":"M Cooke","year":"2001","unstructured":"M Cooke, P Green, L Josifovski, A Vizinho, Robust Automatic Speech Recognition with Missing and Unreliable Acoustic Data. Speech Commun.34(3), 267\u2013285 (2001).","journal-title":"Speech Commun."},{"issue":"5","key":"287_CR7","doi-asserted-by":"publisher","first-page":"101","DOI":"10.1109\/MSP.2005.1511828","volume":"22","author":"B Raj","year":"2005","unstructured":"B Raj, RM Stern, Missing-feature approaches in speech recognition. IEEE Signal Process. Mag.22(5), 101\u2013116 (2005).","journal-title":"IEEE Signal Process. Mag."},{"key":"287_CR8","first-page":"82","volume-title":"Proc. WASPAA","author":"D Kolossa","year":"2005","unstructured":"D Kolossa, A Klimas, R Orglmeister, in Proc. WASPAA. Separation and Robust Recognition of Noisy, Convolutive Speech Mixtures Using Time-Frequency Masking and Missing Data Techniques (IEEENew Jersey, USA, 2005), pp. 82\u201385."},{"key":"287_CR9","volume-title":"Proc. Interspeech","author":"AH Abdelaziz","year":"2012","unstructured":"AH Abdelaziz, D Kolossa, in Proc. Interspeech. Decoding of Uncertain Features Using the Posterior Distribution of the Clean Data for Robust Speech Recognition (ISCABaixas, France, 2012)."},{"key":"287_CR10","unstructured":"MJF Gales, Model-based techniques for noise robust speech recognition, PhD thesis (1995). http:\/\/mi.eng.cam.ac.uk\/~mjfg\/thesis.pdf ."},{"key":"287_CR11","first-page":"869","volume-title":"Proc. ICSLP","author":"A Acero","year":"2000","unstructured":"A Acero, L Deng, T Kristjansson, J Zhang, in Proc. ICSLP, 3. HMM Adaptation Using Vector Taylor Series for Noisy Speech Recognition (ISCABaixas, France, 2000), pp. 869\u2013872."},{"issue":"5","key":"287_CR12","doi-asserted-by":"publisher","first-page":"357","DOI":"10.1109\/89.466659","volume":"3","author":"VV Digalakis","year":"1995","unstructured":"VV Digalakis, D Rtischev, LG Neumeyer, Speaker adaptation using constrained estimation of Gaussian mixtures. IEEE Trans. Speech Audio Process.3(5), 357\u2013366 (1995).","journal-title":"IEEE Trans. Speech Audio Process."},{"issue":"2","key":"287_CR13","doi-asserted-by":"publisher","first-page":"171","DOI":"10.1006\/csla.1995.0010","volume":"9","author":"CJ Leggetter","year":"1995","unstructured":"CJ Leggetter, PC Woodland, Maximum likelihood linear regression for speaker adaptation of continuous density hidden Markov models. Comput. Speech Lang.9(2), 171\u2013185 (1995).","journal-title":"Comput. Speech Lang."},{"issue":"1","key":"287_CR14","doi-asserted-by":"publisher","first-page":"70","DOI":"10.1109\/TSA.2002.805640","volume":"11","author":"J-T Chien","year":"2003","unstructured":"J-T Chien, Linear regression based Bayesian predictive classification for speech recognition. IEEE Trans. Speech Audio Process.11(1), 70\u201379 (2003).","journal-title":"IEEE Trans. Speech Audio Process."},{"key":"287_CR15","first-page":"113","volume-title":"Proc. ASRU","author":"YQ Wang","year":"2011","unstructured":"YQ Wang, MJF Gales, in Proc. ASRU. Improving Reverberant VTS for Hands-Free Robust Speech Recognition (IEEENew Jersey, USA, 2011), pp. 113\u2013118."},{"issue":"3","key":"287_CR16","doi-asserted-by":"publisher","first-page":"244","DOI":"10.1016\/j.specom.2007.09.004","volume":"50","author":"HG Hirsch","year":"2008","unstructured":"HG Hirsch, H Finster, A new approach for the adaptation of HMMs to reverberation and background noise. Speech Commun.50(3), 244\u2013263 (2008).","journal-title":"Speech Commun."},{"key":"287_CR17","first-page":"1133","volume-title":"Proc. ICASSP","author":"CK Raut","year":"2006","unstructured":"CK Raut, T Nishimoto, S Sagayama, in Proc. ICASSP, 1. Model Adaptation for Long Convolutional Distortion by Maximum Likelihood Based State Filtering Approach (IEEENew Jersey, USA, 2006), pp. 1133\u20131136."},{"key":"287_CR18","first-page":"5484","volume-title":"Proc. ICASSP","author":"A Sehr","year":"2011","unstructured":"A Sehr, R Maas, W Kellermann, in Proc. ICASSP. Frame-wise HMM Adaptation Using State-Dependent Reverberation Estimates (IEEENew Jersey, USA, 2011), pp. 5484\u20135487."},{"issue":"3","key":"287_CR19","doi-asserted-by":"publisher","first-page":"908","DOI":"10.1093\/ietisy\/e89-d.3.908","volume":"E89-D","author":"T Takiguchi","year":"2006","unstructured":"T Takiguchi, M Nishimura, Y Ariki, Acoustic model adaptation using first-order linear prediction for reverberant speech. IEICE Trans. Inform. Syst. E89-D(3), 908\u2013914 (2006).","journal-title":"IEICE Trans. Inform. Syst"},{"issue":"5","key":"287_CR20","doi-asserted-by":"publisher","first-page":"1047","DOI":"10.1109\/TASL.2008.925879","volume":"16","author":"V Ion","year":"2008","unstructured":"V Ion, R Haeb-Umbach, A novel uncertainty decoding rule with applications to transmission error robust speech recognition. IEEE Trans. Audio, Speech, Lang. Process.16(5), 1047\u20131060 (2008).","journal-title":"IEEE Trans. Audio, Speech, Lang. Process."},{"key":"287_CR21","doi-asserted-by":"publisher","first-page":"185","DOI":"10.3115\/1075527.1075568","volume-title":"Proc. Workshop on Speech and Natural Lang","author":"JL Gauvain","year":"1992","unstructured":"JL Gauvain, CH Lee, in Proc. Workshop on Speech and Natural Lang. MAP Estimation of Continuous Density HMM: Theory and Applications (Morgan KaufmannBurlington, USA, 1992), pp. 185\u2013190."},{"key":"287_CR22","doi-asserted-by":"publisher","first-page":"229","DOI":"10.1006\/csla.1996.0012","volume":"10","author":"J Ming","year":"1996","unstructured":"J Ming, FJ Smith, Modelling of the interframe dependence in an HMM using conditional Gaussian mixtures. Comput. Speech Lang.10:, 229\u2013247 (1996).","journal-title":"Comput. Speech Lang."},{"key":"287_CR23","first-page":"167","volume-title":"Proc. Int. Workshop on Cognitive Inform. Process","author":"R Maas","year":"2012","unstructured":"R Maas, SR Kotha, A Sehr, W Kellermann, in Proc. Int. Workshop on Cognitive Inform. Process. Combined-Order Hidden Markov Models for Reverberation-Robust Speech Recognition (IEEENew Jersey, USA, 2012), pp. 167\u2013171."},{"key":"287_CR24","doi-asserted-by":"publisher","first-page":"9","DOI":"10.1007\/978-3-642-21317-5_2","volume-title":"Robust Speech Recognition of Uncertain or Missing Data","author":"R Haeb-Umbach","year":"2011","unstructured":"R Haeb-Umbach, in Robust Speech Recognition of Uncertain or Missing Data, ed. by D Kolossa, R Haeb-Umbach. Uncertainty Decoding and Conditional Bayesian Estimation (SpringerBerlin Heidelberg, 2011), pp. 9\u201333."},{"issue":"4","key":"287_CR25","doi-asserted-by":"publisher","first-page":"745","DOI":"10.1109\/TASLP.2014.2304637","volume":"22","author":"J Li","year":"2014","unstructured":"J Li, L Deng, Y Gong, R Haeb-Umbach, An overview of noise-robust automatic speech recognition. IEEE\/ACM Trans. Audio, Speech, Lang. Process.22(4), 745\u2013777 (2014).","journal-title":"IEEE\/ACM Trans. Audio, Speech, Lang. Process."},{"key":"287_CR26","volume-title":"Pattern Recognition and Machine Learning","author":"CM Bishop","year":"2006","unstructured":"CM Bishop, Pattern Recognition and Machine Learning (Springer, New York, 2006)."},{"key":"287_CR27","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-21317-5","volume-title":"Robust Speech Recognition of Uncertain or Missing Data","author":"D Kolossa","year":"2011","unstructured":"D Kolossa, R Haeb-Umbach, Robust Speech Recognition of Uncertain or Missing Data (Springer, Berlin Heidelberg, 2011)."},{"issue":"6","key":"287_CR28","doi-asserted-by":"publisher","first-page":"58","DOI":"10.1109\/MSP.2012.2197232","volume":"29","author":"G Heigold","year":"2012","unstructured":"G Heigold, H Ney, R Schl\u00fcter, S Wiesler, Discriminative training for automatic speech recognition: modeling, criteria, optimization, implementation, and performance. IEEE Signal Process. Mag.29(6), 58\u201369 (2012).","journal-title":"IEEE Signal Process. Mag."},{"issue":"2","key":"287_CR29","doi-asserted-by":"publisher","first-page":"205","DOI":"10.1006\/csla.2002.0191","volume":"16","author":"M Matassoni","year":"2002","unstructured":"M Matassoni, M Omologo, D Giuliani, P Svaizer, Hidden Markov model training with contaminated speech material for distant-talking speech recognition. Comput. Speech Lang.16(2), 205\u2013223 (2002).","journal-title":"Comput. Speech Lang."},{"key":"287_CR30","doi-asserted-by":"crossref","first-page":"566","DOI":"10.21437\/Interspeech.2010-224","volume-title":"Proc. Interspeech","author":"A Sehr","year":"2010","unstructured":"A Sehr, C Hofmann, R Maas, W Kellermann, in Proc. Interspeech. A Novel Approach for Matched Reverberant Training of HMMs Using Data Pairs (ISCABaixas, France, 2010), pp. 566\u2013569."},{"issue":"3","key":"287_CR31","doi-asserted-by":"publisher","first-page":"261","DOI":"10.1016\/0167-6393(94)00059-J","volume":"16","author":"Y Gong","year":"1995","unstructured":"Y Gong, Speech recognition in noisy environments: A survey. Speech Commun.16(3), 261\u2013291 (1995). doi: 10.1016\/0167-6393(94)00059-J .","journal-title":"Speech Commun."},{"issue":"1\u20133","key":"287_CR32","doi-asserted-by":"publisher","first-page":"29","DOI":"10.1016\/S0167-6393(98)00028-4","volume":"25","author":"C-H Lee","year":"1998","unstructured":"C-H Lee, On stochastic feature and model compensation approaches to robust speech recognition. Speech Commun.25(1\u20133), 29\u201347 (1998). doi: 10.1016\/S0167-6393(98)00028-4 .","journal-title":"Speech Commun."},{"issue":"1\u20132","key":"287_CR33","doi-asserted-by":"publisher","first-page":"175","DOI":"10.1016\/S0167-6393(00)00053-4","volume":"34","author":"Q Huo","year":"2001","unstructured":"Q Huo, C-H Lee, Robust speech recognition based on adaptive classification and decision strategies. Speech Commun.34(1\u20132), 175\u2013194 (2001). doi: 10.1016\/S0167-6393(00)00053-4 .","journal-title":"Speech Commun."},{"key":"287_CR34","doi-asserted-by":"publisher","first-page":"653","DOI":"10.1007\/978-3-540-49127-9_33","volume-title":"Springer Handbook of Speech Processing","author":"J Droppo","year":"2008","unstructured":"J Droppo, in Springer Handbook of Speech Processing. Environmental Robustness (SpringerBerlin Heidelberg, 2008), pp. 653\u2013680."},{"issue":"6","key":"287_CR35","doi-asserted-by":"publisher","first-page":"114","DOI":"10.1109\/MSP.2012.2205029","volume":"29","author":"T Yoshioka","year":"2012","unstructured":"T Yoshioka, A Sehr, M Delcroix, K Kinoshita, R Maas, T Nakatani, W Kellermann, Making machines understand us in reverberant rooms: robustness against reverberation for automatic speech recognition. IEEE Signal Process. Mag.29(6), 114\u2013126 (2012).","journal-title":"IEEE Signal Process. Mag."},{"key":"287_CR36","volume-title":"Techniques for Noise Robustness in Automatic Speech Recognition","author":"T Virtanen","year":"2013","unstructured":"T Virtanen, R Singh, B Raj, Techniques for Noise Robustness in Automatic Speech Recognition (Wiley, UK, 2013)."},{"key":"287_CR37","doi-asserted-by":"crossref","first-page":"2083","DOI":"10.21437\/Eurospeech.1997-551","volume-title":"Proc. Eurospeech","author":"JN Holmes","year":"1997","unstructured":"JN Holmes, WJ Holmes, PN Garner, in Proc. Eurospeech, 97. Using Formant Frequencies in Speech Recognition (ISCABaixas, France, 1997), pp. 2083\u20132087."},{"key":"287_CR38","first-page":"61","volume-title":"Proc. ICASSP","author":"TT Kristjansson","year":"2002","unstructured":"TT Kristjansson, BJ Frey, in Proc. ICASSP, 1. Accounting for Uncertainity in Observations: A New Paradigm for Robust Speech Recognition (IEEENew Jersey, USA, 2002), pp. 61\u201364."},{"key":"287_CR39","unstructured":"L Deng, J Droppo, A Acero, in Proc. ICSLP, 4. Exploiting Variances in Robust Feature Extraction Based on a Parametric Model of Speech Distortion, (2002), pp. 2449\u20132452."},{"key":"287_CR40","first-page":"137","volume-title":"Proc. ICSLP","author":"MC Benitez","year":"2004","unstructured":"MC Benitez, JC Segura, A Torre, J Ramirez, A Rubio, in Proc. ICSLP. Including Uncertainty of Speech Observations in Robust Speech Recognition (ISCABaixas, France, 2004), pp. 137\u2013140."},{"issue":"11","key":"287_CR41","doi-asserted-by":"publisher","first-page":"1502","DOI":"10.1016\/j.specom.2005.12.006","volume":"48","author":"V Stouten","year":"2006","unstructured":"V Stouten, H Van Hamme, P Wambacq, Model-based feature enhancement with uncertainty decoding for noise robust ASR. Speech Commun.48(11), 1502\u20131514 (2006).","journal-title":"Speech Commun."},{"issue":"2","key":"287_CR42","doi-asserted-by":"publisher","first-page":"324","DOI":"10.1109\/TASL.2008.2010214","volume":"17","author":"M Delcroix","year":"2009","unstructured":"M Delcroix, T Nakatani, S Watanabe, Static and dynamic variance compensation for recognition of reverberant speech with dereverberation preprocessing. IEEE Trans. Audio, Speech, Lang. Process.17(2), 324\u2013334 (2009).","journal-title":"IEEE Trans. Audio, Speech, Lang. Process."},{"key":"287_CR43","first-page":"806","volume-title":"Proc. ICSLP","author":"L Deng","year":"2000","unstructured":"L Deng, A Acero, M Plumpe, XD Huang, in Proc. ICSLP, 3. Large Vocabulary Continuous Speech Recognition Under Adverse Conditions (ISCABaixas, France, 2000), pp. 806\u2013809."},{"key":"287_CR44","first-page":"301","volume-title":"Proc. ICASSP","author":"L Deng","year":"2001","unstructured":"L Deng, A Acero, L Jiang, J Droppo, X Huang, in Proc. ICASSP, 1. High-Performance Robust Speech Recognition Using Stereo Training Data (IEEENew Jersey, USA, 2001), pp. 301\u2013304."},{"issue":"6","key":"287_CR45","doi-asserted-by":"publisher","first-page":"568","DOI":"10.1109\/TSA.2003.818076","volume":"11","author":"L Deng","year":"2003","unstructured":"L Deng, J Droppo, A Acero, Recursive estimation of nonstationary noise using iterative stochastic approximation for robust speech recognition. IEEE Trans. Speech Audio Process.11(6), 568\u2013580 (2003).","journal-title":"IEEE Trans. Speech Audio Process."},{"issue":"7","key":"287_CR46","doi-asserted-by":"publisher","first-page":"1676","DOI":"10.1109\/TASL.2010.2050511","volume":"18","author":"A Sehr","year":"2010","unstructured":"A Sehr, R Maas, W Kellermann, Reverberation model-based decoding in the logmelspec domain for robust distant-talking speech recognition. IEEE Trans. Audio, Speech, Lang. Process.18(7), 1676\u20131691 (2010).","journal-title":"IEEE Trans. Audio, Speech, Lang. Process."},{"key":"287_CR47","unstructured":"JA Arrowood, Using observation uncertainty for robust speech recognition, PhD thesis (Georgia Institute of Technology, 2003). https:\/\/smartech.gatech.edu\/bitstream\/handle\/1853\/5383\/arrowood_jon_a_200312_phd.pdf ."},{"issue":"5","key":"287_CR48","doi-asserted-by":"publisher","first-page":"1023","DOI":"10.1109\/TASL.2013.2244085","volume":"21","author":"RF Astudillo","year":"2013","unstructured":"RF Astudillo, R Orglmeister, Computing MMSE estimates and residual uncertainty directly in the feature domain of ASR using STFT domain speech distortion models. IEEE Trans. Audio, Speech, Lang. Process.21(5), 1023\u20131034 (2013).","journal-title":"IEEE Trans. Audio, Speech, Lang. Process."},{"key":"287_CR49","unstructured":"M Cooke, A Morris, P Green, in Proc. ICASSP, 2. Missing Data Techniques for Robust Speech Recognition, (1997), pp. 863\u2013866."},{"issue":"1\u20132","key":"287_CR50","doi-asserted-by":"publisher","first-page":"123","DOI":"10.1016\/j.specom.2004.02.005","volume":"43","author":"KJ Palom\u00e4ki","year":"2004","unstructured":"KJ Palom\u00e4ki, GJ Brown, JP Barker, Techniques for handling convolutional distortion with \u2018missing data\u2019 automatic speech recognition. Speech Commun.43(1\u20132), 123\u2013142 (2004).","journal-title":"Speech Commun."},{"key":"287_CR51","volume-title":"Speech recognition in noisy environments, PhD thesis","author":"PJ Moreno","year":"1996","unstructured":"PJ Moreno, Speech recognition in noisy environments, PhD thesis (Carnegie Mellon Univ., Pittsburgh, 1996). http:\/\/www.cs.cmu.edu\/~robust\/Thesis\/pjm_thesis.pdf ."},{"issue":"3","key":"287_CR52","doi-asserted-by":"publisher","first-page":"389","DOI":"10.1016\/j.csl.2009.02.001","volume":"23","author":"J Li","year":"2009","unstructured":"J Li, L Deng, D Yu, Y Gong, A Acero, A unified framework of HMM adaptation with joint compensation of additive and convolutive distortions. Comput. Speech Lang.23(3), 389\u2013405 (2009).","journal-title":"Comput. Speech Lang."},{"key":"287_CR53","doi-asserted-by":"publisher","first-page":"75","DOI":"10.1006\/csla.1998.0043","volume":"12","author":"MJF Gales","year":"1997","unstructured":"MJF Gales, Maximum likelihood linear transformations for HMM-based speech recognition. Comput. Speech Lang.12:, 75\u201398 (1997).","journal-title":"Comput. Speech Lang."},{"issue":"5","key":"287_CR54","doi-asserted-by":"publisher","first-page":"1694","DOI":"10.1109\/TSA.2005.858555","volume":"14","author":"K Yu","year":"2006","unstructured":"K Yu, MJF Gales, Discriminative cluster adaptive training. IEEE Trans. Audio, Speech, Lang. Process.14(5), 1694\u20131703 (2006).","journal-title":"IEEE Trans. Audio, Speech, Lang. Process."},{"key":"287_CR55","first-page":"162","volume-title":"Proc. ASRU","author":"E Vincent","year":"2013","unstructured":"E Vincent, J Barker, S Watanabe, J Le Roux, F Nesta, M Matassoni, in Proc. ASRU. The Second \u2018CHiME\u2019 Speech Separation and Recognition Challenge: An Overview of Challenge Systems and Outcomes (IEEENew Jersey, USA, 2013), pp. 162\u2013167."},{"key":"287_CR56","doi-asserted-by":"crossref","unstructured":"K Kinoshita, M Delcroix, T Yoshioka, T Nakatani, A Sehr, W Kellermann, R Maas, in Proc. WASPAA. The REVERB Challenge: A common Evaluation Framework for Dereverberation and Recognition of Reverberant Speech, (2013).","DOI":"10.1109\/WASPAA.2013.6701894"},{"key":"287_CR57","first-page":"1137","volume-title":"Proc. ICSLP","author":"T Anastasakos","year":"1996","unstructured":"T Anastasakos, J McDonough, R Schwartz, J Makhoul, in Proc. ICSLP, 2. A Compact Model for Speaker-Adaptive Training (ISCABaixas, France, 1996), pp. 1137\u20131140."},{"key":"287_CR58","volume-title":"The HTK Book","author":"S Young","year":"2002","unstructured":"S Young, G Evermann, D Kershaw, G Moore, J Odell, D Ollason, D Povey, V Valtchev, P Woodland, The HTK Book (Cambridge Univ. Eng. Dept., UK, 2002)."},{"key":"287_CR59","unstructured":"M Delcroix, K Kinoshita, T Nakatani, S Araki, A Ogawa, T Hori, S Watanabe, M Fujimoto, T Yoshioka, T Oba, et al, in Proc. Int. Workshop on Mach. Listening in Multisource Environments (CHiME). Speech Recognition in the Presence of Highly Non-stationary Noise Based on Spatial, Spectral and Temporal Speech\/Noise Modeling Combined with Dynamic Variance Adaptation, (2011), pp. 12\u201317. http:\/\/spandh.dcs.shef.ac.uk\/projects\/chime\/workshop\/papers\/pS21_delcroix.pdf ."},{"key":"287_CR60","unstructured":"F Xiong, N Moritz, R Rehr, J Anemuller, BT Meyer, T Gerkmann, S Doclo, S Goetze, in Proc. REVERB Workshop. Robust ASR in Reverberant Environments Using Temporal Cepstrum Smoothing for Speech Enhancement and an Amplitude Modulation Filterbank for Feature Extraction, (2014). http:\/\/reverb2014.dereverberation.com\/workshop\/reverb2014-papers\/1569899061.pdf ."},{"issue":"1-2","key":"287_CR61","doi-asserted-by":"publisher","first-page":"127","DOI":"10.1016\/S0167-6393(00)00050-9","volume":"34","author":"H-G Hirsch","year":"2001","unstructured":"H-G Hirsch, HMM adaptation for applications in telecommunication. Speech Commun.34(1-2), 127\u2013139 (2001).","journal-title":"Speech Commun."},{"issue":"4","key":"287_CR62","doi-asserted-by":"publisher","first-page":"426","DOI":"10.1109\/89.771309","volume":"7","author":"H Jiang","year":"1999","unstructured":"H Jiang, K Hirose, Q Huo, Robust speech recognition based on a Bayesian prediction approach. IEEE Trans. Speech Audio Process.7(4), 426\u2013440 (1999).","journal-title":"IEEE Trans. Speech Audio Process."},{"issue":"1","key":"287_CR63","doi-asserted-by":"publisher","first-page":"70","DOI":"10.1109\/TSA.2002.805640","volume":"11","author":"J-T Chien","year":"2003","unstructured":"J-T Chien, Linear regression based Bayesian predictive classification for speech recognition. IEEE Trans. Speech Audio Process.11(1), 70\u201379 (2003).","journal-title":"IEEE Trans. Speech Audio Process."},{"issue":"10","key":"287_CR64","doi-asserted-by":"publisher","first-page":"1495","DOI":"10.1109\/29.35387","volume":"37","author":"A Nadas","year":"1989","unstructured":"A Nadas, D Nahamoo, MA Picheny, Speech recognition using noise-adaptive prototypes. IEEE Trans. Audio, Speech, Lang. Process.37(10), 1495\u20131503 (1989).","journal-title":"IEEE Trans. Audio, Speech, Lang. Process."},{"key":"287_CR65","first-page":"1983","volume-title":"Proc. European Signal Processing Conf. (EUSIPCO)","author":"R Maas","year":"2010","unstructured":"R Maas, A Sehr, M Gugat, W Kellermann, in Proc. European Signal Processing Conf. (EUSIPCO). A Highly Efficient Optimization Scheme for REMOS-Based Distant-Talking Speech Recognition (IEEENew Jersey, USA, 2010), pp. 1983\u20131987."},{"issue":"7","key":"287_CR66","doi-asserted-by":"publisher","first-page":"1441","DOI":"10.1002\/j.1538-7305.1982.tb04353.x","volume":"61","author":"SC Schwartz","year":"1982","unstructured":"SC Schwartz, YS Yeh, On the distribution function and moments of power sums with log-normal components. Bell Syst. Tech. Journal. 61(7), 1441\u20131462 (1982).","journal-title":"Bell Syst. Tech. Journal"},{"issue":"12","key":"287_CR67","doi-asserted-by":"publisher","first-page":"2869","DOI":"10.1109\/26.477480","volume":"43","author":"NC Beaulieu","year":"1995","unstructured":"NC Beaulieu, AA Abu-Dayya, PJ McLane, Estimating the distribution of a sum of independent lognormal random variables. IEEE Trans. Commun. 43(12), 2869\u20132873 (1995).","journal-title":"IEEE Trans. Commun"},{"key":"287_CR68","volume-title":"Proc. Interspeech","author":"CK Raut","year":"2004","unstructured":"CK Raut, T Nishimoto, S Sagayam, in Proc. Interspeech. Model Composition by Lagrange Polynomial Approximation for Robust Speech Recognition in Noisy Environment (ISCABaixas, France, 2004)."},{"issue":"2","key":"287_CR69","doi-asserted-by":"publisher","first-page":"479","DOI":"10.1109\/TVT.2004.823494","volume":"53","author":"NC Beaulieu","year":"2004","unstructured":"NC Beaulieu, Q Xie, An optimal lognormal approximation to lognormal sum distributions. IEEE Trans. Veh. Technol.53(2), 479\u2013489 (2004).","journal-title":"IEEE Trans. Veh. Technol."},{"key":"287_CR70","first-page":"311","volume-title":"Techniques for Noise Robustness in Automatic Speech Recognition","author":"JR Hershey","year":"2013","unstructured":"JR Hershey, SJ Rennie, JL Roux, in Techniques for Noise Robustness in Automatic Speech Recognition, ed. by T Virtanen, R Singh, and B Raj. Factorial Models for Noise Robust Speech Recognition (WileyUK, 2013), pp. 311\u2013345."},{"key":"287_CR71","doi-asserted-by":"crossref","DOI":"10.1007\/978-1-4471-5779-3","volume-title":"Automatic Speech Recognition\u2014A Deep Learning Approach","author":"D Yu","year":"2015","unstructured":"D Yu, L Deng, Automatic Speech Recognition\u2014A Deep Learning Approach (Springer, London, 2015)."},{"key":"287_CR72","first-page":"7398","volume-title":"Proc. ICASSP","author":"ML Seltzer","year":"2013","unstructured":"ML Seltzer, D Yu, Y Wang, in Proc. ICASSP. An Investigation of Deep Neural Networks for Noise Robust Speech Recognition (IEEENew Jersey, USA, 2013), pp. 7398\u20137402."},{"key":"287_CR73","first-page":"8604","volume-title":"Proc. ICASSP","author":"L Deng","year":"2013","unstructured":"L Deng, J Li, J-T Huang, K Yao, D Yu, F Seide, M Seltzer, G Zweig, X He, J Williams, Y Gong, A Acero, in Proc. ICASSP. Recent Advances in Deep Learning for Speech Research at Microsoft (IEEENew Jersey, USA, 2013), pp. 8604\u20138608."},{"key":"287_CR74","first-page":"1189","volume-title":"Proc. ICASSP","author":"R Gemello","year":"2006","unstructured":"R Gemello, F Mana, S Scanzio, P Laface, R De Mori, in Proc. ICASSP. Adaptation of Hybrid ANN\/HMM Models Using Linear Hidden Transformations and Conservative Training (IEEENew Jersey, USA, 2006), pp. 1189\u20131192."},{"key":"287_CR75","first-page":"24","volume-title":"Proc. ASRU","author":"F Seide","year":"2011","unstructured":"F Seide, G Li, X Chen, D Yu, in Proc. ASRU. Feature Engineering in Context-Dependent Deep Neural Networks for Conversational Speech Transcription (IEEENew Jersey, USA, 2011), pp. 24\u201329."},{"key":"287_CR76","first-page":"366","volume-title":"Proc. SLT","author":"K Yao","year":"2012","unstructured":"K Yao, D Yu, F Seide, H Su, L Deng, Y Gong, in Proc. SLT. Adaptation of Context-Dependent Deep Neural Networks for Automatic Speech Recognition (IEEENew Jersey, USA, 2012), pp. 366\u2013369."},{"key":"287_CR77","first-page":"55","volume-title":"Proc. ASRU","author":"G Saon","year":"2013","unstructured":"G Saon, H Soltau, D Nahamoo, M Picheny, in Proc. ASRU. Speaker Adaptation of Neural Network Acoustic Models Using I-Vectors (IEEENew Jersey, USA, 2013), pp. 55\u201359."},{"key":"287_CR78","doi-asserted-by":"crossref","first-page":"461","DOI":"10.21437\/Interspeech.2011-196","volume-title":"Proc. Interspeech","author":"RF Astudillo","year":"2011","unstructured":"RF Astudillo, JP da Silva Neto, in Proc. Interspeech. Propagation of Uncertainty Through Multilayer Perceptrons for Robust Automatic Speech Recognition (ISCABaixas, France, 2011), pp. 461\u2013464."}],"container-title":["EURASIP Journal on Advances in Signal Processing"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1186\/s13634-015-0287-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1186\/s13634-015-0287-x\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1186\/s13634-015-0287-x","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1186\/s13634-015-0287-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,8,16]],"date-time":"2023-08-16T01:33:14Z","timestamp":1692149594000},"score":1,"resource":{"primary":{"URL":"https:\/\/asp-eurasipjournals.springeropen.com\/articles\/10.1186\/s13634-015-0287-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2015,12]]},"references-count":78,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2015,12]]}},"alternative-id":["287"],"URL":"https:\/\/doi.org\/10.1186\/s13634-015-0287-x","relation":{},"ISSN":["1687-6180"],"issn-type":[{"type":"electronic","value":"1687-6180"}],"subject":[],"published":{"date-parts":[[2015,12]]},"article-number":"103"}}