{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,12]],"date-time":"2026-06-12T16:58:57Z","timestamp":1781283537509,"version":"3.54.1"},"reference-count":54,"publisher":"Elsevier BV","issue":"1-2","license":[{"start":{"date-parts":[[2001,4,1]],"date-time":"2001-04-01T00:00:00Z","timestamp":986083200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["Speech Communication"],"published-print":{"date-parts":[[2001,4]]},"DOI":"10.1016\/s0167-6393(00)00048-0","type":"journal-article","created":{"date-parts":[[2002,7,25]],"date-time":"2002-07-25T19:50:18Z","timestamp":1027626618000},"page":"93-114","source":"Crossref","is-referenced-by-count":86,"title":["Time and frequency filtering of filter-bank energies for robust HMM speech recognition"],"prefix":"10.1016","volume":"34","author":[{"given":"Climent","family":"Nadeu","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Du\u0161an","family":"Macho","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Javier","family":"Hernando","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/S0167-6393(00)00048-0_BIB1","series-title":"Multirresolution Signal Decomposition","author":"Akansu","year":"1992"},{"issue":"3","key":"10.1016\/S0167-6393(00)00048-0_BIB2","doi-asserted-by":"crossref","first-page":"277","DOI":"10.1016\/0167-6393(93)90099-7","article-title":"Root cepstral analysis: A unified view. Application to speech processing in car noise environments","volume":"12","author":"Alexandre","year":"1993","journal-title":"Speech Communication"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB3","doi-asserted-by":"crossref","unstructured":"Arai, T., Pavel, M., Hermansky, H., Avenda\u00f1o, C., 1996. Intelligibility of speech with filtered time trajectories of spectral envelopes. In: Proc. ICSLP, pp. 2490\u20132493","DOI":"10.1109\/ICSLP.1996.607318"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB4","doi-asserted-by":"crossref","unstructured":"Atal, B., 1983. Efficient coding of LPC parameters by temporal decomposition. In: Proc. ICASSP, pp. 81\u201384","DOI":"10.1109\/ICASSP.1983.1172248"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB5","doi-asserted-by":"crossref","unstructured":"Avenda\u00f1o, C., vanVuuren, S., Hermansky, H., 1996. Data based filter design for RASTA-like channel normalization in ASR. In: Proc. ICSLP, pp. 2087\u20132090","DOI":"10.1109\/ICSLP.1996.607213"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB6","doi-asserted-by":"crossref","unstructured":"Batlle, E., Nadeu, C., Fonollosa, J.A.R., 1998. Feature decorrelation methods in speech recognition. A comparative study. In: Proc. ICSLP, Vol. 3, pp. 951\u2013954","DOI":"10.21437\/ICSLP.1998-511"},{"issue":"4","key":"10.1016\/S0167-6393(00)00048-0_BIB7","doi-asserted-by":"crossref","first-page":"357","DOI":"10.1109\/TASSP.1980.1163420","article-title":"Comparison of parametric representations for monosyllabic word recognition in continuously spoken sentences","volume":"ASSP-28","author":"Davis","year":"1980","journal-title":"IEEE Trans. Acoust. Speech Signal Process."},{"key":"10.1016\/S0167-6393(00)00048-0_BIB8","unstructured":"de Veth, J., De Wet, F., Cranen, B., Boves, L., 1999. Missing features theory in ASR: make sure you miss the right type of features. In: Proceedings of Workshop on Robust Methods for Speech Recognition in Adverse Conditions, pp. 231\u2013234"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB9","series-title":"Discrete-time Processing of Speech Signals","author":"Deller","year":"1993"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB10","unstructured":"ETSI SQL W1007, http:\/\/webapp.etsi.org\/WorkProgram\/Report_WorkItem.asp? WKI_ID=6400"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB11","series-title":"Introduction to Statistical Pattern Recognition","author":"Fukunaga","year":"1990"},{"issue":"1","key":"10.1016\/S0167-6393(00)00048-0_BIB12","doi-asserted-by":"crossref","first-page":"52","DOI":"10.1109\/TASSP.1986.1164788","article-title":"Speaker-independent isolated word recognition using dynamic features of speech spectrum","volume":"34","author":"Furui","year":"1986","journal-title":"IEEE Trans. ASSP"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB13","doi-asserted-by":"crossref","unstructured":"Greenberg, S., Kingsbury, B.E.D., 1997. The modulation spectrogram: in pursuit of an invariant representation of speech. In: Proc. ICASSP, Vol. 3, pp. 1647\u20131650","DOI":"10.1109\/ICASSP.1997.598826"},{"issue":"7","key":"10.1016\/S0167-6393(00)00048-0_BIB14","doi-asserted-by":"crossref","first-page":"968","DOI":"10.1109\/TASSP.1987.1165241","article-title":"Spectral slope distance measures with linear prediction analysis for word recognition in noise","volume":"ASSP-35","author":"Hanson","year":"1987","journal-title":"IEEE Trans. Acoust. Speech Signal Process."},{"key":"10.1016\/S0167-6393(00)00048-0_BIB15","series-title":"Advanced Topics in Automatic Speech and Speaker Recognition","article-title":"Spectral dynamics for speech recognition under adverse conditions","author":"Hanson","year":"1996"},{"issue":"4","key":"10.1016\/S0167-6393(00)00048-0_BIB16","doi-asserted-by":"crossref","first-page":"1738","DOI":"10.1121\/1.399423","article-title":"Perceptual linear predictive (PLP) analysis of speech","volume":"87","author":"Hermansky","year":"1990","journal-title":"J. Acoust. Soc. Amer."},{"key":"10.1016\/S0167-6393(00)00048-0_BIB17","doi-asserted-by":"crossref","first-page":"3","DOI":"10.1016\/S0167-6393(98)00027-2","article-title":"Should recognizers have ears?","volume":"25","author":"Hermansky","year":"1998","journal-title":"Speech Communication"},{"issue":"4","key":"10.1016\/S0167-6393(00)00048-0_BIB18","first-page":"1","article-title":"RASTA processing of speech","volume":"2","author":"Hermansky","year":"1994","journal-title":"IEEE Trans. SAP"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB19","doi-asserted-by":"crossref","unstructured":"Hernando, J., Nadeu, C., 1997a. CDHMM speaker recognition by means of frequency filtering of filter-bank energies. In: Proc. Eurospeech, Vol. 5, pp. 2363\u20132366","DOI":"10.21437\/Eurospeech.1997-621"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB20","doi-asserted-by":"crossref","unstructured":"Hernando, J., Nadeu, C., 1997b. Robust speech parameters located in the frequency domain. In: Proc. Eurospeech, Vol. 1, pp. 417\u2013420","DOI":"10.21437\/Eurospeech.1997-153"},{"issue":"3","key":"10.1016\/S0167-6393(00)00048-0_BIB21","doi-asserted-by":"crossref","first-page":"1069","DOI":"10.1121\/1.392224","article-title":"A review of the MTF concept in room acoustics and its use for estimating speech intelligibility in auditoria","volume":"77","author":"Houtgast","year":"1985","journal-title":"J. Acoust. Soc. Amer."},{"key":"10.1016\/S0167-6393(00)00048-0_BIB22","unstructured":"Hunt, M.J., 1999. Spectral signal processing for ASR. In: Proc. Workshop ASRU"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB23","doi-asserted-by":"crossref","unstructured":"Hunt, M.J., Lef\u00e8bvre, C., 1989. A comparison of several acoustic representations for speech recognition with degraded and undegraded speech. In: Proc. ICASSP, Vol. S1, pp. 262\u2013265","DOI":"10.1109\/ICASSP.1989.266415"},{"issue":"7","key":"10.1016\/S0167-6393(00)00048-0_BIB24","doi-asserted-by":"crossref","first-page":"947","DOI":"10.1109\/TASSP.1987.1165237","article-title":"On the use of bandpass liftering in speech recognition","volume":"ASSP-35","author":"Juang","year":"1987","journal-title":"IEEE Trans. Acoust. Speech Signal Process."},{"key":"10.1016\/S0167-6393(00)00048-0_BIB25","series-title":"Robustness in Automatic Speech Recognition","first-page":"1996","author":"Junqua","year":"1996"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB26","doi-asserted-by":"crossref","unstructured":"Klatt, D.H., 1982. Prediction of perceived phonetic distance from critical band spectra: A first step. In: Proc. ICASSP, pp. 1278\u20131281","DOI":"10.1109\/ICASSP.1982.1171512"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB27","doi-asserted-by":"crossref","unstructured":"Leonard, R.G., 1984. A database for speaker-independent digit recognition. In: Proc. ICASSP, Vol. 3, pp. 42\u201345","DOI":"10.1109\/ICASSP.1984.1172716"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB28","doi-asserted-by":"crossref","first-page":"223","DOI":"10.1006\/csla.1994.1011","article-title":"The importance of cepstral parameter correlations in speech recognition","volume":"8","author":"Ljolje","year":"1994","journal-title":"Computer Speech and Language"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB29","doi-asserted-by":"crossref","unstructured":"Macho, D., Nadeu, C., 1998. On the interaction between time and frequency filtering of speech parameters for robust speech recognition. In: Proc. ICSLP, pp. 1487\u20131490","DOI":"10.21437\/ICSLP.1998-335"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB30","unstructured":"Macho, D., Nadeu, C., Hernando, J., Padrell, J., 1999a. Time and frequency filtering for speech recognition in real noise conditions. In: Proceedings of the Workshop on Robust Methods for Speech Recognition in Adverse Conditions, Tampere, pp. 111\u2013114"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB31","doi-asserted-by":"crossref","unstructured":"Macho, D., Nadeu, C., Jancovic, P., Rozinaj, G., Hernando, J., 1999b. Comparison of time and frequency filtering and cepstral-time matrix approaches in ASR. In: Proc. Eurospeech, Vol. 1, pp. 77\u201380","DOI":"10.21437\/Eurospeech.1999-23"},{"issue":"4","key":"10.1016\/S0167-6393(00)00048-0_BIB32","doi-asserted-by":"crossref","first-page":"103","DOI":"10.1109\/97.489061","article-title":"Analysis of LPC\/DFT features for HMM-based alphadigit recognizer","volume":"3","author":"Mashao","year":"1996","journal-title":"IEEE Signal Process. Lett."},{"key":"10.1016\/S0167-6393(00)00048-0_BIB33","doi-asserted-by":"crossref","unstructured":"Nadeu, C., Juang, B.H., 1994. Filtering of spectral parameters for speech recognition. In: Proc. ICSLP, pp. 1927\u20131930","DOI":"10.21437\/ICSLP.1994-484"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB34","doi-asserted-by":"crossref","unstructured":"Nadeu, C., Hernando, J., Gorricho, M., 1995. On the decorrelation of filter-bank energies in speech recognition. In: Proc. Eurospeech, pp. 1381\u20131384","DOI":"10.21437\/Eurospeech.1995-220"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB35","doi-asserted-by":"crossref","unstructured":"Nadeu, C., Mari\u00f1o, J.B., Hernando, J., Nogueiras, A., 1996. Frequency and time filtering of filter-bank energies for HMM speech recognition. In: Proc. ICSLP, pp. 430\u2013433","DOI":"10.1109\/ICSLP.1996.607146"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB36","doi-asserted-by":"crossref","first-page":"315","DOI":"10.1016\/S0167-6393(97)00030-7","article-title":"Filtering the time sequence of spectral parameters for speech recognition","volume":"22","author":"Nadeu","year":"1997","journal-title":"Speech Communication"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB37","doi-asserted-by":"crossref","unstructured":"Nadeu, C., Padrell, J., Esquerra, I., 1997b. Frequency averaging: an useful multiwindow spectral analysis approach. In: Proc. ICASSP, pp. 3953\u20133956","DOI":"10.1109\/ICASSP.1997.604784"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB38","first-page":"1071","article-title":"On frequency averaging for spectral analysis in speech recognition","volume":"3","author":"Nadeu","year":"1998","journal-title":"Proc. ICSLP"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB39","series-title":"Discrete-Time Signal Processing","author":"Oppenheim","year":"1989"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB40","doi-asserted-by":"crossref","unstructured":"Pach\u00e8s-Leal, P., Rose, R.C., Nadeu, C., 1999. Optimization algorithms for estimating modulation spectrum domain filters. In: Proc. Eurospeech, Vol. 1, pp. 89\u201392","DOI":"10.21437\/Eurospeech.1999-26"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB41","doi-asserted-by":"crossref","first-page":"361","DOI":"10.1016\/0885-2308(92)90029-4","article-title":"A study of two-dimensional cepstrum approach for speech recognition","volume":"6","author":"Pai","year":"1992","journal-title":"Computer Speech and Language"},{"issue":"2","key":"10.1016\/S0167-6393(00)00048-0_BIB42","doi-asserted-by":"crossref","first-page":"151","DOI":"10.1016\/0167-6393(82)90034-6","article-title":"On the performance of the quefrency-weighted cepstral coefficients in vowel recognition","volume":"1","author":"Paliwal","year":"1982","journal-title":"Speech Communication"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB43","doi-asserted-by":"crossref","unstructured":"Paliwal, K.K., 1999. Decorrelated and liftered filter-bank energies for robust speech recognition. In: Proc. Eurospeech, Vol. 1, pp. 85\u201388","DOI":"10.21437\/Eurospeech.1999-25"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB44","unstructured":"Pearce, D., 1998. Experimental framework for the performance evaluation of distributed speech recognition front-ends. Aurora project report, Version 1"},{"issue":"4","key":"10.1016\/S0167-6393(00)00048-0_BIB45","first-page":"1214","article-title":"Signal modeling techniques in speech recognition","volume":"79","author":"Picone","year":"1991","journal-title":"Proc. IEEE"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB46","series-title":"Fundamentals of Speech Recognition","author":"Rabiner","year":"1993"},{"issue":"1","key":"10.1016\/S0167-6393(00)00048-0_BIB47","first-page":"19","article-title":"Signal bias removal by maximum likelihood estimation for robust telephone speech recognition","volume":"4","author":"Rahim","year":"1996","journal-title":"IEEE Trans. SAP"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB48","doi-asserted-by":"crossref","unstructured":"Rosenberg, A.E., Lee, C.-H., Soong, F., 1994. Cepstral channel normalization techniques for HMM-based speaker verification. In: Proc. ICSLP, pp. 1835\u20131839","DOI":"10.21437\/ICSLP.1994-461"},{"issue":"5","key":"10.1016\/S0167-6393(00)00048-0_BIB49","doi-asserted-by":"crossref","first-page":"362","DOI":"10.1109\/TASSP.1974.1162599","article-title":"A parametrically controlled spectral analysis system for speech","volume":"ASSP-22","author":"Silverman","year":"1974","journal-title":"IEEE Trans. Acoust. Speech Signal Process."},{"issue":"9","key":"10.1016\/S0167-6393(00)00048-0_BIB50","doi-asserted-by":"crossref","first-page":"1055","DOI":"10.1109\/PROC.1982.12433","article-title":"Spectrum estimation and harmonic analysis","volume":"70","author":"Thomson","year":"1982","journal-title":"Proc. IEEE"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB51","unstructured":"Tian, J., Viikki, O., 1999. Generalized cepstral analysis for speech recognition in noise. In: Proc. Eurospeech, pp. 87\u201390"},{"issue":"10","key":"10.1016\/S0167-6393(00)00048-0_BIB52","doi-asserted-by":"crossref","first-page":"1414","DOI":"10.1109\/TASSP.1987.1165058","article-title":"A weighted cepstral distance measure for speech recognition","volume":"ASSP-35","author":"Tokhura","year":"1987","journal-title":"IEEE Trans. Acoust. Speech Signal Process."},{"issue":"5","key":"10.1016\/S0167-6393(00)00048-0_BIB53","first-page":"317","article-title":"Speech modeling using cepstral-time feature matrices in hidden Markov models","volume":"140","author":"Vaseghi","year":"1993","journal-title":"IEE Proc. I"},{"key":"10.1016\/S0167-6393(00)00048-0_BIB54","doi-asserted-by":"crossref","unstructured":"Young, S., Odell, J., Ollason, D., Valtchev, V., Woodland, P., 1997. Hidden Markov Model Toolkit V2.1 reference manual. Technical report, Speech group. Cambridge University Department, March 1997","DOI":"10.1016\/S0167-6393(97)00029-0"}],"container-title":["Speech Communication"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0167639300000480?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0167639300000480?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2023,4,12]],"date-time":"2023-04-12T21:07:45Z","timestamp":1681333665000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0167639300000480"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2001,4]]},"references-count":54,"journal-issue":{"issue":"1-2","published-print":{"date-parts":[[2001,4]]}},"alternative-id":["S0167639300000480"],"URL":"https:\/\/doi.org\/10.1016\/s0167-6393(00)00048-0","relation":{},"ISSN":["0167-6393"],"issn-type":[{"value":"0167-6393","type":"print"}],"subject":[],"published":{"date-parts":[[2001,4]]}}}