{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,21]],"date-time":"2026-03-21T21:09:36Z","timestamp":1774127376355,"version":"3.50.1"},"reference-count":39,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2016,1,20]],"date-time":"2016-01-20T00:00:00Z","timestamp":1453248000000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Speech Technol"],"published-print":{"date-parts":[[2016,3]]},"DOI":"10.1007\/s10772-016-9333-9","type":"journal-article","created":{"date-parts":[[2016,1,20]],"date-time":"2016-01-20T16:15:17Z","timestamp":1453306517000},"page":"135-150","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":36,"title":["Efficient feature combination techniques for emotional speech classification"],"prefix":"10.1007","volume":"19","author":[{"given":"Hemanta Kumar","family":"Palo","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mihir Narayan","family":"Mohanty","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mahesh","family":"Chandra","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2016,1,20]]},"reference":[{"issue":"1","key":"9333_CR1","doi-asserted-by":"crossref","first-page":"2","DOI":"10.1109\/18.650984","volume":"44","author":"P Abry","year":"1998","unstructured":"Abry, P., & Veith, D. (1998). Wavelet analysis of long-range-dependent traffic. IEEE Transactions on Information Theory, 44(1), 2\u201315.","journal-title":"IEEE Transactions on Information Theory"},{"key":"9333_CR2","doi-asserted-by":"crossref","first-page":"572","DOI":"10.1016\/j.patcog.2010.09.020","volume":"44","author":"ME Ayadi","year":"2011","unstructured":"Ayadi, M. E., Kamel, M. S., & Karray, F. (2011). Survey on speech recognition: Resources, features and methods. Pattern Recognition, 44, 572\u2013587.","journal-title":"Pattern Recognition"},{"key":"9333_CR3","volume-title":"Statistics for long-memory processes","author":"J Beran","year":"1994","unstructured":"Beran, J. (1994). Statistics for long-memory processes. New York: Chapman and Hall\/CRC Press."},{"key":"9333_CR4","doi-asserted-by":"crossref","DOI":"10.1093\/oso\/9780198538493.001.0001","volume-title":"Neural networks for pattern recognition","author":"CM Bishop","year":"1995","unstructured":"Bishop, C. M. (1995). Neural networks for pattern recognition (1st ed.). Oxford: Oxford University Press.","edition":"1"},{"issue":"4","key":"9333_CR5","doi-asserted-by":"crossref","first-page":"389","DOI":"10.1007\/s10772-014-9236-6","volume":"17","author":"A Biswas","year":"2014","unstructured":"Biswas, A., Sahu, P. K., Bhowmick, A., & Chandra, M. (2014). Feature extraction technique using ERB like wavelet sub-band periodic and aperiodic decomposition for TIMIT phoneme recognition. International Journal of Speech Technology, Springer, 17(4), 389\u2013399.","journal-title":"International Journal of Speech Technology, Springer"},{"key":"9333_CR6","doi-asserted-by":"crossref","unstructured":"Burkhardt, F., Paeschke, A. and Rolfes, M., Sendlmeier, W.F. and Weiss, B. (2005). A database of German emotional speech, Proceedings of Interspeech 2005.","DOI":"10.21437\/Interspeech.2005-446"},{"issue":"2","key":"9333_CR7","first-page":"822","volume":"3","author":"HB Chauhan","year":"2015","unstructured":"Chauhan, H. B., & Tanawala, B. A. (2015). Comparative study of MFCC and LPC algorithms for Gujrati isolated word recognition. International Journal of Innovative Research in Computer and Communication Engineering, 3(2), 822\u2013826.","journal-title":"International Journal of Innovative Research in Computer and Communication Engineering"},{"key":"9333_CR8","unstructured":"Do, V. H., Xiao, X. and Chng, E.S. (2011). Comparison and combination of multilayer perceptrons and deep belief networks in hybrid automatic speech recognition systems.\u00a0Proceedings of Asia-Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA ASC), Xi\u2019an, China."},{"issue":"4","key":"9333_CR9","doi-asserted-by":"crossref","first-page":"487","DOI":"10.1007\/s10772-012-9146-4","volume":"15","author":"G Droua-Hamdani","year":"2012","unstructured":"Droua-Hamdani, G., Selouani, S. A., & Boudraa, M. (2012). Speaker-independent ASR for modern standard Arabic: Effect of regional accents. International Journal of Speech Technology, Springer, 15(4), 487\u2013493.","journal-title":"International Journal of Speech Technology, Springer"},{"issue":"4","key":"9333_CR10","doi-asserted-by":"crossref","first-page":"37","DOI":"10.5121\/ijnlc.2013.2503","volume":"2","author":"NS Fulmare","year":"2013","unstructured":"Fulmare, N. S., Chakrabarti, P., & Yada, D. (2013). Understanding and estimation of emotional expression using acoustic analysis of natural speech. International Journal on Natural Language Computing, 2(4), 37\u201346.","journal-title":"International Journal on Natural Language Computing"},{"key":"9333_CR11","doi-asserted-by":"crossref","first-page":"1","DOI":"10.2298\/JAC1001001G","volume":"20","author":"W Gevaert","year":"2010","unstructured":"Gevaert, W., Tsenov, G., & Mladenov, V. (2010). Neural networks used for speech recognition. Journal of Automatic Control, university of Belgrade, 20, 1\u20137.","journal-title":"Journal of Automatic Control, university of Belgrade"},{"key":"9333_CR12","volume-title":"Neural networks: A comprehensive foundation","author":"S Haykins","year":"2006","unstructured":"Haykins, S. (2006). Neural networks: A comprehensive foundation (2nd ed.). Delhi: Pearson Education.","edition":"2"},{"issue":"11","key":"9333_CR13","doi-asserted-by":"crossref","first-page":"1447","DOI":"10.1016\/j.specom.2006.06.008","volume":"48","author":"K Ishizuka","year":"2006","unstructured":"Ishizuka, K., & Nakatani, T. (2006). A feature extraction method using sub-band based periodicity and aperiodicity decomposition with noise robust frontend processing for automatic speech recognition. Speech Communication, 48(11), 1447\u20131457.","journal-title":"Speech Communication"},{"key":"9333_CR14","doi-asserted-by":"crossref","unstructured":"Kopparapu, S. K. and Laxminarayana, M. (2010). Choice of mel filter bank in computing MFCC of a resampled speech. 10th International Conference on Information Science, Signal Processing and their Applications (ISSPA 2010), IEEE, pp. 121\u2013124.","DOI":"10.1109\/ISSPA.2010.5605491"},{"issue":"103","key":"9333_CR15","first-page":"113","volume":"7","author":"M Kulikovs","year":"2010","unstructured":"Kulikovs, M., Sharkovsky, S., & Petersons, E. (2010). Comparative studies of methods for accurate Hurst parameter estimation. Electronics and Electrical engineering, Elektronika IR Elektrotechnika, 7(103), 113\u2013116.","journal-title":"Electronics and Electrical engineering, Elektronika IR Elektrotechnika"},{"key":"9333_CR16","doi-asserted-by":"crossref","unstructured":"Li, Y. and Zhao, Y. (1998). Recognizing emotions in speech using short-term and long-term features. ICSLP.","DOI":"10.21437\/ICSLP.1998-560"},{"key":"9333_CR17","doi-asserted-by":"crossref","first-page":"84","DOI":"10.1109\/TCOM.1980.1094577","volume":"28","author":"Y Linde","year":"1980","unstructured":"Linde, Y., Buzo, A., & Gray, R. (1980). An algorithm for vector quantizer design. IEEE Transactions on Communications, 28, 84\u201395.","journal-title":"IEEE Transactions on Communications"},{"key":"9333_CR18","doi-asserted-by":"crossref","first-page":"106","DOI":"10.4236\/jsip.2013.42014","volume":"4","author":"Q Liu","year":"2013","unstructured":"Liu, Q., Yao, M., Xu, H., & Wang, F. (2013). Research on different feature parameters in speaker recognition. Journal of Signal and Information Processing, Scientific Research, 4, 106\u2013110.","journal-title":"Journal of Signal and Information Processing, Scientific Research"},{"issue":"6","key":"9333_CR19","doi-asserted-by":"crossref","first-page":"490","DOI":"10.1109\/TMM.2010.2051872","volume":"12","author":"I Luengo","year":"2010","unstructured":"Luengo, I., Navas, E., & Hern\u00e1ez, I. (2010). Feature analysis and evaluation for automatic emotion identification in speech. IEEE Transaction Multimedia, 12(6), 490\u2013501.","journal-title":"IEEE Transaction Multimedia"},{"key":"9333_CR20","doi-asserted-by":"crossref","first-page":"594","DOI":"10.1007\/978-3-642-03070-3_45","volume":"5632","author":"E Messina","year":"2009","unstructured":"Messina, E., Arosio, G., & Archetti, F. (2009). Audio-based emotion recognition in judicial domain: A multilayer support vector machines approach. Machine Learning and Data Mining in Pattern Recognition, 5632, 594\u2013602.","journal-title":"Machine Learning and Data Mining in Pattern Recognition"},{"key":"9333_CR21","unstructured":"Palo, H. K., Mohanty, M. N. and Chandra, M. (2015a). Emotion recognition using MLP and GMM for Oriya language. International Journal of Computational Vision and Robotics, Inderscience."},{"key":"9333_CR22","doi-asserted-by":"crossref","unstructured":"Palo, H. K., Mohanty, M. N. and Chandra, M. (2015b). Design of neural network model for emotional speech recognition. Artificial Intelligence and Evolutionary Algorithms in Engineering Systems, 325, Springer India, pp. 291\u2013300.","DOI":"10.1007\/978-81-322-2135-7_32"},{"issue":"3","key":"9333_CR23","first-page":"347","volume":"10","author":"T-L Pao","year":"2005","unstructured":"Pao, T.-L., Chen, Y.-T., Yenand, J.-H., & Liao, W.-Y. (2005). Detecting emotions in Mandarin speech. Computational Linguistics and Chinese Language Processing, 10(3), 347\u2013362.","journal-title":"Computational Linguistics and Chinese Language Processing"},{"key":"9333_CR24","doi-asserted-by":"crossref","unstructured":"Roughan, M. and Veitch, D. (1999). Measuring long-range dependence under changing traffic conditions. IEEE, pp. 1513\u20131521.","DOI":"10.1109\/INFCOM.1999.752173"},{"issue":"4","key":"9333_CR25","doi-asserted-by":"crossref","first-page":"467","DOI":"10.1109\/90.865075","volume":"8","author":"M Roughan","year":"2000","unstructured":"Roughan, M., Veith, D., & Abry, P. (2000). Real-time estimation of the parameters of long-range dependence. IEEE\/ACM Transaction Network, 8(4), 467\u2013478.","journal-title":"IEEE\/ACM Transaction Network"},{"issue":"3","key":"9333_CR26","doi-asserted-by":"crossref","first-page":"931","DOI":"10.1109\/TSA.2005.858054","volume":"14","author":"R Sant\u2019Ana","year":"2006","unstructured":"Sant\u2019Ana, R., Coelho, R., & Alcaim, A. (2006). Text-independent speaker recognition based on the Hurst parameter and the multidimensional fractional brownian motion model. IEEE Transactions on Audio, Speech and Language Processing, 14(3), 931\u2013940.","journal-title":"IEEE Transactions on Audio, Speech and Language Processing"},{"key":"9333_CR27","first-page":"1375","volume":"32","author":"RB Santos","year":"2013","unstructured":"Santos, R. B., Rupp, M., Bonzi, S. J., & Fileti, A. M. F. (2013). Comparison between multilayer feed forward neural networks and a radial basis function network to detect and locate leaks in pipelines transporting gas. Chemical Engineering Transactions, 32, 1375\u20131380.","journal-title":"Chemical Engineering Transactions"},{"issue":"1\u20132","key":"9333_CR28","doi-asserted-by":"crossref","first-page":"227","DOI":"10.1016\/S0167-6393(02)00084-5","volume":"40","author":"K Scherer","year":"2003","unstructured":"Scherer, K. (2003). Vocal communication of emotion: A review of research paradigms. Speech Communication, 40(1\u20132), 227\u2013256.","journal-title":"Speech Communication"},{"key":"9333_CR29","doi-asserted-by":"crossref","first-page":"1062","DOI":"10.1016\/j.specom.2011.01.011","volume":"53","author":"B Schuller","year":"2011","unstructured":"Schuller, B., Batliner, A., Steidl, S., & Seppi, D. (2011). Recognizing realistic emotions and affect in speech: State of the art and lessons learnt from the first challenge. Speech Communication, 53, 1062\u20131087.","journal-title":"Speech Communication"},{"key":"9333_CR30","first-page":"805","volume-title":"Speaker independent emotion recognition by early Fusion of acoustic and linguistic features within ensembles","author":"B Schuller","year":"2005","unstructured":"Schuller, B., M\u00fcller, R., Lang, M., & Rigoll, G. (2005). Speaker independent emotion recognition by early Fusion of acoustic and linguistic features within ensembles (pp. 805\u2013808). Lisbon: Interspeech."},{"issue":"3","key":"9333_CR31","doi-asserted-by":"crossref","first-page":"323","DOI":"10.1007\/s10772-012-9185-x","volume":"16","author":"RP Sharma","year":"2012","unstructured":"Sharma, R. P., Farooq, O., & Khan, I. (2012). Wavelet based sub-band parameters for classification of unaspirated Hindi stop consonants in initial position of CV syllables. International Journal of Speech Technology, Springer, 16(3), 323\u2013332.","journal-title":"International Journal of Speech Technology, Springer"},{"key":"9333_CR32","doi-asserted-by":"crossref","first-page":"1541","DOI":"10.1109\/5.326413","volume":"82","author":"AS Spanias","year":"1994","unstructured":"Spanias, A. S. (1994). Speech coding: A tutorial review. Proceedings IEEE, 82, 1541\u20131582.","journal-title":"Proceedings IEEE"},{"key":"9333_CR33","doi-asserted-by":"crossref","unstructured":"Sunny, S., Peter, S. D. and Jacob, K. P. (2013). Combined feature extraction techniques and na\u00efve bayes classifier for speech recognition. VLSI, CS & IT-CSCP, pp. 155\u2013163.","DOI":"10.5121\/csit.2013.3416"},{"issue":"3","key":"9333_CR34","doi-asserted-by":"crossref","first-page":"878","DOI":"10.1109\/18.761330","volume":"45","author":"D Veitch","year":"1999","unstructured":"Veitch, D., & Abry, P. (1999). A wavelet-based joint estimator of the parameters of long-range dependence. IEEE Transactions on Information Theory, 45(3), 878\u2013897.","journal-title":"IEEE Transactions on Information Theory"},{"issue":"1","key":"9333_CR40","doi-asserted-by":"crossref","first-page":"69","DOI":"10.1109\/TAFFC.2015.2392101","volume":"6","author":"K Wang","year":"2015","unstructured":"Wang, K., An, N., Li, B.N. & Zhang, Y. (2015) Speech emotion recognition using Fourier parameters. IEEE Transactions on Affective Computing, 6(1), 69\u201375.","journal-title":"IEEE Transactions on Affective Computing"},{"key":"9333_CR35","unstructured":"Wenjing, H., Haifeng, L. and Chunyu, G. (2009). A hybrid speech emtion perception method of VQ-based feature processing and ANN recognition. Global Congress on Intelligent Systems, IEEE computer society, Xiamen, pp. 145\u2013149."},{"issue":"1","key":"9333_CR36","doi-asserted-by":"crossref","first-page":"10","DOI":"10.1109\/T-AFFC.2010.16","volume":"2","author":"CH Wu","year":"2011","unstructured":"Wu, C. H., & Liang, W. B. (2011). Emotion recognition of affective speech based on multiple classifiers using acoustic-prosodic information and semantic labels. IEEE Transaction on Affective Computing, 2(1), 10\u201321.","journal-title":"IEEE Transaction on Affective Computing"},{"issue":"12","key":"9333_CR37","doi-asserted-by":"crossref","first-page":"5438","DOI":"10.1109\/TIE.2011.2164773","volume":"58","author":"H Yu","year":"2011","unstructured":"Yu, H., Xie, T., Paszezynski, S., & Wilamowski, B. M. (2011). Advantages of radial basis function networks for dynamics system design. IEEE Transactions on Industrial Electronics, 58(12), 5438\u20135450.","journal-title":"IEEE Transactions on Industrial Electronics"},{"issue":"5","key":"9333_CR38","doi-asserted-by":"crossref","first-page":"620","DOI":"10.1109\/LSP.2014.2311435","volume":"21","author":"L Zao","year":"2014","unstructured":"Zao, L., Cavalcante, D., & Coelho, R. (2014). Time-frequency feature and AMS-GMM mask for acoustic emotion classification. IEEE Signal Processing Letters, 21(5), 620\u2013624.","journal-title":"IEEE Signal Processing Letters"}],"container-title":["International Journal of Speech Technology"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s10772-016-9333-9.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s10772-016-9333-9\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s10772-016-9333-9","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,13]],"date-time":"2024-06-13T22:04:23Z","timestamp":1718316263000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s10772-016-9333-9"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,1,20]]},"references-count":39,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2016,3]]}},"alternative-id":["9333"],"URL":"https:\/\/doi.org\/10.1007\/s10772-016-9333-9","relation":{},"ISSN":["1381-2416","1572-8110"],"issn-type":[{"value":"1381-2416","type":"print"},{"value":"1572-8110","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,1,20]]}}}