{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,9,13]],"date-time":"2024-09-13T00:41:37Z","timestamp":1726188097126},"reference-count":41,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2024,7,12]],"date-time":"2024-07-12T00:00:00Z","timestamp":1720742400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,7,12]],"date-time":"2024-07-12T00:00:00Z","timestamp":1720742400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Speech Technol"],"published-print":{"date-parts":[[2024,9]]},"DOI":"10.1007\/s10772-024-10115-7","type":"journal-article","created":{"date-parts":[[2024,7,12]],"date-time":"2024-07-12T09:02:16Z","timestamp":1720774936000},"page":"569-597","update-policy":"http:\/\/dx.doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["ADMRF: Elucidation of deep feature extraction and adaptive deep Markov random fields with improved heuristic algorithm for speech emotion recognition"],"prefix":"10.1007","volume":"27","author":[{"given":"Kotha","family":"Manohar","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"E.","family":"Logashanmugam","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,7,12]]},"reference":[{"key":"10115_CR1","doi-asserted-by":"publisher","first-page":"119633","DOI":"10.1016\/j.eswa.2023.119633","volume":"218","author":"MR Ahmed","year":"2023","unstructured":"Ahmed, M. R., Islam, S., MuzahidulIslam, A. K. M., & Shatabda, S. (2023). An ensemble 1D-CNN-LSTM-GRU model with data augmentation for speech emotion recognition. Expert Systems with Applications, 218, 119633.","journal-title":"Expert Systems with Applications"},{"key":"10115_CR2","doi-asserted-by":"publisher","first-page":"251","DOI":"10.1016\/j.procs.2020.08.027","volume":"176","author":"H Aouani","year":"2020","unstructured":"Aouani, H., & Ayed, Y. B. (2020). Speech emotion recognition with deep learning. Procedia Computer Science, 176, 251\u2013260.","journal-title":"Procedia Computer Science"},{"key":"10115_CR3","doi-asserted-by":"publisher","first-page":"5373","DOI":"10.1038\/s41598-023-32465-z","volume":"13","author":"M Azizi","year":"2023","unstructured":"Azizi, M., Shishehgarkhaneh, M. B., Basiri, M., & Moehler, R. C. (2023). Squid game optimizer (SGO): A novel metaheuristic algorithm. Scientific Reports, 13, 5373.","journal-title":"Scientific Reports"},{"key":"10115_CR4","doi-asserted-by":"publisher","first-page":"722","DOI":"10.1109\/LSP.2022.3151551","volume":"29","author":"N Braunschweiler","year":"2022","unstructured":"Braunschweiler, N., Doddipatla, R., Keizer, S., & Stoyanchev, S. (2022). Factors in emotion recognition with deep learning models using speech and text on multiple corpora. IEEE Signal Processing Letters, 29, 722\u2013726.","journal-title":"IEEE Signal Processing Letters"},{"key":"10115_CR5","doi-asserted-by":"publisher","first-page":"706","DOI":"10.1016\/j.procs.2022.12.187","volume":"216","author":"A Chowanda","year":"2023","unstructured":"Chowanda, A., AnindaputriIswanto, I., & WidhiAndangsari, E. (2023). Exploring deep learning algorithm to model emotions recognition from speech. Procedia Computer Science, 216, 706\u2013713.","journal-title":"Procedia Computer Science"},{"key":"10115_CR6","doi-asserted-by":"publisher","first-page":"103412","DOI":"10.1016\/j.advengsoft.2023.103412","volume":"180","author":"RV Darekar","year":"2023","unstructured":"Darekar, R. V., Chavan, M., Sharanyaa, S., & Ranjan, N. M. (2023). A hybrid meta-heuristic ensemble based classification technique speech emotion recognition. Advances in Engineering Software, 180, 103412.","journal-title":"Advances in Engineering Software"},{"key":"10115_CR7","doi-asserted-by":"publisher","first-page":"19","DOI":"10.1007\/s10772-023-10037-w","volume":"27","author":"S Deshmukh","year":"2024","unstructured":"Deshmukh, S., & Gupta, P. (2024). Application of probabilistic neural network for speech emotion recognition. International Journal of Speech Technology, 27, 19\u201328.","journal-title":"International Journal of Speech Technology"},{"key":"10115_CR8","doi-asserted-by":"publisher","first-page":"221640","DOI":"10.1109\/ACCESS.2020.3043201","volume":"8","author":"MB Er","year":"2020","unstructured":"Er, M. B. (2020). A novel approach for classification of speech emotions based on deep and acoustic features. IEEE Access, 8, 221640\u2013221653.","journal-title":"IEEE Access"},{"key":"10115_CR9","doi-asserted-by":"publisher","first-page":"60","DOI":"10.1016\/j.neunet.2017.02.013","volume":"92","author":"HM Fayek","year":"2017","unstructured":"Fayek, H. M., Lech, M., & Cavedon, L. (2017). Evaluating deep learning architectures for speech emotion recognition. Neural Networks, 92, 60\u201368.","journal-title":"Neural Networks"},{"key":"10115_CR10","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2019.2930958","author":"Xu Gaowei","year":"2019","unstructured":"Gaowei, Xu., Shen, X., Chen, S., Zong, Y., & Zhang, C. (2019). A deep transfer convolutional neural network framework for EEG signal classification. IEEE Access. https:\/\/doi.org\/10.1109\/ACCESS.2019.2930958","journal-title":"IEEE Access"},{"key":"10115_CR11","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2021.3113877","author":"T Huu Do","year":"2021","unstructured":"Huu Do, T., Berneman, M., Patro, J., Bekoulis, G., & Deligiannis, N. (2021). Context-aware deep Markov random fields for fake news detection. IEEE Access. https:\/\/doi.org\/10.1109\/ACCESS.2021.3113877","journal-title":"IEEE Access"},{"key":"10115_CR12","doi-asserted-by":"publisher","first-page":"122302","DOI":"10.1109\/ACCESS.2022.3223705","volume":"10","author":"S Kakuba","year":"2022","unstructured":"Kakuba, S., Poulose, A., & Han, D. S. (2022). Attention-based multi-learning approach for speech emotion recognition with dilated convolution. IEEE Access, 10, 122302\u2013122313.","journal-title":"IEEE Access"},{"key":"10115_CR13","doi-asserted-by":"publisher","first-page":"117327","DOI":"10.1109\/ACCESS.2019.2936124","volume":"7","author":"RA Khalil","year":"2019","unstructured":"Khalil, R. A., Jones, E., Babar, M. I., Jan, T., Zafar, M. H., & Alhussain, T. (2019). Speech emotion recognition using deep learning techniques: A review. IEEE Access, 7, 117327\u2013117345.","journal-title":"IEEE Access"},{"key":"10115_CR14","first-page":"012110","volume":"1634","author":"J Liang","year":"2020","unstructured":"Liang, J. (2020). Image classification based on RESNET. Journal of Physics: Conference Series, 1634, 012110.","journal-title":"Journal of Physics: Conference Series"},{"key":"10115_CR15","doi-asserted-by":"publisher","unstructured":"Liu, P., Qiu, X., & Huang, X. (2020) Recurrent neural network for text classification with multi-task learning. https:\/\/doi.org\/10.48550\/arXiv.1605.05101","DOI":"10.48550\/arXiv.1605.05101"},{"key":"10115_CR16","doi-asserted-by":"publisher","first-page":"109178","DOI":"10.1016\/j.apacoust.2022.109178","volume":"202","author":"Z-T Liu","year":"2023","unstructured":"Liu, Z.-T., Han, M.-T., Bao-Han, W., & Rehman, A. (2023). Speech emotion recognition based on convolutional neural network with attention-based bidirectional long short-term memory network and multi-task learning. Applied Acoustics, 202, 109178.","journal-title":"Applied Acoustics"},{"key":"10115_CR17","doi-asserted-by":"publisher","first-page":"2193","DOI":"10.1109\/TASLP.2023.3282092","volume":"31","author":"Z Liu","year":"2023","unstructured":"Liu, Z., Kang, X., & Ren, F. (2023). Dual-TBNet: Improving the robustness of speech features via dual-transformer-BiLSTM for speech emotion recognition. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 31, 2193\u20132203.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10115_CR18","doi-asserted-by":"publisher","first-page":"108659","DOI":"10.1016\/j.knosys.2022.108659","volume":"246","author":"K Manohar","year":"2022","unstructured":"Manohar, K., & Logashanmugam, E. (2022). Hybrid deep learning with optimal feature selection for speech emotion recognition using improved meta-heuristic algorithm. Knowledge-Based Systems, 246, 108659.","journal-title":"Knowledge-Based Systems"},{"key":"10115_CR19","doi-asserted-by":"publisher","DOI":"10.1016\/j.inffus.2023.101869","author":"A Mehrish","year":"2023","unstructured":"Mehrish, A., Majumder, N., Bharadwaj, R., Mihalcea, R., & Poria, S. (2023). A review of deep learning techniques for speech processing. Information Fusion. https:\/\/doi.org\/10.1016\/j.inffus.2023.101869","journal-title":"Information Fusion"},{"key":"10115_CR20","doi-asserted-by":"publisher","first-page":"104676","DOI":"10.1016\/j.imavis.2023.104676","volume":"133","author":"B Mocanu","year":"2023","unstructured":"Mocanu, B., RuxandraTapu, T. Z., & RuxandraTapu, T. Z. (2023). Multimodal emotion recognition using cross modal audio-video fusion with attention and deep metric learning. Image and Vision Computing, 133, 104676.","journal-title":"Image and Vision Computing"},{"key":"10115_CR21","doi-asserted-by":"publisher","first-page":"79861","DOI":"10.1109\/ACCESS.2020.2990405","volume":"8","author":"MS Mustaqeem","year":"2020","unstructured":"Mustaqeem, M. S., & Kwon, S. (2020). Clustering-based speech emotion recognition by incorporating learned features and deep BiLSTM. IEEE Access, 8, 79861\u201379875.","journal-title":"IEEE Access"},{"key":"10115_CR22","doi-asserted-by":"publisher","first-page":"9699","DOI":"10.1109\/ACCESS.2021.3051083","volume":"9","author":"J Oliveira","year":"2021","unstructured":"Oliveira, J., & Pra\u00e7a, I. (2021). On the usage of pre-trained speech recognition deep layers to detect emotions. IEEE Access, 9, 9699\u20139705.","journal-title":"IEEE Access"},{"key":"10115_CR23","doi-asserted-by":"publisher","first-page":"53","DOI":"10.1016\/j.specom.2022.11.005","volume":"146","author":"Md Premjeet Singh","year":"2023","unstructured":"Premjeet Singh, Md., & Sahidullah, G. S. (2023). Modulation spectral features for speech emotion recognition using deep neural networks. Speech Communication, 146, 53\u201369.","journal-title":"Speech Communication"},{"key":"10115_CR24","doi-asserted-by":"publisher","first-page":"24394","DOI":"10.1109\/ACCESS.2023.3255982","volume":"11","author":"A Rahdar","year":"2023","unstructured":"Rahdar, A., Gharavian, D., & J\u0119\u015bko, W. (2023). Serial weakening of human-based attributes regarding their effect on content-based speech recognition. IEEE Access, 11, 24394\u201324406.","journal-title":"IEEE Access"},{"key":"10115_CR25","doi-asserted-by":"crossref","unstructured":"Riffi, M. E., & Bouzidi, M. (2015). Discrete cuttlefish optimization algorithm to solve the travelling salesman problem. In 2015 third world conference on complex systems (WCCS).","DOI":"10.1109\/ICoCS.2015.7483231"},{"key":"10115_CR26","doi-asserted-by":"crossref","unstructured":"Senthilkumar, N., Karpakam, S., Devi, M.G., Balakumaresan, R. & Dhilipkumar, P. (2022). Speech emotion recognition based on Bi-directional LSTM architecture and deep belief networks. Materials Today: Proceedings, 57(Part 5), 2180-2184","DOI":"10.1016\/j.matpr.2021.12.246"},{"key":"10115_CR27","doi-asserted-by":"publisher","first-page":"2533","DOI":"10.1016\/j.procs.2023.01.227","volume":"218","author":"V Singh","year":"2023","unstructured":"Singh, V., & Prasad, S. (2023). Speech emotion recognition system using gender dependent convolution neural network. Procedia Computer Science, 218, 2533\u20132540.","journal-title":"Procedia Computer Science"},{"key":"10115_CR28","doi-asserted-by":"publisher","DOI":"10.1016\/j.heliyon.2022.e09196","author":"S Singkul","year":"2022","unstructured":"Singkul, S., & Woraratpanya, K. (2022). Vector learning representation for generalized speech emotion recognition. Heliyon. https:\/\/doi.org\/10.1016\/j.heliyon.2022.e09196","journal-title":"Heliyon"},{"key":"10115_CR29","doi-asserted-by":"publisher","DOI":"10.1007\/s41060-024-00553-6","author":"A Sruthi","year":"2024","unstructured":"Sruthi, A., Kumar, A. K., Dasari, K., Sivaramaiah, Y., Divya, G., & Kumar, G. S. C. (2024). Multi-language: Ensemble learning-based speech emotion recognition. International Journal of Data Science and Analytics. https:\/\/doi.org\/10.1007\/s41060-024-00553-6","journal-title":"International Journal of Data Science and Analytics"},{"key":"10115_CR30","doi-asserted-by":"publisher","DOI":"10.29322\/IJSRP.9.10.2019.p9420","author":"S Tammina","year":"2019","unstructured":"Tammina, S. (2019). Transfer learning using VGG-16 with deep convolutional neural network for classifying images. International Journal of Scientific and Research Publications. https:\/\/doi.org\/10.29322\/IJSRP.9.10.2019.p9420","journal-title":"International Journal of Scientific and Research Publications"},{"key":"10115_CR31","doi-asserted-by":"crossref","unstructured":"Viji, A. A., Jasper, J. & Latha, T. (2022). Efficient emotion based automatic speech recognition using optimal deep learning approach. Optik, 170375.","DOI":"10.1016\/j.ijleo.2022.170375"},{"key":"10115_CR32","doi-asserted-by":"publisher","DOI":"10.1155\/2021\/9210050","author":"L Xie","year":"2021","unstructured":"Xie, L., Han, T., Zhou, H., Zhang, Z.-R., Han, B., & Tang, A. (2021). Tuna swarm optimization: A novel swarm-based metaheuristic algorithm for global optimization. Computational Intelligence and Neuroscience. https:\/\/doi.org\/10.1155\/2021\/9210050","journal-title":"Computational Intelligence and Neuroscience"},{"key":"10115_CR33","doi-asserted-by":"publisher","first-page":"101389","DOI":"10.1016\/j.csl.2022.101389","volume":"76","author":"J Yang","year":"2022","unstructured":"Yang, J., Chen, Z., GuoxinQiu, X. L., Li, C., Yang, K., Chen, Z., Gao, L., & Shuo, L. (2022). Exploring the relationship between children\u2019s facial emotion processing characteristics and speech communication ability using deep learning on eye tracking and speech performance measures. Computer Speech & Language, 76, 101389.","journal-title":"Computer Speech & Language"},{"key":"10115_CR34","doi-asserted-by":"publisher","first-page":"30","DOI":"10.1016\/j.cogr.2023.12.001","volume":"4","author":"Z Yang","year":"2024","unstructured":"Yang, Z., Zhou, S., Zhang, L., & Serikawa, S. (2024). Optimizing speech emotion recognition with Hilbert curve and convolutional neural network. Cognitive Robotics, 4, 30\u201341.","journal-title":"Cognitive Robotics"},{"key":"10115_CR35","doi-asserted-by":"publisher","first-page":"132188","DOI":"10.1109\/ACCESS.2020.3010066","volume":"8","author":"H Zhang","year":"2020","unstructured":"Zhang, H., Zhang, Q., Shao, S., Niu, T., & Yang, X. (2020). Attention-based LSTM network for rotatory machine remaining useful life prediction. IEEE Access, 8, 132188\u2013132199. https:\/\/doi.org\/10.1109\/ACCESS.2020.3010066","journal-title":"IEEE Access"},{"key":"10115_CR36","doi-asserted-by":"publisher","first-page":"1898","DOI":"10.1109\/LSP.2021.3112314","volume":"28","author":"K Zhang","year":"2021","unstructured":"Zhang, K., Li, Y., Wang, J., Wang, Z., & Li, X. (2021). Feature fusion for multimodal emotion recognition based on deep canonical correlation analysis. IEEE Signal Processing Letters, 28, 1898\u20131902.","journal-title":"IEEE Signal Processing Letters"},{"issue":"107340","key":"10115_CR37","first-page":"11","volume":"229","author":"S Zhang","year":"2021","unstructured":"Zhang, S., Chen, M., Chen, J., Li, Y.-F., Yiling, Wu., Li, M., & Zhu, C. (2021). Combining cross-modal knowledge transfer and semi-supervised learning for speech emotion recognition. Knowledge-Based Systems, 229(107340), 11.","journal-title":"Knowledge-Based Systems"},{"issue":"6","key":"10115_CR38","doi-asserted-by":"publisher","first-page":"1576","DOI":"10.1109\/TMM.2017.2766843","volume":"20","author":"S Zhang","year":"2018","unstructured":"Zhang, S., Zhang, S., Huang, T., & Gao, W. (2018). Speech emotion recognition using deep convolutional neural network and discriminant temporal pyramid matching. IEEE Transactions on Multimedia, 20(6), 1576\u20131590.","journal-title":"IEEE Transactions on Multimedia"},{"issue":"10","key":"10115_CR39","doi-asserted-by":"publisher","first-page":"519","DOI":"10.3390\/sym10100519","volume":"10","author":"D Zhao","year":"2018","unstructured":"Zhao, D., Zhu, D., Lu, J., Luo, Y., & Zhang, G. (2018). Synthetic medical images using F&BGAN for improved lung nodules classification by multi-scale VGG16. Symmetry, 10(10), 519.","journal-title":"Symmetry"},{"key":"10115_CR40","doi-asserted-by":"publisher","first-page":"106889","DOI":"10.1109\/ACCESS.2020.3000751","volume":"8","author":"H Zhao","year":"2020","unstructured":"Zhao, H., Xiao, Y., & Zhang, Z. (2020). Robust semisupervised generative adversarial networks for speech emotion recognition via distribution smoothness. IEEE Access, 8, 106889\u2013106900.","journal-title":"IEEE Access"},{"key":"10115_CR41","doi-asserted-by":"publisher","first-page":"10921","DOI":"10.1016\/j.knosys.2022.109215","volume":"251","author":"C Zhong","year":"2022","unstructured":"Zhong, C., Li, G., & Meng, Z. (2022). Beluga whale optimization: A novel nature-inspired metaheuristic algorithm. Knowledge-Based Systems, 251, 10921.","journal-title":"Knowledge-Based Systems"}],"container-title":["International Journal of Speech Technology"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10772-024-10115-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s10772-024-10115-7\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10772-024-10115-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,9,12]],"date-time":"2024-09-12T12:10:07Z","timestamp":1726143007000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s10772-024-10115-7"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,7,12]]},"references-count":41,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2024,9]]}},"alternative-id":["10115"],"URL":"https:\/\/doi.org\/10.1007\/s10772-024-10115-7","relation":{},"ISSN":["1381-2416","1572-8110"],"issn-type":[{"type":"print","value":"1381-2416"},{"type":"electronic","value":"1572-8110"}],"subject":[],"published":{"date-parts":[[2024,7,12]]},"assertion":[{"value":"10 January 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"4 June 2024","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"12 July 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}