{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,24]],"date-time":"2026-06-24T15:59:00Z","timestamp":1782316740423,"version":"3.54.5"},"reference-count":30,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2024,7,17]],"date-time":"2024-07-17T00:00:00Z","timestamp":1721174400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,7,17]],"date-time":"2024-07-17T00:00:00Z","timestamp":1721174400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Speech Technol"],"published-print":{"date-parts":[[2024,9]]},"DOI":"10.1007\/s10772-024-10127-3","type":"journal-article","created":{"date-parts":[[2024,7,17]],"date-time":"2024-07-17T21:01:36Z","timestamp":1721250096000},"page":"637-656","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":4,"title":["An intelligent speech enhancement model using enhanced heuristic-based residual convolutional neural network with encoder-decoder architecture"],"prefix":"10.1007","volume":"27","author":[{"given":"M.","family":"Balasubrahmanyam","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"R. S.","family":"Valarmathi","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,7,17]]},"reference":[{"key":"10127_CR1","doi-asserted-by":"publisher","first-page":"24350","DOI":"10.1109\/ACCESS.2021.3056711","volume":"9","author":"S Abdullah","year":"2021","unstructured":"Abdullah, S., Zamani, M., & Demosthenous, A. (2021). Towards more efficient DNN-based speech enhancement using quantized correlation mask. IEEE Access, 9, 24350\u201324362.","journal-title":"IEEE Access"},{"key":"10127_CR2","doi-asserted-by":"publisher","DOI":"10.1016\/j.cie.2021.107250","author":"L Abualigah","year":"2021","unstructured":"Abualigah, L., Yousri, D., Elaziz, M. A., Ewees, A. A., Al-qaness, M. A. A., & Gandomi, A. H. (2021). Aquila optimizer: A novel meta-heuristic optimization algorithm. Computers & Industrial Engineering. https:\/\/doi.org\/10.1016\/j.cie.2021.107250","journal-title":"Computers & Industrial Engineering"},{"key":"10127_CR3","doi-asserted-by":"publisher","first-page":"163","DOI":"10.1016\/j.inffus.2019.08.008","volume":"59","author":"A Adeel","year":"2020","unstructured":"Adeel, A., Gogate, M., & Hussain, A. (2020). Contextual deep learning-based audio-visual switching for speech enhancement in real-world environments. Information Fusion, 59, 163\u2013170.","journal-title":"Information Fusion"},{"key":"10127_CR4","doi-asserted-by":"publisher","first-page":"670","DOI":"10.1109\/TASLP.2022.3231700","volume":"31","author":"M Barhoush","year":"2023","unstructured":"Barhoush, M., Hallawa, A., Peine, A., Martin, L., & Schmeink, A. (2023). Localization-driven speech enhancement in noisy multi-speaker hospital environments using deep learning and meta learning. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 31, 670\u2013683.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"issue":"10","key":"10127_CR5","doi-asserted-by":"publisher","first-page":"2165","DOI":"10.1109\/LWC.2021.3095383","volume":"10","author":"Y Chen","year":"2021","unstructured":"Chen, Y., Dong, B., Zhang, X., Gao, P., & Li, S. (2021). A Hybrid deep-learning approach for single channel HF-SSB speech enhancement. IEEE Wireless Communications Letters, 10(10), 2165\u20132169.","journal-title":"IEEE Wireless Communications Letters"},{"key":"10127_CR6","doi-asserted-by":"publisher","first-page":"41","DOI":"10.1109\/TASLP.2020.3036611","volume":"29","author":"J Cheng","year":"2021","unstructured":"Cheng, J., Liang, R., Liang, Z., Zhao, L., Huang, C., & Schuller, B. (2021). A deep adaptation network for speech enhancement: combining a relativistic discriminator with multi-kernel maximum mean discrepancy. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 29, 41\u201353.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"issue":"11","key":"10127_CR7","first-page":"3461","volume":"68","author":"SR Chiluveru","year":"2021","unstructured":"Chiluveru, S. R., Gyanendra, S., Chunarkar, M. T., & Kaushik, B. K. (2021). Efficient hardware implementation of DNN-based speech enhancement algorithm with precise sigmoid activation function. IEEE Transactions on Circuits and Systems II: Express Briefs, 68(11), 3461\u20133465.","journal-title":"IEEE Transactions on Circuits and Systems II: Express Briefs"},{"key":"10127_CR8","doi-asserted-by":"publisher","first-page":"1493","DOI":"10.1109\/TASLP.2020.2991537","volume":"28","author":"Z Du","year":"2020","unstructured":"Du, Z., Zhang, X., & Han, J. (2020). A joint framework of denoising autoencoder and generative vocoder for monaural speech enhancement. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 28, 1493\u20131505.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"issue":"11","key":"10127_CR9","doi-asserted-by":"publisher","first-page":"1803","DOI":"10.1109\/TASLP.2019.2933698","volume":"27","author":"S Elshamy","year":"2019","unstructured":"Elshamy, S., & Fingscheidt, T. (2019). DNN-based cepstral excitation manipulation for speech enhancement. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 27(11), 1803\u20131814.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10127_CR10","doi-asserted-by":"publisher","first-page":"2310","DOI":"10.1109\/TASLP.2021.3092838","volume":"29","author":"N Furnon","year":"2021","unstructured":"Furnon, N., Serizel, R., Essid, S., & Illina, I. (2021). DNN-Based mask estimation for distributed speech enhancement in spatially unconstrained microphone arrays. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 29, 2310\u20132323.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10127_CR11","doi-asserted-by":"publisher","DOI":"10.1007\/s00500-021-06291-2","author":"D Hepsiba","year":"2021","unstructured":"Hepsiba, D., & Justin, J. (2021). Enhancement of single channel speech quality and intelligibility in multiple noise conditions using wiener filter and deep CNN. Soft Computing. https:\/\/doi.org\/10.1007\/s00500-021-06291-2","journal-title":"Soft Computing"},{"key":"10127_CR12","doi-asserted-by":"publisher","first-page":"14","DOI":"10.1016\/j.tcs.2022.08.017","volume":"941","author":"S Kantamaneni","year":"2023","unstructured":"Kantamaneni, S., Charles, A., & Babu, T. R. (2023). Speech enhancement with noise estimation and filtration using deep learning models. Theoretical Computer Science, 941, 14\u201328.","journal-title":"Theoretical Computer Science"},{"key":"10127_CR13","doi-asserted-by":"publisher","first-page":"1898","DOI":"10.1109\/LSP.2022.3200581","volume":"29","author":"H Kim","year":"2022","unstructured":"Kim, H., Kang, K., & Shin, J. W. (2022). Factorized MVDR deep beamforming for multi-channel speech enhancement. IEEE Signal Processing Letters, 29, 1898\u20131902.","journal-title":"IEEE Signal Processing Letters"},{"issue":"6","key":"10127_CR14","doi-asserted-by":"publisher","first-page":"1098","DOI":"10.1109\/TASLP.2019.2910638","volume":"27","author":"J Lee","year":"2019","unstructured":"Lee, J., & Kang, H.-G. (2019). A joint learning algorithm for complex-valued T-F masks in deep learning-based single-channel speech enhancement systems. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 27(6), 1098\u20131108.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10127_CR15","doi-asserted-by":"publisher","first-page":"56798","DOI":"10.1109\/ACCESS.2020.2982212","volume":"8","author":"Y Li","year":"2020","unstructured":"Li, Y., Chen, F., Sun, Z., Ji, J., Jia, W., & Wang, Z. (2020). A smart binaural hearing aid architecture leveraging a smartphone APP with deep-learning speech enhancement. IEEE Access, 8, 56798\u201356810.","journal-title":"IEEE Access"},{"key":"10127_CR16","doi-asserted-by":"publisher","DOI":"10.1109\/ICSSIT46314.2019.8987950","author":"HS Mashiana","year":"2019","unstructured":"Mashiana, H. S., Salaria, A., & Kaur, K. (2019). Speech enhancement using residual convolutional neural network. In\u00a02019 international conference on smart systems and inventive technology (ICSSIT). https:\/\/doi.org\/10.1109\/ICSSIT46314.2019.8987950","journal-title":"2019 International Conference on Smart Systems and Inventive Technology (ICSSIT)"},{"key":"10127_CR17","doi-asserted-by":"publisher","first-page":"22993","DOI":"10.1109\/ACCESS.2023.3253719","volume":"11","author":"D Mukhutdinov","year":"2023","unstructured":"Mukhutdinov, D., Alex, A., Cavallaro, A., & Wang, L. (2023). Deep learning models for single-channel speech enhancement on drones. IEEE Access, 11, 22993\u201323007.","journal-title":"IEEE Access"},{"issue":"1","key":"10127_CR18","doi-asserted-by":"publisher","first-page":"93","DOI":"10.1109\/TASLP.2015.2498101","volume":"24","author":"M Sun","year":"2016","unstructured":"Sun, M., Zhang, X., Van Hamme, H., & Zheng, T. F. (2016). Unseen noise estimation using separable deep auto encoder for speech enhancement. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 24(1), 93\u2013104.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"issue":"1","key":"10127_CR19","doi-asserted-by":"publisher","first-page":"189","DOI":"10.1109\/TASLP.2018.2876171","volume":"27","author":"K Tan","year":"2019","unstructured":"Tan, K., Chen, J., & Wang, D. (2019). Gated residual networks with dilated convolutions for monaural speech enhancement. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 27(1), 189\u2013198.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10127_CR20","doi-asserted-by":"publisher","first-page":"1785","DOI":"10.1109\/TASLP.2021.3082282","volume":"29","author":"K Tan","year":"2021","unstructured":"Tan, K., & Wang, D. (2021). Towards model compression for deep learning based speech enhancement. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 29, 1785\u20131794.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"issue":"2","key":"10127_CR21","doi-asserted-by":"publisher","first-page":"239","DOI":"10.3390\/biomimetics8020239","volume":"8","author":"E Trojovsk\u00e1","year":"2023","unstructured":"Trojovsk\u00e1, E., Dehghani, M., & Leiva, V. (2023). Drawer algorithm: A new metaheuristic approach for solving optimization problems in engineering. Biomimetics, 8(2), 239.","journal-title":"Biomimetics"},{"issue":"12","key":"10127_CR22","doi-asserted-by":"publisher","first-page":"2080","DOI":"10.1109\/TASLP.2019.2940662","volume":"27","author":"Y-H Tu","year":"2019","unstructured":"Tu, Y.-H., Du, J., & Lee, C.-H. (2019). Speech enhancement based on teacher-student deep learning using improved speech presence probability for noise-robust speech recognition. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 27(12), 2080\u20132091.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10127_CR23","doi-asserted-by":"publisher","first-page":"1778","DOI":"10.1109\/TASLP.2020.2998279","volume":"28","author":"Z-Q Wang","year":"2020","unstructured":"Wang, Z.-Q., Wang, P., & Wang, D. (2020). Complex spectral mapping for single- and multi-channel speech enhancement and robust ASR. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 28, 1778\u20131787.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"issue":"12","key":"10127_CR24","doi-asserted-by":"publisher","first-page":"1887","DOI":"10.1109\/LSP.2019.2951950","volume":"26","author":"J-Y Wu","year":"2019","unstructured":"Wu, J.-Y., Yu, C., Fu, S.-W., Liu, C.-T., Chien, S.-Y., & Tsao, Y. (2019). Increasing compactness of deep learning based speech enhancement models with parameter pruning and quantization techniques. IEEE Signal Processing Letters, 26(12), 1887\u20131891.","journal-title":"IEEE Signal Processing Letters"},{"key":"10127_CR25","doi-asserted-by":"publisher","first-page":"105","DOI":"10.1109\/LSP.2021.3128374","volume":"29","author":"X Xiang","year":"2022","unstructured":"Xiang, X., Zhang, X., & Chen, H. (2022). A nested U-Net with self-attention and dense connectivity for monaural speech enhancement. IEEE Signal Processing Letters, 29, 105\u2013109.","journal-title":"IEEE Signal Processing Letters"},{"key":"10127_CR26","first-page":"2021","volume":"22","author":"L Xie","year":"2021","unstructured":"Xie, L., Han, T., Zhou, H., Zhang, Z.-R., Han, Bo., & Tang, A. (2021). Tuna swarm optimization: A novel swarm-based metaheuristic algorithm for global optimization. Computational Intelligence and Neuroscience, 22, 2021.","journal-title":"Computational Intelligence and Neuroscience"},{"key":"10127_CR27","doi-asserted-by":"publisher","first-page":"2756","DOI":"10.1109\/TASLP.2020.3025638","volume":"28","author":"C Yu","year":"2020","unstructured":"Yu, C., Zezario, R. E., Wang, S. S., Sherman, J., Hsieh, Y. Y., Lu, X., Wang, H. M., & Tsao, Y. (2020). Speech enhancement based on denoising autoencoder with multi-branched encoders. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 28, 2756\u20132769.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10127_CR28","doi-asserted-by":"publisher","DOI":"10.1007\/s10489-023-04571-y","author":"N Zacarias-Morales","year":"2023","unstructured":"Zacarias-Morales, N., Hern\u00e1ndez-Nolasco, J. A., & Pancardo, P. (2023). Full single-type deep learning models with multihead attention for speech enhancement. Applied Intelligence. https:\/\/doi.org\/10.1007\/s10489-023-04571-y","journal-title":"Applied Intelligence"},{"issue":"1","key":"10127_CR29","doi-asserted-by":"publisher","first-page":"53","DOI":"10.1109\/TASLP.2018.2870725","volume":"27","author":"Y Zhao","year":"2019","unstructured":"Zhao, Y., Wang, Z.-Q., & Wang, D. (2019). Two-stage deep learning for noisy-reverberant speech enhancement. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 27(1), 53\u201362.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"10127_CR30","doi-asserted-by":"publisher","DOI":"10.1016\/j.knosys.2022.109215","author":"C Zhong","year":"2022","unstructured":"Zhong, C., Li, G., & Meng, Z. (2022). Beluga whale optimization: A novel nature-inspired metaheuristic algorithm. Knowledge-Based Systems. https:\/\/doi.org\/10.1016\/j.knosys.2022.109215","journal-title":"Knowledge-Based Systems"}],"container-title":["International Journal of Speech Technology"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10772-024-10127-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s10772-024-10127-3\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10772-024-10127-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,9,12]],"date-time":"2024-09-12T12:10:55Z","timestamp":1726143055000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s10772-024-10127-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,7,17]]},"references-count":30,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2024,9]]}},"alternative-id":["10127"],"URL":"https:\/\/doi.org\/10.1007\/s10772-024-10127-3","relation":{},"ISSN":["1381-2416","1572-8110"],"issn-type":[{"value":"1381-2416","type":"print"},{"value":"1572-8110","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,7,17]]},"assertion":[{"value":"29 November 2023","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"2 July 2024","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"17 July 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"Not Applicable.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethical approval"}},{"value":"Not Applicable.","order":4,"name":"Ethics","group":{"name":"EthicsHeading","label":"Informed consent"}}]}}