{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,18]],"date-time":"2026-06-18T08:10:26Z","timestamp":1781770226196,"version":"3.54.5"},"reference-count":75,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","license":[{"start":{"date-parts":[[2025,1,1]],"date-time":"2025-01-01T00:00:00Z","timestamp":1735689600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/legalcode"}],"funder":[{"DOI":"10.13039\/501100006730","name":"Ministry of Education, Research, Development, and Youth of the Slovak Republic","doi-asserted-by":"publisher","award":["KEGA 049TUKE-4\/2024"],"award-info":[{"award-number":["KEGA 049TUKE-4\/2024"]}],"id":[{"id":"10.13039\/501100006730","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100006730","name":"Ministry of Education, Research, Development, and Youth of the Slovak Republic","doi-asserted-by":"publisher","award":["KEGA 041TUKE-4\/2025"],"award-info":[{"award-number":["KEGA 041TUKE-4\/2025"]}],"id":[{"id":"10.13039\/501100006730","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100006190","name":"Slovak Research and Development Agency","doi-asserted-by":"publisher","award":["APVV-22-0261"],"award-info":[{"award-number":["APVV-22-0261"]}],"id":[{"id":"10.13039\/100006190","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100006190","name":"Slovak Research and Development Agency","doi-asserted-by":"publisher","award":["APVV-22-0414"],"award-info":[{"award-number":["APVV-22-0414"]}],"id":[{"id":"10.13039\/100006190","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Access"],"published-print":{"date-parts":[[2025]]},"DOI":"10.1109\/access.2025.3584534","type":"journal-article","created":{"date-parts":[[2025,6,30]],"date-time":"2025-06-30T17:39:16Z","timestamp":1751305156000},"page":"112880-112904","source":"Crossref","is-referenced-by-count":14,"title":["Performance Evaluation of Different Speech-Based Emotional Stress Level Detection Approaches"],"prefix":"10.1109","volume":"13","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-7403-0235","authenticated-orcid":false,"given":"J\u00e1n","family":"Sta\u0161","sequence":"first","affiliation":[{"name":"Department of Electronics and Multimedia Communications, Faculty of Electrical Engineering and Informatics, Technical University of Ko&#x0161;ice, Ko&#x0161;ice, Slovakia"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0075-3788","authenticated-orcid":false,"given":"Stanislav","family":"Ond\u00e1\u0161","sequence":"additional","affiliation":[{"name":"Department of Electronics and Multimedia Communications, Faculty of Electrical Engineering and Informatics, Technical University of Ko&#x0161;ice, Ko&#x0161;ice, Slovakia"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1596-9258","authenticated-orcid":false,"given":"Jozef","family":"Juh\u00e1r","sequence":"additional","affiliation":[{"name":"Department of Electronics and Multimedia Communications, Faculty of Electrical Engineering and Informatics, Technical University of Ko&#x0161;ice, Ko&#x0161;ice, Slovakia"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"issue":"1","key":"ref1","doi-asserted-by":"crossref","first-page":"75","DOI":"10.1558\/ijsll.v18i1.75","article-title":"Acoustic correlates of speech when under stress: Research, methods and future directions","volume":"18","author":"Kirchh\u00fcbel","year":"2011","journal-title":"Int. J. Speech, Lang. Law"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1504\/ijmei.2013.053332"},{"issue":"1","key":"ref3","doi-asserted-by":"crossref","first-page":"94","DOI":"10.47001\/IRJIET\/2024.801013","article-title":"AI based speech analysis framework","volume":"8","author":"Perera","year":"2024","journal-title":"Int. Res. J. Innov. Eng. Technol."},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/RADIOELEK.2010.5478596"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/NORSIG.2006.275258"},{"issue":"28","key":"ref6","first-page":"1","article-title":"Psychological stress speech analysis: A review","volume":"4","author":"Jena","year":"2018","journal-title":"Int. J. Eng. Res. Technol."},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2008-194"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.21437\/Eurospeech.1997-494"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1145\/3264869.3264875"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/ICITACEE55701.2022.9923955"},{"key":"ref11","doi-asserted-by":"crossref","first-page":"1722","DOI":"10.1016\/j.procs.2024.04.163","article-title":"Unravelling stress levels in continuous speech through optimal feature selection and deep learning","volume":"235","author":"Duvvuri","year":"2024","journal-title":"Proc. Comput. Sci."},{"key":"ref12","first-page":"3123","article-title":"The distress analysis interview corpus of human and computer interviews","volume-title":"Proc. LREC","author":"Gratch"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.23919\/APSIPAASC55919.2022.9980183"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2023-2070"},{"key":"ref15","first-page":"25","article-title":"BYOL-S: Learning self-supervised speech representations by bootstrapping","volume-title":"Proc. HEAR","author":"Elbanna"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2022-10498"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1145\/3678957.3685717"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.21437\/IberSPEECH.2018-4"},{"key":"ref19","first-page":"1568","article-title":"VOCE corpus: Ecologically collected speech annotated with physiological and psychological stress assessments","volume-title":"Proc. LREC","author":"Aguiar"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.3389\/fcomp.2021.750284"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1145\/3475957.3484450"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2017.7952261"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.32628\/ijsrst229436"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1371\/journal.pone.0196391"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2005-446"},{"issue":"5","key":"ref26","first-page":"2239","article-title":"Stress detection through speech analysis using machine learning","volume":"8","author":"Vaikole","year":"2020","journal-title":"Int. J. Creative Res. Thoughts"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ICOCO56118.2022.10031771"},{"key":"ref28","doi-asserted-by":"crossref","DOI":"10.1016\/j.dsp.2020.102763","article-title":"Speech emotion recognition using cepstral features extracted with novel triangular filter banks based on bark and ERB frequency scales","volume":"104","author":"Nagarajan","year":"2020","journal-title":"Digit. Signal Process."},{"key":"ref29","first-page":"53","article-title":"Speaker-dependent audio-visual emotion recognition","volume-title":"Proc. AVSP","author":"Haq"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/CSNDSP.2014.6923837"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.21437\/ICSLP.2000-743"},{"key":"ref32","doi-asserted-by":"crossref","first-page":"79","DOI":"10.1016\/j.cogsys.2020.10.001","article-title":"Speech stress recognition using semi-eager learning","volume":"65","author":"Yerigeri","year":"2020","journal-title":"Cognit. Syst. Res."},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2015.7178964"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/TAFFC.2014.2336244"},{"key":"ref35","article-title":"Emotional expression detection in spoken language employing machine learning algorithms","author":"Hosain","year":"2023","journal-title":"arXiv:2304.11040"},{"key":"ref36","volume-title":"Toronto emotional speech set (TESS)","author":"Pichora-Fuller"},{"issue":"6","key":"ref37","first-page":"1312","article-title":"Expressive speech synthesis for critical situations","volume":"33","author":"Rusko","year":"2014","journal-title":"Comput. Informat."},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.2478\/jazcas-2021-0053"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1109\/ICCCIS48478.2019.8974561"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.21437\/ICSLP.2002-555"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1016\/S0167-6393(02)00080-8"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1007\/978-0-387-79582-9_5"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1177\/0954410012467944"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1007\/s00034-016-0284-9"},{"key":"ref45","first-page":"1499","article-title":"MuSE: A multimodal dataset of stressed emotion","volume-title":"Proc. LREC","author":"Jaiswal"},{"key":"ref46","first-page":"1","article-title":"StressID: A multimodal dataset for stress identification","volume-title":"Proc. NeurIPS","author":"Chaptoukaev"},{"key":"ref47","first-page":"1355","article-title":"BESST dataset: A multimodal resource for speech-based stress detection and analysis","volume-title":"Proc. Interspeech","author":"Pe\u0161\u00e1n"},{"key":"ref48","first-page":"1174","article-title":"A multilingual natural stress emotion database","volume-title":"Proc. LREC","author":"Zuo"},{"key":"ref49","first-page":"1","article-title":"A state of the art review on emotional speech databases","volume-title":"Proc. 1st Richmedia Conf.","author":"Ververidis"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1007\/s10772-011-9125-1"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2024.3476960"},{"key":"ref52","article-title":"DARPA TIMIT acoustic-phonetic continuous speech corpus CD-ROM","author":"Garofolo","year":"4930"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.15546\/aeei-2015-0011"},{"key":"ref54","doi-asserted-by":"publisher","DOI":"10.12693\/aphyspola.121.a-92"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.3389\/fpsyg.2018.01994"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1016\/S1808-8694(15)31023-5"},{"issue":"6","key":"ref57","first-page":"3171","article-title":"Application of different filters in mel frequency cepstral coefficients feature extraction and fuzzy vector quantization approach in speaker recognition","volume":"2","author":"Singh","year":"2013","journal-title":"Int. J. Eng. Res. Technol."},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2011.6163888"},{"key":"ref59","doi-asserted-by":"publisher","DOI":"10.1109\/TASSP.1979.1163234"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2017.7952132"},{"key":"ref61","article-title":"MobileNets: Efficient convolutional neural networks for mobile vision applications","author":"Howard","year":"2017","journal-title":"arXiv:1704.04861"},{"key":"ref62","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2024.3415112"},{"key":"ref63","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2023.3344531"},{"key":"ref64","first-page":"1","article-title":"Wav2vec 2.0: A framework for self-supervised learning of speech representations","volume-title":"Proc. NeurIPS","author":"Baevski"},{"key":"ref65","doi-asserted-by":"publisher","DOI":"10.18201\/ijisae.2020363531"},{"key":"ref66","doi-asserted-by":"publisher","DOI":"10.1109\/ICETA61311.2023.10343755"},{"key":"ref67","doi-asserted-by":"publisher","DOI":"10.3758\/bf03192732"},{"key":"ref68","doi-asserted-by":"publisher","DOI":"10.1016\/j.mehy.2011.11.016"},{"key":"ref69","doi-asserted-by":"publisher","DOI":"10.17488\/rmib.45.2.1"},{"issue":"1","key":"ref70","first-page":"1","article-title":"Scaling speech technology to 1,000+ languages","volume":"25","author":"Pratap","year":"2024","journal-title":"J. Mach. Learn. Res."},{"key":"ref71","doi-asserted-by":"publisher","DOI":"10.1109\/TAFFC.2015.2457417"},{"key":"ref72","doi-asserted-by":"publisher","DOI":"10.21437\/SLaTE.2019-9"},{"issue":"1","key":"ref73","first-page":"6340","article-title":"AuDeep: Unsupervised learning of representations from audio with deep recurrent neural networks","volume":"18","author":"Freitag","year":"2017","journal-title":"J. Mach. Learn. Res."},{"key":"ref74","first-page":"1","article-title":"BEATs: Audio pre-training with acoustic tokenizers","volume-title":"Proc. ICML","author":"Chen"},{"key":"ref75","doi-asserted-by":"publisher","DOI":"10.1109\/taslp.2021.3122291"}],"container-title":["IEEE Access"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/6287639\/10820123\/11059908.pdf?arnumber=11059908","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,7,5]],"date-time":"2025-07-05T04:39:01Z","timestamp":1751690341000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11059908\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025]]},"references-count":75,"URL":"https:\/\/doi.org\/10.1109\/access.2025.3584534","relation":{},"ISSN":["2169-3536"],"issn-type":[{"value":"2169-3536","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025]]}}}