{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,13]],"date-time":"2026-07-13T20:02:45Z","timestamp":1783972965776,"version":"3.55.0"},"reference-count":75,"publisher":"Oxford University Press (OUP)","issue":"8","license":[{"start":{"date-parts":[[2025,7,28]],"date-time":"2025-07-28T00:00:00Z","timestamp":1753660800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/"}],"funder":[{"name":"Industrial Technology Innovation Program","award":["20012462"],"award-info":[{"award-number":["20012462"]}]},{"DOI":"10.13039\/501100003052","name":"Ministry of Trade, Industry and Energy","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100003052","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100003725","name":"National Research Foundation of Korea","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100003725","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Ministry of Science and ICT (MSIT), Republic of Korea","award":["NRF-2021R1A2C2093065"],"award-info":[{"award-number":["NRF-2021R1A2C2093065"]}]},{"name":"Ministry of Science and ICT (MSIT), Republic of Korea","award":["RS-2024-00453107"],"award-info":[{"award-number":["RS-2024-00453107"]}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025,8,4]]},"abstract":"<jats:title>Abstract<\/jats:title>\n               <jats:p>Human Activity Recognition (HAR) plays a crucial role in identifying and digitizing human behaviors. Among various approaches, sound-based HAR offers distinct advantages, such as overcoming visual limitations and enabling recognition in diverse environments. This study introduces an innovative application of sound segmentation with SegNet, originally designed for image segmentation, to sound-based HAR. Traditionally, labeling sound data has been challenging due to its limited scope, often restricted to specific events or time frames. To address this issue, a novel labeling approach was developed, allowing detailed annotations across the entire temporal and frequency domains. This method facilitates the use of SegNet, which requires pixel-level labeling for accurate segmentation, leading to more granular and explainable activity recognition. A dataset comprising six distinct human activities\u2014speech, groaning, screaming, coughing, toilet and snoring\u2014was constructed to enable comprehensive evaluation. The trained neural network, utilizing this annotated dataset, achieved F1 scores ranging from 0.68 to 0.95. The model\u2019s practical applicability was further validated through recognition tests conducted in a professional office environment. This study presents a novel framework for quantifying daily human activities through sound segmentation, contributing to advancements in intelligent system technology.<\/jats:p>","DOI":"10.1093\/jcde\/qwaf075","type":"journal-article","created":{"date-parts":[[2025,7,28]],"date-time":"2025-07-28T13:29:01Z","timestamp":1753709341000},"page":"252-269","source":"Crossref","is-referenced-by-count":3,"title":["Granular and explainable human activity recognition through sound segmentation and deep learning"],"prefix":"10.1093","volume":"12","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-1954-8805","authenticated-orcid":false,"given":"Jisoo","family":"Kim","sequence":"first","affiliation":[{"name":"Jeju National University Department of Artificial Intelligence, , 102 Jejudaehak-ro, Jeju-si, Jeju Special Self-Governing Province, 63243 ,","place":["South Korea"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9299-349X","authenticated-orcid":false,"given":"Byounghyun","family":"Yoo","sequence":"additional","affiliation":[{"name":"Korea Institute of Science and Technology Intelligence and Interaction Research Center, , 5 Hwarangro14-gil, Seongbuk-gu, Seoul 02792 ,","place":["South Korea"]},{"name":"Korea National University of Science and Technology AI-Robotics, KIST School, , 5 Hwarangro14-gil, Seongbuk-gu, Seoul 02792 ,","place":["South Korea"]}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"286","published-online":{"date-parts":[[2025,7,28]]},"reference":[{"key":"2025082213165322000_bib1","doi-asserted-by":"publisher","first-page":"34","DOI":"10.1109\/JSTSP.2018.2885636","article-title":"Sound event localization and detection of overlapping sources using convolutional recurrent neural networks","volume":"13","author":"Adavanne","year":"2019","journal-title":"IEEE Journal of Selected Topics in Signal Processing"},{"key":"2025082213165322000_bib2","doi-asserted-by":"publisher","first-page":"296","DOI":"10.1016\/j.apacoust.2018.06.013","article-title":"Fall detection through acoustic local ternary patterns","volume":"140","author":"Adnan","year":"2018","journal-title":"Applied Acoustics"},{"key":"2025082213165322000_bib3","doi-asserted-by":"publisher","first-page":"234","DOI":"10.1093\/jcde\/qwae061","article-title":"Frequency-focused sound data generator for fault diagnosis in industrial robots","volume":"11","author":"Ahn","year":"2024","journal-title":"Journal of Computational Design and Engineering"},{"key":"2025082213165322000_bib4","doi-asserted-by":"publisher","first-page":"644","DOI":"10.1093\/jcde\/qwaa048","article-title":"Wi-ESP\u2014A tool for CSI-based device-free Wi-fi sensing (DFWS)","volume":"7","author":"Atif","year":"2020","journal-title":"Journal of Computational Design and Engineering"},{"key":"2025082213165322000_bib5","doi-asserted-by":"publisher","first-page":"2481","DOI":"10.1109\/TPAMI.2016.2644615","article-title":"SegNet: A deep convolutional encoder-decoder architecture for image segmentation","volume":"39","author":"Badrinarayanan","year":"2017","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"2025082213165322000_bib6","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1986.1169179","article-title":"Maximum mutual information estimation of hidden Markov model parameters for speech recognition","volume-title":"IEEE International Conference on Acoustics, Speech, and Signal Processing","author":"Bahl","year":"1986"},{"key":"2025082213165322000_bib7","doi-asserted-by":"publisher","first-page":"82","DOI":"10.1016\/j.inffus.2019.12.012","article-title":"eXplainable Artificial Intelligence (XAI): Concepts, taxonomies, opportunities and challenges toward responsible AI","volume-title":"Information Fusion","author":"Barredo\u00a0Arrieta","year":"2020"},{"key":"2025082213165322000_bib8","doi-asserted-by":"publisher","first-page":"30509","DOI":"10.1007\/s11042-020-09004-3","article-title":"Vision-based human activity recognition: A survey","volume":"79","author":"Beddiar","year":"2020","journal-title":"Multimedia Tools and Applications"},{"key":"2025082213165322000_bib9","doi-asserted-by":"publisher","first-page":"130529","DOI":"10.1109\/ACCESS.2021.3113903","article-title":"Semi-supervised NMF-CNN for Sound event detection","volume":"9","author":"Chan","year":"2021","journal-title":"IEEE Access"},{"key":"2025082213165322000_bib10","doi-asserted-by":"publisher","first-page":"111445","DOI":"10.1016\/j.measurement.2022.111445","article-title":"Human activity recognition in IoHT applications using Arithmetic Optimization Algorithm and deep learning","volume":"199","author":"Dahou","year":"2022","journal-title":"Measurement"},{"key":"2025082213165322000_bib11","doi-asserted-by":"publisher","first-page":"720","DOI":"10.1007\/978-3-030-01225-0_44","article-title":"Scaling egocentric vision: The epic-kitchens dataset","volume-title":"Proceedings of the European Conference on Computer Vision (ECCV)","author":"Damen","year":"2018"},{"key":"2025082213165322000_bib12","volume-title":"Audio Event Detection on Google's Audio Set Database: Preliminary Results Using Different Types of DNNs","author":"Darna-Sequeiros","year":"2018"},{"key":"2025082213165322000_bib13","article-title":"Demucs: Deep extractor for music sources with extra unlabeled data remixed","author":"D\u00e9fossez","year":"2019"},{"key":"2025082213165322000_bib14","doi-asserted-by":"publisher","first-page":"21","DOI":"10.1016\/j.engappai.2018.08.014","article-title":"A review of state-of-the-art techniques for abnormal human activity recognition","volume":"77","author":"Dhiman","year":"2019","journal-title":"Engineering Applications of Artificial Intelligence"},{"key":"2025082213165322000_bib15","doi-asserted-by":"publisher","DOI":"10.23919\/MIPRO.2018.8400040","article-title":"Explainable artificial intelligence: A survey","volume-title":"2018 41st International Convention on Information and Communication Technology, Electronics and Microelectronics","author":"Do\u0161ilovi\u0107","year":"2018"},{"key":"2025082213165322000_bib16","doi-asserted-by":"publisher","first-page":"1784101","DOI":"10.1155\/2016\/1784101","article-title":"An analysis of audio features to develop a Human activity recognition model using genetic algorithms, random forests, and neural networks","volume":"2016","author":"Galv\u00e1n-Tejada","year":"2016","journal-title":"Mobile Information Systems"},{"key":"2025082213165322000_bib17","doi-asserted-by":"crossref","DOI":"10.1109\/CVPR42600.2020.01049","article-title":"Music gesture for visual sound separation","volume-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","author":"Gan","year":"2020"},{"key":"2025082213165322000_bib18","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2017.7952261","article-title":"Audio set: An ontology and human-labeled dataset for audio events","volume-title":"2017 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","author":"Gemmeke","year":"2017"},{"key":"2025082213165322000_bib19","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2015.7354253","article-title":"Time difference of arrival estimation based on binary frequency mask for sound source localization on mobile robots","volume-title":"2015 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)","author":"Grondin","year":"2015"},{"key":"2025082213165322000_bib20","doi-asserted-by":"publisher","first-page":"2957","DOI":"10.1121\/1.4979337","article-title":"Analysis of human scream and its impact on text-independent speaker verification","volume":"141","author":"Hansen","year":"2017","journal-title":"The Journal of the Acoustical Society of America"},{"key":"2025082213165322000_bib21","doi-asserted-by":"publisher","first-page":"75","DOI":"10.1016\/j.neucom.2018.08.033","article-title":"Recognizing multi-resident activities in non-intrusive sensor-based smart homes by formal concept analysis","volume":"318","author":"Hao","year":"2018","journal-title":"Neurocomputing"},{"key":"2025082213165322000_bib22","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2016.7471631","article-title":"Deep clustering: Discriminative embeddings for segmentation and separation","volume-title":"2016 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","author":"Hershey","year":"2016"},{"key":"2025082213165322000_bib23","doi-asserted-by":"publisher","first-page":"107218","DOI":"10.1016\/j.engappai.2023.107218","article-title":"AI-driven behavior biometrics framework for robust human activity recognition in surveillance systems","volume":"127","author":"Hussain","year":"2024","journal-title":"Engineering Applications of Artificial Intelligence"},{"key":"2025082213165322000_bib24","doi-asserted-by":"publisher","first-page":"118523","DOI":"10.1016\/j.eswa.2022.118523","article-title":"Multimodal fusion methods with deep neural networks and meta-information for aggression detection in surveillance","volume":"211","author":"Jaafar","year":"2023","journal-title":"Expert Systems with Applications"},{"key":"2025082213165322000_bib25","doi-asserted-by":"publisher","first-page":"108050","DOI":"10.1016\/j.measurement.2020.108050","article-title":"Optimized unsupervised deep learning assisted reconstructed coder in the on-nodule wearable sensor for human activity recognition","volume":"164","author":"Janarthanan","year":"2020","journal-title":"Measurement"},{"key":"2025082213165322000_bib26","doi-asserted-by":"publisher","first-page":"Article 17","DOI":"10.1145\/3580804","article-title":"X-CHAR: A concept-based explainable complex Human activity recognition model","volume":"7","author":"Jeyakumar","year":"2023","journal-title":"Proc. ACM Interact. Mob. Wearable Ubiquitous Technol."},{"key":"2025082213165322000_bib27","doi-asserted-by":"publisher","DOI":"10.1109\/ICECIT54077.2021.9641237","article-title":"Human expertise inspired smart sensing and manufacturing","volume-title":"2021 International Conference on Electronics, Communications and Information Technology (ICECIT)","author":"Jun","year":"2021"},{"key":"2025082213165322000_bib28","doi-asserted-by":"publisher","first-page":"103177","DOI":"10.1016\/j.autcon.2020.103177","article-title":"Human activity classification based on sound recognition and residual convolutional neural network","volume":"114","author":"Jung","year":"2020","journal-title":"Automation in Construction"},{"key":"2025082213165322000_bib29","doi-asserted-by":"publisher","first-page":"201","DOI":"10.1007\/s12541-020-00445-2","article-title":"Appropriate smart factory for SMEs: Concept, application and perspective","volume":"22","author":"Jung","year":"2021","journal-title":"International Journal of Precision Engineering and Manufacturing"},{"key":"2025082213165322000_bib30","doi-asserted-by":"publisher","first-page":"555","DOI":"10.1007\/s40684-018-0057-y","article-title":"Smart machining process using machine learning: A review and perspective on machining industry","volume":"5","author":"Kim","year":"2018","journal-title":"International Journal of Precision Engineering and Manufacturing-Green Technology"},{"key":"2025082213165322000_bib31","doi-asserted-by":"publisher","first-page":"1437","DOI":"10.1007\/s12541-024-01018-3","article-title":"Operation and productivity monitoring from sound signal of legacy pipe bending machine via convolutional neural network (CNN)","volume":"25","author":"Kim","year":"2024","journal-title":"International Journal of Precision Engineering and Manufacturing"},{"key":"2025082213165322000_bib32","doi-asserted-by":"publisher","first-page":"116014","DOI":"10.1016\/j.eswa.2021.116014","article-title":"Broken stitch detection method for sewing operation using CNN feature map and image-processing techniques","volume":"188","author":"Kim","year":"2022","journal-title":"Expert Systems with Applications"},{"key":"2025082213165322000_bib33","doi-asserted-by":"publisher","first-page":"1291","DOI":"10.1007\/s00170-020-06201-0","article-title":"Image-based failure detection for material extrusion process using a convolutional neural network","volume":"111","author":"Kim","year":"2020","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"key":"2025082213165322000_bib34","doi-asserted-by":"publisher","first-page":"431","DOI":"10.1016\/j.jmsy.2020.12.020","article-title":"Sound-based remote real-time multi-device operational monitoring system using a Convolutional Neural Network (CNN)","volume":"58","author":"Kim","year":"2021","journal-title":"Journal of Manufacturing Systems"},{"key":"2025082213165322000_bib35","doi-asserted-by":"publisher","first-page":"107092","DOI":"10.1016\/j.buildenv.2020.107092","article-title":"Occupant behavior monitoring and emergency event detection in single-person households using deep learning-based sound recognition","volume":"181","author":"Kim","year":"2020","journal-title":"Building and Environment"},{"key":"2025082213165322000_bib36","doi-asserted-by":"publisher","first-page":"17228","DOI":"10.1038\/s41598-022-21692-5","article-title":"Convolutional neural network-based classification of cervical intraepithelial neoplasias using colposcopic image segmentation for acetowhite epithelium","volume":"12","author":"Kim","year":"2022","journal-title":"Scientific Reports"},{"key":"2025082213165322000_bib37","doi-asserted-by":"publisher","first-page":"174399","DOI":"10.1109\/ACCESS.2024.3457912","article-title":"Recognition of Human activities based on ambient audio and vibration data","volume":"12","author":"Koch","year":"2024","journal-title":"IEEE Access"},{"key":"2025082213165322000_bib38","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2018.8461392","article-title":"Audio set classification with attention model: A probabilistic perspective","volume-title":"2018 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","author":"Kong","year":"2018"},{"key":"2025082213165322000_bib39","doi-asserted-by":"publisher","first-page":"2450","DOI":"10.1109\/TASLP.2020.3014737","article-title":"Sound event detection of weakly labelled data with CNN-transformer and automatic threshold optimization","volume":"28","author":"Kong","year":"2020","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"2025082213165322000_bib40","doi-asserted-by":"publisher","DOI":"10.1145\/3025453.3025773","volume-title":"Synthetic Sensors: towards General-Purpose Sensing Proceedings of the 2017 CHI Conference on Human Factors in Computing Systems","author":"Laput","year":"2017"},{"key":"2025082213165322000_bib41","doi-asserted-by":"publisher","first-page":"8323962","DOI":"10.1155\/2022\/8323962","article-title":"A comprehensive review of recent deep learning techniques for Human activity recognition","volume":"2022","author":"Le","year":"2022","journal-title":"Computational Intelligence and Neuroscience"},{"key":"2025082213165322000_bib42","doi-asserted-by":"publisher","DOI":"10.1109\/MFI49285.2020.9235269","article-title":"Machine assisted video tagging of elderly activities in K-log centre","volume-title":"2020 IEEE International Conference on Multisensor Fusion and Integration for Intelligent Systems (MFI)","author":"Lee","year":"2020"},{"key":"2025082213165322000_bib43","doi-asserted-by":"publisher","first-page":"117811","DOI":"10.1016\/j.eswa.2022.117811","article-title":"Deep learning based cough detection camera using enhanced features","volume":"206","author":"Lee","year":"2022","journal-title":"Expert Systems with Applications"},{"key":"2025082213165322000_bib44","doi-asserted-by":"publisher","first-page":"107959","DOI":"10.1016\/j.ymssp.2021.107959","article-title":"Deep learning-based method for multiple sound source localization with high resolution and accuracy","volume":"161","author":"Lee","year":"2021","journal-title":"Mechanical Systems and Signal Processing"},{"key":"2025082213165322000_bib45","doi-asserted-by":"publisher","first-page":"5","DOI":"10.1186\/s13636-022-00239-6","article-title":"Improved capsule routing for weakly labeled sound event detection","volume":"2022","author":"Li","year":"2022","journal-title":"EURASIP Journal on Audio, Speech, and Music Processing"},{"key":"2025082213165322000_bib46","doi-asserted-by":"publisher","first-page":"10407","DOI":"10.1007\/s11042-015-3105-4","article-title":"Detection, classification and localization of acoustic events in the presence of background noise for acoustic surveillance of hazardous situations","volume":"75","author":"Lopatka","year":"2016","journal-title":"Multimedia Tools and Applications"},{"key":"2025082213165322000_bib47","doi-asserted-by":"publisher","first-page":"1256","DOI":"10.1109\/TASLP.2019.2915167","article-title":"Conv-tasnet: Surpassing ideal time\u2013frequency magnitude masking for speech separation","volume":"27","author":"Luo","year":"2019","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"2025082213165322000_bib48","article-title":"Deep semantic encoder-decoder network for acoustic scene classification with multiple devices","volume-title":"2020 Asia-Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA ASC)","author":"Ma","year":"2020"},{"key":"2025082213165322000_bib49","doi-asserted-by":"publisher","first-page":"1499","DOI":"10.1093\/jcde\/qwab054","article-title":"Recent use of deep learning techniques in clinical applications based on gait: A survey","volume":"8","author":"Matsushita","year":"2021","journal-title":"Journal of Computational Design and Engineering"},{"key":"2025082213165322000_bib50","doi-asserted-by":"crossref","DOI":"10.1109\/ICASSP40776.2020.9053609","article-title":"Weakly-supervised sound event detection with self-attention","volume-title":"ICASSP 2020\u20132020 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","author":"Miyazaki","year":"2020"},{"key":"2025082213165322000_bib51","doi-asserted-by":"publisher","first-page":"103237","DOI":"10.1016\/j.autcon.2020.103237","article-title":"Real-time space occupancy sensing and human motion analysis using deep learning for indoor air quality control","volume":"116","author":"Mutis","year":"2020","journal-title":"Automation in Construction"},{"key":"2025082213165322000_bib52","doi-asserted-by":"publisher","first-page":"1243","DOI":"10.1093\/jcde\/qwab044","article-title":"Neural network-based build time estimation for additive manufacturing: A performance comparison","volume":"8","author":"Oh","year":"2021","journal-title":"Journal of Computational Design and Engineering"},{"key":"2025082213165322000_bib53","doi-asserted-by":"publisher","first-page":"1193","DOI":"10.1007\/s11760-023-02825-3","article-title":"Explainable audio CNNs applied to neural decoding: Sound category identification from inferior colliculus","volume":"18","author":"\u00d6zcan","year":"2024","journal-title":"Signal, Image and Video Processing"},{"key":"2025082213165322000_bib54","doi-asserted-by":"publisher","first-page":"3009","DOI":"10.3390\/app11073009","article-title":"Multi-view attention Network for visual dialog","volume":"11","author":"Park","year":"2021","journal-title":"Applied Sciences"},{"key":"2025082213165322000_bib55","doi-asserted-by":"publisher","first-page":"92","DOI":"10.1109\/TETCI.2017.2762739","article-title":"Light gated recurrent units for speech recognition","volume":"2","author":"Ravanelli","year":"2018","journal-title":"IEEE Transactions on Emerging Topics in Computational Intelligence"},{"key":"2025082213165322000_bib56","doi-asserted-by":"publisher","first-page":"199","DOI":"10.1016\/j.sigpro.2014.08.021","article-title":"An unsupervised acoustic fall detection system using source separation for sound interference suppression","volume":"110","author":"Salman\u00a0Khan","year":"2015","journal-title":"Signal Processing"},{"key":"2025082213165322000_bib57","doi-asserted-by":"crossref","DOI":"10.1109\/ICCV.2017.74","article-title":"Grad-cam: Visual explanations from deep networks via gradient-based localization","volume-title":"IEEE International Conference on Computer Vision\u00a0ICCV 2017","author":"Selvaraju","year":"2017"},{"key":"2025082213165322000_bib58","doi-asserted-by":"publisher","first-page":"256","DOI":"10.1504\/IJAHUC.2018.090597","article-title":"Information fusion of heterogeneous sensors for enriched personal healthcare activity logging","volume":"27","author":"Seo","year":"2018","journal-title":"International Journal of Ad Hoc and Ubiquitous Computing"},{"key":"2025082213165322000_bib59","doi-asserted-by":"publisher","first-page":"104104","DOI":"10.1016\/j.autcon.2021.104104","article-title":"Sound-based multiple-equipment activity recognition using convolutional neural networks","volume":"135","author":"Sherafat","year":"2022","journal-title":"Automation in Construction"},{"key":"2025082213165322000_bib60","doi-asserted-by":"publisher","first-page":"270","DOI":"10.1016\/j.apacoust.2017.08.002","article-title":"Audio sounds classification using scattering features and support vectors machines for medical surveillance","volume":"130","author":"Souli","year":"2018","journal-title":"Applied Acoustics"},{"key":"2025082213165322000_bib61","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP43922.2022.9747732","article-title":"SegNet-based deep representation learning for dysphagia classification","volume-title":"ICASSP 2022\u20132022 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","author":"Subramani","year":"2022"},{"key":"2025082213165322000_bib62","doi-asserted-by":"publisher","first-page":"1280","DOI":"10.1080\/01691864.2020.1829040","article-title":"Sound event aware environmental sound segmentation with Mask U-Net","volume":"34","author":"Sudo","year":"2020","journal-title":"Advanced Robotics"},{"key":"2025082213165322000_bib63","doi-asserted-by":"publisher","first-page":"129169","DOI":"10.1109\/ACCESS.2020.3009852","article-title":"Vision-based fault diagnostics using explainable deep learning with class activation maps","volume":"8","author":"Sun","year":"2020","journal-title":"IEEE Access"},{"key":"2025082213165322000_bib64","doi-asserted-by":"publisher","first-page":"103356","DOI":"10.1016\/j.autcon.2020.103356","article-title":"Human-object interaction recognition for automatic construction site safety inspection","volume":"120","author":"Tang","year":"2020","journal-title":"Automation in Construction"},{"key":"2025082213165322000_bib65","doi-asserted-by":"crossref","DOI":"10.1109\/CVPR52729.2023.00718","article-title":"Interactive and explainable region-guided radiology report generation","volume-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","author":"Tanida","year":"2023"},{"key":"2025082213165322000_bib66","doi-asserted-by":"publisher","first-page":"113231","DOI":"10.1016\/j.measurement.2023.113231","article-title":"A low-cost real-time IoT human activity recognition system based on wearable sensor and the supervised learning algorithms","volume":"218","author":"Tran\u00a0Thi\u00a0Hong","year":"2023","journal-title":"Measurement"},{"key":"2025082213165322000_bib67","doi-asserted-by":"crossref","DOI":"10.33682\/006b-jx26","article-title":"Sound event detection in domestic environments with weakly labeled data and soundscape synthesis","author":"Turpault","year":"2019","journal-title":"DCASE 2019 Workshop"},{"key":"2025082213165322000_bib68","doi-asserted-by":"publisher","DOI":"10.1109\/ISCSLP49672.2021.9362116","article-title":"A model ensemble approach for sound event localization and detection","volume-title":"2021 12th International Symposium on Chinese Spoken Language Processing (ISCSLP)","author":"Wang","year":"2021"},{"key":"2025082213165322000_bib69","doi-asserted-by":"publisher","first-page":"510","DOI":"10.1093\/jcde\/qwab003","article-title":"CSI-based human sensing using model-based approaches: A survey","volume":"8","author":"Wang","year":"2021","journal-title":"Journal of Computational Design and Engineering"},{"key":"2025082213165322000_bib70","doi-asserted-by":"publisher","DOI":"10.1109\/EMBC48229.2022.9871291","article-title":"CoughLIME: Sonified explanations for the predictions of COVID-19 cough classifiers","volume-title":"2022 44th Annual International Conference of the IEEE Engineering in Medicine & Biology Society (EMBC)","author":"Wullenweber","year":"2022"},{"key":"2025082213165322000_bib71","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP40776.2020.9053073","article-title":"Task-aware mean teacher method for large scale weakly labeled semi-supervised sound event detection","volume-title":"ICASSP 2020\u20132020 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","author":"Yan","year":"2020"},{"key":"2025082213165322000_bib72","doi-asserted-by":"publisher","first-page":"251","DOI":"10.1016\/j.pmcj.2014.11.004","article-title":"Multi-scale conditional random fields for first-person activity recognition on elders and disabled patients","volume":"16","author":"Zhan","year":"2015","journal-title":"Pervasive and Mobile Computing"},{"key":"2025082213165322000_bib73","doi-asserted-by":"publisher","first-page":"77","DOI":"10.1007\/s12652-012-0122-2","article-title":"Wearable sensor-based human activity recognition from environmental background sounds [Article]","volume":"5","author":"Zhan","year":"2014","journal-title":"Journal of Ambient Intelligence and Humanized Computing"},{"key":"2025082213165322000_bib74","doi-asserted-by":"publisher","first-page":"012008","DOI":"10.1088\/1742-6596\/1769\/1\/012008","article-title":"Multi-scale convolutional recurrent neural network and data augmentation for polyphonic sound event detection","volume":"1769","author":"Zhang","year":"2021","journal-title":"Journal of Physics: Conference Series"},{"key":"2025082213165322000_bib75","doi-asserted-by":"publisher","first-page":"514","DOI":"10.3390\/s17030514","article-title":"Design of an acoustic target intrusion detection system based on small-aperture microphone array","volume":"17","author":"Zu","year":"2017","journal-title":"Sensors"}],"container-title":["Journal of Computational Design and Engineering"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/academic.oup.com\/jcde\/advance-article-pdf\/doi\/10.1093\/jcde\/qwaf075\/63862340\/qwaf075.pdf","content-type":"application\/pdf","content-version":"am","intended-application":"syndication"},{"URL":"https:\/\/academic.oup.com\/jcde\/article-pdf\/12\/8\/252\/63862340\/qwaf075.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"syndication"},{"URL":"https:\/\/academic.oup.com\/jcde\/article-pdf\/12\/8\/252\/63862340\/qwaf075.pdf","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,8,22]],"date-time":"2025-08-22T17:16:58Z","timestamp":1755883018000},"score":1,"resource":{"primary":{"URL":"https:\/\/academic.oup.com\/jcde\/article\/12\/8\/252\/8215199"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,7,28]]},"references-count":75,"journal-issue":{"issue":"8","published-print":{"date-parts":[[2025,8,4]]}},"URL":"https:\/\/doi.org\/10.1093\/jcde\/qwaf075","relation":{},"ISSN":["2288-5048"],"issn-type":[{"value":"2288-5048","type":"electronic"}],"subject":[],"published-other":{"date-parts":[[2025,8]]},"published":{"date-parts":[[2025,7,28]]}}}