{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,2]],"date-time":"2026-08-02T19:54:12Z","timestamp":1785700452661,"version":"3.56.0"},"reference-count":174,"publisher":"Springer Science and Business Media LLC","issue":"17","license":[{"start":{"date-parts":[[2023,11,11]],"date-time":"2023-11-11T00:00:00Z","timestamp":1699660800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,11,11]],"date-time":"2023-11-11T00:00:00Z","timestamp":1699660800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"DOI":"10.1007\/s11042-023-17529-6","type":"journal-article","created":{"date-parts":[[2023,11,11]],"date-time":"2023-11-11T06:01:30Z","timestamp":1699682490000},"page":"52653-52709","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":26,"title":["A survey on intelligent human action recognition techniques"],"prefix":"10.1007","volume":"83","author":[{"given":"Rahul","family":"Kumar","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shailender","family":"Kumar","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2023,11,11]]},"reference":[{"key":"17529_CR1","doi-asserted-by":"publisher","unstructured":"Ke SR, Thuc HLU, Lee YJ, Hwang JN, Yoo JH, Choi KH (2013) A review on video-based human activity recognition. Computers 2(2): 88\u2013131. MDPI AG. https:\/\/doi.org\/10.3390\/computers2020088","DOI":"10.3390\/computers2020088"},{"key":"17529_CR2","doi-asserted-by":"publisher","first-page":"4755","DOI":"10.1007\/s10462-021-10116-x","volume":"55","author":"N Gupta","year":"2022","unstructured":"Gupta N, Gupta SK, Pathak RK et al (2022) Human activity recognition in artificial intelligence framework: a narrative review. Artif Intell Rev 55:4755\u20134808. https:\/\/doi.org\/10.1007\/s10462-021-10116-x","journal-title":"Artif Intell Rev"},{"key":"17529_CR3","volume-title":"Local descriptors for spatio-temporal recognition","author":"I Laptev","year":"2004","unstructured":"Laptev I, Lindeberg T (2004) Local descriptors for spatio-temporal recognition. In: International workshop on spatial coherence for visual motion analysis"},{"key":"17529_CR4","volume-title":"The tenth IEEE international conference on computer vision (ICCV\u201905)","author":"L Gorelick","year":"2005","unstructured":"Gorelick L, BlankM SE, Irani M, Basri R (2005) Actions as space-time shapes. In: The tenth IEEE international conference on computer vision (ICCV\u201905)"},{"key":"17529_CR5","first-page":"1","volume-title":"26th IEEE conference on computer vision and pattern recognition, CVPR","author":"MD Rodriguez","year":"2008","unstructured":"Rodriguez MD, Ahmed J, Shah M (2008) Action of MACH a spatio-temporal maximum average correlation height filter for action recognition. In: 26th IEEE conference on computer vision and pattern recognition, CVPR, pp 1\u20138"},{"key":"17529_CR6","doi-asserted-by":"publisher","unstructured":"Kuehne H, Jhuang H, Garrote E, Poggio T, Serre T (n.d.) HMDB: a large video database for human motion recognition. In: International conference on computer vision, Barcelona, pp 2556\u20132563. https:\/\/doi.org\/10.1109\/ICCV.2011.6126543","DOI":"10.1109\/ICCV.2011.6126543"},{"key":"17529_CR7","doi-asserted-by":"crossref","unstructured":"Reddy KK, Shah M (2012) Recognizing 50 human action categories of web videos. Machine Vision and Applications Journal (MVAP)","DOI":"10.1007\/s00138-012-0450-4"},{"key":"17529_CR8","unstructured":"Soomro K, Zamir AR, Mubarak Shah (2012) UCF101: A dataset of 101 human action classes from videos in the wild, CRCV-TR-12-01"},{"key":"17529_CR9","volume-title":"IEEE11th international conference on computer vision, Rio de Janeiro","author":"D Weinland","year":"2007","unstructured":"Weinland D, Boyer E, Ronfard R (2007) Action recognition from arbitrary views using 3D exemplars. In: IEEE11th international conference on computer vision, Rio de Janeiro"},{"issue":"2","key":"17529_CR10","doi-asserted-by":"publisher","first-page":"74","DOI":"10.1145\/1964897.1964918","volume":"12","author":"JR Kwapisz","year":"2011","unstructured":"Kwapisz JR, Weiss GM, Moore SA (2011) Activity recognition using cell phone accelerometers. ACM SIGKDD Explorations Newsl 12(2):74\u201382. https:\/\/doi.org\/10.1145\/1964897.1964918","journal-title":"ACM SIGKDD Explorations Newsl"},{"key":"17529_CR11","volume-title":"Proceedings of IEEE international conference on image processing","author":"C Chen","year":"2015","unstructured":"Chen C, Jafari R, Kehtarnavaz N (2015) UTD-MHAD: a multimodal dataset for human action recognition utilizing a depth camera and a wearable inertial sensor. In: Proceedings of IEEE international conference on image processing. Canada"},{"key":"17529_CR12","unstructured":"Heilbron FC, Escorcia V, Ghanem B, Niebles JC (n.d) ActivityNet: a large-scale video benchmark for human activity understanding. In: IEEE conference on computer vision and pattern recognition (CVPR), Boston M A"},{"key":"17529_CR13","doi-asserted-by":"publisher","first-page":"2649","DOI":"10.1109\/CVPR.2014.339","volume-title":"Proceedings of the IEEE computer society conference on computer vision and pattern recognition","author":"J Wang","year":"2014","unstructured":"Wang J, Nie X, Xia Y, Wu Y, Zhu SC (2014) Cross-view action modeling, learning and recognition. In: Proceedings of the IEEE computer society conference on computer vision and pattern recognition, pp 2649\u20132656. https:\/\/doi.org\/10.1109\/CVPR.2014.339"},{"issue":"PART 2","key":"17529_CR14","doi-asserted-by":"publisher","first-page":"742","DOI":"10.1007\/978-3-319-10605-2_48\/COVER","volume":"8690 LNCS","author":"H Rahmani","year":"2014","unstructured":"Rahmani H, Mahmood A, Huynh DQ, Mian A (2014) HOPC: histogram of oriented principal components of 3D pointclouds for action recognition. Lect Notes Comput Sci (including subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics) 8690 LNCS(PART 2):742\u2013757. https:\/\/doi.org\/10.1007\/978-3-319-10605-2_48\/COVER","journal-title":"Lect Notes Comput Sci (including subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics)"},{"key":"17529_CR15","unstructured":"Shahroudy A, Liu J, Ng T-T, Wang G (n.d.) NTU RGB+D: a large-scale dataset for 3D human activity analysis. In: IEEE conference on computer vision and pattern recognition (CVPR)"},{"key":"17529_CR16","doi-asserted-by":"crossref","unstructured":"Jalal A, Kamal S, Kim D (n.d.) A depth video sensor-based life-logging human activity recognition system for elderly care in smart indoor environments. Sensors 14(7):11735\u201311759","DOI":"10.3390\/s140711735"},{"key":"17529_CR17","unstructured":"Liu J, Shahroudy A, Perez M, Wang G, Duan L-Y, Kot AC (n.d.) NTU RGB+D 120: a large-scale benchmark for 3D human activity understanding. In: IEEE transactions on pattern analysis and machine intelligence (TPAMI)"},{"key":"17529_CR18","unstructured":"Kay W et al (2017) The Kinetics Human Action Video Dataset. [Online]. Available: http:\/\/arxiv.org\/abs\/1705.06950"},{"key":"17529_CR19","unstructured":"Li A, Thotakuri M, Ross DA, Carreira J, Vostrikov A, Zisserman A (2020) The AVA-Kinetics Localized Human Actions Video Dataset, [Online]. Available: http:\/\/arxiv.org\/abs\/2005.00214"},{"key":"17529_CR20","doi-asserted-by":"publisher","first-page":"33","DOI":"10.1007\/s11263-021-01531-2","volume":"130","author":"D Damen","year":"2022","unstructured":"Damen D, Doughty H, Farinella GM et al (2022) Rescaling egocentric vision: collection, pipeline and challenges for EPIC-KITCHENS-100. Int J Comput Vis 130:33\u201355. https:\/\/doi.org\/10.1007\/s11263-021-01531-2","journal-title":"Int J Comput Vis"},{"key":"17529_CR21","unstructured":"Carreira J, Noland E, Banki-Horvath A, Hillier C, Zisserman A (2018) A Short Note about Kinetics-600, [Online]. Available: http:\/\/arxiv.org\/abs\/1808.01340"},{"key":"17529_CR22","unstructured":"Carreira J, Noland E, Hillier C, Zisserman A (2019) A Short Note on the Kinetics-700 Human Action Dataset, [Online]. Available: http:\/\/arxiv.org\/abs\/1907.06987"},{"key":"17529_CR23","unstructured":"Monfort M et al (2018) Moments in Time Dataset: one million videos for event understanding, [Online]. Available: http:\/\/arxiv.org\/abs\/1801.03150"},{"key":"17529_CR24","doi-asserted-by":"crossref","unstructured":"Niebles JC, Wang H, Fei-Fei L (n.d.) Unsupervised learning of human action categories using spatio-temporal words. Int J Comput Vis 79:299\u2013318","DOI":"10.1007\/s11263-007-0122-4"},{"key":"17529_CR25","doi-asserted-by":"crossref","unstructured":"Calderara S, Cucchiara R, Prati A (n.d.) Action signature: a novel holistic representation for action recognition. In: Proc. IEEE 5th international conference on advanced video and signal-based surveillance, pp 121\u2013128","DOI":"10.1109\/AVSS.2008.32"},{"issue":"7","key":"17529_CR26","doi-asserted-by":"publisher","first-page":"1409","DOI":"10.1109\/TPAMI.2011.239","volume":"34","author":"Z Kalal","year":"2012","unstructured":"Kalal Z, Mikolajczyk K, Matas J (2012) Tracking-learning-detection. IEEE Trans Pattern Anal Mach Intell 34(7):1409\u20131422. https:\/\/doi.org\/10.1109\/TPAMI.2011.239","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"17529_CR27","doi-asserted-by":"publisher","unstructured":"Iosifidis A, Tefas A, Pitas I (2012) Neural representation and learning for multi-view human action recognition. In: The 2012 international joint conference on neural networks (IJCNN), Brisbane, pp 1\u20136. https:\/\/doi.org\/10.1109\/IJCNN.2012.6252675","DOI":"10.1109\/IJCNN.2012.6252675"},{"key":"17529_CR28","doi-asserted-by":"publisher","first-page":"76","DOI":"10.1109\/IHMSC.2012.114","volume-title":"2012 4th International Conference on Intelligent Human-Machine Systems and Cybernetics","author":"Y Lu","year":"2012","unstructured":"Lu Y et al (2012) A human action recognition method based on Tchebichef moment invariants and temporal templates. In: 2012 4th International Conference on Intelligent Human-Machine Systems and Cybernetics, 2:76\u201379"},{"key":"17529_CR29","doi-asserted-by":"publisher","first-page":"13","DOI":"10.1109\/TSMCC.2009.2027608","volume-title":"IEEE transactions on systems, man, and cybernetics, Part C (applications and reviews)","author":"X Ji","year":"2010","unstructured":"Ji X, Liu H (2010) Advances in view-invariant human motion analysis: a review. In: IEEE transactions on systems, man, and cybernetics, Part C (applications and reviews), 40(1):13\u201324. https:\/\/doi.org\/10.1109\/TSMCC.2009.2027608"},{"key":"17529_CR30","doi-asserted-by":"publisher","first-page":"59","DOI":"10.1016\/j.neucom.2021.01.036","volume":"439","author":"V Estevam","year":"2021","unstructured":"Estevam V, Pedrini H, Menotti D (2021) Zero-shot action recognition in videos: a survey. Neurocomputing 439:59\u2013175. https:\/\/doi.org\/10.1016\/j.neucom.2021.01.036","journal-title":"Neurocomputing"},{"key":"17529_CR31","doi-asserted-by":"crossref","unstructured":"Pareek P, Thakkar A (n.d.) A survey on video-based human action recognition: recent updates, datasets, challenges, and applications. Artif Intell Rev 54:2259\u20132322","DOI":"10.1007\/s10462-020-09904-8"},{"issue":"107561","key":"17529_CR32","first-page":"31","volume":"108","author":"LM Dang","year":"2020","unstructured":"Dang LM, Min K, Wang H, Piran MJ, Lee CH, Moon HJ (2020) Sensor-based and vision-based human activity recognition: a comprehensive survey. Pattern Recogn 108(107561):31\u20133203","journal-title":"Pattern Recogn"},{"key":"17529_CR33","doi-asserted-by":"publisher","first-page":"30509","DOI":"10.1007\/s11042-020-09004-3","volume":"79","author":"DR Beddiar","year":"2020","unstructured":"Beddiar DR, Nini B, Sabokrou M et al (2020) Vision-based human activity recognition: a survey. Multimed Tools Appl 79:30509\u201330555. https:\/\/doi.org\/10.1007\/s11042-020-09004-3","journal-title":"Multimed Tools Appl"},{"key":"17529_CR34","doi-asserted-by":"publisher","first-page":"1005","DOI":"10.3390\/s19051005","volume":"19","author":"H-B Zhang","year":"2019","unstructured":"Zhang H-B, Zhang Y-X, Zhong B, Lei Q, Yang L, Du J-X, Chen D-S (2019) A comprehensive survey of vision-based human action recognition methods. Sensors 19:1005. https:\/\/doi.org\/10.3390\/s19051005","journal-title":"Sensors"},{"key":"17529_CR35","doi-asserted-by":"publisher","first-page":"4","DOI":"10.1016\/j.imavis.2017.01.010","volume":"60","author":"S Herath","year":"2017","unstructured":"Herath S, Harandi M, Porikli F (2017) Going deeper into action recognition: a survey. Image and Vision Computing 60:4\u201321. https:\/\/doi.org\/10.1016\/j.imavis.2017.01.010","journal-title":"Image and Vision Computing"},{"key":"17529_CR36","doi-asserted-by":"publisher","unstructured":"Singh PK, Kundu S, Adhikary T, Sarkar R, Bhattacharjee D (2021) Progress of Human Action Recognition Research in the Last Ten Years: A Comprehensive Survey. Arch Comput Methods Eng 29:4:2309\u20132349. https:\/\/doi.org\/10.1007\/S11831-021-09681-9","DOI":"10.1007\/S11831-021-09681-9"},{"key":"17529_CR37","doi-asserted-by":"publisher","unstructured":"Jobanputra H, Bavishi J, Doshi N (2019) Human activity recognition: a survey. Procedia Comput Sci 155:698\u2013703. https:\/\/doi.org\/10.1016\/j.procs.2019.08.100","DOI":"10.1016\/j.procs.2019.08.100"},{"key":"17529_CR38","doi-asserted-by":"publisher","first-page":"1366","DOI":"10.1007\/s11263-022-01594-9","volume":"130","author":"Y Kong","year":"2018","unstructured":"Kong Y, Yun Raymond F (2018) Human action recognition and prediction: a survey. Int J Comput Vis 130:1366\u20131401","journal-title":"Int J Comput Vis"},{"key":"17529_CR39","unstructured":"Guangchun C, Yiwen W, Abdullah S, Kamesh N, Bill B (2015) Advances in human action recognition: A survey"},{"key":"17529_CR40","doi-asserted-by":"crossref","unstructured":"Vishwakarma S, Agrawal A (n.d.) A survey on activity recognition and behavior understanding in video surveillance. Vis Comput 29(10):983\u20131009","DOI":"10.1007\/s00371-012-0752-6"},{"key":"17529_CR41","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/1922649.1922653","volume":"43","author":"JK Aggarwal","year":"2011","unstructured":"Aggarwal JK, Ryoo MS (2011) Human activity analysis. ACM Computing Surveys (CSUR) 43:1\u201343","journal-title":"ACM Computing Surveys (CSUR)"},{"key":"17529_CR42","doi-asserted-by":"crossref","unstructured":"Bobick AF, Davis JW (n.d.) The recognition of human movement using temporal templates. IEEE Trans Pattern Anal Mach Intell 23(3):257\u2013267","DOI":"10.1109\/34.910878"},{"key":"17529_CR43","doi-asserted-by":"crossref","unstructured":"Sheikh Y, Sheikh M, Shah M (n.d.) Exploring the space of a human action. In: Tenth IEEE Int Conf on Computer Vision, pp 144\u2013149","DOI":"10.1109\/ICCV.2005.90"},{"key":"17529_CR44","doi-asserted-by":"crossref","unstructured":"Amor BB, Su J, Srivastava A (n.d.) Action recognition using rate-invariant analysis of skeletal shape trajectories. Trans Pattern Anal Mach Intell 38:1\u201313","DOI":"10.1109\/TPAMI.2015.2439257"},{"key":"17529_CR45","unstructured":"Wang H, Kl\u00e4ser A, Schmid C, Liu C (n.d.) Action recognition by dense trajectories. CVPR 3169\u20133176"},{"key":"17529_CR46","doi-asserted-by":"crossref","unstructured":"Laptev I, Lindeberg T (n.d.) Space-time interest points. In: Proc. 9th IEEE Int. Conf. On computer vision, pp 432\u2013439","DOI":"10.1109\/ICCV.2003.1238378"},{"key":"17529_CR47","volume-title":"IEEE international workshop on visual surveillance and performance evaluation of tracking and surveillance","author":"P Dollar","year":"2005","unstructured":"Dollar P, Rabaud V, Cottrell G, Belongie S (2005) Behavior recognition via sparse Spatio-temporal features. In: IEEE international workshop on visual surveillance and performance evaluation of tracking and surveillance"},{"key":"17529_CR48","doi-asserted-by":"publisher","unstructured":"Bregonzio M, Gong S, Xiang T (2009) Recognising action as clouds of space-time interest points. In: 2009 IEEE conference on computer vision and pattern recognition, Miami, pp 1948\u20131955. https:\/\/doi.org\/10.1109\/CVPR.2009.5206779","DOI":"10.1109\/CVPR.2009.5206779"},{"key":"17529_CR49","doi-asserted-by":"crossref","unstructured":"Thi TH, Zhang J, Cheng L, Wang L, Satoh S (n.d.) Human action recognition and localization in video using structured learning of local space-time features. IEEE International Conference on Advanced Video and Signal Based Surveillance, pp 204\u2013211","DOI":"10.1109\/AVSS.2010.76"},{"key":"17529_CR50","unstructured":"Sadek S, Al-Hamadi A, Michaelis B, Sayed U (n.d.) An action recognition scheme using fuzzy log-polar histogram and temporal self-similarity. EURASIP J Adv Signal Process"},{"key":"17529_CR51","unstructured":"Chaudhry R, Ravichandran A, Hager G, Vidal R (n.d.) Histograms of oriented optical flow and Binet-Cauchy kernels on nonlinear dynamical systems for the recognition of human actions. In: IEEE computer Soc. Conf. Computer. Vis. Pattern recognition work. CVPR work. IEEE, pp 1932\u20131939"},{"key":"17529_CR52","doi-asserted-by":"crossref","unstructured":"Yuan C, Li X, Hu W, Ling H, Maybank S (n.d.) 3D R transform on spatio-temporal interest points for action recognition. In: Proceedings of the IEEE computer society conference on computer vision and pattern recognition, pp 724\u2013730","DOI":"10.1109\/CVPR.2013.99"},{"key":"17529_CR53","doi-asserted-by":"crossref","unstructured":"Sahoo SP, Silambarasi R, Ari S (n.d.) Fusion of histogram-based features for human action recognition. In: 5th international conference on advanced computing & communication systems, pp 1012\u20131016","DOI":"10.1109\/ICACCS.2019.8728473"},{"key":"17529_CR54","unstructured":"Gupta S, Mazumdar S, Student M (2013) Sobel edge detection algorithm."},{"key":"17529_CR55","doi-asserted-by":"crossref","unstructured":"Teoh SH, Ibrahim H (n.d) Median filtering frameworks for reducing impulse noise from grayscale digital images: a literature survey. Int J Future Comput Commun 1:323\u2013326","DOI":"10.7763\/IJFCC.2012.V1.87"},{"key":"17529_CR56","unstructured":"Le QV, Zou WY, Yeung SY, Ng AY (n.d.) Learning hierarchical invariant spatio-temporal features for action recognition with independent subspace analysis. In: IEEE conference on computer vision and pattern recognition (CVPR), pp 3361\u20133368"},{"key":"17529_CR57","doi-asserted-by":"crossref","unstructured":"Darrell T, Pentland A (n.d.) Space-time gestures. In: Proc. IEEE computer society Conf. On computer vision and pattern recognition, pp 335\u2013340","DOI":"10.1109\/CVPR.1993.341109"},{"key":"17529_CR58","unstructured":"Jiang H, Drew MS, Li ZN (n.d.) Successive convex matching for action detection. In: IEEE computer society Conf. On computer vision and pattern recognition, pp 1646\u20131653"},{"key":"17529_CR59","doi-asserted-by":"crossref","unstructured":"Oliver NM, Rosario B, Pentland AP (n.d.) A Bayesian computer vision system for modelling human interactions. IEEE Trans Pattern Anal Mach Intell 22(8):831\u2013843","DOI":"10.1109\/34.868684"},{"key":"17529_CR60","doi-asserted-by":"crossref","unstructured":"Shi Q, Cheng L, Wang L, Smola A (n.d.) Human action segmentation and recognition using discriminative semi-Markov models. Int J Comput Vis 93:22\u201332","DOI":"10.1007\/s11263-010-0384-0"},{"key":"17529_CR61","doi-asserted-by":"crossref","unstructured":"Oliver N, Horvitz E, Garg A (n.d) Layered representations for human activity recognition. In: Proc. 4th IEEE Int. Conf. On multimodal interfaces, pp 3\u20138","DOI":"10.1109\/ICMI.2002.1166960"},{"key":"17529_CR62","doi-asserted-by":"crossref","unstructured":"Zhang D, Gatica-Perez D, Bengio S, McCowan I (n.d.) Modelling individual and group actions in meetings with layered hmms. IEEE Trans Multimed 8(3):509\u2013520","DOI":"10.1109\/TMM.2006.870735"},{"key":"17529_CR63","doi-asserted-by":"crossref","unstructured":"Nguyen NT, Phung DQ, Venkatesh S, Bui H (n.d.) Learning and detecting activities from movement trajectories using the hierarchical hidden Markov model, IEEE computer society Conf on computer vision and pattern recognition, pp 955\u2013960","DOI":"10.1109\/CVPR.2005.203"},{"key":"17529_CR64","unstructured":"Shi Y, Huang Y, Minnen D, Bobick A, Essa I (n.d.) Propagation networks for recognition of partially ordered sequential action. In: Proc. of IEEE computer society Conf. On computer vision and pattern recognition, pp 862\u2013869"},{"key":"17529_CR65","doi-asserted-by":"crossref","unstructured":"Iosifidis A, Tefas A, Pitas I (n.d.) Action-based person identification using fuzzy representation and discriminant learning. IEEE Trans Inf Forensics Secur 7:530\u2013542","DOI":"10.1109\/TIFS.2011.2175921"},{"key":"17529_CR66","doi-asserted-by":"crossref","unstructured":"Xu W, Miao Z, Zhang X, Tian Y (n.d.) Learning a hierarchical spatio-temporal model for human activity recognition. In: International conference on acoustics, speech and signal processing (ICASSP). IEEE, New Orleans, pp 1607\u20131611","DOI":"10.1109\/ICASSP.2017.7952428"},{"key":"17529_CR67","doi-asserted-by":"publisher","unstructured":"Kitani KM, Sato Y, Sugimoto A (2007) Recovering the basic structure of human activities from a video-based symbol string. In: 2007 IEEE workshop on motion and video computing (WMVC'07), Austin, p 9. https:\/\/doi.org\/10.1109\/WMVC.2007.34","DOI":"10.1109\/WMVC.2007.34"},{"key":"17529_CR68","doi-asserted-by":"crossref","unstructured":"Ivanov Y, Bobick A (n.d.) Recognition of visual activities and interactions by stochastic parsing. IEEE Trans Pattern Anal Mach Intell 22:852\u2013872","DOI":"10.1109\/34.868686"},{"key":"17529_CR69","unstructured":"Moore D, Essa I (n.d.) Recognizing multitasked activities from video using stochastic context-free grammar. AAAI National Conference on Artificial Intelligence, pp 770\u2013776"},{"key":"17529_CR70","doi-asserted-by":"crossref","unstructured":"Minnen D, Essa I, Starner T (n.d.) Expectation grammars: leveraging high-level expectations for activity recognition. In: IEEE conference on computer vision and pattern recognition (CVPR), pp 626\u2013632","DOI":"10.1109\/CVPR.2003.1211525"},{"key":"17529_CR71","unstructured":"Joo SW, Chellappa R (n.d.) Attribute grammar-based event recognition and anomaly detection. IEEE Conference on Computer Vision and Pattern Recognition Workshop, pp 107\u2013114"},{"key":"17529_CR72","doi-asserted-by":"crossref","unstructured":"Siskind JM (n.d.) Grounding the lexical semantics of verbs in visual perception using force dynamics and event logic. J Artif Intell Res 15:31\u201390","DOI":"10.1613\/jair.790"},{"key":"17529_CR73","unstructured":"Gupta A, Srinivasan P, Shi J, Davis L (n.d.) Understanding videos, constructing plots learning a visually grounded storyline model from annotated videos. In: IEEE conference on computer vision and pattern recognition (CVPR), pp 2012\u20132019"},{"key":"17529_CR74","doi-asserted-by":"crossref","unstructured":"Ijsselmuiden J, Stiefelhagen R (n.d.) Towards high-level human activity recognition through computer vision and temporal logic. In: The 33rd annual German conference on advances in artificial intelligence, pp 426\u2013435","DOI":"10.1007\/978-3-642-16111-7_49"},{"issue":"24","key":"17529_CR75","doi-asserted-by":"publisher","first-page":"34863","DOI":"10.1007\/S11042-021-11828-6\/FIGURES\/10","volume":"81","author":"M Khare","year":"2022","unstructured":"Khare M, Jeon M (2022) Multi-resolution approach to human activity recognition in video sequence based on combination of complex wavelet transform, Local Binary Pattern and Zernike moment. Multimed Tools Appl 81(24):34863\u201334892. https:\/\/doi.org\/10.1007\/S11042-021-11828-6\/FIGURES\/10","journal-title":"Multimed Tools Appl"},{"issue":"21\u201323","key":"17529_CR76","doi-asserted-by":"publisher","first-page":"32111","DOI":"10.1007\/S11042-021-11193-4\/TABLES\/8","volume":"80","author":"C Li","year":"2021","unstructured":"Li C, Huang Q, Li X, Wu Q (2021) Human action recognition based on multi-scale feature maps from depth video sequences. Multimed Tools Appl 80(21\u201323):32111\u201332130. https:\/\/doi.org\/10.1007\/S11042-021-11193-4\/TABLES\/8","journal-title":"Multimed Tools Appl"},{"key":"17529_CR77","doi-asserted-by":"publisher","unstructured":"Ikizler N, Duygulu PD (n.d.) Histogram of oriented rectangles: a new pose descriptor for human action recognition. Image Vis Comput 27(10):1515\u20131526. https:\/\/doi.org\/10.1016\/j.imavis.2009.02.002","DOI":"10.1016\/j.imavis.2009.02.002"},{"key":"17529_CR78","doi-asserted-by":"crossref","unstructured":"Kellokumpu V, Zhao G, Pietik\u00e4inen M (n.d.) Recognition of human actions using texture descriptors. Mach Vis Appl 22:767\u2013780","DOI":"10.1007\/s00138-009-0233-8"},{"key":"17529_CR79","doi-asserted-by":"crossref","unstructured":"Kliper-Gross O, Gurovich Y, Hassner T, Wolf L (n.d.) Motion interchange patterns for action recognition in unconstrained videos. In: European conference on computer vision. Springer, Berlin\/Heidelberg, pp 256\u2013269","DOI":"10.1007\/978-3-642-33783-3_19"},{"key":"17529_CR80","doi-asserted-by":"crossref","unstructured":"Jiang YG, Dai Q, Xue X, Liu W, Ngo CW (n.d.) Trajectory-based modeling of human actions with motion reference points. In: European conference on computer vision. Springer, Berlin\/Heidelberg, pp 425\u2013438","DOI":"10.1007\/978-3-642-33715-4_31"},{"key":"17529_CR81","unstructured":"Wang C, Wang Y, Yuille AL (n.d.) An approach to pose-based action recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition. Portland, OR, USA, pp 915\u2013922"},{"key":"17529_CR82","doi-asserted-by":"crossref","unstructured":"Zanfir M, Leordeanu M, Sminchisescu C (n.d.) The moving pose: an efficient 3d kinematics descriptor for low-latency action recognition and detection. In: Proceedings of the IEEE international conference on computer vision. Sydney, Australia, pp 2752\u20132759","DOI":"10.1109\/ICCV.2013.342"},{"key":"17529_CR83","doi-asserted-by":"crossref","unstructured":"Chaaraoui AA, Climent-P\u00e9rez P, Fl\u00f3rez-Revuelta F (n.d.) Silhouette-based human action recognition using sequences of key poses. Pattern Recogn Lett 34:1799\u20131807","DOI":"10.1016\/j.patrec.2013.01.021"},{"key":"17529_CR84","doi-asserted-by":"crossref","unstructured":"Rahman SA, Song I, Leung MK, Lee I, Lee K (n.d.) Fast action recognition using negative space features. Expert Syst Appl 41:574\u2013587","DOI":"10.1016\/j.eswa.2013.07.082"},{"key":"17529_CR85","doi-asserted-by":"crossref","unstructured":"Junejo IN, Junejo KN, Al Aghbari Z (n.d) Silhouette-based human action recognition using SAX-shapes. Vis Comput 30:259\u2013269","DOI":"10.1007\/s00371-013-0842-0"},{"key":"17529_CR86","doi-asserted-by":"crossref","unstructured":"Vishwakarma DK, Kapoor R, Dhiman A (n.d.) A proposed unified framework for the recognition of human activity by exploiting the characteristics of action dynamics. Robot Auton Syst 77:25\u201338","DOI":"10.1016\/j.robot.2015.11.013"},{"key":"17529_CR87","doi-asserted-by":"crossref","unstructured":"Jalal A, Kim YH, Kim YJ, Kamal S, Kim D (n.d.) Robust human activity recognition from depth video using spatiotemporal multi-fused features. Pattern Recogn 61:295\u2013308","DOI":"10.1016\/j.patcog.2016.08.003"},{"key":"17529_CR88","doi-asserted-by":"crossref","unstructured":"Patrona F, Chatzitofis A, Zarpalas D, Daras P (2018) Motion analysis: action detection, recognition and evaluation based on motion capture data. Pattern Recogn 76:612\u2013622","DOI":"10.1016\/j.patcog.2017.12.007"},{"key":"17529_CR89","doi-asserted-by":"publisher","first-page":"12771","DOI":"10.1007\/s10489-021-03068-w","volume":"52","author":"C Zhang","year":"2022","unstructured":"Zhang C, Xu Y, Xu Z et al (2022) Hybrid handcrafted and learned feature framework for human action recognition. Appl Intell 52:12771\u201312787. https:\/\/doi.org\/10.1007\/s10489-021-03068-w","journal-title":"Appl Intell"},{"key":"17529_CR90","doi-asserted-by":"crossref","unstructured":"Bengio Y (n.d) Learning deep architectures for AI. Found Trends Mach Learn 2:1\u2013127","DOI":"10.1561\/2200000006"},{"key":"17529_CR91","doi-asserted-by":"crossref","unstructured":"Ji S, Xu W, Yang M, Yu K (n.d.) 3D convolutional neural networks for human action recognition. IEEE Trans Pattern Anal Mach Intell 35(1):221\u2013231","DOI":"10.1109\/TPAMI.2012.59"},{"key":"17529_CR92","doi-asserted-by":"crossref","unstructured":"Weimer D, Scholz-Reiter B, Shpitalni M (n.d.) Design of deep convolutional neural network architectures for automated feature extraction in industrial inspection. CIRP Ann Manuf Technol 65(1):417\u2013420","DOI":"10.1016\/j.cirp.2016.04.072"},{"key":"17529_CR93","doi-asserted-by":"crossref","unstructured":"Le QV (n.d.) Building high-level features using large scale unsupervised learning. In: 2013 IEEE Int. Conf. On acoustics, speech and signal processing (ICASSP)","DOI":"10.1109\/ICASSP.2013.6639343"},{"key":"17529_CR94","unstructured":"Huang Y, Lai S-H, Tai S-H (n.d.) Human action recognition based on temporal pose CNN and multidimensional fusion. In: Proceedings of the European conference on computer vision (ECCV)"},{"issue":"5","key":"17529_CR95","doi-asserted-by":"publisher","first-page":"851","DOI":"10.1093\/bib\/bbw068","volume":"18","author":"S Min","year":"2017","unstructured":"Min S, Lee B, Yoon S (2017) Deep learning in bioinformatics. Brief Bioinform 18(5):851\u2013869. https:\/\/doi.org\/10.1093\/bib\/bbw068","journal-title":"Brief Bioinform"},{"key":"17529_CR96","unstructured":"Krizhevsky A, Sutskever I, Hinton GE (n.d.) Imagenet classification with deep convolutional neural networks. In: Advances in neural information processing systems, Lake Tahoe, Nevada, pp 1097\u20131105"},{"key":"17529_CR97","unstructured":"Karpathy A, Toderici G, Shetty S, Leung T, Sukthankar R, Li FF (n.d.) Large-scale video classification with convolutional neural networks, Proc. IEEE Comput. Soc. Conf. Comput. Vis. Pattern Recognit, pp 1725\u20131732"},{"key":"17529_CR98","doi-asserted-by":"crossref","unstructured":"Ravi D, Wong C, Lo B, Yang GZ (n.d.) Deep learning for human action recognition: a resource efficient implementation on low-power devices. In: BSN 2016\u201413th annual body sensor networks conference, pp 71\u201376","DOI":"10.1109\/BSN.2016.7516235"},{"key":"17529_CR99","unstructured":"Marjaneh S, Hassan F (2017) Single image action recognition by predicting space-time saliency"},{"key":"17529_CR100","doi-asserted-by":"crossref","unstructured":"Banerjee A, Singh PK, Sarkar R (n.d.) Fuzzy integral based CNN classifier fusion for 3D skeleton action recognition. IEEE Trans Circ Syst Video Technol 31(6):2206\u20132216","DOI":"10.1109\/TCSVT.2020.3019293"},{"key":"17529_CR101","unstructured":"Ng A (n.d.) Sparse autoencoder. CS294A Lect Note 72:1\u201319"},{"key":"17529_CR102","unstructured":"Vincent P, Larochelle H, Lajoie I, Bengio Y, Manzagol P-A (n.d.) Stacked denoising autoencoders: learning useful representations in a deep network with a local denoising criterion. J Mach Learn Res 11:3371\u20133408"},{"key":"17529_CR103","doi-asserted-by":"crossref","unstructured":"Hasan M, Roy-Chowdhury AK (n.d.) A continuous learning framework for activity recognition using deep hybrid feature models. IEEE Trans Multimed 17:11","DOI":"10.1109\/TMM.2015.2477242"},{"key":"17529_CR104","doi-asserted-by":"crossref","unstructured":"Wang X, Gao L, Song J, Zhen X, Sebe N, Shen HT (n.d.) Deep appearance and motion learning for egocentric activity recognition. Neurocomputing 275:438\u2013447","DOI":"10.1016\/j.neucom.2017.08.063"},{"issue":"4","key":"17529_CR105","doi-asserted-by":"publisher","first-page":"947","DOI":"10.3390\/s19040947","volume":"19","author":"X Gao","year":"2019","unstructured":"Gao X, Luo H, Wang Q, Zhao F, Ye L, Zhang Y (2019) A human activity recognition algorithm based on stacking Denoising autoencoder and LightGBM. Sensors. 19(4):947. https:\/\/doi.org\/10.3390\/s19040947","journal-title":"Sensors."},{"key":"17529_CR106","unstructured":"Du Y, Wang W, Wang L (n.d.) Hierarchical recurrent neural network for skeleton-based action recognition. Proceedings of the IEEE computer society conference on computer vision and pattern recognition, pp 1110\u20131118"},{"key":"17529_CR107","unstructured":"Graves A (n.d.) Generating sequences with recurrent neural networks."},{"key":"17529_CR108","unstructured":"Salehinejad H, Sankar S, Barfett J, Colak E, Valaee S (n.d.) Recent advances in recurrent neural networks."},{"key":"17529_CR109","doi-asserted-by":"crossref","unstructured":"Qi M, Wang Y, Qin J, Li A, Luo J, Gool L (n.d.) stagNet: an attentive semantic RNN for group action and individual action recognition. IEEE Trans Circ Syst Video Technol 30:1","DOI":"10.1109\/TCSVT.2019.2894161"},{"key":"17529_CR110","doi-asserted-by":"crossref","unstructured":"Liu J, Shahroudy A, Xu D, Wang G (n.d.) Spatio-temporal LSTM with trust gates for 3D human action recognition. In: Lecture notes in computer science (including subseries lecture notes in artificial intelligence and lecture notes in bioinformatics), vol 9907. LNCS, pp 816\u2013833","DOI":"10.1007\/978-3-319-46487-9_50"},{"key":"17529_CR111","doi-asserted-by":"crossref","unstructured":"Cho K et al (2014) Learning phrase representations using RNN encoder-decoder for statistical machine translation. In: Proceedings of the 2014 conference on empirical methods in natural language processing, pp 1724\u20131734","DOI":"10.3115\/v1\/D14-1179"},{"key":"17529_CR112","unstructured":"Goodfellow I et al (n.d.) Generative adversarial nets. In: Advances in Neural Information Processing Systems, pp 2672\u20132680"},{"key":"17529_CR113","doi-asserted-by":"crossref","unstructured":"Huang GB, Lee H, Learned-Miller E (n.d.) Learning hierarchical representations for face verifcation with convolutional deep belief networks. In: Proceedings of the IEEE conference on computer vision and pattern recognition (CVPR\u2019 12), pp 2518\u20132525","DOI":"10.1109\/CVPR.2012.6247968"},{"key":"17529_CR114","unstructured":"Radford A, Metz L, Chintala S (n.d.) Unsupervised representation learning with deep convolutional generative adversarial networks."},{"key":"17529_CR115","unstructured":"Zadeh MZ, Babu AR, Jaiswal A, Makedon F (n.d.) Self-supervised human activity recognition by augmenting generative adversarial networks, p 11755"},{"key":"17529_CR116","unstructured":"Li R, Pan J, Li Z, Tang J (n.d.) Single image Dehazing via conditional generative adversarial network."},{"key":"17529_CR117","doi-asserted-by":"crossref","unstructured":"Yang Y, Hou C, Lang Y, Guan D, Huang D, Xu J (n.d.) Open-set human activity recognition based on micro-Doppler signatures. Pattern Recogn 85:60\u201369","DOI":"10.1016\/j.patcog.2018.07.030"},{"key":"17529_CR118","doi-asserted-by":"publisher","unstructured":"Gammulle H, Denman S, Sridharan S, Fookes C (2019) Multi-level sequence GAN for group activity recognition. In: Jawahar C, Li H, Mori G, Schindler K (eds) Computer vision \u2013 ACCV 2018. Lecture notes in computer science(), vol 11361. Springer, Cham. https:\/\/doi.org\/10.1007\/978-3-030-20887-5_21","DOI":"10.1007\/978-3-030-20887-5_21"},{"key":"17529_CR119","unstructured":"Ahsan U, Sun C, Essa I (n.d.) DiscrimNet: semi-supervised action recognition from videos using generative adversarial networks. In: Proceedings of the IEEE conference on computer vision and pattern recognition workshops. Women in computer vision (WiCV\u201917)"},{"key":"17529_CR120","unstructured":"Donahue J et al (n.d.) Long-term recurrent convolutional networks for visual recognition and description. CVPR"},{"key":"17529_CR121","unstructured":"Kar A, Rai N, Sikka K, Sharma G (n.d.) Adascan: adaptive scan pooling in deep convolutional neural networks for human action recognition in videos. CVPR"},{"key":"17529_CR122","doi-asserted-by":"crossref","unstructured":"Jaouedi N, Boujnah N, Bouhlel MS (n.d.) A new hybrid deep learning model for human action recognition. J King Saud Univ - Comput Inf Sci 32","DOI":"10.1016\/j.jksuci.2019.09.004"},{"key":"17529_CR123","doi-asserted-by":"publisher","first-page":"1589","DOI":"10.1109\/CVPRW.2017.203","volume-title":"IEEE computer society conference on computer vision and pattern recognition workshops","author":"SN Gowda","year":"2017","unstructured":"Gowda SN (2017) Human activity recognition using combinatorial deep belief networks. In: IEEE computer society conference on computer vision and pattern recognition workshops, pp 1589\u20131594. https:\/\/doi.org\/10.1109\/CVPRW.2017.203"},{"key":"17529_CR124","doi-asserted-by":"publisher","first-page":"461","DOI":"10.1145\/2733373.2806222","volume-title":"Proceedings of the 23rd ACM international conference on multimedia (MM '15)","author":"Z Wu","year":"2015","unstructured":"Wu Z, Wang X, Jiang Y-G, Ye H, Xue X (2015) Modeling spatial-temporal clues in a hybrid deep learning framework for video classification. In: Proceedings of the 23rd ACM international conference on multimedia (MM '15). Association for Computing Machinery, New York, pp 461\u2013470. https:\/\/doi.org\/10.1145\/2733373.2806222"},{"key":"17529_CR125","doi-asserted-by":"crossref","unstructured":"Lv M, Xu W, Chen T (n.d.) A hybrid deep convolutional and recurrent neural network for complex activity recognition using multimodal sensors. Neurocomputing 362","DOI":"10.1016\/j.neucom.2019.06.051"},{"key":"17529_CR126","doi-asserted-by":"crossref","unstructured":"Ijjina EP, Mohan CK (n.d.) Hybrid deep neural network model for human action recognition. Appl. Soft Comput 46:936\u2013952","DOI":"10.1016\/j.asoc.2015.08.025"},{"key":"17529_CR127","doi-asserted-by":"crossref","unstructured":"Al-Azzawi NA (n.d.) Human action recognition based on hybrid deep learning model and Shearlet transform. In: 2020 12th international conference on information technology and electrical engineering (ICITEE, Yogyakarta), pp 152\u2013155","DOI":"10.1109\/ICITEE49829.2020.9271687"},{"issue":"2","key":"17529_CR128","doi-asserted-by":"publisher","first-page":"877","DOI":"10.1007\/S00500-021-06238-7\/FIGURES\/11","volume":"26","author":"SK Yadav","year":"2022","unstructured":"Yadav SK, Tiwari K, Pandey HM, Akbar SA (2022) Skeleton-based human activity recognition using ConvLSTM and guided feature learning. Soft comput 26(2):877\u2013890. https:\/\/doi.org\/10.1007\/S00500-021-06238-7\/FIGURES\/11","journal-title":"Soft comput"},{"key":"17529_CR129","doi-asserted-by":"crossref","unstructured":"Wensel J, Ullah H, Member S, Munir A, Member S (2022) ViT-ReT: Vision and Recurrent Transformer Neural Networks for Human Activity Recognition in Videos. Accessed: May 11, 2023. [Online]. Available: https:\/\/arxiv.org\/abs\/2208.07929v2","DOI":"10.1109\/ACCESS.2023.3293813"},{"issue":"12","key":"17529_CR130","doi-asserted-by":"publisher","first-page":"4095","DOI":"10.1007\/S00371-021-02283-3\/TABLES\/7","volume":"38","author":"SK Challa","year":"2022","unstructured":"Challa SK, Kumar A, Semwal VB (2022) A multibranch CNN-BiLSTM model for human activity recognition using wearable sensor data. Vis Comput 38(12):4095\u20134109. https:\/\/doi.org\/10.1007\/S00371-021-02283-3\/TABLES\/7","journal-title":"Vis Comput"},{"key":"17529_CR131","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1109\/ICASSP49357.2023.10096404","volume-title":"ICASSP 2023\u20132023 IEEE international conference on acoustics, speech and signal processing (ICASSP)","author":"N Jiang","year":"2023","unstructured":"Jiang N, Quan W, Geng Q, Shi Z, Xu P (2023) Exploiting 3D human recovery for action recognition with Spatio-temporal bifurcation fusion. In: ICASSP 2023\u20132023 IEEE international conference on acoustics, speech and signal processing (ICASSP), pp 1\u20135. https:\/\/doi.org\/10.1109\/ICASSP49357.2023.10096404"},{"key":"17529_CR132","doi-asserted-by":"crossref","unstructured":"Merlo E, Lagomarsino M, Lamon E, Ajoudani A (2023) Automatic Interaction and Activity Recognition from Videos of Human Manual Demonstrations with Application to Anomaly Detection. Accessed: May 12, 2023. [Online]. Available: http:\/\/arxiv.org\/abs\/2304.09789","DOI":"10.1109\/RO-MAN57019.2023.10309311"},{"key":"17529_CR133","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/S11042-023-15024-6","volume":"2023","author":"A Usmani","year":"2023","unstructured":"Usmani A, Siddiqui N, Islam S (2023) Skeleton joint trajectories based human activity recognition using deep RNN. Multimed Tools Applic 2023:1\u201325. https:\/\/doi.org\/10.1007\/S11042-023-15024-6","journal-title":"Multimed Tools Applic"},{"key":"17529_CR134","doi-asserted-by":"publisher","first-page":"120080","DOI":"10.1016\/J.ESWA.2023.120080","volume":"226","author":"M Yin","year":"2023","unstructured":"Yin M, He S, Soomro TA, Yuan H (2023) Efficient skeleton-based action recognition via multi-stream depthwise separable convolutional neural network. Expert Syst Appl 226:120080. https:\/\/doi.org\/10.1016\/J.ESWA.2023.120080","journal-title":"Expert Syst Appl"},{"key":"17529_CR135","doi-asserted-by":"publisher","first-page":"103371","DOI":"10.1016\/J.JVCIR.2021.103371","volume":"82","author":"A Barkoky","year":"2022","unstructured":"Barkoky A, Charkari NM (2022) Complex Network-based features extraction in RGB-D human action recognition. J Vis Commun Image Represent 82:103371. https:\/\/doi.org\/10.1016\/J.JVCIR.2021.103371","journal-title":"J Vis Commun Image Represent"},{"key":"17529_CR136","doi-asserted-by":"crossref","unstructured":"Deng L (n.d.) A tutorial survey of architectures, algorithms, and applications for deep learning. APSIPA Trans Signal Inf Process 3:2","DOI":"10.1017\/atsip.2013.9"},{"key":"17529_CR137","doi-asserted-by":"crossref","unstructured":"Dosovitskiy A, Fischer P, Springenberg JT (n.d.) Discriminative unsupervised feature learning with exemplar convolutional neural networks. IEEE Trans Pattern Anal Mach Intell 38(9):1734\u20131747","DOI":"10.1109\/TPAMI.2015.2496141"},{"key":"17529_CR138","doi-asserted-by":"crossref","unstructured":"N\u00fa\u00f1ez JC, Cabido R, Pantrigo JJ, Montemayor AS, V\u00e9lez JF (2018) Convolutional neural networks and long short-term memory for skeleton-based human activity and hand gesture recognition. Pattern Recogn 76","DOI":"10.1016\/j.patcog.2017.10.033"},{"key":"17529_CR139","doi-asserted-by":"crossref","unstructured":"Dobhal T, Shitole V, Thomas G, Navada G (n.d.) Human activity recognition using binary motion image and deep learning. Procedia Comput Sci 58:178\u2013185","DOI":"10.1016\/j.procs.2015.08.050"},{"key":"17529_CR140","doi-asserted-by":"crossref","unstructured":"Khelalef A, Ababsa F, Benoudjit N (2019) An efficient human activity recognition technique based on deep learning. Pattern Recognit Image Anal 29:702\u2013715","DOI":"10.1134\/S1054661819040084"},{"key":"17529_CR141","unstructured":"Si C, Chen W, Wang W, Wang L, Tan T (n.d.) An attention enhanced graph convolutional LSTM network for skeleton-based action recognition, Proceedings of the IEEE conference on computer vision and pattern recognition, pp 1227\u20131236"},{"key":"17529_CR142","doi-asserted-by":"publisher","first-page":"224","DOI":"10.1016\/j.neucom.2018.10.095","volume":"396","author":"M Majd","year":"2020","unstructured":"Majd M, Safabakhsh R (2020) Correlational convolutional LSTM for human action recognition. Neurocomputing 396:224\u2013229. https:\/\/doi.org\/10.1016\/j.neucom.2018.10.095","journal-title":"Neurocomputing"},{"key":"17529_CR143","unstructured":"Dai C, Liu X, Lai J (n.d.) Human action recognition using two-stream attention-based LSTM networks. Appl Soft Comput"},{"key":"17529_CR144","unstructured":"Simonyan K, Zisserman A (n.d.) Two-stream convolutional networks for action recognition in videos. In: Advances in neural information processing systems, pp. 568\u2013576"},{"key":"17529_CR145","doi-asserted-by":"crossref","unstructured":"Ullah A, Muhammad K, Ser JD, Baik SW, Albuquerque VHC (n.d.) Activity Recognition Using Temporal Optical Flow Convolutional Features and Multilayer LSTM. IEEE Trans Ind Electr 66(12):9692\u20139702","DOI":"10.1109\/TIE.2018.2881943"},{"key":"17529_CR146","doi-asserted-by":"crossref","unstructured":"Hinton GE, Osindero S, Teh Y-W (n.d.) A fast-learning algorithm for deep belief nets. Neural Comput 18:1527\u20131554","DOI":"10.1162\/neco.2006.18.7.1527"},{"key":"17529_CR147","doi-asserted-by":"crossref","unstructured":"Uddin MZ (n.d.) Facial expression recognition utilizing local direction-based robust features and deep belief network. IEEE Access 5:4525\u20134536","DOI":"10.1109\/ACCESS.2017.2676238"},{"key":"17529_CR148","unstructured":"Sheeba PT, SSM, Rani SD (n.d.) Fuzzy Based Deep Belief Network for Activity Recognition. In: Proceedings of International Conference on Recent Trends in Computing, Communication & Networking Technologies (ICRTCCNT)"},{"key":"17529_CR149","doi-asserted-by":"crossref","unstructured":"Lee H, Grosse R, Ranganath R, Ng AY (n.d.) Unsupervised learning of hierarchical representations with convolutional deep belief networks. Commun ACM 54(10):95\u2013103","DOI":"10.1145\/2001269.2001295"},{"key":"17529_CR150","doi-asserted-by":"crossref","unstructured":"Li X et al (n.d.) Region-based Activity Recognition Using Conditional GAN. In: Proceedings of the 25th ACM international conference on Multimedia Association for Computing Machinery, New York, NY, USA, pp. 1059\u20131067","DOI":"10.1145\/3123266.3123365"},{"key":"17529_CR151","unstructured":"Savadi Hosseini M, Ghaderi F (n.d.) A Hybrid Deep Learning Architecture Using 3D CNNs and GRUs for Human Action Recognition. Int J Eng 33(5):959\u2013965"},{"key":"17529_CR152","unstructured":"Wang L, Qiao Y (n.d.) Tang X Action recognition with trajectory-pooled deep-convolutional descriptors. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp. 4305\u20134314"},{"key":"17529_CR153","doi-asserted-by":"crossref","unstructured":"Ullah A, Muhammad K, Haq IU (n.d.) Baik SW Action recognition using optimized deep Autoencoder and CNN for surveillance data streams of non-stationary environments. Future Gener Comput 96:386\u2013397","DOI":"10.1016\/j.future.2019.01.029"},{"key":"17529_CR154","doi-asserted-by":"crossref","unstructured":"Shi Y, Tian Y, Wang Y, Huang T (n.d.) Sequential deep trajectory descriptor for action recognition with three-stream cnn. IEEE Trans Multimed 19(7):1510\u20131520","DOI":"10.1109\/TMM.2017.2666540"},{"key":"17529_CR155","doi-asserted-by":"crossref","unstructured":"Liu M, Liu H, Chen C (n.d.) Enhanced skeleton visualization for view invariant human action recognition. Pattern Recognit 68:346\u2013362","DOI":"10.1016\/j.patcog.2017.02.030"},{"key":"17529_CR156","unstructured":"Li C, Wang P, Wang S, Hou Y, Li W (n.d.) Skeleton-based action recognition using LSTM and CNN. In: IEEE international conference on multimedia and expo workshops (ICMEW). IEEE, pp. 585\u2013590"},{"key":"17529_CR157","doi-asserted-by":"crossref","unstructured":"Das S, Chaudhary A, Bremond F, Thonnat M (n.d.) Where to focus on for human action recognition? In: IEEE winter conference on applications of computer vision (WACV). IEEE, pp. 71\u201380","DOI":"10.1109\/WACV.2019.00015"},{"key":"17529_CR158","doi-asserted-by":"crossref","unstructured":"Ijjina EP, Chalavadi KM (n.d.) Human action recognition in RGB-D videos using motion sequence information and deep learning. Recognition 72:pp. 31\u20133203, 504\u2013516","DOI":"10.1016\/j.patcog.2017.07.013"},{"key":"17529_CR159","doi-asserted-by":"crossref","unstructured":"Verma P, Sah A, Srivastava R (n.d.) Deep learning-based multi-modal approach using RGB and skeleton sequences for human activity recognition. Multimed Syst 26:671\u2013685","DOI":"10.1007\/s00530-020-00677-2"},{"key":"17529_CR160","doi-asserted-by":"crossref","unstructured":"Tanberk S, Kilimci ZH, T\u00fckel DB, Uysal M, Akyoku\u015f S (n.d.) A Hybrid Deep Model Using Deep Learning and Dense Optical Flow Approaches for Human Activity Recognition. IEEE Access 8:19799\u201319809","DOI":"10.1109\/ACCESS.2020.2968529"},{"key":"17529_CR161","doi-asserted-by":"crossref","unstructured":"Singh T, Vishwakarma DK (n.d.) A deeply coupled ConvNet for human activity recognition using dynamic and RGB images. Neural Comput Applic 33:469\u2013485","DOI":"10.1007\/s00521-020-05018-y"},{"key":"17529_CR162","doi-asserted-by":"crossref","unstructured":"Mukherjee D, Mondal R, Singh PK (n.d.) EnsemConvNet: a deep learning approach for human activity recognition using smartphone sensors for healthcare applications. Multimed Tools Appl 79:31663\u201331690","DOI":"10.1007\/s11042-020-09537-7"},{"issue":"6","key":"17529_CR163","doi-asserted-by":"publisher","first-page":"2675","DOI":"10.3390\/app11062675","volume":"11","author":"N Tasnim","year":"2021","unstructured":"Tasnim N, Islam MK, Baek J-H (2021) Deep Learning Based Human Activity Recognition Using Spatio-Temporal Image Formation of Skeleton Joints. Appl Sci 11(6):2675","journal-title":"Appl Sci"},{"key":"17529_CR164","doi-asserted-by":"crossref","unstructured":"Bilal M, Maqsood M, Yasmin S (n.d.) A transfer learning-based efficient spatiotemporal human action recognition framework for long and overlapping action classes. J Supercomput 78:2873\u20132908","DOI":"10.1007\/s11227-021-03957-4"},{"key":"17529_CR165","doi-asserted-by":"crossref","unstructured":"Muhammad K et al (n.d.) Human action recognition using attention-based LSTM network with dilated CNN features. Future Gener Comput Syst 125:820\u2013830, pp. 167\u2013739","DOI":"10.1016\/j.future.2021.06.045"},{"key":"17529_CR166","doi-asserted-by":"crossref","unstructured":"Andrade-Ambriz YA, Ledesma S, Ibarra-Manzano M-A, Oros-Flores MI, Almanza-Ojeda D-L (2022) Human activity recognition using temporal convolutional neural network architecture. Expert Syst Appl 191:116287","DOI":"10.1016\/j.eswa.2021.116287"},{"key":"17529_CR167","doi-asserted-by":"publisher","first-page":"107102","DOI":"10.1016\/J.ASOC.2021.107102","volume":"103","author":"A Ullah","year":"2021","unstructured":"Ullah A, Muhammad K, Ding W, Palade V, Haq IU, Baik SW (2021) Efficient activity recognition using lightweight CNN and DS-GRU network for surveillance applications. Appl Soft Comput 103:107102. https:\/\/doi.org\/10.1016\/J.ASOC.2021.107102","journal-title":"Appl Soft Comput"},{"key":"17529_CR168","doi-asserted-by":"publisher","first-page":"107948","DOI":"10.1016\/J.KNOSYS.2021.107948","volume":"239","author":"SK Yadav","year":"2022","unstructured":"Yadav SK, Luthra A, Tiwari K, Pandey HM, Akbar SA (2022) ARFDNet: An efficient activity recognition & fall detection system using latent feature pooling. Knowl Based Syst 239:107948. https:\/\/doi.org\/10.1016\/J.KNOSYS.2021.107948","journal-title":"Knowl Based Syst"},{"key":"17529_CR169","doi-asserted-by":"publisher","unstructured":"Basak H, Kundu R, Singh PK, Ijaz MF, Wo\u017aniak M, Sarkar R (2022) A union of deep learning and swarm-based optimization for 3D human action recognition. Sci Rep 12(1). https:\/\/doi.org\/10.1038\/s41598-022-09293-8","DOI":"10.1038\/s41598-022-09293-8"},{"key":"17529_CR170","doi-asserted-by":"crossref","unstructured":"Putra PU, Shima K, Shimatani K (n.d.) A deep neural network model for multi-view human activity recognition. PLoS One 17(1):262181","DOI":"10.1371\/journal.pone.0262181"},{"issue":"17","key":"17529_CR171","doi-asserted-by":"publisher","first-page":"24119","DOI":"10.1007\/S11042-022-12091-Z\/TABLES\/7","volume":"81","author":"A S\u00e1nchez-Caballero","year":"2022","unstructured":"S\u00e1nchez-Caballero A et al (2022) 3DFCNN: real-time action recognition using 3D deep neural networks with raw depth information. Multimed Tools Appl 81(17):24119\u201324143. https:\/\/doi.org\/10.1007\/S11042-022-12091-Z\/TABLES\/7","journal-title":"Multimed Tools Appl"},{"key":"17529_CR172","doi-asserted-by":"publisher","first-page":"120311","DOI":"10.1016\/J.ESWA.2023.120311","volume":"227","author":"IM Nasir","year":"2023","unstructured":"Nasir IM, Raza M, Ulyah SM, Shah JH, Fitriyani NL, Syafrudin M (2023) ENGA: Elastic Net-Based Genetic Algorithm for human action recognition. Expert Syst Appl 227:120311. https:\/\/doi.org\/10.1016\/J.ESWA.2023.120311","journal-title":"Expert Syst Appl"},{"key":"17529_CR173","doi-asserted-by":"publisher","first-page":"109428","DOI":"10.1016\/J.PATCOG.2023.109428","volume":"139","author":"B Nikpour","year":"2023","unstructured":"Nikpour B, Armanfard N (2023) Spatio-temporal hard attention learning for skeleton-based activity recognition. Pattern Recognit 139:109428. https:\/\/doi.org\/10.1016\/J.PATCOG.2023.109428","journal-title":"Pattern Recognit"},{"key":"17529_CR174","doi-asserted-by":"crossref","unstructured":"Al-Faris M, Chiverton J, Ndzi D, Ahmed AI (n.d.) A Review on Computer Vision-Based Methods for Human Action Recognition. J Imaging 10;6(6):46","DOI":"10.3390\/jimaging6060046"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-023-17529-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11042-023-17529-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-023-17529-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,11,1]],"date-time":"2024-11-01T21:21:23Z","timestamp":1730496083000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11042-023-17529-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,11,11]]},"references-count":174,"journal-issue":{"issue":"17","published-online":{"date-parts":[[2024,5]]}},"alternative-id":["17529"],"URL":"https:\/\/doi.org\/10.1007\/s11042-023-17529-6","relation":{},"ISSN":["1573-7721"],"issn-type":[{"value":"1573-7721","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,11,11]]},"assertion":[{"value":"10 October 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"29 May 2023","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"15 October 2023","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"11 November 2023","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"N.A.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethics approval"}},{"value":"N.A.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Consent to participate"}},{"value":"NA.","order":4,"name":"Ethics","group":{"name":"EthicsHeading","label":"Consent for publication"}},{"value":"Authors declare that they have no\u00a0conflict of interest.","order":5,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflicts of interest\/Competing interests"}}]}}