{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,4]],"date-time":"2026-04-04T06:59:58Z","timestamp":1775285998711,"version":"3.50.1"},"reference-count":77,"publisher":"Springer Science and Business Media LLC","issue":"5","license":[{"start":{"date-parts":[[2018,11,27]],"date-time":"2018-11-27T00:00:00Z","timestamp":1543276800000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2019,3]]},"DOI":"10.1007\/s11042-018-6875-7","type":"journal-article","created":{"date-parts":[[2018,11,27]],"date-time":"2018-11-27T01:51:33Z","timestamp":1543283493000},"page":"5919-5939","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":32,"title":["Fusing depth and colour information for human action recognition"],"prefix":"10.1007","volume":"78","author":[{"given":"Danilo","family":"Avola","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Marco","family":"Bernardi","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Gian Luca","family":"Foresti","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2018,11,27]]},"reference":[{"issue":"3","key":"6875_CR1","doi-asserted-by":"publisher","first-page":"16, 1","DOI":"10.1145\/1922649.1922653","volume":"43","author":"J Aggarwal","year":"2011","unstructured":"Aggarwal J, Ryoo M (2011) Human activity analysis: a review. ACM Comput Surv 43(3):16, 1\u201316, 43","journal-title":"ACM Comput Surv"},{"key":"6875_CR2","doi-asserted-by":"publisher","first-page":"70","DOI":"10.1016\/j.patrec.2014.04.011","volume":"48","author":"J Aggarwal","year":"2014","unstructured":"Aggarwal J, Xia L (2014) Human activity recognition from 3D data: a review. Pattern Recogn Lett 48:70\u201380","journal-title":"Pattern Recogn Lett"},{"key":"6875_CR3","doi-asserted-by":"publisher","first-page":"465","DOI":"10.1007\/978-3-642-41190-8_50","volume-title":"New Trends in Image Analysis and Processing \u2013 ICIAP 2013","author":"Danilo Avola","year":"2013","unstructured":"Avola D, Cinque L, Levialdi S, Placidi G (2013) Human body language analysis: a preliminary study based on kinect skeleton tracking. In: Proceedings of the international conference on image analysis and processing (ICIAP), pp 465\u2013473"},{"key":"6875_CR4","doi-asserted-by":"crossref","unstructured":"Avola D, Bernardi M, Cinque L, Foresti GL, Massaroni C (2018a) Combining keypoint clustering and neural background subtraction for real-time moving object detection by PTZ cameras. In: Proceedings of the international conference on pattern recognition applications and methods (ICPRAM), pp 638\u2013645","DOI":"10.5220\/0006722506380645"},{"key":"6875_CR5","doi-asserted-by":"crossref","unstructured":"Avola D, Bernardi M, Cinque L, Foresti GL, Massaroni C (2018b) Exploiting recurrent neural networks and leap motion controller for the recognition of sign language and semaphoric hand gestures. IEEE Transactions on Multimedia, pp P\u2013P (in press)","DOI":"10.1109\/TMM.2018.2856094"},{"key":"6875_CR6","first-page":"7","volume-title":"Intelligent Systems Reference Library","author":"D. Avola","year":"2018","unstructured":"Avola D, Cinque L, Foresti G, Martinel N, Pannone D, Piciarelli C (2018c) Low-level feature detectors and descriptors for smart image and video analysis: a comparative study. In: Bridging the semantic gap in image and video analysis, pp 7\u201329"},{"issue":"19","key":"6875_CR7","doi-asserted-by":"publisher","first-page":"24955","DOI":"10.1007\/s11042-018-5730-1","volume":"77","author":"Danilo Avola","year":"2018","unstructured":"Avola D, Cinque L, Foresti GL, Marini MR, Pannone D (2018d) VRheab: a fully immersive motor rehabilitation system based on recurrent neural network. Multimedia Tools and Applications 77(19):24, 955\u201324, 982","journal-title":"Multimedia Tools and Applications"},{"issue":"1","key":"6875_CR8","doi-asserted-by":"publisher","first-page":"69","DOI":"10.1007\/s11042-009-0351-3","volume":"48","author":"L Ballan","year":"2010","unstructured":"Ballan L, Bertini M, Del Bimbo A, Serra G (2010) Video event classification using string kernels. Multimedia Tools and Applications 48(1):69\u201387","journal-title":"Multimedia Tools and Applications"},{"issue":"3","key":"6875_CR9","doi-asserted-by":"publisher","first-page":"346","DOI":"10.1016\/j.cviu.2007.09.014","volume":"110","author":"H Bay","year":"2008","unstructured":"Bay H, Ess A, Tuytelaars T, Gool LV (2008) Speeded-up robust features (SURF). Comput Vis Image Underst 110(3):346\u2013359","journal-title":"Comput Vis Image Underst"},{"issue":"2","key":"6875_CR10","doi-asserted-by":"publisher","first-page":"253","DOI":"10.1007\/s11042-012-1022-3","volume":"69","author":"R Benmokhtar","year":"2014","unstructured":"Benmokhtar R (2014) Robust human action recognition scheme based on high-level feature fusion. Multimedia Tools and Applications 69(2):253\u2013275","journal-title":"Multimedia Tools and Applications"},{"issue":"C","key":"6875_CR11","doi-asserted-by":"publisher","first-page":"65","DOI":"10.1016\/j.cviu.2016.03.004","volume":"149","author":"G Canal","year":"2016","unstructured":"Canal G, Escalera S, Angulo C (2016) A real-time human-robot interaction system based on gestures for assistive scenarios. Comput Vis Image Underst 149(C):65\u201377","journal-title":"Comput Vis Image Underst"},{"issue":"3","key":"6875_CR12","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/1961189.1961199","volume":"2","author":"CC Chang","year":"2011","unstructured":"Chang CC, Lin CJ (2011) LIBSVM: A library for support vector machines. ACM Trans Intell Syst Technol 2(3):1\u201327","journal-title":"ACM Trans Intell Syst Technol"},{"key":"6875_CR13","unstructured":"Chathuramali KGM, Rodrigo R (2012) Faster human activity recognition with SVM. In: Proceedings of the international conference on advances in ICT for emerging regions (ICTer), pp 197\u2013203"},{"key":"6875_CR14","doi-asserted-by":"crossref","unstructured":"C\u00e1mara-Ch\u00e1vez G, de Albuquerque Ara\u00fajo A (2009) Harris-SIFT descriptor for video event detection based on a machine learning approach. In: Proceedings of the IEEE international symposium on multimedia (ISM), pp 153\u2013158","DOI":"10.1109\/ISM.2009.116"},{"issue":"4","key":"6875_CR15","doi-asserted-by":"publisher","first-page":"39","DOI":"10.1109\/MSP.2010.936725","volume":"27","author":"NM Correa","year":"2010","unstructured":"Correa NM, Adali T, Li YO, Calhoun VD (2010) Canonical correlation analysis for data fusion and group inferences. IEEE Signal Proc Mag 27(4):39\u201350","journal-title":"IEEE Signal Proc Mag"},{"issue":"3","key":"6875_CR16","doi-asserted-by":"crossref","first-page":"273","DOI":"10.1023\/A:1022627411411","volume":"20","author":"C Cortes","year":"1995","unstructured":"Cortes C, Vapnik V (1995) Support-vector networks. Mach Learn 20(3):273\u2013297","journal-title":"Mach Learn"},{"key":"6875_CR17","doi-asserted-by":"crossref","unstructured":"Das S, Koperski M, Bremond F, Francesca G (2017) Action recognition based on a mixture of RGB and depth based skeleton. In: Proceedings of the IEEE international conference on advanced video and signal based surveillance (AVSS), pp 1\u20136","DOI":"10.1109\/AVSS.2017.8078548"},{"issue":"21","key":"6875_CR18","doi-asserted-by":"publisher","first-page":"22, 445","DOI":"10.1007\/s11042-017-4795-6","volume":"76","author":"IC Duta","year":"2017","unstructured":"Duta IC, Uijlings JRR, Ionescu B, Aizawa K, Hauptmann AG, Sebe N (2017) Efficient human action recognition using histograms of motion gradients and VLAD with descriptor shape information. Multimedia Tools and Applications 76(21):22, 445-22, 472","journal-title":"Multimedia Tools and Applications"},{"key":"6875_CR19","doi-asserted-by":"crossref","unstructured":"Eigen D, Fergus R (2015) Predicting depth, surface normals and semantic labels with a common multi-scale convolutional architecture. In: Proceedings of the IEEE international conference on computer vision (ICCV), pp 2650\u20132658","DOI":"10.1109\/ICCV.2015.304"},{"key":"6875_CR20","doi-asserted-by":"crossref","unstructured":"Fei-Fei L, Perona P (2005) A Bayesian hierarchical model for learning natural scene categories. In: Proceedings of the IEEE conference on computer vision and pattern recognition (CVPR), vol 2, pp 524\u2013531","DOI":"10.1109\/CVPR.2005.16"},{"key":"6875_CR21","doi-asserted-by":"crossref","unstructured":"Foggia P, Percannella G, Saggese A, Vento M (2013) Recognizing human actions by a bag of visual words. In: Proceedings of the IEEE international conference on systems, man, and cybernetics (SMC), pp 2910\u20132915","DOI":"10.1109\/SMC.2013.496"},{"key":"6875_CR22","doi-asserted-by":"publisher","first-page":"52, 277","DOI":"10.1109\/ACCESS.2018.2869790","volume":"6","author":"Y Gao","year":"2018","unstructured":"Gao Y, Xiang X, Xiong N, Huang B, Lee HJ, Alrifai R, Jiang X, Fang Z (2018) Human action monitoring for healthcare based on deep learning. IEEE Access 6:52, 277\u201352, 285","journal-title":"IEEE Access"},{"key":"6875_CR23","doi-asserted-by":"publisher","first-page":"740","DOI":"10.1007\/978-3-319-46484-8_45","volume-title":"Computer Vision \u2013 ECCV 2016","author":"Ravi Garg","year":"2016","unstructured":"Garg R, BG VK, Carneiro G, Reid I (2016) Unsupervised CNN for single view depth estimation: Geometry to the rescue. In: Proceedings of the european conference on computer vision (ECCV), pp 740\u2013756"},{"issue":"6","key":"6875_CR24","doi-asserted-by":"publisher","first-page":"577","DOI":"10.1109\/34.927459","volume":"23","author":"AH Gunatilaka","year":"2001","unstructured":"Gunatilaka AH, Baertlein BA (2001) Feature-level and decision-level fusion of noncoincidently sampled sensors for land mine detection. IEEE Trans Pattern Anal Mach Intell 23(6):577\u2013589","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"6875_CR25","doi-asserted-by":"crossref","unstructured":"Gupta K, Bhavsar A (2016) Scale invariant human action detection from depth cameras using class templates. In: Proceedings of the IEEE conference on computer vision and pattern recognition workshops (CVPRW), pp 38\u201345","DOI":"10.1109\/CVPRW.2016.45"},{"issue":"1","key":"6875_CR26","doi-asserted-by":"publisher","first-page":"6","DOI":"10.1109\/5.554205","volume":"85","author":"DL Hall","year":"1997","unstructured":"Hall DL, Llinas J (1997) An introduction to multisensor data fusion. Proc IEEE 85(1):6\u201323","journal-title":"Proc IEEE"},{"issue":"1","key":"6875_CR27","first-page":"100","volume":"28","author":"JA Hartigan","year":"1979","unstructured":"Hartigan JA, Wong MA (1979) Algorithm AS 136: a k-means clustering algorithm. J R Stat Soc Ser C Appl Stat 28(1):100\u2013108","journal-title":"J R Stat Soc Ser C Appl Stat"},{"issue":"22","key":"6875_CR28","doi-asserted-by":"publisher","first-page":"29, 573","DOI":"10.1007\/s11042-017-5255-z","volume":"77","author":"C He","year":"2018","unstructured":"He C, Shao J, Sun J (2018) An anomaly-introduced learning method for abnormal event detection. Multimedia Tools and Applications 77(22):29, 573\u201329, 588","journal-title":"Multimedia Tools and Applications"},{"key":"6875_CR29","unstructured":"He X, Cai D, Niyogi P (2006) Tensor subspace analysis. In: Advances in neural information processing systems, pp 499\u2013506"},{"issue":"11","key":"6875_CR30","doi-asserted-by":"publisher","first-page":"2186","DOI":"10.1109\/TPAMI.2016.2640292","volume":"39","author":"J Hu","year":"2017","unstructured":"Hu J, Zheng W, Lai J, Zhang J (2017) Jointly learning heterogeneous features for RGB-d activity recognition. IEEE Trans Pattern Anal Mach Intell 39(11):2186\u20132200","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"6875_CR31","doi-asserted-by":"publisher","first-page":"504","DOI":"10.1016\/j.patcog.2017.07.013","volume":"72","author":"EP Ijjina","year":"2017","unstructured":"Ijjina EP, Chalavadi KM (2017) Human action recognition in RGB-d videos using motion sequence information and deep learning. Pattern Recogn 72:504\u2013516","journal-title":"Pattern Recogn"},{"issue":"10","key":"6875_CR32","doi-asserted-by":"publisher","first-page":"4641","DOI":"10.1109\/TIP.2016.2589320","volume":"25","author":"C Jia","year":"2016","unstructured":"Jia C, Fu Y (2016) Low-rank tensor subspace learning for RGB-d action recognition. IEEE Trans Image Process 25(10):4641\u20134652","journal-title":"IEEE Trans Image Process"},{"key":"6875_CR33","doi-asserted-by":"crossref","unstructured":"Jia C, Kong Y, Ding Z, Fu YR (2014a) Latent tensor transfer learning for RGB-D action recognition. In: Proceedings of the ACM international conference on multimedia (MM), pp 87\u201396","DOI":"10.1145\/2647868.2654928"},{"key":"6875_CR34","doi-asserted-by":"crossref","unstructured":"Jia C, Zhong G, Fu Y (2014b) Low-rank tensor learning with discriminant analysis for action classification and image recovery. In: Proceedings of the AAAI conference on artificial intelligence (CAI), pp 1228\u20131234","DOI":"10.1609\/aaai.v28i1.8901"},{"key":"6875_CR35","doi-asserted-by":"crossref","unstructured":"Karpathy A, Toderici G, Shetty S, Leung T, Sukthankar R, Fei-Fei L (2014) Large-scale video classification with convolutional neural networks. In: Proceedings of the IEEE international conference on computer vision and pattern recognition (CVPR), pp 1725\u20131732","DOI":"10.1109\/CVPR.2014.223"},{"key":"6875_CR36","doi-asserted-by":"crossref","unstructured":"Khaire P, Kumar P, Imran J (2018) Combining cnn streams of RGB-D and skeletal data for human activity recognition. Pattern Recognition Letters pp P\u2013P (in press)","DOI":"10.1016\/j.patrec.2018.04.035"},{"issue":"1","key":"6875_CR37","doi-asserted-by":"publisher","first-page":"28","DOI":"10.1016\/j.inffus.2011.08.001","volume":"14","author":"B Khaleghi","year":"2013","unstructured":"Khaleghi B, Khamis A, Karray FO, Razavi SN (2013) Multisensor data fusion: a review of the state-of-the-art. Information Fusion 14(1):28\u201344","journal-title":"Information Fusion"},{"issue":"12","key":"6875_CR38","doi-asserted-by":"publisher","first-page":"871","DOI":"10.1109\/LSP.2005.859494","volume":"12","author":"TY Kim","year":"2005","unstructured":"Kim TY, Ko H (2005) Bayesian fusion of confidence measures for speech recognition. IEEE Signal Process Lett 12(12):871\u2013874","journal-title":"IEEE Signal Process Lett"},{"key":"6875_CR39","doi-asserted-by":"publisher","DOI":"10.1117\/3.563340","volume-title":"Sensor and data fusion: a tool for information assessment and decision making","author":"LA Klein","year":"2004","unstructured":"Klein LA (2004) Sensor and data fusion: a tool for information assessment and decision making. SPIE Press, Bellingham"},{"key":"6875_CR40","doi-asserted-by":"crossref","unstructured":"Koperski M, Bremond F (2016) Modeling spatial layout of features for real world scenario RGB-D action recognition. In: Proceedings of the IEEE international conference on advanced video and signal based surveillance (AVSS), pp 44\u201350","DOI":"10.1109\/AVSS.2016.7738023"},{"key":"6875_CR41","doi-asserted-by":"crossref","unstructured":"Koperski M, Bilinski P, Bremond F (2014) 3D trajectories for action recognition. In: Proceedings of the IEEE international conference on image processing (ICIP), pp 4176\u20134180","DOI":"10.1109\/ICIP.2014.7025848"},{"issue":"8","key":"6875_CR42","doi-asserted-by":"publisher","first-page":"951","DOI":"10.1177\/0278364913478446","volume":"32","author":"HS Koppula","year":"2013","unstructured":"Koppula HS, Gupta R, Saxena A (2013) Learning human activities and object affordances from RGB-d videos. Int J Robot Res 32(8):951\u2013970","journal-title":"Int J Robot Res"},{"key":"6875_CR43","doi-asserted-by":"publisher","first-page":"42","DOI":"10.1007\/978-3-642-39351-8_5","volume-title":"Distributed, Ambient, and Pervasive Interactions","author":"Dimitrios I. Kosmopoulos","year":"2013","unstructured":"Kosmopoulos DI, Doliotis P, Athitsos V, Maglogiannis I (2013) Fusion of color and depth video for human behavior recognition in an assistive environment. In: Proceedings of the internation conference on distributed, ambient, and pervasive interactions (DAPI), pp 42\u201351"},{"key":"6875_CR44","doi-asserted-by":"publisher","first-page":"528","DOI":"10.1007\/11949619_47","volume-title":"Computer Vision, Graphics and Image Processing","author":"Praveen Kumar","year":"2006","unstructured":"Kumar P, Mittal A, Kumar P (2006) Fusion of thermal infrared and visible spectrum video for robust surveillance. In: Proceedings of the indian conference on computer vision, graphics and image processing (ICVGIP), pp 528\u2013539"},{"key":"6875_CR45","doi-asserted-by":"publisher","DOI":"10.1002\/0471660264","volume-title":"Combining pattern classifiers: methods and algorithms","author":"LI Kuncheva","year":"2004","unstructured":"Kuncheva LI (2004) Combining pattern classifiers: methods and algorithms. Wiley, New York"},{"key":"6875_CR46","doi-asserted-by":"crossref","unstructured":"Laptev I, Marszalek M, Schmid C, Rozenfeld B (2008) Learning realistic human actions from movies. In: Proceedings of the IEEE conference on computer vision and pattern recognition (CVPR), pp 1\u20138","DOI":"10.1109\/CVPR.2008.4587756"},{"key":"6875_CR47","doi-asserted-by":"publisher","first-page":"74","DOI":"10.1016\/j.sigpro.2014.08.038","volume":"112","author":"AA Liu","year":"2015","unstructured":"Liu AA, Nie WZ, Su YT, Ma L, Hao T, Yang ZX (2015) Coupled hidden conditional random fields for RGB-d human action recognition. Signal Process 112:74\u201382","journal-title":"Signal Process"},{"issue":"2","key":"6875_CR48","doi-asserted-by":"publisher","first-page":"91","DOI":"10.1023\/B:VISI.0000029664.99615.94","volume":"60","author":"DG Lowe","year":"2004","unstructured":"Lowe DG (2004) Distinctive image features from scale-invariant keypoints. Int J Comput Vis 60(2):91\u2013110","journal-title":"Int J Comput Vis"},{"key":"6875_CR49","doi-asserted-by":"publisher","first-page":"65","DOI":"10.1016\/j.patrec.2013.10.005","volume":"39","author":"L Miranda","year":"2014","unstructured":"Miranda L, Vieira T, Mart\u00ednez D, Lewiner T, Vieira AW, Campos MFM (2014) Online gesture recognition from pose kernel learning and decision forests. Pattern Recogn Lett 39:65\u201373","journal-title":"Pattern Recogn Lett"},{"key":"6875_CR50","doi-asserted-by":"crossref","unstructured":"Ni B, Nguyen CD, Moulin P (2012) RGBD-camera based get-up event detection for hospital fall prevention. In: Proceedings of the IEEE international conference on acoustics, speech and signal processing (ICASSP), pp 1405\u20131408","DOI":"10.1109\/ICASSP.2012.6287947"},{"issue":"5","key":"6875_CR51","doi-asserted-by":"publisher","first-page":"1383","DOI":"10.1109\/TCYB.2013.2276433","volume":"43","author":"B Ni","year":"2013","unstructured":"Ni B, Pei Y, Moulin P, Yan S (2013) Multilevel depth and image fusion for human activity detection. IEEE Transactions on Cybernetics 43(5):1383\u20131394","journal-title":"IEEE Transactions on Cybernetics"},{"key":"6875_CR52","doi-asserted-by":"crossref","unstructured":"Oneata D, Verbeek J, Schmid C (2013) Action and event recognition with Fisher vectors on a compact feature set. In: Proceedings of the IEEE international conference on computer vision (ICCV), pp 1817\u20131824","DOI":"10.1109\/ICCV.2013.228"},{"key":"6875_CR53","doi-asserted-by":"crossref","unstructured":"Padhy RP, Chang X, Choudhury SK, Sa PK, Bakshi S (2018) Multi-stage cascaded deconvolution for depth map and surface normal prediction from single image. Pattern Recognition Letters pp P\u2013P (in press)","DOI":"10.1016\/j.patrec.2018.07.012"},{"key":"6875_CR54","doi-asserted-by":"publisher","first-page":"109","DOI":"10.1016\/j.cviu.2016.03.013","volume":"150","author":"X Peng","year":"2016","unstructured":"Peng X, Wang L, Wang X, Qiao Y (2016) Bag of visual words and fusion methods for action recognition: Comprehensive study and good practice. Comput Vis Image Underst 150:109\u2013125","journal-title":"Comput Vis Image Underst"},{"key":"6875_CR55","first-page":"395","volume-title":"Springer Tracts in Advanced Robotics","author":"Lasitha Piyathilaka","year":"2015","unstructured":"Piyathilaka L, Kodagoda S (2013) Human activity recognition for domestic robots. In: Proceedings of the international conference on field and service robotics (FSR), pp 395\u2013408"},{"key":"6875_CR56","doi-asserted-by":"publisher","first-page":"130","DOI":"10.1016\/j.patcog.2015.11.019","volume":"53","author":"LL Presti","year":"2016","unstructured":"Presti LL, Cascia ML (2016) 3D skeleton-based human action classification: a survey. Pattern Recogn 53:130\u2013147","journal-title":"Pattern Recogn"},{"issue":"3","key":"6875_CR57","doi-asserted-by":"publisher","first-page":"667","DOI":"10.1109\/TPAMI.2017.2691768","volume":"40","author":"H Rahmani","year":"2018","unstructured":"Rahmani H, Mian A, Shah M (2018) Learning a deep model for human action recognition from novel viewpoints. IEEE Trans Pattern Anal Mach Intell 40(3):667\u2013681","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"6875_CR58","doi-asserted-by":"publisher","first-page":"149","DOI":"10.1016\/j.neucom.2014.12.009","volume":"154","author":"N Raman","year":"2015","unstructured":"Raman N, Maybank S (2015) Action classification using a discriminative multilevel HDP-HMM. Neurocomputing 154:149\u2013161","journal-title":"Neurocomputing"},{"key":"6875_CR59","unstructured":"Ross AA, Govindarajan R (2005) Feature level fusion of hand and face biometrics. In: SPIE proceedings, pp 196\u2013204"},{"key":"6875_CR60","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.patrec.2015.12.006","volume":"73","author":"J Sanchez-Riera","year":"2016","unstructured":"Sanchez-Riera J, Hua KL, Hsiao YS, Lim T, Hidayati SC, Cheng WH (2016) A comparative study of data fusion for RGB-d based visual recognition. Pattern Recogn Lett 73:1\u20136","journal-title":"Pattern Recogn Lett"},{"issue":"11","key":"6875_CR61","doi-asserted-by":"publisher","first-page":"2758","DOI":"10.1109\/78.650102","volume":"45","author":"B Scholkopf","year":"1997","unstructured":"Scholkopf B, Sung KK, Burges CJC, Girosi F, Niyogi P, Poggio T, Vapnik V (1997) Comparing support vector machines with Gaussian kernels to radial basis function classifiers. IEEE Trans Signal Process 45(11):2758\u20132765","journal-title":"IEEE Trans Signal Process"},{"key":"6875_CR62","doi-asserted-by":"crossref","unstructured":"Shahroudy A, Wang G, Ng TT (2014) Multi-modal feature fusion for action recognition in RGB-D sequences. In: Proceedings of the international symposium on communications, control and signal processing (ISCCSP), pp 1\u20134","DOI":"10.1109\/ISCCSP.2014.6877819"},{"issue":"4","key":"6875_CR63","first-page":"26","volume":"76","author":"P Sharma","year":"2013","unstructured":"Sharma P, Kaur M (2013) Multimodal classification using feature level fusion and SVM. Int J Comput Appl 76(4):26\u201332","journal-title":"Int J Comput Appl"},{"key":"6875_CR64","unstructured":"Sung J, Ponce C, Selman B, Saxena A (2011) Human activity detection from RGBD images. In: Proceedings of the AAAI conference on plan, activity, and intent recognition (PAIR), pp 47\u201355"},{"key":"6875_CR65","unstructured":"Sung J, Ponce C, Selman B, Saxena A (2012) Unstructured human activity detection from RGBD images. In: Proceedings of the IEEE international conference on robotics and automation (ICRA), pp 842\u2013849"},{"key":"6875_CR66","doi-asserted-by":"publisher","first-page":"19","DOI":"10.1016\/j.aasri.2014.09.005","volume":"9","author":"P Sykora","year":"2014","unstructured":"Sykora P, Kamencay P, Hudec R (2014) Comparison of SIFT and SURF methods for use on hand gesture recognition based on depth map. AASRI Procedia 9:19\u201324","journal-title":"AASRI Procedia"},{"issue":"2","key":"6875_CR67","doi-asserted-by":"publisher","first-page":"283","DOI":"10.1007\/s10462-017-9545-7","volume":"50","author":"RK Tripathi","year":"2018","unstructured":"Tripathi RK, Jalal AS, Agrawal SC (2018) Suspicious human activity recognition: a review. Artif Intell Rev 50(2):283\u2013339","journal-title":"Artif Intell Rev"},{"key":"6875_CR68","doi-asserted-by":"crossref","unstructured":"Wang J, Liu Z, Wu Y, Yuan J (2012) Mining actionlet ensemble for action recognition with depth cameras. In: Proceedings of the IEEE conference on computer vision and pattern recognition (CVPR), pp 1290\u20131297","DOI":"10.1109\/CVPR.2012.6247813"},{"key":"6875_CR69","doi-asserted-by":"publisher","first-page":"14","DOI":"10.1016\/j.cviu.2014.06.014","volume":"127","author":"C Wolf","year":"2014","unstructured":"Wolf C, Mille J, Lombardi E, Celiktutan O, Jiu M, Dogan E, Eren G, Baccouche M, Dellandrea E, Bichot CE, Garcia C, Sankur B (2014) Evaluation of video activity localizations integrating quality and quantity measurements. Comput Vis Image Underst 127:14\u201330","journal-title":"Comput Vis Image Underst"},{"key":"6875_CR70","doi-asserted-by":"crossref","unstructured":"Xia L, Chen CC, Aggarwal JK (2012) View invariant human action recognition using histograms of 3D joints. In: Proceedings of the IEee conference on computer vision and pattern recognition workshops (CVPRW), pp 20\u201327","DOI":"10.1109\/CVPRW.2012.6239233"},{"issue":"3","key":"6875_CR71","doi-asserted-by":"publisher","first-page":"624","DOI":"10.1109\/TCSVT.2016.2589838","volume":"27","author":"Y Xian","year":"2017","unstructured":"Xian Y, Rong X, Yang X, Tian Y (2017) Evaluation of low-level features for real-world surveillance event detection. IEEE Trans Circuits Syst Video Technol 27 (3):624\u2013634","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"6875_CR72","unstructured":"Yan S, Xu D, Yang Q, Zhang L, Tang X, Zhang HJ (2005) Discriminant analysis with tensor representation. In: Proceedings of the conference on computer vision and pattern recognition (CVPR), vol 1, pp 526\u2013532"},{"key":"6875_CR73","doi-asserted-by":"publisher","first-page":"236","DOI":"10.1016\/j.patcog.2016.11.012","volume":"64","author":"T Yao","year":"2017","unstructured":"Yao T, Wang Z, Xie Z, Gao J, Feng DD (2017) Learning universal multiview dictionary for human action recognition. Pattern Recogn 64:236\u2013244","journal-title":"Pattern Recogn"},{"issue":"4","key":"6875_CR74","doi-asserted-by":"publisher","first-page":"761","DOI":"10.1162\/NECO_a_00570","volume":"26","author":"G Zhong","year":"2014","unstructured":"Zhong G, Cheriet M (2014) Large margin low rank tensor analysis. Neural Comput 26(4):761\u2013780","journal-title":"Neural Comput"},{"key":"6875_CR75","doi-asserted-by":"crossref","unstructured":"Zhou X, Zhuang X, Yan S, Chang SF, Hasegawa-Johnson M, Huang TS (2008) SIFT-bag kernel for video event analysis. In: Proceedings of the ACM international conference on multimedia (MM), pp 229\u2013238","DOI":"10.1145\/1459359.1459391"},{"key":"6875_CR76","doi-asserted-by":"crossref","unstructured":"Zhu Y, Chen W, Guo G (2013) Fusing spatiotemporal features and joints for 3D action recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition workshops (CVPRW), pp 486\u2013491","DOI":"10.1109\/CVPRW.2013.78"},{"issue":"8","key":"6875_CR77","doi-asserted-by":"publisher","first-page":"453","DOI":"10.1016\/j.imavis.2014.04.005","volume":"32","author":"Y Zhu","year":"2014","unstructured":"Zhu Y, Chen W, Guo G (2014) Evaluating spatiotemporal interest point features for depth-based action recognition. Image Vis Comput 32(8):453\u2013464","journal-title":"Image Vis Comput"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-018-6875-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11042-018-6875-7\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-018-6875-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,4]],"date-time":"2026-04-04T06:06:37Z","timestamp":1775282797000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11042-018-6875-7"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,11,27]]},"references-count":77,"journal-issue":{"issue":"5","published-print":{"date-parts":[[2019,3]]}},"alternative-id":["6875"],"URL":"https:\/\/doi.org\/10.1007\/s11042-018-6875-7","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"value":"1380-7501","type":"print"},{"value":"1573-7721","type":"electronic"}],"subject":[],"published":{"date-parts":[[2018,11,27]]},"assertion":[{"value":"4 October 2017","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 November 2018","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"13 November 2018","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"27 November 2018","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}