{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,16]],"date-time":"2026-04-16T20:27:09Z","timestamp":1776371229600,"version":"3.51.2"},"reference-count":37,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2016,9,19]],"date-time":"2016-09-19T00:00:00Z","timestamp":1474243200000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/creativecommons.org\/licenses\/by\/4.0"}],"funder":[{"name":"EU Horizon 2020 ICT4Life"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2017,2]]},"DOI":"10.1007\/s11042-016-3945-6","type":"journal-article","created":{"date-parts":[[2016,9,19]],"date-time":"2016-09-19T02:54:17Z","timestamp":1474253657000},"page":"4505-4521","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":13,"title":["Landmark-based multimodal human action recognition"],"prefix":"10.1007","volume":"76","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-4298-6870","authenticated-orcid":false,"given":"Stylianos","family":"Asteriadis","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Petros","family":"Daras","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2016,9,19]]},"reference":[{"issue":"3","key":"3945_CR1","doi-asserted-by":"crossref","first-page":"16","DOI":"10.1145\/1922649.1922653","volume":"43","author":"JK Aggarwal","year":"2011","unstructured":"Aggarwal JK, Ryoo MS (2011) Human activity analysis: a review. ACM Comput Surv 43(3):16","journal-title":"ACM Comput Surv"},{"key":"3945_CR2","doi-asserted-by":"crossref","unstructured":"Asteriadis S, Chatzitofis A, Zarpalas D, Alexiadis DS, Daras P (2013) Estimating human motion from multiple kinect sensors. In: Proceedings of the 6th international conference on computer vision\/computer graphics collaboration techniques and applications, p 3. ACM","DOI":"10.1145\/2466715.2466727"},{"key":"3945_CR3","doi-asserted-by":"crossref","unstructured":"Asteriadis S, Daras P (2015) Skeleton-based human action recognition using basis vectors. In: International conference on pervasive technologies related to assistive environments (PETRA)","DOI":"10.1145\/2769493.2769569"},{"key":"3945_CR4","doi-asserted-by":"crossref","unstructured":"Asteriadis S, Karpouzis K, Kollias SD (2008) A neuro-fuzzy approach to user attention recognition. In: 18th international conference on artificial neural networks (ICANN). Prague, 3\u20136 September 2008, pp 927\u2013936","DOI":"10.1007\/978-3-540-87536-9_95"},{"key":"3945_CR5","unstructured":"Caridakis G, Castellano G, Kessous L, Raouzaiou A, Malatesta L, Asteriadis S, Karpouzis K (2007) Expressive faces, gestures and speech in multimodal affective analysis. In: Boukis C, Pnevmatikakis A, Polymenakos L (eds) Artificial intelligence and innovations: from theory to applications, pp 375\u2013 388"},{"key":"3945_CR6","unstructured":"Chen C, Liu M, Zhang B, Han J, Jiang J, Liu H 3d action recognition using multi-temporal depth motion maps and fisher vector"},{"issue":"15","key":"3945_CR7","doi-asserted-by":"crossref","first-page":"1995","DOI":"10.1016\/j.patrec.2013.02.006","volume":"34","author":"L Chen","year":"2013","unstructured":"Chen L, Wei H, Ferryman JM (2013) A survey of human motion analysis using depth imagery. Pattern Recogn Lett 34(15):1995\u20132006","journal-title":"Pattern Recogn Lett"},{"key":"3945_CR8","doi-asserted-by":"crossref","unstructured":"Chen X, Cai D (2011) Large scale spectral clustering with landmark-based representation. In: AAAI conference on artificial intelligence","DOI":"10.1609\/aaai.v25i1.7900"},{"key":"3945_CR9","unstructured":"Delachaux B, Rebetez J, Perez-Uribe A, Mejia HFS (2013) Indoor activity recognition by combining one-vs.-all neural network classifiers exploiting wearable and depth sensors. In: Lecture notes in computer science, pp 216\u2013223"},{"key":"3945_CR10","unstructured":"Du Y, Wang W, Wang L (2015) Hierarchical recurrent neural network for skeleton based action recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 1110\u20131118"},{"key":"3945_CR11","doi-asserted-by":"crossref","first-page":"108","DOI":"10.1186\/1687-6180-2012-108","volume":"2012","author":"W He","year":"2012","unstructured":"He W, Guo Y, Gao C, Li X (2012) Recognition of human activities with wearable sensors. EURASIP J Adv Sig Proc 2012:108","journal-title":"EURASIP J Adv Sig Proc"},{"key":"3945_CR12","doi-asserted-by":"crossref","unstructured":"Jain A, Gupta A, Rodriguez M, Davis LS (2013) Representing videos using mid-level discriminative patches. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 2571\u20132578","DOI":"10.1109\/CVPR.2013.332"},{"issue":"1","key":"3945_CR13","doi-asserted-by":"crossref","first-page":"221","DOI":"10.1109\/TPAMI.2012.59","volume":"35","author":"S Ji","year":"2013","unstructured":"Ji S, Xu W, Yang M, Yu K (2013) 3d convolutional neural networks for human action recognition. IEEE Trans Pattern Anal Mach Intell 35(1):221\u2013231","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"6","key":"3945_CR14","doi-asserted-by":"crossref","first-page":"1432","DOI":"10.1016\/j.jvcir.2014.04.007","volume":"25","author":"I Kapsouras","year":"2014","unstructured":"Kapsouras I, Nikolaidis N (2014) Action recognition on motion capture data using a dynemes and forward differences representation. J Vis Commun Image Represent 25 (6):1432\u20131445","journal-title":"J Vis Commun Image Represent"},{"key":"3945_CR15","doi-asserted-by":"crossref","unstructured":"Ke Y, Sukthankar R, Hebert M (2007) Spatio-temporal shape and flow correlation for action recognition. In: 7th international workshop on visual surveillance","DOI":"10.1109\/CVPR.2007.383512"},{"key":"3945_CR16","doi-asserted-by":"publisher","unstructured":"Kim E, Helal S, Cook D (2010) Human activity recognition and pattern discovery. IEEE Pervasive Comput 9(1):48\u201353. doi: 10.1109\/MPRV.2010.7","DOI":"10.1109\/MPRV.2010.7"},{"key":"3945_CR17","doi-asserted-by":"crossref","unstructured":"Kumari S, Mitra SK (2011) Human action recognition using dft. In: Computer vision, pattern recognition national conference on image processing and graphics, vol 0, pp 239\u2013242","DOI":"10.1109\/NCVPRIPG.2011.58"},{"key":"3945_CR18","doi-asserted-by":"crossref","unstructured":"Laptev I, Marsza\u0142ek M, Schmid C, Rozenfeld B (2008) Learning realistic human actions from movies. In: IEEE conference on computer vision & pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2008.4587756"},{"key":"3945_CR19","unstructured":"Lu WL, Little JJ (2006) Simultaneous tracking and action recognition using the pca-hog descriptor. In: The 3rd Canadian conference on computer and robot vision, p 6"},{"issue":"2\u20133","key":"3945_CR20","doi-asserted-by":"crossref","first-page":"196","DOI":"10.1016\/j.cviu.2003.08.001","volume":"92","author":"Y Luo","year":"2003","unstructured":"Luo Y, Wu TD, Hwang JN (2003) Object-based analysis and interpretation of human motion in sports video sequences by dynamic bayesian networks. Comput Vis Image Underst 92(2\u20133):196\u2013216","journal-title":"Comput Vis Image Underst"},{"key":"3945_CR21","doi-asserted-by":"crossref","unstructured":"Nandakumar K, Wan KW, Chan SMA, Ng WZT, Wang JG, Yau WY (2013) A multi-modal gesture recognition system using audio, video, and skeletal joint data. In: Proceedings of the 15th ACM on International conference on multimodal interaction, pp 475\u2013482. ACM","DOI":"10.1145\/2522848.2532593"},{"key":"3945_CR22","unstructured":"Ng AY, Jordan MI, Weiss Y (2001) On spectral clustering: analysis and an algorithm. In: Advances in neural information processing systems. MIT Press, pp 849\u2013856"},{"key":"3945_CR23","doi-asserted-by":"crossref","unstructured":"Ofli F, Chaudhry R, Kurillo G, Vidal R, Bajcsy R (2013) Berkeley mhad: a comprehensive multimodal human action database. In: IEEE workshop on applications of computer vision, vol 0, pp 53\u201360","DOI":"10.1109\/WACV.2013.6474999"},{"key":"3945_CR24","doi-asserted-by":"crossref","unstructured":"Scovanner P, Ali S, Shah M (2007) A 3-dimensional sift descriptor and its application to action recognition. In: Proceedings of the 15th international conference on multimedia, MULTIMEDIA \u201907. ACM, New York, pp 357\u2013360","DOI":"10.1145\/1291233.1291311"},{"key":"3945_CR25","unstructured":"Shen C, Chen L, Priebe CE (2015) Sparse representation classification beyond l1 minimization and the subspace assumption. arXiv preprint arXiv: 1502.01368"},{"key":"3945_CR26","doi-asserted-by":"crossref","unstructured":"Song Y, Morency LP, Davis R (2012) Multimodal human behavior analysis: learning correlation and interaction across modalities. In: Proceedings of the 14th ACM international conference on multimodal interaction. ACM, pp 27\u201330","DOI":"10.1145\/2388676.2388684"},{"key":"3945_CR27","doi-asserted-by":"crossref","unstructured":"Stork J, Spinello L, Silva J, Arras K (2012) Audio-based human activity recognition using non-markovian ensemble voting. In: IEEE international workshop on robots and human interactive communications (RO-MAN), pp 509\u2013514","DOI":"10.1109\/ROMAN.2012.6343802"},{"key":"3945_CR28","doi-asserted-by":"crossref","unstructured":"Sun L, Aizawa K (2013) Action recognition using invariant features under unexampled viewing conditions. In: Proceedings of the 21st ACM international conference on multimedia, MM \u201913. ACM, New York, pp 389\u2013392","DOI":"10.1145\/2502081.2508126"},{"key":"3945_CR29","doi-asserted-by":"crossref","unstructured":"Vantigodi S, Babu RV (2013) Real-time human action recognition from motion capture data. In: 2013 fourth national conference on computer vision, pattern recognition, image processing and graphics (NCVPRIPG). IEEE, pp 1\u20134","DOI":"10.1109\/NCVPRIPG.2013.6776204"},{"key":"3945_CR30","doi-asserted-by":"crossref","first-page":"1896","DOI":"10.1109\/TPAMI.2005.246","volume":"27","author":"A Veeraraghavan","year":"2005","unstructured":"Veeraraghavan A, Member S, Roy-chowdhury AK (2005) Matching shape sequences in video with applications in human movement analysis. IEEE Trans Pattern Anal Mach Intell 27:1896\u20131909","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"3945_CR31","doi-asserted-by":"crossref","unstructured":"von Luxburg U (2007) A tutorial on spectral clustering. Stat Comput","DOI":"10.1007\/s11222-007-9033-z"},{"key":"3945_CR32","unstructured":"Wang X, Ji Q (2012) Learning dynamic bayesian network discriminatively for human activity recognition. In: Proceedings of the 21st international conference on pattern recognition (ICPR), pp 3553\u2013 3556"},{"issue":"2","key":"3945_CR33","doi-asserted-by":"crossref","first-page":"210","DOI":"10.1109\/TPAMI.2008.79","volume":"31","author":"J Wright","year":"2009","unstructured":"Wright J, Yang AY, Ganesh A, Sastry SS, Ma Y (2009) Robust face recognition via sparse representation. IEEE Trans Pattern Anal Mach Intell 31 (2):210\u2013227","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"8","key":"3945_CR34","doi-asserted-by":"crossref","first-page":"3234","DOI":"10.1109\/TIP.2013.2262292","volume":"22","author":"AY Yang","year":"2013","unstructured":"Yang AY, Zhou Z, Balasubramanian AG, Sastry SS, Ma Y (2013) Fast-minimization algorithms for robust face recognition. IEEE Trans Image Process 22(8):3234\u20133246","journal-title":"IEEE Trans Image Process"},{"key":"3945_CR35","unstructured":"Zappi P, Lombriser C, Stiefmeier T, Farella E, Roggen D, Benini L, Tr\u00f6ster G (2008) Activity recognition from on-body sensors: accuracy-power trade-off by dynamic sensor selection. Springer"},{"key":"3945_CR36","doi-asserted-by":"crossref","unstructured":"Zhang B, Perina A, Li Z, Murino V, Liu J, Ji R (2016) Bounding multiple gaussians uncertainty with application to object tracking. Int J Comput Vis 1\u201316","DOI":"10.1016\/j.jvlc.2016.02.001"},{"key":"3945_CR37","doi-asserted-by":"crossref","unstructured":"Zhang B, Perina A, Murino V, Del Bue A (2015) Sparse representation classification with manifold constraints transfer. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 4557\u20134565","DOI":"10.1109\/CVPR.2015.7299086"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-016-3945-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11042-016-3945-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-016-3945-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,8,20]],"date-time":"2023-08-20T05:03:36Z","timestamp":1692507816000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11042-016-3945-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,9,19]]},"references-count":37,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2017,2]]}},"alternative-id":["3945"],"URL":"https:\/\/doi.org\/10.1007\/s11042-016-3945-6","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"value":"1380-7501","type":"print"},{"value":"1573-7721","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,9,19]]}}}