{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,30]],"date-time":"2025-06-30T00:10:01Z","timestamp":1751242201757,"version":"3.41.0"},"reference-count":74,"publisher":"Springer Science and Business Media LLC","issue":"18","license":[{"start":{"date-parts":[[2018,1,23]],"date-time":"2018-01-23T00:00:00Z","timestamp":1516665600000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2018,9]]},"DOI":"10.1007\/s11042-018-5617-1","type":"journal-article","created":{"date-parts":[[2018,1,23]],"date-time":"2018-01-23T02:05:19Z","timestamp":1516673119000},"page":"23193-23225","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":4,"title":["Understanding holistic human pose using class-specific convolutional neural network"],"prefix":"10.1007","volume":"77","author":[{"given":"Faranak","family":"Shamsafar","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hossein","family":"Ebrahimnezhad","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2018,1,23]]},"reference":[{"issue":"10","key":"5617_CR1","doi-asserted-by":"crossref","first-page":"1533","DOI":"10.1109\/TASLP.2014.2339736","volume":"22","author":"O Abdel-Hamid","year":"2014","unstructured":"Abdel-Hamid O, Mohamed AR, Jiang H, Deng L, Penn G, Yu D (2014) Convolutional neural networks for speech recognition. IEEE\/ACM Transactions on Audio, Speech and Language Processing (TASLP) 22(10):1533\u20131545","journal-title":"IEEE\/ACM Transactions on Audio, Speech and Language Processing (TASLP)"},{"key":"5617_CR2","doi-asserted-by":"crossref","unstructured":"Amin S, Andriluka M, Rohrbach M, Schiele B (2013) Multi-view pictorial structures for 3D human pose estimation. In: British machine vision conference (BMVC)","DOI":"10.5244\/C.27.45"},{"key":"5617_CR3","doi-asserted-by":"crossref","unstructured":"Andriluka M, Pishchulin L, Gehle P, Schiele B (2014) 2D human pose estimation: new benchmark and state of the art analysis. In: IEEE conference on computer vision and pattern recognition (CVPR). http:\/\/human-pose.mpi-inf.mpg.de\/","DOI":"10.1109\/CVPR.2014.471"},{"key":"5617_CR4","doi-asserted-by":"crossref","unstructured":"Belagiannis V, Amann C, Navab N, Ilic S (2014) Holistic Human Pose Estimation with Regression Forests. In: Articulated Motion and Deformable Objects (AMDO)","DOI":"10.1007\/978-3-319-08849-5_3"},{"key":"5617_CR5","doi-asserted-by":"publisher","unstructured":"Belagiannis V, Rupprecht C, Carneiro G (2015) Robust optimization for deep regression. In: International Conference on Computer Vision (ICCV) https:\/\/doi.org\/10.1109\/ICCV.2015.324","DOI":"10.1109\/ICCV.2015.324"},{"key":"5617_CR6","unstructured":"Berg A, Deng J, Fei-Fei L (2010) Large Scale Visual Recognition Challenge. http:\/\/www.image-net.org\/challenges\/LSVRC"},{"key":"5617_CR7","doi-asserted-by":"crossref","unstructured":"Bourdev L, Malik J (2009) Poselets: body part detectors trained using 3D human pose annotations. In: International Conference on Computer Vision (ICCV)","DOI":"10.1109\/ICCV.2009.5459303"},{"key":"5617_CR8","doi-asserted-by":"crossref","unstructured":"Butepage J, Black MJ, Kragic D, Kjellstr\u00f6m H (2017) Deep representation learning for human motion prediction and classification. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/CVPR.2017.173"},{"key":"5617_CR9","doi-asserted-by":"crossref","unstructured":"Cao Z, Simon T, Wei S-E, Sheikh Y (2017) Realtime multi-person 2D pose estimation using part affinity fields. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/CVPR.2017.143"},{"key":"5617_CR10","doi-asserted-by":"crossref","unstructured":"Carreira J, Agrawal P, Fragkiadaki K, Malik J (2016) Human pose estimation with iterative error feedback. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2016.512"},{"key":"5617_CR11","doi-asserted-by":"crossref","unstructured":"Chao Y-W, Yang J, Price B, Cohen S, Deng J (2017) Forecasting human dynamics from static images. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/CVPR.2017.388"},{"key":"5617_CR12","doi-asserted-by":"crossref","unstructured":"Chatfield K, Simonyan K, Vedaldi A, Zisserman A (2014) Return of the devil in the details: delving deep into convolutional networks. In: British Machine Vision Conference (BMVC)","DOI":"10.5244\/C.28.6"},{"key":"5617_CR13","unstructured":"Chen X, Yuille A (2014) Articulated pose estimation by a graphical model with image dependent pairwise relations. Advances in neural information processing systems (NIPS)"},{"key":"5617_CR14","doi-asserted-by":"crossref","first-page":"1088","DOI":"10.1016\/j.asoc.2015.06.048","volume":"38","author":"Y Chen","year":"2016","unstructured":"Chen Y, Yang X, Zhong B, Pan S, Chen D, Zhang H (2016) CNNTracker: online discriminative object tracking via deep convolutional neural network. Appl Soft Comput 38:1088\u20131098","journal-title":"Appl Soft Comput"},{"key":"5617_CR15","doi-asserted-by":"crossref","unstructured":"Chu X, Yang W, Ouyang W, Ma C, Yuille AL, Wang X (2017) Multi-context attention for human pose estimation. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2017.601"},{"issue":"4","key":"5617_CR16","doi-asserted-by":"publisher","first-page":"996","DOI":"10.1109\/TSMCA.2012.2223670","volume":"43","author":"J Cui","year":"2013","unstructured":"Cui J, Liu Y, Xu Y (2013) Tracking generic human motion via fusion of low- and high-dimensional approaches. IEEE Trans Syst Man Cybern Syst 43(4):996\u20131002. https:\/\/doi.org\/10.1109\/TSMCA.2012.2223670","journal-title":"IEEE Trans Syst Man Cybern Syst"},{"key":"5617_CR17","doi-asserted-by":"publisher","unstructured":"Dalal N, Triggs B (2005) Histograms of oriented gradients for human detection. In: IEEE conference on computer vision and pattern recognition (CVPR). Pp 886-893. https:\/\/doi.org\/10.1109\/CVPR.2005.177","DOI":"10.1109\/CVPR.2005.177"},{"key":"5617_CR18","doi-asserted-by":"crossref","unstructured":"Deng J, Dong W, Socher R, Li LJ, Li K, Fei-Fei L (2009) ImageNet: a large-scale hierarchical image database. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"5617_CR19","doi-asserted-by":"publisher","unstructured":"Eichner M, Ferrari V (2009) Better appearance models for pictorial structures. In: Proceedings of the British Machine Vision Conference (BMVC). https:\/\/doi.org\/10.5244\/C.23.3","DOI":"10.5244\/C.23.3"},{"key":"5617_CR20","doi-asserted-by":"crossref","unstructured":"Eigen D, Krishnan D, Fergus R (2013) Restoring an image taken through a window covered with dirt or rain. In: international conference on computer vision (ICCV)","DOI":"10.1109\/ICCV.2013.84"},{"key":"5617_CR21","doi-asserted-by":"crossref","unstructured":"Felzenszwalb PF, Huttenlocher DP (2005) Pictorial Structures for Object Recognition. International Journal of Computer Vision (IJCV)","DOI":"10.1023\/B:VISI.0000042934.15159.49"},{"key":"5617_CR22","doi-asserted-by":"crossref","unstructured":"Felzenszwalb PF, McAllester D, Ramanan D (2008) A discriminatively trained, multiscale, deformable part model. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2008.4587597"},{"key":"5617_CR23","doi-asserted-by":"publisher","unstructured":"Ferrari V, Marin-Jimenez M, Zisserman A (2008) Progressive search space reduction for human pose estimation. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR) https:\/\/doi.org\/10.1109\/CVPR.2008.4587468","DOI":"10.1109\/CVPR.2008.4587468"},{"key":"5617_CR24","doi-asserted-by":"publisher","unstructured":"Ferrari V, Marin-Jiminez M, Zisserman A (2008) Progressive search space reduction for human pose estimation. In: Proceedings of the IEEE Conferencen Computer Vision and Pattern Recognition (CVPR). https:\/\/doi.org\/10.1109\/CVPR.2008.4587468","DOI":"10.1109\/CVPR.2008.4587468"},{"key":"5617_CR25","doi-asserted-by":"crossref","unstructured":"Ghodrati A, Diba A, Pedersoli M, Tuytelaars T, Van Gool L (2015) DeepProposal: hunting objects by cascading deep convolutional layers. In: international conference on computer vision (ICCV)","DOI":"10.1109\/ICCV.2015.296"},{"key":"5617_CR26","doi-asserted-by":"crossref","unstructured":"Girshick R (2015) Fast R-CNN. In: International Conference on Computer Vision (ICCV)","DOI":"10.1109\/ICCV.2015.169"},{"key":"5617_CR27","doi-asserted-by":"crossref","unstructured":"Girshick R, Donahue J, Darrell T, Malik J (2014) Rich feature hierarchies for accurate object detection and semantic segmentation. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2014.81"},{"key":"5617_CR28","unstructured":"Gkioxari G, Hariharan B, Girshick R, Malik J (2014) R-CNNs for pose estimation and action detection. arXiv:1406.5212"},{"key":"5617_CR29","doi-asserted-by":"crossref","unstructured":"Hariharan B, Arbel\u00e1ez P, Girshick R, Malik J (2015) Hypercolumns for object segmentation and fine-grained localization. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2015.7298642"},{"key":"5617_CR30","doi-asserted-by":"publisher","unstructured":"He T, Mao H, Yi Z (2016) Moving object recognition using multi-view three-dimensional convolutional neural networks. Neural Comput & Applic. https:\/\/doi.org\/10.1007\/s00521-016-2277-9","DOI":"10.1007\/s00521-016-2277-9"},{"key":"5617_CR31","doi-asserted-by":"publisher","unstructured":"Insafutdinov E, Pishchulin L, Andres B, Andriluka M, Schiele B (2016) DeeperCut: a deeper, stronger, and faster multi-person pose estimation model. In: European conference on computer vision (ECCV) Cham. Springer international publishing, pp 34-50. https:\/\/doi.org\/10.1007\/978-3-319-46466-4_3","DOI":"10.1007\/978-3-319-46466-4_3"},{"key":"5617_CR32","doi-asserted-by":"crossref","unstructured":"Ionescu C, Li F, Sminchisescu C (2011) Latent structured models for human pose estimation. In: International conference on computer vision (ICCV). pp 2220\u20132227","DOI":"10.1109\/ICCV.2011.6126500"},{"key":"5617_CR33","doi-asserted-by":"crossref","unstructured":"Iqbal U, Milan A, Gall J (2017) PoseTrack: joint multi-person pose estimation and tracking. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/CVPR.2017.495"},{"key":"5617_CR34","unstructured":"Jain A, Tompson J, Andriluka M, Taylor GW, Bregler C (2013) Learning Human Pose Estimation Features with Convolutional Networks. arXiv:1312.7302"},{"key":"5617_CR35","doi-asserted-by":"publisher","unstructured":"Johnson S, Everingham M (2010) Clustered Pose and Nonlinear Appearance Models for Human Pose Estimation. In: British Machine Vision Conference (BMVC). http:\/\/www.comp.leeds.ac.uk\/mat4saj\/lsp.html . https:\/\/doi.org\/10.5244\/C.24.12","DOI":"10.5244\/C.24.12"},{"key":"5617_CR36","doi-asserted-by":"crossref","unstructured":"Johnson S, Everingham M (2011) Learning effective human pose estimation from inaccurate annotation. In: IEEE conference on computer vision and pattern recognition (CVPR). http:\/\/www.comp.leeds.ac.uk\/mat4saj\/lspet.html","DOI":"10.1109\/CVPR.2011.5995318"},{"key":"5617_CR37","doi-asserted-by":"publisher","unstructured":"Kadkhodamohammadi A, Gangi A, de Mathelin M, Padoy N (2015) Pictorial structures on RGB-D images for human pose estimation in the operating room. In: Medical Image Computing and Computer-Assisted Intervention. pp 363\u2013370. https:\/\/doi.org\/10.1007\/978-3-319-24553-9_45","DOI":"10.1007\/978-3-319-24553-9_45"},{"key":"5617_CR38","unstructured":"Krizhevsky A, Sutskever I, Hinton GE (2012) ImageNet classification with deep convolutional neural networks. In: Neural information processing systems (NIPS). pp 1106\u20131114"},{"key":"5617_CR39","doi-asserted-by":"crossref","unstructured":"LeCun Y, Bottou L, Bengio Y, Haffner P (1998) Gradient-based learning applied to document recognition. In: the IEEE vol 11. pp 2278\u20132324","DOI":"10.1109\/5.726791"},{"key":"5617_CR40","doi-asserted-by":"crossref","unstructured":"Lifshitz I, Fetaya E, Ullman S (2016) Human pose estimation using deep consensus voting. In: European conference on computer vision (ECCV)","DOI":"10.1007\/978-3-319-46475-6_16"},{"key":"5617_CR41","doi-asserted-by":"publisher","unstructured":"Liu Y, Zhang X, Cui J (2010) Visual analysis of child-adult interactive behaviors in video sequences. In: International Conference on Virtual Systems and Multimedia (VSMM) https:\/\/doi.org\/10.1109\/VSMM.2010.5665969","DOI":"10.1109\/VSMM.2010.5665969"},{"key":"5617_CR42","unstructured":"Ye Liu, Jinshi Cui, Zhao H (2012) Fusion of low-and high-dimensional approaches by Trackers sampling for generic human motion tracking. In: 21st International Conference on Pattern Recognition (ICPR)"},{"key":"5617_CR43","unstructured":"Liu Y, Nie L, Han L, Zhang L, Rosenblum DS (2015) Action2Activity: recognizing complex activities from sensor data. In: International conference on artificial intelligence (IJCAI), pp 1617\u20131623"},{"key":"5617_CR44","doi-asserted-by":"crossref","unstructured":"Liu L, Cheng L, Liu Y, Jia Y, Rosenblum DS (2016) Recognizing complex activities by a probabilistic interval-based model. In: AAAI Conference on Artificial Intelligence","DOI":"10.1609\/aaai.v30i1.10155"},{"key":"5617_CR45","doi-asserted-by":"publisher","first-page":"108","DOI":"10.1016\/j.neucom.2015.08.096","volume":"181","author":"Y Liu","year":"2016","unstructured":"Liu Y, Nie L, Liu L, Rosenblum DS (2016) From action to activity: sensor-based activity recognition. Neurocomputing 181:108\u2013115. https:\/\/doi.org\/10.1016\/j.neucom.2015.08.096","journal-title":"Neurocomputing"},{"key":"5617_CR46","doi-asserted-by":"publisher","unstructured":"Lowe DG (1999) Object recognition from local scale-invariant features. In: International Conference on Computer Vision. pp 1150\u20131157. https:\/\/doi.org\/10.1109\/ICCV.1999.790410","DOI":"10.1109\/ICCV.1999.790410"},{"issue":"8","key":"5617_CR47","doi-asserted-by":"crossref","first-page":"10701","DOI":"10.1007\/s11042-015-3188-y","volume":"76","author":"Y Lu","year":"2017","unstructured":"Lu Y, Wei Y, Liu L, Zhong J, Sun L, Liu Y (2017) Towards unsupervised physical activity recognition using smartphone accelerometers. Multimedia Tools Appl 76(8):10701\u201310719","journal-title":"Multimedia Tools Appl"},{"key":"5617_CR48","doi-asserted-by":"crossref","unstructured":"Martinez J, Black MJ, Romero J (2017) On human motion prediction using recurrent neural networks. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/CVPR.2017.497"},{"key":"5617_CR49","doi-asserted-by":"crossref","unstructured":"Newell A, Yang K, Deng J (2016) Stacked hourglass networks for human pose estimation. arXiv:1603.06937","DOI":"10.1007\/978-3-319-46484-8_29"},{"key":"5617_CR50","doi-asserted-by":"crossref","unstructured":"Ojala T, Pietik\u00e4inen M, Harwood D (1994) Performance evaluation of texture measures with classification based on Kullback discrimination of distributions. In: IAPR. Int Conf Pattern Recog (ICPR):582\u2013585","DOI":"10.1109\/ICPR.1994.576366"},{"key":"5617_CR51","doi-asserted-by":"crossref","unstructured":"Ouyang W, Chu X, Wang X (2014) Multi-source deep learning for human pose estimation. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2014.299"},{"key":"5617_CR52","doi-asserted-by":"publisher","unstructured":"Oyedotun OK, Khashman A (2016) Deep learning in vision-based static hand gesture recognition. Neural Comput & Applic. https:\/\/doi.org\/10.1007\/s00521-016-2294-8","DOI":"10.1007\/s00521-016-2294-8"},{"key":"5617_CR53","doi-asserted-by":"crossref","unstructured":"Papandreou G, Zhu T, Kanazawa N, Toshev A, Tompson J, Bregler C, Murphy K (2017) Towards accurate multi-person pose estimation in the wild. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/CVPR.2017.395"},{"key":"5617_CR54","doi-asserted-by":"crossref","unstructured":"Parkhi OM, Vedaldi A, Zisserman A (2015) Deep Face Recognition. In: British Machine Vision Conference (BMVC)","DOI":"10.5244\/C.29.41"},{"key":"5617_CR55","doi-asserted-by":"crossref","unstructured":"Pfister T, Simonyan K, Charles J, Zisserman A (2014) Deep convolutional neural networks for efficient pose estimation in gesture videos. In: Asian Conference on Computer Vision (ACCV)","DOI":"10.1007\/978-3-319-16865-4_35"},{"key":"5617_CR56","doi-asserted-by":"crossref","unstructured":"Pfister T, Charles J, Zisserman A (2015) Flowing ConvNets for human pose estimation in videos. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","DOI":"10.1109\/ICCV.2015.222"},{"key":"5617_CR57","unstructured":"Pinheiro P, Collobert R (2014) Recurrent convolutional neural networks for scene labeling in: international conference on machine learning (ICML). Pp 82-90"},{"key":"5617_CR58","doi-asserted-by":"crossref","unstructured":"Pishchulin L, Insafutdinov E, Tang S, Andres B, Andriluka M, Gehler P, Schiele B (2015) DeepCut: joint subset partition and labeling for multi person pose estimation. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2016.533"},{"key":"5617_CR59","doi-asserted-by":"crossref","unstructured":"Ramanan D (2006) Learning to parse images of articulated objects. Neural information processing systems (NIPS)","DOI":"10.7551\/mitpress\/7503.003.0146"},{"key":"5617_CR60","doi-asserted-by":"crossref","unstructured":"Rogez G, Rihan J, Ramalingam S, Orrite C, Torr PH (2008) Randomized trees for human pose detection. In: IEEE conference on computer vision and pattern recognition (CVPR). pp 1\u20138","DOI":"10.1109\/CVPR.2008.4587617"},{"issue":"12","key":"5617_CR61","doi-asserted-by":"publisher","first-page":"2821","DOI":"10.1109\/TPAMI.2012.241","volume":"35","author":"J Shotton","year":"2013","unstructured":"Shotton J, Fitzgibbon A, Sharp T, Cook M, Finocchio M, Moore R, Kohli P, Criminisi A, Kipman A (2013) Efficient human pose estimation from single depth images. IEEE Trans Pattern Anal Mach Intell (PAMI) 35(12):2821\u20132840. https:\/\/doi.org\/10.1109\/TPAMI.2012.241","journal-title":"IEEE Trans Pattern Anal Mach Intell (PAMI)"},{"key":"5617_CR62","unstructured":"Simonyan K, Zisserman A (2014) Very deep convolutional networks for large-scale image recognition arXiv:1409.1556"},{"key":"5617_CR63","unstructured":"Tompson J, Jain A, LeCun Y, Bregler C (2014) Joint Training of a Convolutional Network and a Graphical Model for Human Pose Estimation. Neural Information Processing Systems (NIPS)"},{"key":"5617_CR64","doi-asserted-by":"crossref","unstructured":"Tompson J, Goroshin R, Jain A, LeCun Y, Bregler C (2015) Efficient object localization using convolutional networks. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2015.7298664"},{"key":"5617_CR65","doi-asserted-by":"crossref","unstructured":"Toshev A, Szegedy C (2014) DeepPose: human pose estimation via deep neural networks. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2014.214"},{"key":"5617_CR66","doi-asserted-by":"crossref","unstructured":"Tran D, Forsyth D (2010) Improved human parsing with a full relational model. In: European conference on computer vision (ECCV) http:\/\/vision.cs.uiuc.edu\/humanparse\/","DOI":"10.1007\/978-3-642-15561-1_17"},{"key":"5617_CR67","doi-asserted-by":"crossref","unstructured":"Uijlings JRR, Ferrari V (2015) Situational object boundary detection. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2015.7299103"},{"key":"5617_CR68","doi-asserted-by":"publisher","unstructured":"Wang Y, Tran D, Liao Z (2011) Learning hierarchical Poselets for human parsing. In: IEEE conference on computer vision and pattern recognition (CVPR). http:\/\/ieeexplore.ieee.org\/abstract\/document\/5995519\/ ; https:\/\/doi.org\/10.1109\/CVPR.2011.5995519","DOI":"10.1109\/CVPR.2011.5995519"},{"key":"5617_CR69","doi-asserted-by":"crossref","unstructured":"Wei S-E, Ramakrishna V, Kanade T, Sheikh Y (2016) Convolutional pose machines. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2016.511"},{"key":"5617_CR70","unstructured":"Xu L, Ren JS, Liu C, Jia J (2014) Deep Convolutional Neural Network for Image Deconvolution. In: Neural Information Processing Systems (NIPS)"},{"key":"5617_CR71","doi-asserted-by":"crossref","unstructured":"Yang Y, Ramanan D (2013) Articulated human detection with flexible mixtures of parts. IEEE transactions on pattern analysis and machine intelligence (PAMI)","DOI":"10.1109\/TPAMI.2012.261"},{"key":"5617_CR72","doi-asserted-by":"crossref","unstructured":"Zagoruyko S, Komodakis N (2015) Learning to compare image patches via convolutional neural networks. In: IEEE conference on computer vision and pattern recognition (CVPR)","DOI":"10.1109\/CVPR.2015.7299064"},{"issue":"4","key":"5617_CR73","doi-asserted-by":"publisher","first-page":"1779","DOI":"10.1109\/TIP.2016.2531283","volume":"25","author":"K Zhang","year":"2016","unstructured":"Zhang K, Liu Q, Wu Y, Yang MH (2016) Robust visual tracking via convolutional networks without training. IEEE Trans Image Process 25(4):1779\u20131792. https:\/\/doi.org\/10.1109\/TIP.2016.2531283","journal-title":"IEEE Trans Image Process"},{"issue":"8","key":"5617_CR74","doi-asserted-by":"publisher","first-page":"1492","DOI":"10.1109\/TPAMI.2016.2526002","volume":"38","author":"F Zhou","year":"2016","unstructured":"Zhou F, De la Torre F (2016) Spatio-temporal matching for human pose estimation in video. IEEE Trans Pattern Anal Mach Intell (PAMI) 38(8):1492\u20131504. https:\/\/doi.org\/10.1109\/TPAMI.2016.2526002","journal-title":"IEEE Trans Pattern Anal Mach Intell (PAMI)"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11042-018-5617-1\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-018-5617-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-018-5617-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,29]],"date-time":"2025-06-29T23:38:49Z","timestamp":1751240329000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11042-018-5617-1"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,1,23]]},"references-count":74,"journal-issue":{"issue":"18","published-print":{"date-parts":[[2018,9]]}},"alternative-id":["5617"],"URL":"https:\/\/doi.org\/10.1007\/s11042-018-5617-1","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"type":"print","value":"1380-7501"},{"type":"electronic","value":"1573-7721"}],"subject":[],"published":{"date-parts":[[2018,1,23]]}}}