{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,2,21]],"date-time":"2025-02-21T07:26:41Z","timestamp":1740122801173,"version":"3.37.3"},"reference-count":48,"publisher":"Springer Science and Business Media LLC","issue":"13","license":[{"start":{"date-parts":[[2017,5,10]],"date-time":"2017-05-10T00:00:00Z","timestamp":1494374400000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61075041, 61105016"],"award-info":[{"award-number":["61075041, 61105016"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2017,7]]},"DOI":"10.1007\/s11042-017-4729-3","type":"journal-article","created":{"date-parts":[[2017,5,10]],"date-time":"2017-05-10T15:34:14Z","timestamp":1494430454000},"page":"15173-15189","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Directional geometric histogram feature extraction and applications"],"prefix":"10.1007","volume":"76","author":[{"given":"Hong","family":"Han","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jingxiang","family":"Gou","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2017,5,10]]},"reference":[{"issue":"1","key":"4729_CR1","doi-asserted-by":"crossref","first-page":"44","DOI":"10.1109\/TPAMI.2006.21","volume":"28","author":"A Agarwal","year":"2006","unstructured":"Agarwal A, Triggs B (2006) Recovering 3D human pose from monocular images. IEEE Trans Pattern Anal Mach Intell 28(1):44\u201358","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"3","key":"4729_CR2","doi-asserted-by":"crossref","first-page":"259","DOI":"10.1007\/s11263-011-0498-z","volume":"99","author":"M Andriluka","year":"2012","unstructured":"Andriluka M, Roth S, Schiele B (2012) Discriminative appearance models for pictorial structures. Int J Comput Vis 99(3):259\u2013280","journal-title":"Int J Comput Vis"},{"issue":"4","key":"4729_CR3","doi-asserted-by":"crossref","first-page":"581","DOI":"10.1177\/0278364913514283","volume":"33","author":"L Bo","year":"2014","unstructured":"Bo L, Ren X, Fox D (2014) Learning hierarchical sparse features for RGB-(D) object recognition. Int J Robot Res 33(4):581\u2013599","journal-title":"Int J Robot Res"},{"issue":"1\u20132","key":"4729_CR4","doi-asserted-by":"crossref","first-page":"28","DOI":"10.1007\/s11263-008-0204-y","volume":"87","author":"L Bo","year":"2010","unstructured":"Bo L, Sminchisescu C (2010) Twin gaussian processes for structured prediction. Int J Comput Vis 87(1\u20132):28\u201352","journal-title":"Int J Comput Vis"},{"key":"4729_CR5","doi-asserted-by":"crossref","unstructured":"Bosch A, Zisserman A, Munoz X (2007) Representing shape with a spatial pyramid kernel. In: Proceedings of the 6th ACM international conference on image and video retrieval, pp 401\u2013408","DOI":"10.1145\/1282280.1282340"},{"key":"4729_CR6","unstructured":"Boureau YL, Ponce J, LeCun Y (2010) A theoretical analysis of feature pooling in visual recognition. In: Proceedings of the 27th international conference on machine learning (ICML-10), pp 111\u2013 118"},{"key":"4729_CR7","doi-asserted-by":"crossref","unstructured":"Cichy RM, Khosla A, Pantazis D, Torralba A, Oliva A (2016) Comparison of deep neural networks to spatio-temporal cortical dynamics of human visual object recognition reveals hierarchical correspondence. Scientific Reports 6","DOI":"10.1038\/srep27755"},{"key":"4729_CR8","unstructured":"Cichy RM, Khosla A, Pantazis D, Torralba A, Oliva A (2016) Deep neural networks predict hierarchical spatio-temporal cortical dynamics of human visual object recognition. arXiv: 1601.02970"},{"key":"4729_CR9","doi-asserted-by":"crossref","unstructured":"Cimpoi M, Maji S, Vedaldi A (2015) Deep filter banks for texture recognition and segmentation. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 3828\u20133836","DOI":"10.1109\/CVPR.2015.7299007"},{"key":"4729_CR10","doi-asserted-by":"crossref","unstructured":"Dalal N, Triggs B (2005) Histograms of oriented gradients for human detection. In: IEEE computer society conference on computer vision and pattern recognition, 2005. CVPR 2005. vol 1, pp 886\u2013893","DOI":"10.1109\/CVPR.2005.177"},{"key":"4729_CR11","doi-asserted-by":"crossref","unstructured":"Dalal N, Triggs B, Schmid C (2006) Human detection using oriented histograms of flow and appearance. In: Computer vision\u2013ECCV 2006, pp 428\u2013441","DOI":"10.1007\/11744047_33"},{"key":"4729_CR12","doi-asserted-by":"crossref","unstructured":"Eichner M, Ferrari V (2013) Appearance sharing for collective human pose estimation. In: Computer vision\u2013ACCV 2012, pp 138\u2013151","DOI":"10.1007\/978-3-642-37331-2_11"},{"issue":"2","key":"4729_CR13","doi-asserted-by":"crossref","first-page":"190","DOI":"10.1007\/s11263-012-0524-9","volume":"99","author":"M Eichner","year":"2012","unstructured":"Eichner M, Marin-Jimenez M, Zisserman A, Ferrari V (2012) 2d articulated human pose estimation and retrieval in (almost) unconstrained still images. Int J Comput Vis 99(2):190\u2013214","journal-title":"Int J Comput Vis"},{"key":"4729_CR14","doi-asserted-by":"crossref","unstructured":"Ekiz E, Cinbi\u015f N\u0130 (2015) A multiple region selection based approach for scene recognition. In: 2015 23nd signal processing and communications applications conference (SIU) IEEE, pp 2238\u20132241","DOI":"10.1109\/SIU.2015.7130321"},{"key":"4729_CR15","unstructured":"Girshick R, Donahue J, Darrell T, Malik J (2013) Rich feature hierarchies for accurate object detection and semantic segmentation. In: Computer vision and pattern recognition, pp 580\u2013587"},{"key":"4729_CR16","unstructured":"Inria person dataset. Website (2005). http:\/\/lear.inrialpes.fr\/data"},{"key":"4729_CR17","doi-asserted-by":"crossref","unstructured":"Kanaujia A, Sminchisescu C, Metaxas D (2007) Semi-supervised hierarchical models for 3d human pose reconstruction. In: IEEE conference on computer vision and pattern recognition, 2007. CVPR\u201907, pp 1\u20138","DOI":"10.1109\/CVPR.2007.383341"},{"key":"4729_CR18","unstructured":"Krizhevsky A, Sutskever I, Hinton GE (2012) Imagenet classification with deep convolutional neural networks. In: Advances in neural information processing systems, pp 1097\u20131105"},{"key":"4729_CR19","doi-asserted-by":"crossref","unstructured":"Lazebnik S, Schmid C, Ponce J (2006) Beyond bags of features: spatial pyramid matching for recognizing natural scene categories. In: IEEE computer society conference on computer vision and pattern recognition, 2006, pp 2169\u20132178","DOI":"10.1109\/CVPR.2006.68"},{"key":"4729_CR20","doi-asserted-by":"crossref","unstructured":"Le QV (2013) Building high-level features using large scale unsupervised learning. In: IEEE international conference on acoustics, speech and signal processing (ICASSP), 2013, pp 8595\u20138598","DOI":"10.1109\/ICASSP.2013.6639343"},{"key":"4729_CR21","doi-asserted-by":"crossref","unstructured":"Le Pennec E, Mallat S (2000) Image compression with geometrical wavelets. In: International conference on image processing, 2000. Proceedings. 2000, vol 1, pp 661\u2013664","DOI":"10.1109\/ICIP.2000.901045"},{"issue":"2","key":"4729_CR22","doi-asserted-by":"crossref","first-page":"91","DOI":"10.1023\/B:VISI.0000029664.99615.94","volume":"60","author":"DG Lowe","year":"2004","unstructured":"Lowe DG (2004) Distinctive image features from scale-invariant keypoints. Int J Comput Vis 60(2): 91\u2013110","journal-title":"Int J Comput Vis"},{"key":"4729_CR23","doi-asserted-by":"crossref","unstructured":"Mesnil G, Rifai S, Bordes A, Glorot X, Bengio Y, Vincent P (2015) Unsupervised learning of semantics of object detections for scene categorization. In: Pattern recognition applications and methods. Springer, pp 209\u2013224","DOI":"10.1007\/978-3-319-12610-4_13"},{"issue":"10","key":"4729_CR24","doi-asserted-by":"crossref","first-page":"1615","DOI":"10.1109\/TPAMI.2005.188","volume":"27","author":"K Mikolajczyk","year":"2005","unstructured":"Mikolajczyk K, Schmid C (2005) A performance evaluation of local descriptors. IEEE Trans Pattern Anal Mach Intell 27(10):1615\u20131630","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"15","key":"4729_CR25","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1007\/s11042-015-2819-7","volume":"75","author":"I Mironica\u030c","year":"2016","unstructured":"Mironica\u030c I, Du\u0163a\u030c IC, Ionescu B, Sebe N (2016) A modified vector of locally aggregated descriptors approach for fast video classification. Multimedia Tools Appl 75(15):1\u201328","journal-title":"Multimedia Tools Appl"},{"key":"4729_CR26","doi-asserted-by":"crossref","unstructured":"Mironica I, Uijlings J, Rostamzadeh N, Ionescu B, Sebe N (2013) Time matters!: capturing variation in time in video using fisher kernels. In: ACM international conference on multimedia, pp 701\u2013704","DOI":"10.1145\/2502081.2502183"},{"key":"4729_CR27","unstructured":"Onishi K, Takiguchi T, Ariki Y (2008) 3D human posture estimation using the HOG features from monocular image. In: 19th international conference on pattern recognition, 2008. ICPR 2008, pp 1\u20134"},{"issue":"4","key":"4729_CR28","doi-asserted-by":"crossref","first-page":"423","DOI":"10.1109\/TIP.2005.843753","volume":"14","author":"EL Pennec","year":"2005","unstructured":"Pennec EL, Mallat S (2005) Sparse geometric image representations with bandelets. IEEE Transactions on Image Processing A Publication of the IEEE Signal Processing Society 14(4):423\u2013 438","journal-title":"IEEE Transactions on Image Processing A Publication of the IEEE Signal Processing Society"},{"key":"4729_CR29","unstructured":"Peyr\u00e9 G, Mallat S (2004) Second generation bandelets and their application to image and 3D meshes compression. Mathematics and Image Analysis MIA 4"},{"issue":"3","key":"4729_CR30","doi-asserted-by":"crossref","first-page":"601","DOI":"10.1145\/1073204.1073236","volume":"24","author":"G Peyr\u00e9","year":"2005","unstructured":"Peyr\u00e9 G, Mallat S (2005) Surface compression with geometric bandelets. ACM Trans Graph (TOG) 24(3):601\u2013608","journal-title":"ACM Trans Graph (TOG)"},{"key":"4729_CR31","unstructured":"Poppe R (2007) Evaluating example-based pose estimation: experiments on the humaneva sets. Centre for Telematics and Information Technology University of Twente"},{"key":"4729_CR32","unstructured":"Raj A, Bhattacharya T, Mukerjee MA Articulated Human Detection and Pose Estimation (CS365 Course Project)"},{"key":"4729_CR33","doi-asserted-by":"crossref","unstructured":"Ren Z, Yan J, Ni B, Liu B, Yang X, Zha H (2017) Unsupervised deep learning for optical flow estimation. In: AAAI conference on artificial intelligence. http:\/\/www.aaai.org\/ocs\/index.php\/AAAI\/AAAI17\/paper\/view\/14388","DOI":"10.1609\/aaai.v31i1.10723"},{"issue":"3","key":"4729_CR34","doi-asserted-by":"crossref","first-page":"222","DOI":"10.1007\/s11263-013-0636-x","volume":"105","author":"J Sanchez","year":"2013","unstructured":"Sanchez J, Perronnin F, Mensink T, Verbeek J (2013) Image classification with the fisher vector: theory and practice. Int J Comput Vis 105(3):222\u2013245","journal-title":"Int J Comput Vis"},{"key":"4729_CR35","doi-asserted-by":"crossref","unstructured":"Seo S, Wallat M, Graepel T, Obermayer K (2000) Gaussian process regression: active data selection and test point rejection. In: Mustererkennung 2000, pp 27\u201334","DOI":"10.1007\/978-3-642-59802-9_4"},{"key":"4729_CR36","doi-asserted-by":"crossref","unstructured":"Sharma G, Jurie F, Schmid C (2012) Discriminative spatial saliency for image classification. In: IEEE conference on computer vision and pattern recognition (CVPR), 2012, pp 3506\u20133513","DOI":"10.1109\/CVPR.2012.6248093"},{"issue":"1-2","key":"4729_CR37","doi-asserted-by":"crossref","first-page":"4","DOI":"10.1007\/s11263-009-0273-6","volume":"87","author":"L Sigal","year":"2010","unstructured":"Sigal L, Balan AO, Black MJ (2010) Humaneva: synchronized video and motion capture dataset and baseline algorithm for evaluation of articulated human motion. Int J Comput Vis 87(1-2):4\u201327","journal-title":"Int J Comput Vis"},{"issue":"11","key":"4729_CR38","doi-asserted-by":"crossref","first-page":"2030","DOI":"10.1109\/TPAMI.2007.1111","volume":"29","author":"C Sminchisescu","year":"2007","unstructured":"Sminchisescu C, Kanaujia A, Metaxas DN (2007) BM 3E: discriminative density propagation for visual tracking. IEEE Trans Pattern Anal Mach Intell 29(11):2030\u20132044","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"8","key":"4729_CR39","doi-asserted-by":"crossref","first-page":"e103575","DOI":"10.1371\/journal.pone.0103575","volume":"9","author":"Y Song","year":"2014","unstructured":"Song Y, McLoughlin IV, Dai LR (2014) Local coding based matching kernel method for image classification. Plos One 9(8):e103575","journal-title":"Plos One"},{"key":"4729_CR40","doi-asserted-by":"crossref","unstructured":"Tepper M, Sapiro G (2012) Decoupled coarse-to-fine matching and nonlinear regularization for efficient motion estimation. In: 19th IEEE international conference on image processing (ICIP), 2012, pp 1517\u20131520","DOI":"10.1109\/ICIP.2012.6467160"},{"key":"4729_CR41","doi-asserted-by":"crossref","first-page":"78","DOI":"10.4236\/jcc.2014.22014","volume":"2","author":"J Tian","year":"2014","unstructured":"Tian J, Li L, Liu W (2014) Multi-scale human pose tracking in 2D monocular images. J Comput Commun 2:78","journal-title":"J Comput Commun"},{"key":"4729_CR42","doi-asserted-by":"crossref","unstructured":"Ukita N (2013) Iterative action and pose recognition using global-and-pose features and action-specific models. In: IEEE international conference on computer vision workshops (ICCVW), 2013, pp 476\u2013483","DOI":"10.1109\/ICCVW.2013.68"},{"issue":"9","key":"4729_CR43","doi-asserted-by":"crossref","first-page":"1582","DOI":"10.1109\/TPAMI.2009.154","volume":"32","author":"KE Van De Sande","year":"2010","unstructured":"Van De Sande KE, Gevers T, Snoek CG (2010) Evaluating color descriptors for object and scene recognition. IEEE Trans Pattern Anal Mach Intell 32(9):1582\u20131596","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"4729_CR44","doi-asserted-by":"crossref","unstructured":"van Gemert JC, Geusebroek JM, Veenman CJ, Smeulders AW (2008) Kernel codebooks for scene categorization. In: Computer vision\u2013ECCV 2008, pp 696\u2013709","DOI":"10.1007\/978-3-540-88690-7_52"},{"key":"4729_CR45","unstructured":"Wang F, Li Y (2013) Learning visual symbols for parsing human poses in images. In: Proceedings of the twenty-third international joint conference on artificial intelligence, pp 2510\u20132516"},{"issue":"4","key":"4729_CR46","doi-asserted-by":"crossref","first-page":"986","DOI":"10.1109\/TMM.2012.2186120","volume":"14","author":"J Wang","year":"2012","unstructured":"Wang J, Gong Y (2012) Discovering image semantics in codebook derivative space. IEEE Trans Multimedia 14(4):986\u2013994","journal-title":"IEEE Trans Multimedia"},{"key":"4729_CR47","unstructured":"Yang J, Yu K, Gong Y, Huang T (2009) Linear spatial pyramid matching using sparse coding for image classification. In: IEEE conference on computer vision and pattern recognition, 2009. CVPR 2009, pp 1794\u20131801"},{"key":"4729_CR48","unstructured":"Zhou B, Khosla A, Lapedriza A, Oliva A, Torralba A (2014) Object detectors emerge in deep scene CNNs. Comput Sci"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11042-017-4729-3\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-017-4729-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-017-4729-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,7,28]],"date-time":"2022-07-28T12:40:07Z","timestamp":1659012007000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11042-017-4729-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2017,5,10]]},"references-count":48,"journal-issue":{"issue":"13","published-print":{"date-parts":[[2017,7]]}},"alternative-id":["4729"],"URL":"https:\/\/doi.org\/10.1007\/s11042-017-4729-3","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"type":"print","value":"1380-7501"},{"type":"electronic","value":"1573-7721"}],"subject":[],"published":{"date-parts":[[2017,5,10]]}}}