{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,5]],"date-time":"2026-06-05T09:16:16Z","timestamp":1780650976566,"version":"3.54.1"},"reference-count":93,"publisher":"Springer Science and Business Media LLC","issue":"2","license":[{"start":{"date-parts":[[2016,11,28]],"date-time":"2016-11-28T00:00:00Z","timestamp":1480291200000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2017,6]]},"DOI":"10.1007\/s11263-016-0970-x","type":"journal-article","created":{"date-parts":[[2016,11,28]],"date-time":"2016-11-28T11:18:44Z","timestamp":1480331924000},"page":"226-250","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":31,"title":["Towards Reversal-Invariant Image Representation"],"prefix":"10.1007","volume":"123","author":[{"given":"Lingxi","family":"Xie","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jingdong","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Weiyao","family":"Lin","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bo","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Qi","family":"Tian","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2016,11,28]]},"reference":[{"key":"970_CR1","doi-asserted-by":"publisher","unstructured":"Alahi, A., Ortiz, R., & Vandergheynst, P. (2012). FREAK: Fast Retina Keypoint. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2012.6247715"},{"key":"970_CR2","doi-asserted-by":"publisher","unstructured":"Angelova, A., & Zhu, S. (2013). Efficient object detection and segmentation for fine-grained recognition. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2013.110"},{"key":"970_CR3","doi-asserted-by":"publisher","unstructured":"Arandjelovic, R., & Zisserman, A. (2012). Three things everyone should know to improve object retrieval. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2012.6248018"},{"issue":"3","key":"970_CR4","doi-asserted-by":"publisher","first-page":"346","DOI":"10.1016\/j.cviu.2007.09.014","volume":"110","author":"H Bay","year":"2008","unstructured":"Bay, H., Ess, A., Tuytelaars, T., & Van Gool, L. (2008). Speeded-up robust features (SURF). Computer Vision and Image Understanding, 110(3), 346\u2013359.","journal-title":"Computer Vision and Image Understanding"},{"issue":"4","key":"970_CR5","doi-asserted-by":"publisher","first-page":"509","DOI":"10.1109\/34.993558","volume":"24","author":"S Belongie","year":"2002","unstructured":"Belongie, S., Malik, J., & Puzicha, J. (2002). Shape matching and object recognition using shape contexts. IEEE Transactions on Pattern Analysis and Machine Intelligence, 24(4), 509\u2013522.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"970_CR6","doi-asserted-by":"publisher","unstructured":"Berg, T., & Belhumeur, P. (2013). POOF: Part-based one-vs-one features for fine-grained categorization, face verification, and attribute estimation. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2013.128"},{"key":"970_CR7","doi-asserted-by":"publisher","unstructured":"Bosch, A., Zisserman, A., & Munoz, X. (2006). Scene classification via pLSA. In International conference on computer vision.","DOI":"10.1007\/11744085_40"},{"key":"970_CR8","doi-asserted-by":"publisher","unstructured":"Calonder, M., Lepetit, V., Strecha, C., & Fua, P. (2010). BRIEF: Binary robust independent elementary features. In European conference on computer vision.","DOI":"10.1007\/978-3-642-15561-1_56"},{"key":"970_CR9","doi-asserted-by":"publisher","unstructured":"Chai, Y., Lempitsky, V., & Zisserman, A. (2013). Symbiotic segmentation and part localization for fine-grained categorization. In International conference on computer vision.","DOI":"10.1109\/ICCV.2013.47"},{"key":"970_CR10","doi-asserted-by":"publisher","unstructured":"Chatfield, K., Lempitsky, V., Vedaldi, A., & Zisserman, A. (2011). The devil is in the details: An evaluation of recent feature encoding methods. In British machine vision conference.","DOI":"10.5244\/C.25.76"},{"key":"970_CR11","doi-asserted-by":"publisher","unstructured":"Chatfield, K., Simonyan, K., Vedaldi, A., & Zisserman, A. (2014). Return of the devil in the details: Delving deep into convolutional nets. In British machine vision conference.","DOI":"10.5244\/C.28.6"},{"key":"970_CR12","unstructured":"Clinchant, S., Csurka, G., Perronnin, F., & Renders, J. (2007). XRCEs participation to ImagEval. ImagEval workshop at CVIR."},{"key":"970_CR13","unstructured":"Csurka, G., Dance, C., Fan, L., Willamowski, J., & Bray, C. (2004). Visual categorization with bags of keypoints. Workshop on statistical learning in computer vision, European conference on computer vision."},{"key":"970_CR14","doi-asserted-by":"publisher","unstructured":"Dalal, N., & Triggs, B. (2005). Histograms of oriented gradients for human detection. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2005.177"},{"key":"970_CR15","doi-asserted-by":"crossref","unstructured":"Deng, J., Dong, W., Socher, R., Li, L., Li, K., & Fei-Fei, L. (2009). ImageNet: A large-scale hierarchical image database. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"970_CR16","unstructured":"Donahue, J., Jia, Y., Vinyals, O., Hoffman, J., Zhang, N., Tzeng, E., & Darrell, T. (2014). DeCAF: A deep convolutional activation feature for generic visual recognition. In IEEE conference international conference on machine learning."},{"key":"970_CR17","first-page":"1871","volume":"9","author":"R Fan","year":"2008","unstructured":"Fan, R., Chang, K., Hsieh, C., Wang, X., & Lin, C. (2008). LIBLINEAR: A library for large linear classification. Journal of Machine Learning Research, 9, 1871\u20131874.","journal-title":"Journal of Machine Learning Research"},{"key":"970_CR18","unstructured":"Feng, J., Ni, B., Tian, Q., & Yan, S. (2011). Geometric Lp-norm feature pooling for image classification. In IEEE conference on computer vision and pattern recognition."},{"key":"970_CR19","doi-asserted-by":"publisher","first-page":"191","DOI":"10.1007\/s11263-014-0741-5","volume":"111","author":"E Gavves","year":"2014","unstructured":"Gavves, E., Fernando, B., Snoek, C., Smeulders, A., & Tuytelaars, T. (2014). Local alignments for fine-grained categorization. International Journal on Computer Vision, 111, 191\u2013212.","journal-title":"International Journal on Computer Vision"},{"key":"970_CR20","doi-asserted-by":"publisher","unstructured":"Girshick, R., Donahue, J., Darrell, T., & Malik, J. (2014). Rich feature hierarchies for accurate object detection and semantic segmentation. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.81"},{"key":"970_CR21","unstructured":"Goodfellow, I., Warde-Farley, D., Mirza, M., Courville, A., & Bengio, Y. (2013). Maxout networks. In International conference on machine learning."},{"key":"970_CR22","doi-asserted-by":"publisher","unstructured":"Grauman, K., & Darrell, T. (2005). The pyramid match kernel: Discriminative classification with sets of image features. In International conference on computer vision.","DOI":"10.1109\/ICCV.2005.239"},{"key":"970_CR23","unstructured":"Griffin, G. (2007). Caltech-256 object category dataset. Technical Report: CNS-TR-2007-001."},{"key":"970_CR24","doi-asserted-by":"publisher","unstructured":"Guo, X., & Cao, X. (2010). FIND: A neat flip invariant descriptor. In International conference on patter recognition.","DOI":"10.1109\/ICPR.2010.131"},{"issue":"9","key":"970_CR25","doi-asserted-by":"publisher","first-page":"1904","DOI":"10.1109\/TPAMI.2015.2389824","volume":"37","author":"K He","year":"2015","unstructured":"He, K., Zhang, X., Ren, S., & Sun, J. (2015). Spatial pyramid pooling in deep convolutional networks for visual recognition. IEEE Transactions on Pattern Analysis and Machine Intelligence, 37(9), 1904\u20131916.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"970_CR26","unstructured":"Ioffe, S., & Szegedy, C. (2015). Batch normalization: Accelerating deep network training by reducing internal covariate shift. In International conference on machine learning."},{"key":"970_CR27","doi-asserted-by":"publisher","unstructured":"Jia, Y., Shelhamer, E., Donahue, J., Karayev, S., Long, J., Girshick, R., Guadarrama, S., & Darrell, T. (2014). CAFFE: Convolutional architecture for fast feature embedding. In ACM international conference on multimedia.","DOI":"10.1145\/2647868.2654889"},{"key":"970_CR28","doi-asserted-by":"publisher","unstructured":"Juneja, M., Vedaldi, A., Jawahar, C., & Zisserman, A. (2013). Blocks that shout: Distinctive parts for scene classification. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2013.124"},{"key":"970_CR29","doi-asserted-by":"publisher","unstructured":"Kobayashi, T. (2014). Dirichlet-based histogram feature transform for image classification. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.413"},{"key":"970_CR30","doi-asserted-by":"publisher","unstructured":"Krause, J., Jin, H., Yang, J., & Fei-Fei, L. (2015). Fine-grained recognition without part annotations. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2015.7299194"},{"key":"970_CR31","unstructured":"Krizhevsky, A., & Hinton, G. (2009). Learning multiple layers of features from tiny images. Technical report, University of Toronto, (Vol. 1(4), p. 7)."},{"key":"970_CR32","unstructured":"Krizhevsky, A., Sutskever, I., & Hinton, G. (2012). ImageNet classification with deep convolutional neural networks. In Advances in neural information processing systems."},{"key":"970_CR33","doi-asserted-by":"publisher","unstructured":"Lapin, M., Schiele, B., & Hein, M. (2014). Scalable multitask representation learning for scene classification. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.186"},{"key":"970_CR34","doi-asserted-by":"publisher","unstructured":"Lazebnik, S., Schmid, C., & Ponce, J. (2006). Beyond bags of features: Spatial pyramid matching for recognizing natural scene categories. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2006.68"},{"key":"970_CR35","unstructured":"LeCun, Y., Denker, J., Henderson, D., Howard, R., Hubbard, W., & Jackel, L. (1990). Handwritten digit recognition with a back-propagation network. In Advances in neural information processing systems."},{"key":"970_CR36","unstructured":"Lee, C., Gallagher, P., & Tu, Z. (2016). Generalizing pooling functions in convolutional neural networks: Mixed, gated, and tree. In International conference on artificial intelligence and statistics."},{"key":"970_CR37","unstructured":"Lee, C., Xie, S., Gallagher, P., Zhang, Z., & Tu, Z. (2015). Deeply-supervised nets. In International conference on artificial intelligence and statistics."},{"key":"970_CR38","doi-asserted-by":"publisher","unstructured":"Leutenegger, S., Chli, M., & Siegwart, R. (2011). BRISK: Binary robust invariant scalable keypoints. In International conference on computer vision.","DOI":"10.1109\/ICCV.2011.6126542"},{"key":"970_CR39","doi-asserted-by":"publisher","unstructured":"Li, L., Guo, Y., Xie, L., Kong, X., & Tian, Q. (2015). Fine-grained visual categorization with fine-tuned segmentation. In International conference on image processing.","DOI":"10.1109\/ICIP.2015.7351156"},{"key":"970_CR40","doi-asserted-by":"publisher","unstructured":"Liang, M., & Hu, X. (2015). Recurrent convolutional neural network for object recognition. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2015.7298958"},{"key":"970_CR41","unstructured":"Lin, M., Chen, Q., & Yan, S. (2014a) Network in network. In International conference on learning representations."},{"key":"970_CR42","doi-asserted-by":"publisher","unstructured":"Lin, D., Lu, C., Liao, R., & Jia, J. (2014b) Learning important spatial pooling regions for scene classification. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.476"},{"key":"970_CR43","doi-asserted-by":"publisher","unstructured":"Lin, D., Shen, X., Lu, C., & Jia, J. (2015). Deep LAC: Deep localization, alignment and classification for fine-grained recognition. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2015.7298775"},{"issue":"3","key":"970_CR44","doi-asserted-by":"publisher","first-page":"342","DOI":"10.1007\/s11263-013-0634-z","volume":"106","author":"K Liu","year":"2014","unstructured":"Liu, K., Skibbe, H., Schmidt, T., Blein, T., Palme, K., Brox, T., et al. (2014). Rotation-invariant HOG descriptors using fourier analysis in polar and spherical coordinates. International Journal of Computer Vision, 106(3), 342\u2013364.","journal-title":"International Journal of Computer Vision"},{"issue":"2","key":"970_CR45","doi-asserted-by":"publisher","first-page":"91","DOI":"10.1023\/B:VISI.0000029664.99615.94","volume":"60","author":"D Lowe","year":"2004","unstructured":"Lowe, D. (2004). Distinctive image features from scale-invariant keypoints. International Journal on Computer Vision, 60(2), 91\u2013110.","journal-title":"International Journal on Computer Vision"},{"key":"970_CR46","doi-asserted-by":"publisher","unstructured":"Ma, R., Chen, J., & Su, Z. (2010). MI-SIFT: Mirror and inversion invariant generalization for SIFT descriptor. In Conference on image and video retrieval.","DOI":"10.1145\/1816041.1816076"},{"key":"970_CR47","unstructured":"Maji, S., Rahtu, E., Kannala, J., Blaschko, M., & Vedaldi, A. (2013). Fine-grained visual classification of aircraft. Technical report."},{"issue":"10","key":"970_CR48","doi-asserted-by":"publisher","first-page":"761","DOI":"10.1016\/j.imavis.2004.02.006","volume":"22","author":"J Matas","year":"2004","unstructured":"Matas, J., Chum, O., Urban, M., & Pajdla, T. (2004). Robust wide-baseline stereo from maximally stable extremal regions. Image and Vision Computing, 22(10), 761\u2013767.","journal-title":"Image and Vision Computing"},{"key":"970_CR49","doi-asserted-by":"publisher","unstructured":"Murray, N., & Perronnin, F. (2014). Generalized max pooling. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.317"},{"key":"970_CR50","unstructured":"Nagadomi. (2014). The Kaggle CIFAR10 network. https:\/\/github.com\/nagadomi\/kaggle-cifar10-torch7\/"},{"key":"970_CR51","doi-asserted-by":"publisher","unstructured":"Nilsback, M., & Zisserman, A. (2008). Automated flower classification over a large number of classes. In International conference on computer vision, graphics & image processing.","DOI":"10.1109\/ICVGIP.2008.47"},{"key":"970_CR52","doi-asserted-by":"publisher","unstructured":"Parkhi, O., Vedaldi, A., Zisserman, A., & Jawahar, C. (2012). Cats and dogs. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2012.6248092"},{"key":"970_CR53","doi-asserted-by":"publisher","unstructured":"Paulin, M., Revaud, J., Harchaoui, Z., Perronnin, F., & Schmid, C. (2014). Transformation pursuit for image classification. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.466"},{"key":"970_CR54","doi-asserted-by":"publisher","unstructured":"Perronnin, F., S\u00e1nchez, J., & Mensink, T. (2010). Improving the Fisher Kernel for large-scale image classification. In European conference on computer vision.","DOI":"10.1007\/978-3-642-15561-1_11"},{"key":"970_CR55","doi-asserted-by":"publisher","unstructured":"Pu, J., Jiang, Y., Wang, J., & Xue, X. (2014). Which looks like which: Exploring inter-class relationships in fine-grained visual categorization. In European conference on computer vision.","DOI":"10.1007\/978-3-319-10578-9_28"},{"key":"970_CR56","doi-asserted-by":"publisher","unstructured":"Qian, Q., Jin, R., Zhu, S., & Lin, Y. (2015). Fine-grained visual categorization via multi-stage metric learning. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2015.7298995"},{"key":"970_CR57","doi-asserted-by":"publisher","unstructured":"Quattoni, A., & Torralba, A. (2009). Recognizing indoor scenes. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2009.5206537"},{"key":"970_CR58","doi-asserted-by":"publisher","unstructured":"Razavian, A., Azizpour, H., Sullivan, J., & Carlsson, S. (2014). CNN features off-the-shelf: An astounding baseline for recognition. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPRW.2014.131"},{"key":"970_CR59","doi-asserted-by":"publisher","unstructured":"Rublee, E., Rabaud, V., Konolige, K., & Bradski, G. (2011). ORB: An efficient alternative to SIFT or SURF. In IEEE conference on international conference on computer vision.","DOI":"10.1109\/ICCV.2011.6126544"},{"key":"970_CR60","first-page":"1","volume":"1","author":"O Russakovsky","year":"2015","unstructured":"Russakovsky, O., Deng, J., Su, H., Krause, J., Satheesh, S., Ma, S., et al. (2015). ImageNet large scale visual recognition challenge. International Journal of Computer Vision, 1, 1\u201342.","journal-title":"International Journal of Computer Vision"},{"issue":"3","key":"970_CR61","doi-asserted-by":"publisher","first-page":"222","DOI":"10.1007\/s11263-013-0636-x","volume":"105","author":"J Sanchez","year":"2013","unstructured":"Sanchez, J., Perronnin, F., Mensink, T., & Verbeek, J. (2013). Image classification with the Fisher vector: Theory and practice. International Journal on Computer Vision, 105(3), 222\u2013245.","journal-title":"International Journal on Computer Vision"},{"key":"970_CR62","unstructured":"Simonyan, K., & Zisserman, A. (2015). Very deep convolutional networks for large-scale image recognition. In International conference on learning representations."},{"key":"970_CR63","doi-asserted-by":"crossref","unstructured":"Skelly, L., & Sclaroff, S. (2007). Improved feature descriptors for 3D surface matching. In Proceedings of SPIE: 6762, two- and three-dimensional methods for inspection and metrology V","DOI":"10.1117\/12.753263"},{"key":"970_CR64","doi-asserted-by":"publisher","unstructured":"Szegedy, C., Liu, W., Jia, Y., Sermanet, P., Reed, S., Anguelov, D., Erhan, D., Vanhoucke, V., & Rabinovich, A. (2015). Going deeper with convolutions. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2015.7298594"},{"issue":"8","key":"970_CR65","doi-asserted-by":"publisher","first-page":"2970","DOI":"10.1109\/TIP.2012.2230011","volume":"22","author":"G Takacs","year":"2013","unstructured":"Takacs, G., Chandrasekhar, V., Tsai, S., Chen, D., Grzeszczuk, R., & Girod, B. (2013). Fast computation of rotation-invariant image features by an approximate radial gradient transform. IEEE Transactions on Image Processing, 22(8), 2970\u20132982.","journal-title":"IEEE Transactions on Image Processing"},{"issue":"11","key":"970_CR66","doi-asserted-by":"publisher","first-page":"1958","DOI":"10.1109\/TPAMI.2008.128","volume":"30","author":"A Torralba","year":"2008","unstructured":"Torralba, A., Fergus, R., & Freeman, W. (2008). 80 Million tiny images: A large data set for nonparametric object and scene recognition. IEEE Transactions on Pattern Analysis and Machine Intelligence, 30(11), 1958\u20131970.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"9","key":"970_CR67","first-page":"1582","volume":"32","author":"T Tuytelaars","year":"2010","unstructured":"Tuytelaars, T. (2010). Dense interest points. Computer Vision and Pattern Recognition, 32(9), 1582\u20131596.","journal-title":"Computer Vision and Pattern Recognition"},{"issue":"9","key":"970_CR68","doi-asserted-by":"publisher","first-page":"1582","DOI":"10.1109\/TPAMI.2009.154","volume":"32","author":"K Sande van de","year":"2010","unstructured":"van de Sande, K., Gevers, T., & Snoek, C. (2010). Evaluating color descriptors for object and scene recognition. IEEE Transactions on Pattern Analysis and Machine Intelligence, 32(9), 1582\u20131596.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"970_CR69","doi-asserted-by":"publisher","unstructured":"Vedaldi, A., & Fulkerson, B. (2010). VLFeat: An open and portable library of computer vision algorithms. In ACM international conference on multimedia.","DOI":"10.1145\/1873951.1874249"},{"key":"970_CR70","unstructured":"Vedaldi, A., & Lenc, K. (2014). MatConvNet-convolutional neural networks for MATLAB. arXiv:1412.4564 ."},{"key":"970_CR71","unstructured":"Wah, C., Branson, S., Welinder, P., Perona, P., & Belongie, S. (2011). The Caltech-UCSD Birds-200-2011 Dataset. Technical report: CNS-TR-2011-001."},{"key":"970_CR72","unstructured":"Wang, Z., Fan, B., & Wu, F. (2011). Local intensity order pattern for feature description. In IEEE conference on international conference on computer vision."},{"key":"970_CR73","first-page":"1","volume":"1","author":"Z Wang","year":"2014","unstructured":"Wang, Z., Feng, J., & Yan, S. (2014). Collaborative linear coding for robust image classification. International Journal on Computer Vision, 1, 1\u201312.","journal-title":"International Journal on Computer Vision"},{"key":"970_CR74","doi-asserted-by":"publisher","unstructured":"Wang, J., Yang, J., Yu, K., Lv, F., Huang, T., & Gong, Y. (2010). Locality-constrained linear coding for image classification. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2010.5540018"},{"key":"970_CR75","unstructured":"Xiao, J., Hays, J., Ehinger, K., Oliva, A., & Torralba, A. (2010). SUN satabase: Large-scale scene recognition from Abbey to Zoo. In IEEE conference on computer vision and pattern recognition."},{"key":"970_CR76","doi-asserted-by":"publisher","unstructured":"Xie, L., Hong, R., Zhang, B., & Tian, Q. (2015a). Image classification and retrieval are ONE. In International conference on multimedia retrieval.","DOI":"10.1145\/2671188.2749289"},{"key":"970_CR77","doi-asserted-by":"publisher","unstructured":"Xie, L., Tian, Q., Hong, R., Yan, S., & Zhang, B. (2013). Hierarchical part matching for fine-grained visual categorization. In International conference on computer vision.","DOI":"10.1109\/ICCV.2013.206"},{"issue":"5","key":"970_CR78","doi-asserted-by":"publisher","first-page":"1994","DOI":"10.1109\/TIP.2014.2310117","volume":"23","author":"L Xie","year":"2014","unstructured":"Xie, L., Tian, Q., Wang, M., & Zhang, B. (2014a). Spatial pooling of heterogeneous features for image classification. IEEE Transactions on Image Processing, 23(5), 1994\u20132008.","journal-title":"IEEE Transactions on Image Processing"},{"key":"970_CR79","unstructured":"Xie, L., Tian, Q., & Zhang, B. (2015b). Image classification with Max-SIFT descriptors. In International conference on acoustics, speech and signal processing."},{"key":"970_CR80","doi-asserted-by":"crossref","unstructured":"Xie, L., Tian, Q., & Zhang, B. (2015c). Simple techniques make sense: Feature pooling and normalization for image classification. In IEEE transactions on circuits and systems for video technology.","DOI":"10.1109\/TCSVT.2015.2461978"},{"key":"970_CR81","doi-asserted-by":"publisher","unstructured":"Xie, L., Wang, J., Guo, B., Zhang, B., & Tian, Q. (2014b). Orientational pyramid matching for recognizing indoor scenes. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.477"},{"key":"970_CR82","doi-asserted-by":"crossref","unstructured":"Xie, L., Wang, J., Lin, W., Zhang, B., & Tian, Q. (2015d). RIDE: Reversal invariant descriptor enhancement. In International conference on computer vision.","DOI":"10.1109\/ICCV.2015.20"},{"key":"970_CR83","unstructured":"Yang, J., Yu, K., Gong, Y., & Huang, T. (2009). Linear spatial pyramid matching using sparse coding for image classification. In IEEE conference on computer vision and pattern recognition."},{"key":"970_CR84","doi-asserted-by":"publisher","unstructured":"Yang, Y., & Newsam, S. (2010). Bag-of-visual-words and spatial extensions for land-use classification. In International conference on advances in geographic information systems.","DOI":"10.1145\/1869790.1869829"},{"key":"970_CR85","doi-asserted-by":"publisher","unstructured":"Zeiler, M., & Fergus, R. (2014). Visualizing and understanding convolutional networks. In European conference on computer vision.","DOI":"10.1007\/978-3-319-10590-1_53"},{"key":"970_CR86","doi-asserted-by":"crossref","unstructured":"Zhang, N., Donahue, J., Girshick, R., & Darrell, T. (2014a). Part-based R-CNNs for fine-grained category detection. In European conference on computer vision.","DOI":"10.1007\/978-3-319-10590-1_54"},{"key":"970_CR87","doi-asserted-by":"publisher","unstructured":"Zhang, N., Farrell, R., Iandola, F., & Darrell, T. (2013). Deformable part descriptors for fine-grained recognition and attribute prediction. In International conference on computer vision.","DOI":"10.1109\/ICCV.2013.96"},{"key":"970_CR88","doi-asserted-by":"publisher","unstructured":"Zhang, S., Tian, Q., Hua, G., Huang, Q., & Li, S. (2009). Descriptive visual words and visual phrases for image applications. In ACM international conference on multimedia.","DOI":"10.1145\/1631272.1631285"},{"key":"970_CR89","doi-asserted-by":"publisher","unstructured":"Zhang, X., Xiong, H., Zhou, W., Lin, W., & Tian, Q. (2016). Picking deep filter responses for fine-grained image recognition. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2016.128"},{"key":"970_CR90","doi-asserted-by":"publisher","unstructured":"Zhang, X., Xiong, H., Zhou, W., & Tian, Q. (2014b). Fused one-vs-all mid-level features for fine-grained visual categorization. In ACM international conference on multimedia.","DOI":"10.1145\/2647868.2654937"},{"issue":"3","key":"970_CR91","doi-asserted-by":"publisher","first-page":"980","DOI":"10.1109\/TIP.2012.2226043","volume":"22","author":"W Zhao","year":"2013","unstructured":"Zhao, W., & Ngo, C. (2013). Flip-invariant SIFT for copy and object detection. IEEE Transactions on Image Processing, 22(3), 980\u2013991.","journal-title":"IEEE Transactions on Image Processing"},{"key":"970_CR92","unstructured":"Zhou, B., Lapedriza, A., Xiao, J., Torralba, A., & Oliva, A. (2014). Learning deep features for scene recognition using places database. In Advances in neural information processing systems."},{"key":"970_CR93","doi-asserted-by":"publisher","unstructured":"Zhou, X., Yu, K., Zhang, T., & Huang, T. (2010). Image classification using super-vector coding of local image descriptors. In European conference on computer vision.","DOI":"10.1007\/978-3-642-15555-0_11"}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11263-016-0970-x\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-016-0970-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-016-0970-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,15]],"date-time":"2019-09-15T21:15:53Z","timestamp":1568582153000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11263-016-0970-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,11,28]]},"references-count":93,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2017,6]]}},"alternative-id":["970"],"URL":"https:\/\/doi.org\/10.1007\/s11263-016-0970-x","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,11,28]]}}}