{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,20]],"date-time":"2026-07-20T04:11:24Z","timestamp":1784520684465,"version":"3.55.0"},"reference-count":105,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2023,8,24]],"date-time":"2023-08-24T00:00:00Z","timestamp":1692835200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,8,24]],"date-time":"2023-08-24T00:00:00Z","timestamp":1692835200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["NO. 61976038"],"award-info":[{"award-number":["NO. 61976038"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["NO.61932020"],"award-info":[{"award-number":["NO.61932020"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"name":"The Taishan Scholar Program of Shandong Province"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2024,1]]},"DOI":"10.1007\/s11263-023-01873-z","type":"journal-article","created":{"date-parts":[[2023,8,24]],"date-time":"2023-08-24T09:02:43Z","timestamp":1692867763000},"page":"137-160","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":47,"title":["Accurate Fine-Grained Object Recognition with Structure-Driven Relation Graph Networks"],"prefix":"10.1007","volume":"132","author":[{"given":"Shijie","family":"Wang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhihui","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Haojie","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jianlong","family":"Chang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Wanli","family":"Ouyang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Qi","family":"Tian","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2023,8,24]]},"reference":[{"key":"1873_CR1","doi-asserted-by":"crossref","unstructured":"Bai, S., Bai, X., & Tian, Q. (2017). Scalable person re-identification on supervised smoothed manifold. In: 2017 IEEE conference on computer vision and pattern recognition, CVPR 2017, Honolulu, HI, USA, July 21\u201326, pp. 3356\u20133365.","DOI":"10.1109\/CVPR.2017.358"},{"issue":"10","key":"1873_CR2","doi-asserted-by":"publisher","first-page":"6854","DOI":"10.1109\/TPAMI.2021.3099253","volume":"44","author":"Y Bai","year":"2022","unstructured":"Bai, Y., Liu, J., Lou, Y., Wang, C., & Duan, L. (2022). Disentangled feature learning network and a comprehensive benchmark for vehicle re-identification. IEEE Transactions on Pattern Analysis and Machine Intelligence, 44(10), 6854\u20136871.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"9","key":"1873_CR3","doi-asserted-by":"publisher","first-page":"2385","DOI":"10.1109\/TMM.2018.2796240","volume":"20","author":"Y Bai","year":"2018","unstructured":"Bai, Y., Lou, Y., Gao, F., Wang, S., Wu, Y., & Duan, L. (2018). Group-sensitive triplet embedding for vehicle reidentification. IEEE Transactions on Multimedia, 20(9), 2385\u20132399.","journal-title":"IEEE Transactions on Multimedia"},{"key":"1873_CR4","doi-asserted-by":"publisher","first-page":"6017","DOI":"10.1109\/TIP.2022.3205215","volume":"31","author":"A Bera","year":"2022","unstructured":"Bera, A., Wharton, Z., Liu, Y., Bessis, N., & Behera, A. (2022). SR-GNN: spatial relation-aware graph neural network for fine-grained image categorization. IEEE Transactions on Image Processing, 31, 6017\u20136031.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1873_CR5","doi-asserted-by":"crossref","unstructured":"Branson, S., Horn, G.V., Belongie, S.J., Perona, P. (2014). Bird species categorization using pose normalized deep convolutional nets. CoRR:1406.2952","DOI":"10.5244\/C.28.87"},{"key":"1873_CR6","doi-asserted-by":"crossref","unstructured":"Cai, S., Zuo, W., & Zhang, L. (2017). Higher-order integration of hierarchical convolutional activations for fine-grained visual categorization. In: ICCV 2017, Venice, Italy, October 22\u201329, pp. 511\u2013520","DOI":"10.1109\/ICCV.2017.63"},{"key":"1873_CR7","doi-asserted-by":"crossref","unstructured":"Carion, N., Massa, F., Synnaeve, G., Usunier, N., Kirillov, A., Zagoruyko, S. (2020). End-to-end object detection with transformers. In: Computer vision\u2014ECCV 2020\u201416th European Conference, Glasgow, UK, August 23\u201328, Proceedings, Part I, pp. 213\u2013229.","DOI":"10.1007\/978-3-030-58452-8_13"},{"key":"1873_CR8","doi-asserted-by":"crossref","unstructured":"Chen, Y., Bai, Y., Zhang, W., & Mei, T. (2019). Destruction and construction learning for fine-grained image recognition. In: IEEE conference on computer vision and pattern recognition, CVPR 2019, Long Beach, CA, USA, June 16-20, pp. 5157\u20135166.","DOI":"10.1109\/CVPR.2019.00530"},{"key":"1873_CR9","doi-asserted-by":"crossref","unstructured":"Chen, B., Deng, W., & Hu, J. (2019). Mixed high-order attention network for person re-identification. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 371\u2013381.","DOI":"10.1109\/ICCV.2019.00046"},{"key":"1873_CR10","doi-asserted-by":"crossref","unstructured":"Chen, T., Lin, L., Chen, R., Wu, Y., & Luo, X. (2018). Knowledge-embedded representation learning for fine-grained image recognition. In: Lang, J. (ed.) Proceedings of the twenty-seventh international joint conference on artificial intelligence, IJCAI 2018, July 13\u201319, Stockholm, Sweden, pp. 627\u2013634.","DOI":"10.24963\/ijcai.2018\/87"},{"key":"1873_CR11","doi-asserted-by":"crossref","unstructured":"Chen, G., Lin, C., Ren, L., Lu, J., & Zhou, J. (2019). Self-critical attention learning for person re-identification. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 9636\u20139645.","DOI":"10.1109\/ICCV.2019.00973"},{"key":"1873_CR12","doi-asserted-by":"crossref","unstructured":"Choi, S., Kim, J.T., & Choo, J. (2020). Cars can\u2019t fly up in the sky: Improving urban-scene segmentation via height-driven attention networks. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u20139, pp. 9370\u20139380.","DOI":"10.1109\/CVPR42600.2020.00939"},{"key":"1873_CR13","doi-asserted-by":"crossref","unstructured":"Chu, R., Sun, Y., Li, Y., Liu, Z., Zhang, C., & Wei, Y. (2019) Vehicle re-identification with viewpoint-aware metric learning. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 8281\u20138290.","DOI":"10.1109\/ICCV.2019.00837"},{"key":"1873_CR14","doi-asserted-by":"crossref","unstructured":"Cui, Y., Zhou, F., Wang, J., Liu, X., Lin, Y., & Belongie, S.J. (2017). Kernel pooling for convolutional neural networks. In: CVPR 2017, Honolulu, HI, USA, July 21\u201326, pp. 3049\u20133058","DOI":"10.1109\/CVPR.2017.325"},{"key":"1873_CR15","doi-asserted-by":"crossref","unstructured":"Deng, J., Guo, J., Xue, N., & Zafeiriou, S. (2019). Arcface: Additive angular margin loss for deep face recognition. In: IEEE conference on computer vision and pattern recognition, CVPR 2019, Long Beach, CA, USA, June 16\u201320, pp. 4690\u20134699.","DOI":"10.1109\/CVPR.2019.00482"},{"key":"1873_CR16","unstructured":"Dereli, O., Oguz, C., & G\u00f6nen, M. (2019). A multitask multiple kernel learning algorithm for survival analysis with application to cancer biology. In: Chaudhuri, K., Salakhutdinov, R. (eds.) Proceedings of the 36th international conference on machine learning, ICML 2019, 9\u201315 June 2019, Long Beach, California, USA. Proceedings of Machine Learning Research, vol. 97, pp. 1576\u20131585."},{"key":"1873_CR17","unstructured":"Diao, Q., Jiang, Y., Wen, B., Sun, J., & Yuan, Z. (2022). Metaformer: A unified meta framework for fine-grained recognition. CoRR:2203.02751"},{"key":"1873_CR18","doi-asserted-by":"crossref","unstructured":"Ding, Y., Zhou, Y., Zhu, Y., Ye, Q., & Jiao, J. (2019). Selective sparse sampling for fine-grained image recognition. In: The IEEE international conference on computer vision (ICCV).","DOI":"10.1109\/ICCV.2019.00670"},{"key":"1873_CR19","unstructured":"Dosovitskiy, A., Beyer, L., Kolesnikov, A., Weissenborn, D., Zhai, X., Unterthiner, T., Dehghani, M., Minderer, M., Heigold, G., Gelly, S., Uszkoreit, J., & Houlsby, N. (2021). An image is worth 16x16 words: Transformers for image recognition at scale. In: 9th International conference on learning representations, ICLR 2021, Virtual Event, Austria, May 3\u20137."},{"key":"1873_CR20","unstructured":"Dubey, A., Gupta, O., Raskar, R., & Naik, N. (2018) Maximum-entropy fine grained classification. In: Bengio, S., Wallach, H.M., Larochelle, H., Grauman, K., Cesa-Bianchi, N., Garnett, R. (eds.) Advances in neural information processing systems 31: Annual conference on neural information processing systems 2018, NeurIPS 2018, December 3\u20138, 2018, Montr\u00e9al, Canada, pp. 635\u2013645."},{"key":"1873_CR21","doi-asserted-by":"crossref","unstructured":"Fang, P., Zhou, J., Roy, S.K., Petersson, L., & Harandi, M. (2019). Bilinear attention networks for person retrieval. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 8029\u20138038.","DOI":"10.1109\/ICCV.2019.00812"},{"key":"1873_CR22","doi-asserted-by":"crossref","unstructured":"Gao, Y., Beijbom, O., Zhang, N., & Darrell, T. (2016). Compact bilinear pooling. In: CVPR 2016, Las Vegas, NV, USA, June 27\u201330, pp. 317\u2013326.","DOI":"10.1109\/CVPR.2016.41"},{"key":"1873_CR23","doi-asserted-by":"crossref","unstructured":"Ge, W., Lin, X., Yu, Y. (2019). Weakly supervised complementary parts models for fine-grained image classification from the bottom up. In: IEEE conference on computer vision and pattern recognition, CVPR 2019, Long Beach, CA, USA, June 16\u201320, pp. 3034\u20133043.","DOI":"10.1109\/CVPR.2019.00315"},{"key":"1873_CR24","doi-asserted-by":"crossref","unstructured":"Guo, Y., Zhang, L., Hu, Y., He, X., & Gao, J. (2016). Ms-celeb-1m: A dataset and benchmark for large-scale face recognition. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) Computer Vision\u2014ECCV 2016\u201414th European conference, Amsterdam, The Netherlands, October 11-14, 2016, Proceedings, Part III. Lecture Notes in Computer Science, vol. 9907, pp. 87\u2013102.","DOI":"10.1007\/978-3-319-46487-9_6"},{"key":"1873_CR25","doi-asserted-by":"crossref","unstructured":"He, J., Chen, J., Liu, S., Kortylewski, A., Yang, C., Bai, Y., & Wang, C. (2022). Transfg: A transformer architecture for fine-grained recognition. In: Thirty-Sixth AAAI conference on artificial intelligence, AAAI 2022, thirty-fourth conference on innovative applications of artificial intelligence, IAAI 2022, the twelveth symposium on educational advances in artificial intelligence, EAAI 2022 virtual event, February 22\u2013March 1, 2022, pp. 852\u2013860.","DOI":"10.1609\/aaai.v36i1.19967"},{"key":"1873_CR26","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., & Sun, J. (2016). Deep residual learning for image recognition. In: CVPR 2016, Las Vegas, NV, USA, June 27\u201330, pp. 770\u2013778.","DOI":"10.1109\/CVPR.2016.90"},{"issue":"9","key":"1873_CR27","doi-asserted-by":"publisher","first-page":"1235","DOI":"10.1007\/s11263-019-01176-2","volume":"127","author":"X He","year":"2019","unstructured":"He, X., Peng, Y., & Zhao, J. (2019). Which and how many regions to gaze: Focus discriminative regions for fine-grained visual categorization. International Journal of Computer Vision, 127(9), 1235\u20131255.","journal-title":"International Journal of Computer Vision"},{"key":"1873_CR28","doi-asserted-by":"crossref","unstructured":"Horn, G.V., Aodha, O.M., Song, Y., Cui, Y., Sun, C., Shepard, A., Adam, H., Perona, P., & Belongie, S.J. (2018). The inaturalist species classification and detection dataset. In: 2018 IEEE conference on computer vision and pattern recognition, CVPR 2018, Salt Lake City, UT, USA, June 18\u201322, pp. 8769\u20138778.","DOI":"10.1109\/CVPR.2018.00914"},{"key":"1873_CR29","doi-asserted-by":"crossref","unstructured":"Hou, R., Ma, B., Chang, H., Gu, X., Shan, S., & Chen, X. (2019) Interaction-and-aggregation network for person re-identification. In: IEEE conference on computer vision and pattern recognition, CVPR 2019, Long Beach, CA, USA, June 16\u201320, 2019, pp. 9317\u20139326.","DOI":"10.1109\/CVPR.2019.00954"},{"key":"1873_CR30","doi-asserted-by":"crossref","unstructured":"Hu, Y., Jin, X., Zhang, Y., Hong, H., Zhang, J., He, Y., & Xue, H. (2021). Rams-trans: Recurrent attention multi-scale transformer for fine-grained image recognition. In: Shen, H.T., Zhuang, Y., Smith, J.R., Yang, Y., C\u00e9sar, P., Metze, F., Prabhakaran, B. (eds.) MM \u201921: ACM multimedia conference, Virtual Event, China, October 20\u201324, pp. 4239\u20134248.","DOI":"10.1145\/3474085.3475561"},{"key":"1873_CR31","doi-asserted-by":"crossref","unstructured":"Hu, L., Zhang, P., Zhang, B., Pan, P., Xu, Y., & Jin, R. (2021). Learning position and target consistency for memory-based video object segmentation. In: IEEE conference on computer vision and pattern recognition, CVPR 2021, Virtual, June 19\u201325, pp 4144\u20134154.","DOI":"10.1109\/CVPR46437.2021.00413"},{"key":"1873_CR32","doi-asserted-by":"crossref","unstructured":"Huang, Z., & Li, Y. (2020). Interpretable and accurate fine-grained recognition via region grouping. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u201319, 2020, pp. 8659\u20138669","DOI":"10.1109\/CVPR42600.2020.00869"},{"key":"1873_CR33","doi-asserted-by":"crossref","unstructured":"Huang, S., Wang, X., & Tao, D. (2021). Stochastic partial swap: Enhanced model generalization and interpretability for fine-grained recognition. In: 2021 IEEE\/CVF international conference on computer vision, ICCV 2021, Montreal, QC, Canada, October 10\u201317, pp. 600\u2013609.","DOI":"10.1109\/ICCV48922.2021.00066"},{"key":"1873_CR34","doi-asserted-by":"crossref","unstructured":"Huang, Y., Wang, Y., Tai, Y., Liu, X., Shen, P., Li, S., Li, J., & Huang, F. (2020). Curricularface: Adaptive curriculum learning loss for deep face recognition. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u201319, pp. 5900\u20135909.","DOI":"10.1109\/CVPR42600.2020.00594"},{"key":"1873_CR35","doi-asserted-by":"crossref","unstructured":"Huang, S., Xu, Z., Tao, D., & Zhang, Y. (2016) Part-stacked CNN for fine-grained visual categorization. In: 2016 IEEE conference on computer vision and pattern recognition, CVPR 2016, Las Vegas, NV, USA, June 27\u201330, pp. 1173\u20131182","DOI":"10.1109\/CVPR.2016.132"},{"key":"1873_CR36","doi-asserted-by":"crossref","unstructured":"Ji, R., Wen, L., Zhang, L., Du, D., Wu, Y., Zhao, C., Liu, X., & Huang, F. (2020). Attention convolutional binary neural tree for fine-grained visual categorization. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13-19, 2020, pp. 10465\u201310474","DOI":"10.1109\/CVPR42600.2020.01048"},{"key":"1873_CR37","doi-asserted-by":"crossref","unstructured":"Jin, X., Lan, C., Zeng, W., & Chen, Z. (2020). Uncertainty-aware multi-shot knowledge distillation for image-based object re-identification. In: The thirty-fourth AAAI conference on artificial intelligence, AAAI2020, the thirty-second innovative applications of artificial intelligence conference, IAAI 2020, the tenth AAAI symposium on educational advances in artificial intelligence, EAAI 2020, New York, NY, USA, February 7\u201312, 2020, pp. 11165\u201311172.","DOI":"10.1609\/aaai.v34i07.6774"},{"key":"1873_CR38","doi-asserted-by":"crossref","unstructured":"Joung, S., Kim, S., Kim, M., Kim, I., & Sohn, K. (2021). Learning canonical 3d object representation for fine-grained recognition. In: 2021 IEEE\/CVF international conference on computer vision, ICCV 2021, Montreal, QC, Canada, October 10\u201317, pp. 1015\u20131025.","DOI":"10.1109\/ICCV48922.2021.00107"},{"key":"1873_CR39","doi-asserted-by":"crossref","unstructured":"Kalayeh, M.M., Basaran, E., G\u00f6kmen, M., Kamasak, M.E., & Shah, M. (2018). Human semantic parsing for person re-identification. In: 2018 IEEE conference on computer vision and pattern recognition, CVPR 2018, Salt Lake City, UT, USA, June 18\u201322, pp. 1062\u20131071","DOI":"10.1109\/CVPR.2018.00117"},{"key":"1873_CR40","doi-asserted-by":"crossref","unstructured":"Khorramshahi, P., Kumar, A., Peri, N., Rambhatla, S.S., Chen, J., & Chellappa, R (2019): A dual path modelwith adaptive attention for vehicle re-identification. CoRR:1905.03397","DOI":"10.1109\/ICCV.2019.00623"},{"key":"1873_CR41","doi-asserted-by":"crossref","unstructured":"Khorramshahi, P., Kumar, A., Peri, N., Rambhatla, S.S., Chen, J., & Chellappa, R. (2019) A dual-path model with adaptive attention for vehicle re-identification. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 6131\u20136140.","DOI":"10.1109\/ICCV.2019.00623"},{"key":"1873_CR42","doi-asserted-by":"crossref","unstructured":"Khorramshahi, P., Peri, N., Chen, J., & Chellappa, R. (2020). The devil is in the details: Self-supervised attention for vehicle re-identification. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J. (eds.) Computer vision\u2014ECCV 2020\u201416th European conference, Glasgow, UK, August 23-28, 2020, Proceedings, Part XIV. Lecture Notes in Computer Science, vol. 12359, pp. 369\u2013386.","DOI":"10.1007\/978-3-030-58568-6_22"},{"key":"1873_CR43","doi-asserted-by":"crossref","unstructured":"Kim, M., Jain, A.K., & Liu, X. (2022). Adaface: Quality adaptive margin for face recognition. In: IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2022, New Orleans, LA, USA, June 18\u201324, pp. 18729\u201318738.","DOI":"10.1109\/CVPR52688.2022.01819"},{"key":"1873_CR44","doi-asserted-by":"crossref","unstructured":"Kim, Y., Park, W., & Shin, J. (2020). Broadface: Looking at tens of thousands of people at once for face recognition. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J. (eds.) Computer vision\u2014ECCV 2020\u201416th European conference, Glasgow, UK, August 23-28, 2020, Proceedings, Part IX. Lecture Notes in Computer Science, vol. 12354, pp. 536\u2013552.","DOI":"10.1007\/978-3-030-58545-7_31"},{"key":"1873_CR45","doi-asserted-by":"crossref","unstructured":"Kong, S., & Fowlkes, C.C. (2017). Low-rank bilinear pooling for fine-grained classification. In: CVPR 2017, Honolulu, HI, USA, July 21\u201326, pp. 7025\u20137034.","DOI":"10.1109\/CVPR.2017.743"},{"key":"1873_CR46","doi-asserted-by":"crossref","unstructured":"Krause, J., Jin, H., Yang, J., & Li, F. (2015). Fine-grained recognition without part annotations. In: CVPR 2015, Boston, MA, USA, June 7\u201312, pp. 5546\u20135555","DOI":"10.1109\/CVPR.2015.7299194"},{"key":"1873_CR47","doi-asserted-by":"crossref","unstructured":"Krause, J., Stark, M., Deng, J., & Fei-Fei, L. (2013). 3d object representations for fine-grained categorization. In: ICCV Workshops 2013, Sydney, Australia, December 1\u20138, pp. 554\u2013561","DOI":"10.1109\/ICCVW.2013.77"},{"key":"1873_CR48","doi-asserted-by":"crossref","unstructured":"Kumar, R., Weill, E., Aghdasi, F., & Sriram, P. (2019). Vehicle re-identification: an efficient baseline using triplet embedding. In: International joint conference on neural networks, IJCNN 2019 Budapest, Hungary, July 14\u201319, pp. 1\u20139.","DOI":"10.1109\/IJCNN.2019.8852059"},{"key":"1873_CR49","doi-asserted-by":"crossref","unstructured":"Li, S., Xu, J., Xu, X., Shen, P., Li, S., & Hooi, B. (2021) Spherical confidence learning for face recognition. In: IEEE conference on computer vision and pattern recognition, CVPR 2021, Virtual, June 19\u201325, pp. 15629\u201315637.","DOI":"10.1109\/CVPR46437.2021.01537"},{"key":"1873_CR50","doi-asserted-by":"crossref","unstructured":"Lin, T., Roy Chowdhury, A., & Maji, S. (2015). Bilinear CNN models for fine-grained visual recognition. In: ICCV 2015, Santiago, Chile, December 7\u201313, pp. 1449\u20131457.","DOI":"10.1109\/ICCV.2015.170"},{"key":"1873_CR51","doi-asserted-by":"crossref","unstructured":"Liu, X., Liu, W., Mei, T., & Ma, H. (2016). A deep learning-based approach to progressive vehicle re-identification for urban surveillance. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) Computer Vision\u2014ECCV 2016\u201414th European conference, Amsterdam, The Netherlands, October 11-14, 2016, Proceedings, Part II. Lecture Notes in Computer Science, vol. 9906, pp. 869\u2013884.","DOI":"10.1007\/978-3-319-46475-6_53"},{"key":"1873_CR52","doi-asserted-by":"crossref","unstructured":"Liu, H., Tian, Y., Wang, Y., Pang, L., & Huang, T. (2016). Deep relative distance learning: Tell the difference between similar vehicles. In: 2016 IEEE conference on computer vision and pattern recognition, CVPR 2016, Las Vegas, NV, USA, June 27-30, pp. 2167\u20132175.","DOI":"10.1109\/CVPR.2016.238"},{"key":"1873_CR53","doi-asserted-by":"crossref","unstructured":"Liu, J., Wu, Y., Wu, Y., Li, C., Hu, X., Liang, D., & Wang, M. (2021). DAM: discrepancy alignment metric for face recognition. In: 2021 IEEE\/CVF international conference on computer vision, ICCV2021, Montreal, QC, Canada, October 10-17, pp. 3794\u20133803.","DOI":"10.1109\/ICCV48922.2021.00379"},{"key":"1873_CR54","doi-asserted-by":"crossref","unstructured":"Liu, Y., Zhou, L., Zhang, P., Bai, X., Gu, L., Yu, X., Zhou, J., Hancock, E.R. (2022). Where to focus: Investigating hierarchical attention relationship for fine-grained visual classification. In: Avidan, S., Brostow, G.J., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) Computer Vision\u2014ECCV 2022: 17th European Conference, Tel Aviv, Israel, October 23-27, Proceedings, Part XXIV. Lecture Notes in Computer Science, vol. 13684, pp. 57\u201373.","DOI":"10.1007\/978-3-031-20053-3_4"},{"key":"1873_CR55","doi-asserted-by":"crossref","unstructured":"Lou, Y., Bai, Y., Liu, J., Wang, S., & Duan, L. (2019). Veri-wild: A large dataset and a new method for vehicle re-identification in the wild. In: IEEE conference on computer vision and pattern recognition, CVPR 2019, Long Beach, CA, USA, June 16\u201320, pp. 3235\u20133243.","DOI":"10.1109\/CVPR.2019.00335"},{"issue":"8","key":"1873_CR56","doi-asserted-by":"publisher","first-page":"3794","DOI":"10.1109\/TIP.2019.2902112","volume":"28","author":"Y Lou","year":"2019","unstructured":"Lou, Y., Bai, Y., Liu, J., Wang, S., & Duan, L. (2019). Embedding adversarial learning for vehicle re-identification. IEEE Transactions on Image Processing, 28(8), 3794\u20133807.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1873_CR57","doi-asserted-by":"crossref","unstructured":"Luo, C., Chen, Y., Wang, N., & Zhang, Z. (2019). Spectral feature transformation for person re-identification. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 4975\u20134984.","DOI":"10.1109\/ICCV.2019.00508"},{"key":"1873_CR58","unstructured":"Maji, S., Rahtu, E., Kannala, J., Blaschko, M.B., & Vedaldi, A. (2013). Fine-grained visual classification of aircraft. CoRR:1306.5151"},{"key":"1873_CR59","doi-asserted-by":"crossref","unstructured":"Maze, B., Adams, J.C., Duncan, J.A., Kalka, N.D., Miller, T., Otto, C., Jain, A.K., Niggel, W.T., Anderson, J., Cheney, J., & Grother, P. (2018). IARPA janus benchmark-C: Face dataset and protocol. In: 2018 International conference on biometrics, ICB 2018, Gold Coast, Australia, February 20\u201323, pp. 158\u2013165.","DOI":"10.1109\/ICB2018.2018.00033"},{"key":"1873_CR60","doi-asserted-by":"crossref","unstructured":"Meng, D., Li, L., Liu, X., Li, Y., Yang, S., Zha, Z., Gao, X., Wang, S., & Huang, Q. (2020). Parsing-based view-aware embedding network for vehicle re-identification. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u201319, pp. 7101\u20137110.","DOI":"10.1109\/CVPR42600.2020.00713"},{"key":"1873_CR61","doi-asserted-by":"crossref","unstructured":"Meng, Q., Zhao, S., Huang, Z., & Zhou, F. (2021). Magface: A universal representation for face recognition and quality assessment. In: IEEE conference on computer vision and pattern recognition, CVPR 2021, Virtual, June 19\u201325, pp. 14225\u201314234.","DOI":"10.1109\/CVPR46437.2021.01400"},{"issue":"3","key":"1873_CR62","first-page":"1487","volume":"27","author":"Y Peng","year":"2018","unstructured":"Peng, Y., He, X., & Zhao, J. (2018). Object-part attention model for fine-grained image classification. TIP, 27(3), 1487\u20131500.","journal-title":"TIP"},{"key":"1873_CR63","doi-asserted-by":"crossref","unstructured":"Quan, R., Dong, X., Wu, Y., Zhu, L., & Yang, Y. (2019). Auto-reid: Searching for a part-aware convnet for person re-identification. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 3749\u20133758.","DOI":"10.1109\/ICCV.2019.00385"},{"key":"1873_CR64","doi-asserted-by":"crossref","unstructured":"Rao, Y., Chen, G., Lu, J., & Zhou, J. (2021). Counterfactual attention learning for fine-grained visual categorization and re-identification. In: 2021 IEEE\/CVF international conference on computer vision, ICCV 2021, Montreal, QC, Canada, October 10-17, 2021, pp. 1005\u20131014.","DOI":"10.1109\/ICCV48922.2021.00106"},{"key":"1873_CR65","doi-asserted-by":"crossref","unstructured":"Recasens, A., Kellnhofer, P., Stent, S., Matusik, W., & Torralba, A. (2018). Learning to zoom: A saliency-based sampling layer for neural networks. In: Ferrari, V., Hebert, M., Sminchisescu, C., Weiss, Y. (eds.) Computer vision\u2014ECCV 2018\u201415th European conference, Munich, Germany, September 8\u201314, Proceedings, Part IX. Lecture Notes in Computer Science, vol. 11213, pp. 52\u201367.","DOI":"10.1007\/978-3-030-01240-3_4"},{"key":"1873_CR66","doi-asserted-by":"crossref","unstructured":"Ristani, E., Solera, F., Zou, R.S., Cucchiara, R., & Tomasi, C. (2016). Performance measures and a data set for multi-target, multi-camera tracking. In: Hua, G., J\u00e9gou, H. (eds.) Computer Vision\u2014ECCV 2016 Workshops\u2014Amsterdam, The Netherlands, October 8\u201310 and 15\u201316, Proceedings, Part II. Lecture Notes in Computer Science, vol. 9914, pp. 17\u201335.","DOI":"10.1007\/978-3-319-48881-3_2"},{"issue":"7","key":"1873_CR67","doi-asserted-by":"publisher","first-page":"2113","DOI":"10.1007\/s11263-021-01457-9","volume":"129","author":"B Saunders","year":"2021","unstructured":"Saunders, B., Camg\u00f6z, N. C., & Bowden, R. (2021). Continuous 3d multi-channel sign language production via progressive transformers and mixture density networks. International Journal of Computer Vision, 129(7), 2113\u20132135.","journal-title":"International Journal of Computer Vision"},{"key":"1873_CR68","doi-asserted-by":"crossref","unstructured":"Selvaraju, R.R., Cogswell, M., Das, A., Vedantam, R., Parikh, D., & Batra, D. (2017). Grad-cam: Visual explanations from deep networks via gradient-based localization. In: IEEE international conference on computer vision, ICCV 2017, Venice, Italy, October 22\u201329, pp. 618\u2013626.","DOI":"10.1109\/ICCV.2017.74"},{"issue":"7","key":"1873_CR69","doi-asserted-by":"publisher","first-page":"8793","DOI":"10.1109\/TITS.2021.3086142","volume":"23","author":"F Shen","year":"2022","unstructured":"Shen, F., Zhu, J., Zhu, X., Xie, Y., & Huang, J. (2022). Exploring spatial significance via hybrid pyramidal graph network for vehicle re-identification. IEEE Transactions on Intelligent Transportation Systems, 23(7), 8793\u20138804.","journal-title":"IEEE Transactions on Intelligent Transportation Systems"},{"key":"1873_CR70","doi-asserted-by":"crossref","unstructured":"Shi, Y., Yu, X., Sohn, K., Chandraker, M., & Jain, A.K. (2020). Towards universal representation learning for deep face recognition. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u201319, pp. 6816\u20136825.","DOI":"10.1109\/CVPR42600.2020.00685"},{"issue":"2","key":"1873_CR71","doi-asserted-by":"publisher","first-page":"435","DOI":"10.1007\/s11263-021-01547-8","volume":"130","author":"A Shin","year":"2022","unstructured":"Shin, A., Ishii, M., & Narihira, T. (2022). Perspectives and prospects on transformer architecture for cross-modal tasks with language and vision. International Journal of Computer Vision, 130(2), 435\u2013454.","journal-title":"International Journal of Computer Vision"},{"key":"1873_CR72","doi-asserted-by":"crossref","unstructured":"Sun, Y., Cheng, C., Zhang, Y., Zhang, C., Zheng, L., Wang, Z., & Wei, Y. (2020). Circle loss: A unified perspective of pair similarity optimization. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u201319, 2020, pp. 6397\u20136406.","DOI":"10.1109\/CVPR42600.2020.00643"},{"key":"1873_CR73","doi-asserted-by":"crossref","unstructured":"Sun, H., He, X., & Peng, Y. (2022). Sim-trans: Structure information modeling transformer for fine-grained visual categorization. In: Magalh\u00e3es, J., Bimbo, A.D., Satoh, S., Sebe, N., Alameda-Pineda, X., Jin, Q., Oria, V., Toni, L. (eds.) MM \u201922: The 30th ACM international conference on multimedia, Lisboa, Portugal, October 10\u201314, pp. 5853\u20135861.","DOI":"10.1145\/3503161.3548308"},{"key":"1873_CR74","doi-asserted-by":"crossref","unstructured":"Sun, M., Yuan, Y., Zhou, F., & Ding, E. (2018) Multi-attention multi-class constraint for fine-grained image recognition. In: Ferrari, V., Hebert, M., Sminchisescu, C., Weiss, Y. (eds.) Computer Vision\u2014ECCV 2018\u201415th European Conference, Munich, Germany, September 8-14, 2018, Proceedings, Part XVI. Lecture Notes in Computer Science, vol. 11220, pp. 834\u2013850.","DOI":"10.1007\/978-3-030-01270-0_49"},{"key":"1873_CR75","doi-asserted-by":"crossref","unstructured":"Sun, Y., Zheng, L., Yang, Y., Tian, Q., & Wang, S. (2018). Beyond part models: Person retrieval with refined part pooling (and A strong convolutional baseline). In: Ferrari, V., Hebert, M., Sminchisescu, C., Weiss, Y. (eds.) Computer Vision\u2014ECCV 2018\u201415th European conference, Munich, Germany, September 8\u201314, 2018, Proceedings, Part IV. Lecture Notes in Computer Science, vol. 11208, pp. 501\u2013518.","DOI":"10.1007\/978-3-030-01225-0_30"},{"key":"1873_CR76","unstructured":"Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A.N., Kaiser, L., & Polosukhin, I. (2017). Attention is all you need. In: Guyon, I., von Luxburg, U., Bengio, S., Wallach, H.M., Fergus, R., Vishwanathan, S.V.N., Garnett, R. (eds.) Advances in neural information processing systems 30: Annual conference on neural information processing systems 2017, December 4\u20139, Long Beach, CA, USA, pp. 5998\u20136008."},{"key":"1873_CR77","doi-asserted-by":"crossref","unstructured":"Wang, S., Chang, J., Li, H., Wang, Z., Ouyang, W., & Tian, Q. (2023). Open-set fine-grained retrieval via prompting vision-language evaluator. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition (CVPR), pp. 19381\u201319391","DOI":"10.1109\/CVPR52729.2023.01857"},{"key":"1873_CR78","doi-asserted-by":"crossref","unstructured":"Wang, S., Li, H., Wang, Z., & Ouyang, W. (2021). Dynamic position-aware network for fine-grained image recognition. In: Thirty-fifth AAAI conference on artificial intelligence, AAAI 2021, thirty-third conference on innovative applications of artificial intelligence, IAAI 2021, the eleventh symposium on educational advances in artificial intelligence, EAAI 2021, virtual event, February 2\u20139, 2021, pp. 2791\u20132799","DOI":"10.1609\/aaai.v35i4.16384"},{"key":"1873_CR79","doi-asserted-by":"crossref","unstructured":"Wang, S., Wang, Z., Li, H., & Ouyang, W. (2020). Category-specific semantic coherency learning for fine-grained image recognition. In: MM \u201920: The 28th ACM international conference on multimedia, virtual event\/seattle, WA, USA, October 12\u201316, pp. 174\u2013183.","DOI":"10.1145\/3394171.3413871"},{"key":"1873_CR80","doi-asserted-by":"crossref","unstructured":"Wang, S., Wang, Z., Li, H., & Ouyang, W. (2022) Category-specific nuance exploration network for fine-grained object retrieval. In: Thirty-sixth AAAI conference on artificial intelligence, AAAI 2022, thirty-fourth conference on innovative applications of artificial intelligence, IAAI 2022, the twelveth symposium on educational advances in artificial intelligence, EAAI 2022 virtual event, February 22-March 1, pp. 2513\u20132521.","DOI":"10.1609\/aaai.v36i3.20152"},{"key":"1873_CR81","doi-asserted-by":"crossref","unstructured":"Wang, S., Wang, Z., Li, H., Chang, J., Ouyang, W., & Tian, Q. (2023) Semantic-guided information alignment network for fine-grained image recognition. IEEE Transactions on Circuits and Systems for Video Technology.","DOI":"10.1109\/TCSVT.2023.3263870"},{"key":"1873_CR82","doi-asserted-by":"crossref","unstructured":"Wang, Z., Wang, S., Li, H., Dou, Z., & Li, J. (2020). Graph-propagation based correlation learning for weakly supervised fine-grained image classification. In: The thirty-fourth AAAI conference on artificial intelligence, AAAI 2020, the thirty-second innovative applications of artificial intelligence conference, IAAI 2020, the tenth AAAI symposium on educational advances in artificial intelligence, EAAI 2020, New York, NY, USA, February 7\u201312, pp. 12289\u201312296.","DOI":"10.1609\/aaai.v34i07.6912"},{"key":"1873_CR83","doi-asserted-by":"crossref","unstructured":"Wang, Z., Wang, S., Yang, S., Li, H., Li, J., & Li, Z. (2020). Weakly supervised fine-grained image classification via guassian mixture model oriented discriminative learning. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u201319, pp. 9746\u20139755","DOI":"10.1109\/CVPR42600.2020.00977"},{"key":"1873_CR84","doi-asserted-by":"crossref","unstructured":"Wang, Z., Wang, S., Zhang, P., Li, H., Zhong, W., & Li, J. (2019). Weakly supervised fine-grained image classification via correlation-guided discriminative learning. In: Proceedings of the 27th ACM international conference on multimedia, MM 2019, Nice, France, October 21\u201325, pp. 1851\u20131860.","DOI":"10.1145\/3343031.3350976"},{"key":"1873_CR85","doi-asserted-by":"crossref","unstructured":"Wang, X., Zhang, S., Wang, S., Fu, T., Shi, H., & Mei, T. (2020). Mis-classified vector guided softmax loss for face recognition. In: The thirty-fourth AAAI conference on artificial intelligence, AAAI 2020, the thirty-second innovative applications of artificial intelligence conference, IAAI 2020, the tenth AAAI symposium on educational advances in artificial intelligence, EAAI 2020, New York, NY, USA, February 7\u201312, pp. 12241\u201312248.","DOI":"10.1609\/aaai.v34i07.6906"},{"key":"1873_CR86","unstructured":"Wei, X., Xie, C., Wu, J. (2016). Mask-cnn: Localizing parts and selecting descriptors for fine-grained image recognition. CoRR:1605.06878"},{"key":"1873_CR87","doi-asserted-by":"crossref","unstructured":"Wei, L., Zhang, S., Gao, W., & Tian, Q. (2018). Person transfer GAN to bridge domain gap for person re-identification. In: 2018 IEEE conference on computer vision and pattern recognition, CVPR 2018, Salt Lake City, UT, USA, June 18\u201322, pp. 79\u201388.","DOI":"10.1109\/CVPR.2018.00016"},{"issue":"6","key":"1873_CR88","first-page":"2868","volume":"26","author":"X Wei","year":"2017","unstructured":"Wei, X., Luo, J., Wu, J., & Zhou, Z. (2017). Selective convolutional descriptor aggregation for fine-grained image retrieval. TIP, 26(6), 2868\u20132881.","journal-title":"TIP"},{"key":"1873_CR89","doi-asserted-by":"crossref","unstructured":"Whitelam, C., Taborsky, E., Blanton, A., Maze, B., Adams, J.C., Miller, T., Kalka, N.D., Jain, A.K., Duncan, J.A., Allen, K., Cheney, J., & Grother, P. (2017). IARPA janus benchmark-b face dataset. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition Workshops, CVPR Workshops 2017, Honolulu, HI, USA, July 21\u201326, pp. 592\u2013600.","DOI":"10.1109\/CVPRW.2017.87"},{"key":"1873_CR90","unstructured":"Xu, K., Lai, R., Gu, L., & Li, Y. (2021). Multiresolution discriminative mixup network for fine-grained visual categorization. IEEE Transactions on Neural Networks and Learning Systems, pp. 1\u201313."},{"key":"1873_CR91","doi-asserted-by":"crossref","unstructured":"Yang, Z., Luo, T., Wang, D., Hu, Z., Gao, J., & Wang, L. (2018). Learning to navigate for fine-grained classification. In: ECCV, Germany, September 8-14, 2018, Proceedings, Part XIV, pp. 438\u2013454.","DOI":"10.1007\/978-3-030-01264-9_26"},{"key":"1873_CR92","doi-asserted-by":"crossref","unstructured":"Yang, X., Wang, Y., Chen, K., Xu, Y., & Tian, Y. (2022). Fine-grained object classification via self-supervised pose alignment. In: IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2022, New Orleans, LA, USA, June 18\u201324, pp. 7389\u20137398.","DOI":"10.1109\/CVPR52688.2022.00725"},{"issue":"1","key":"1873_CR93","first-page":"10","volume":"27","author":"H Yao","year":"2018","unstructured":"Yao, H., Zhang, S., Yan, C., Zhang, Y., Li, J., & Tian, Q. (2018). Autobd: Automated bi-level description for scalable fine-grained visual categorization. TIP, 27(1), 10\u201323.","journal-title":"TIP"},{"key":"1873_CR94","doi-asserted-by":"crossref","unstructured":"Yue, X., Kuang, Z., Lin, C., Sun, H., & Zhang, W. (2020). Robustscanner: Dynamically enhancing positional clues for robust text recognition. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J. (eds.) Computer vision\u2014ECCV 2020\u201416th European conference, Glasgow, UK, August 23-28, 2020, Proceedings, Part XIX. Lecture Notes in Computer Science, vol. 12364, pp. 135\u2013151.","DOI":"10.1007\/978-3-030-58529-7_9"},{"key":"1873_CR95","doi-asserted-by":"crossref","unstructured":"Zhang, L., Huang, S., Liu, W., Tao, D. (2019). Learning a mixture of granularity-specific experts for fine-grained categorization. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 8330\u20138339.","DOI":"10.1109\/ICCV.2019.00842"},{"key":"1873_CR96","doi-asserted-by":"crossref","unstructured":"Zhang, X., Xiong, H., Zhou, W., Lin, W., & Tian, Q. (2016). Picking deep filter responses for fine-grained image recognition. In: CVPR 2016, Las Vegas, NV, USA, June 27\u201330, pp. 1134\u20131142.","DOI":"10.1109\/CVPR.2016.128"},{"key":"1873_CR97","doi-asserted-by":"crossref","unstructured":"Zhao, Y., Yan, K., Huang, F., & Li, J. (2021). Graph-based high-order relation discovery for fine-grained recognition. In: IEEE conference on computer vision and pattern recognition, CVPR 2021, Virtual, June 19\u201325, pp. 15079\u201315088.","DOI":"10.1109\/CVPR46437.2021.01483"},{"key":"1873_CR98","doi-asserted-by":"publisher","first-page":"9470","DOI":"10.1109\/TIP.2021.3126490","volume":"30","author":"Y Zhao","year":"2021","unstructured":"Zhao, Y., Li, J., Chen, X., & Tian, Y. (2021). Part-guided relational transformers for fine-grained visual recognition. IEEE Transactions on Image Processing, 30, 9470\u20139481.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1873_CR99","unstructured":"Zheng, H., Fu, J., Zha, Z., & Luo, J. (2019). Learning deep bilinear transformation for fine-grained image representation. In H. M. Wallach, H. Larochelle, A. Beygelzimer, F. d\u2019Alch\u00e9-Buc, E. B. Fox, & R. Garnett (Eds.), Advances in neural information processing systems 32: Annual conference on neural information processing systems 2019, NeurIPS 2019, 8\u201314 December 2019 (pp. 4279\u20134288). Vancouver."},{"key":"1873_CR100","doi-asserted-by":"crossref","unstructured":"Zheng, H., Fu, J., Zha, Z., & Luo, J. (2019). Looking for the devil in the details: Learning trilinear attention sampling network for fine-grained image recognition. In: IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2019, Long Beach, CA, USA, June 16-20, pp. 5012\u20135021.","DOI":"10.1109\/CVPR.2019.00515"},{"key":"1873_CR101","doi-asserted-by":"crossref","unstructured":"Zheng, Z., Yang, X., Yu, Z., Zheng, L., Yang, Y., & Kautz, J. (2019). Joint discriminative and generative learning for person re-identification. In: IEEE conference on computer vision and pattern recognition, CVPR 2019, Long Beach, CA, USA, June 16-20, pp. 2138\u20132147.","DOI":"10.1109\/CVPR.2019.00224"},{"key":"1873_CR102","doi-asserted-by":"publisher","first-page":"476","DOI":"10.1109\/TIP.2019.2921876","volume":"29","author":"H Zheng","year":"2020","unstructured":"Zheng, H., Fu, J., Zha, Z., Luo, J., & Mei, T. (2020). Learning rich part hierarchies with progressive attention networks for fine-grained image recognition. IEEE Transaction Image Processing, 29, 476-488.","journal-title":"IEEE Transaction Image Processing"},{"key":"1873_CR103","doi-asserted-by":"crossref","unstructured":"Zhou, Y., & Shao, L. (2018). Viewpoint-aware attentive multi-view inference for vehicle re-identification. In: 2018 IEEE conference on computer vision and pattern recognition, CVPR 2018, Salt Lake City, UT, USA, June 18\u201322, pp. 6489\u20136498.","DOI":"10.1109\/CVPR.2018.00679"},{"key":"1873_CR104","doi-asserted-by":"crossref","unstructured":"Zhou, M., Bai, Y., Zhang, W., Zhao, T., & Mei, T. (2020). Look-into-object: Self-supervised structure modeling for object recognition. In: 2020 IEEE\/CVF conference on computer vision and pattern recognition, CVPR 2020, Seattle, WA, USA, June 13\u201319, pp. 11771\u201311780.","DOI":"10.1109\/CVPR42600.2020.01179"},{"key":"1873_CR105","doi-asserted-by":"crossref","unstructured":"Zhou, K., Yang, Y., Cavallaro, A., & Xiang, T. (2019). Omni-scale feature learning for person re-identification. In: 2019 IEEE\/CVF international conference on computer vision, ICCV 2019, Seoul, Korea (South), October 27\u2013November 2, pp. 3701\u20133711.","DOI":"10.1109\/ICCV.2019.00380"}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-023-01873-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11263-023-01873-z\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-023-01873-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,1,22]],"date-time":"2024-01-22T03:11:08Z","timestamp":1705893068000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11263-023-01873-z"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,8,24]]},"references-count":105,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2024,1]]}},"alternative-id":["1873"],"URL":"https:\/\/doi.org\/10.1007\/s11263-023-01873-z","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,8,24]]},"assertion":[{"value":"26 July 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"31 July 2023","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"24 August 2023","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}