{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,20]],"date-time":"2026-07-20T01:30:59Z","timestamp":1784511059352,"version":"3.55.0"},"reference-count":63,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2024,6,28]],"date-time":"2024-06-28T00:00:00Z","timestamp":1719532800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,6,28]],"date-time":"2024-06-28T00:00:00Z","timestamp":1719532800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"the National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["71801108"],"award-info":[{"award-number":["71801108"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]},{"name":"Anhui Provincial universi- ties outstanding young backbone talents domestic visiting study and Research project","award":["gxgnfx2019006"],"award-info":[{"award-number":["gxgnfx2019006"]}]},{"name":"the University Synergy Innovation Pro- gram of Anhui Province, China","award":["GXXT-2021-002"],"award-info":[{"award-number":["GXXT-2021-002"]}]},{"name":"the University Synergy Innovation Pro- gram of Anhui Province, China","award":["GXXT-2022-033"],"award-info":[{"award-number":["GXXT-2022-033"]}]},{"name":"Innovation Fund for Postgraduates of Huaibei Normal University","award":["cx2022042"],"award-info":[{"award-number":["cx2022042"]}]},{"name":"Open Laboratory project of Huaibei Normal University","award":["2021sykf026"],"award-info":[{"award-number":["2021sykf026"]}]},{"name":"2022 National Innovation and Entrepreneurship Training Program for College Students","award":["202210373005"],"award-info":[{"award-number":["202210373005"]}]},{"name":"Anhui Province university natural science research key project","award":["2023AH050333"],"award-info":[{"award-number":["2023AH050333"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Vis Comput"],"published-print":{"date-parts":[[2025,3]]},"DOI":"10.1007\/s00371-024-03545-6","type":"journal-article","created":{"date-parts":[[2024,6,28]],"date-time":"2024-06-28T16:55:15Z","timestamp":1719593715000},"page":"2439-2459","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":15,"title":["TransFGVC: transformer-based fine-grained visual classification"],"prefix":"10.1007","volume":"41","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-1184-8552","authenticated-orcid":false,"given":"Longfeng","family":"Shen","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bin","family":"Hou","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yulei","family":"Jian","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xisong","family":"Tu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yingjie","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Lingying","family":"Shuai","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Fangzhen","family":"Ge","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Debao","family":"Chen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,6,28]]},"reference":[{"key":"3545_CR1","doi-asserted-by":"publisher","first-page":"50","DOI":"10.1016\/j.cviu.2019.03.001","volume":"182","author":"SD Khan","year":"2019","unstructured":"Khan, S.D., Ullah, H.: A survey of advances in vision-based vehicle re-identification. Comput. Vis. Image Understand. 182, 50\u201363 (2019)","journal-title":"Comput. Vis. Image Understand."},{"key":"3545_CR2","doi-asserted-by":"crossref","unstructured":"Karlinsky, L., Shtok, J., Tzur, Y., Tzadok, A.: Fine-grained recognition of thousands of object categories with single-example training. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition(CVPR), pp. 4113\u20134122 (2017)","DOI":"10.1109\/CVPR.2017.109"},{"key":"3545_CR3","doi-asserted-by":"crossref","unstructured":"Van\u00a0Horn, G., Branson, S., Farrell, R., Haber, S., Barry, J., Ipeirotis, P., Perona, P., Belongie, S.: Building a bird recognition app and large scale dataset with citizen scientists: the fine print in fine-grained dataset collection. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 595\u2013604 (2015)","DOI":"10.1109\/CVPR.2015.7298658"},{"key":"3545_CR4","doi-asserted-by":"crossref","unstructured":"Nilsback, M.-E., Zisserman, A.: Automated flower classification over a large number of classes. In: 2008 Sixth Indian Conference on Computer Vision, Graphics and Image Processing (ICVGIP), pp. 722\u2013729 (2008) IEEE","DOI":"10.1109\/ICVGIP.2008.47"},{"key":"3545_CR5","doi-asserted-by":"publisher","DOI":"10.1109\/TMM.2023.3244340","author":"Q Xu","year":"2023","unstructured":"Xu, Q., Wang, J., Jiang, B., Luo, B.: Fine-grained visual classification via internal ensemble learning transformer. IEEE Trans. Multimed. (2023). https:\/\/doi.org\/10.1109\/TMM.2023.3244340","journal-title":"IEEE Trans. Multimed."},{"key":"3545_CR6","volume-title":"The Caltech-UCSD birds-200-2011 Dataset","author":"C Wah","year":"2011","unstructured":"Wah, C., Branson, S., Welinder, P., Perona, P., Belongie, S.: The Caltech-UCSD birds-200-2011 Dataset. California Institute of Technology (2011)"},{"key":"3545_CR7","unstructured":"Chou, P.-Y., Kao, Y.-Y., Lin, C.-H.: Fine-grained Visual Classification with High-temperature Refinement and Background Suppression (2023)"},{"key":"3545_CR8","unstructured":"Khosla, A., Jayadevaprakash, N., Yao, B., Li, F.-F.: Novel dataset for fine-grained image categorization: Stanford dogs. In: Proceedings of CVPR Workshop on Fine-Grained Visual Categorization, vol. 2(1). Citeseer (2011)"},{"key":"3545_CR9","doi-asserted-by":"crossref","unstructured":"Ge, W., Lin, X., Yu, Y.: Weakly supervised complementary parts models for fine-grained image classification from the bottom up. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 3034\u20133043 (2019)","DOI":"10.1109\/CVPR.2019.00315"},{"key":"3545_CR10","doi-asserted-by":"publisher","unstructured":"Parkhi, O.M., Vedaldi, A., Zisserman, A., Jawahar, C.V.: Cats and dogs. In: 2012 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 3498\u20133505 (2012). https:\/\/doi.org\/10.1109\/CVPR.2012.6248092","DOI":"10.1109\/CVPR.2012.6248092"},{"key":"3545_CR11","doi-asserted-by":"crossref","unstructured":"Behera, A., Wharton, Z., Hewage, P., Bera, A.: Context-aware attentional pooling (cap) for fine-grained visual classification. AAAI (2021)","DOI":"10.1609\/aaai.v35i2.16176"},{"key":"3545_CR12","doi-asserted-by":"crossref","unstructured":"Krause, J., Stark, M., Deng, J., Fei-Fei, L.: 3d object representations for fine-grained categorization. In: Proceedings of the IEEE International Conference on Computer Vision Workshops (ICCV), pp. 554\u2013561 (2013)","DOI":"10.1109\/ICCVW.2013.77"},{"key":"3545_CR13","doi-asserted-by":"publisher","first-page":"109550","DOI":"10.1016\/j.patcog.2023.109550","volume":"140","author":"D Liu","year":"2023","unstructured":"Liu, D., Zhao, L., Wang, Y., Kato, J.: Learn from each other to classify better: cross-layer mutual attention learning for fine-grained visual classification. Pattern Recognit. 140, 109550 (2023)","journal-title":"Pattern Recognit."},{"key":"3545_CR14","unstructured":"Maji, S., Rahtu, E., Kannala, J., Blaschko, M., Vedaldi, A.: Fine-grained visual classification of aircraft (2013). arXiv preprint arXiv:1306.5151"},{"key":"3545_CR15","doi-asserted-by":"crossref","unstructured":"Bossard, L., Guillaumin, M., Gool, L.V.: Food-101-mining discriminative components with random forests. In: European Conference on Computer vision (ECCV), pp. 446\u2013461. Springer (2014)","DOI":"10.1007\/978-3-319-10599-4_29"},{"key":"3545_CR16","doi-asserted-by":"publisher","unstructured":"Song, J., Yang, R.: Feature boosting, suression, and diversification for fine-grained visual classification. In: 2021 International Joint Conference on Neural Networks (IJCNN), pp. 1\u20138 (2021). https:\/\/doi.org\/10.1109\/IJCNN52387.2021.9534004","DOI":"10.1109\/IJCNN52387.2021.9534004"},{"key":"3545_CR17","unstructured":"Chou, P.-Y., Lin, C.-H., Kao, W.-C.: A novel plug-in module for fine-grained visual classification (2022). arXiv preprint arXiv:2202.03822"},{"key":"3545_CR18","doi-asserted-by":"crossref","unstructured":"Huang, S., Wang, X., Tao, D.: Snapmix: semantically proportional mixing for augmenting fine-grained data, vol. 35(2), pp. 1628\u20131636 (2021)","DOI":"10.1609\/aaai.v35i2.16255"},{"key":"3545_CR19","doi-asserted-by":"crossref","unstructured":"Zhuang, P., Wang, Y., Qiao, Y.: Learning attentive pairwise interaction for fine-grained classification. In: Proceedings of the AAAI Conference on Artificial Intelligence(AAAI), vol. 34, pp. 13130\u201313137 (2020)","DOI":"10.1609\/aaai.v34i07.7016"},{"key":"3545_CR20","unstructured":"Wang, J., Yu, X., Gao, Y.: Feature fusion vision transformer for fine-grained visual categorization (2021). arXiv preprint arXiv:2107.02341"},{"key":"3545_CR21","doi-asserted-by":"crossref","unstructured":"He, J., Chen, J.-N., Liu, S., Kortylewski, A., Yang, C., Bai, Y., Wang, C.: Transfg: a transformer architecture for fine-grained recognition. In: Proceedings of the AAAI Conference on Artificial Intelligence, vol. 36, pp. 852\u2013860 (2022)","DOI":"10.1609\/aaai.v36i1.19967"},{"key":"3545_CR22","doi-asserted-by":"crossref","unstructured":"Li, H., Zhang, X., Tian, Q., Xiong, H.: Attribute mix: semantic data augmentation for fine grained recognition. In: 2020 IEEE International Conference on Visual Communications and Image Processing (VCIP), pp. 243\u2013246. IEEE (2020)","DOI":"10.1109\/VCIP49819.2020.9301763"},{"key":"3545_CR23","unstructured":"Diao, Q., Jiang, Y., Wen, B., Sun, J., Yuan, Z.: MetaFormer: a unified meta framework for fine-grained recognition (2022)"},{"key":"3545_CR24","unstructured":"Chou, P.-Y., Lin, C.-H., Kao, W.-C.: A novel plug-in module for fine-grained visual classification (2022)"},{"key":"3545_CR25","first-page":"1","volume":"8","author":"M Li","year":"2022","unstructured":"Li, M., Lei, L., Sun, H., Li, X., Kuang, G.: Fine-grained visual classification via multilayer bilinear pooling with object localization. Vis. Comput. 8, 1\u201310 (2022)","journal-title":"Vis. Comput."},{"key":"3545_CR26","first-page":"1","volume":"8","author":"C Guo","year":"2022","unstructured":"Guo, C., Lin, Y., Xu, M., Shao, M., Yao, J.: Inverse transformation sampling-based attentive cutout for fine-grained visual recognition. Vis. Comput. 8, 1\u201312 (2022)","journal-title":"Vis. Comput."},{"key":"3545_CR27","doi-asserted-by":"crossref","unstructured":"Zhang, N., Donahue, J., Girshick, R., Darrell, T.: Part-based R-CNNS for fine-grained category detection. In: European Conference on Computer Vision (ECCV), pp. 834\u2013849. Springer (2014)","DOI":"10.1007\/978-3-319-10590-1_54"},{"key":"3545_CR28","doi-asserted-by":"publisher","unstructured":"Chai, Y., Lempitsky, V., Zisserman, A.: Symbiotic segmentation and part localization for fine-grained categorization. In: Proceedings of the IEEE International Conference on Computer Vision (ICCV), pp. 321\u2013328 (2013). https:\/\/doi.org\/10.1109\/ICCV.2013.47","DOI":"10.1109\/ICCV.2013.47"},{"key":"3545_CR29","doi-asserted-by":"publisher","unstructured":"Huang, S., Xu, Z., Tao, D., Zhang, Y.: Part-stacked CNN for fine-grained visual categorization. In: 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 1173\u20131182 (2016). https:\/\/doi.org\/10.1109\/CVPR.2016.132","DOI":"10.1109\/CVPR.2016.132"},{"key":"3545_CR30","doi-asserted-by":"publisher","first-page":"2826","DOI":"10.1109\/TIP.2021.3055617","volume":"30","author":"Y Ding","year":"2021","unstructured":"Ding, Y., Ma, Z., Wen, S., Xie, J., Chang, D., Si, Z., Wu, M., Ling, H.: AP-CNN: weakly supervised attention pyramid convolutional neural network for fine-grained visual classification. IEEE Trans. Image Process. 30, 2826\u20132836 (2021). https:\/\/doi.org\/10.1109\/TIP.2021.3055617","journal-title":"IEEE Trans. Image Process."},{"key":"3545_CR31","doi-asserted-by":"crossref","unstructured":"Liu, C., Xie, H., Zha, Z.-J., Ma, L., Yu, L., Zhang, Y.: Filtration and distillation: enhancing region attention for fine-grained visual categorization. In: Proceedings of the AAAI Conference on Artificial Intelligence (AAAI), vol. 34, pp. 11555\u201311562 (2020)","DOI":"10.1609\/aaai.v34i07.6822"},{"key":"3545_CR32","doi-asserted-by":"crossref","unstructured":"Zheng, H., Fu, J., Zha, Z.-J., Luo, J.: Looking for the devil in the details: learning trilinear attention sampling network for fine-grained image recognition. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (2019)","DOI":"10.1109\/CVPR.2019.00515"},{"key":"3545_CR33","unstructured":"Chen, W., Liu, T.-y., Lan, Y., Ma, Z.-m., Li, H.: Ranking measures and loss functions in learning to rank. In: Advances in Neural Information Processing Systems, vol. 22 (2009)"},{"key":"3545_CR34","doi-asserted-by":"publisher","unstructured":"Kong, S., Fowlkes, C.: Low-rank bilinear pooling for fine-grained classification. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 7025\u20137034 (2017). https:\/\/doi.org\/10.1109\/CVPR.2017.743","DOI":"10.1109\/CVPR.2017.743"},{"key":"3545_CR35","doi-asserted-by":"publisher","unstructured":"Lin, T.-Y., RoyChowdhury, A., Maji, S.: Bilinear CNN models for fine-grained visual recognition. In: 2015 IEEE International Conference on Computer Vision (ICCV), pp. 1449\u20131457 (2015). https:\/\/doi.org\/10.1109\/ICCV.2015.170","DOI":"10.1109\/ICCV.2015.170"},{"key":"3545_CR36","doi-asserted-by":"publisher","unstructured":"Gao, Y., Beijbom, O., Zhang, N., Darrell, T.: Compact bilinear pooling. In: 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 317\u2013326 (2016). https:\/\/doi.org\/10.1109\/CVPR.2016.41","DOI":"10.1109\/CVPR.2016.41"},{"key":"3545_CR37","doi-asserted-by":"crossref","unstructured":"Liu, Z., Lin, Y., Cao, Y., Hu, H., Wei, Y., Zhang, Z., Lin, S., Guo, B.: Swin transformer: hierarchical vision transformer using shifted windows. In: International Conference on Computer Vision (ICCV) (2021)","DOI":"10.1109\/ICCV48922.2021.00986"},{"key":"3545_CR38","doi-asserted-by":"crossref","unstructured":"Branson, S., Van\u00a0Horn, G., Belongie, S., Perona, P.: Bird species categorization using pose normalized deep convolutional nets. In: BMVC, pp. 1\u201314 (2014)","DOI":"10.5244\/C.28.87"},{"key":"3545_CR39","doi-asserted-by":"publisher","first-page":"48","DOI":"10.1016\/j.neucom.2015.12.008","volume":"182","author":"L Xie","year":"2016","unstructured":"Xie, L., Wang, J., Zhang, B., Tian, Q.: Incorporating visual adjectives for image classification. Neurocomputing 182, 48\u201355 (2016). https:\/\/doi.org\/10.1016\/j.neucom.2015.12.008","journal-title":"Neurocomputing"},{"key":"3545_CR40","doi-asserted-by":"crossref","unstructured":"Zheng, H., Fu, J., Mei, T., Luo, J.: Learning multi-attention convolutional neural network for fine-grained image recognition. In: Proceedings of the IEEE International Conference on Computer Vision (ICCV), pp. 5209\u20135217 (2017)","DOI":"10.1109\/ICCV.2017.557"},{"key":"3545_CR41","doi-asserted-by":"crossref","unstructured":"Girshick, R., Donahue, J., Darrell, T., Malik, J.: Rich feature hierarchies for accurate object detection and semantic segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition(CVPR), pp. 580\u2013587 (2014)","DOI":"10.1109\/CVPR.2014.81"},{"key":"3545_CR42","doi-asserted-by":"crossref","unstructured":"Cui, Y., Zhou, F., Wang, J., Liu, X., Lin, Y., Belongie, S.: Kernel pooling for convolutional neural networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 2921\u20132930 (2017)","DOI":"10.1109\/CVPR.2017.325"},{"key":"3545_CR43","doi-asserted-by":"crossref","unstructured":"Cai, S., Zuo, W., Zhang, L.: Higher-order integration of hierarchical convolutional activations for fine-grained visual categorization. In: Proceedings of the IEEE International Conference on Computer Vision (CVPR), pp. 511\u2013520 (2017)","DOI":"10.1109\/ICCV.2017.63"},{"key":"3545_CR44","doi-asserted-by":"crossref","unstructured":"Engin, M., Wang, L., Zhou, L., Liu, X.: Deepkspd: learning kernel-matrix-based SPD representation for fine-grained image recognition. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 612\u2013627 (2018)","DOI":"10.1007\/978-3-030-01216-8_38"},{"key":"3545_CR45","doi-asserted-by":"publisher","first-page":"137","DOI":"10.1016\/j.neucom.2022.04.037","volume":"492","author":"X Liu","year":"2022","unstructured":"Liu, X., Wang, L., Han, X.: Transformer with peak suppression and knowledge guidance for fine-grained image recognition. Neurocomputing 492, 137\u2013149 (2022)","journal-title":"Neurocomputing"},{"key":"3545_CR46","doi-asserted-by":"publisher","first-page":"170","DOI":"10.1016\/j.neucom.2021.10.096","volume":"470","author":"Y Chen","year":"2022","unstructured":"Chen, Y., Song, J., Song, M.: Hierarchical gate network for fine-grained visual recognition. Neurocomputing 470, 170\u2013181 (2022)","journal-title":"Neurocomputing"},{"key":"3545_CR47","doi-asserted-by":"crossref","unstructured":"Hu, Y., Jin, X., Zhang, Y., Hong, H., Zhang, J., He, Y., Xue, H.: Rams-trans: recurrent attention multi-scale transformer for fine-grained image recognition, pp. 4239\u20134248 (2021)","DOI":"10.1145\/3474085.3475561"},{"key":"3545_CR48","doi-asserted-by":"crossref","unstructured":"Rao, Y., Chen, G., Lu, J., Zhou, J.: Counterfactual attention learning for fine-grained visual categorization and re-identification, pp. 1025\u20131034 (2021)","DOI":"10.1109\/ICCV48922.2021.00106"},{"key":"3545_CR49","doi-asserted-by":"crossref","unstructured":"Zhang, T., Chang, D., Ma, Z., Guo, J.: Progressive co-attention network for fine-grained visual classification, pp. 1\u20135. IEEE (2021)","DOI":"10.1109\/VCIP53242.2021.9675376"},{"key":"3545_CR50","doi-asserted-by":"publisher","first-page":"1545","DOI":"10.1109\/LSP.2020.3020227","volume":"27","author":"W Luo","year":"2020","unstructured":"Luo, W., Zhang, H., Li, J., Wei, X.-S.: Learning semantically enhanced feature for fine-grained image classification. IEEE Signal Process. Lett. 27, 1545\u20131549 (2020)","journal-title":"IEEE Signal Process. Lett."},{"key":"3545_CR51","doi-asserted-by":"crossref","unstructured":"Du, R., Chang, D., Bhunia, A.K., Xie, J., Ma, Z., Song, Y.-Z., Guo, J.: Fine-grained visual classification via progressive multi-granularity training of jigsaw patches. In: European Conference on Computer Vision (ECCV), pp. 153\u2013168. Springer (2020)","DOI":"10.1007\/978-3-030-58565-5_10"},{"key":"3545_CR52","doi-asserted-by":"publisher","first-page":"4996","DOI":"10.1109\/TIP.2020.2977457","volume":"29","author":"S Min","year":"2020","unstructured":"Min, S., Yao, H., Xie, H., Zha, Z.-J., Zhang, Y.: Multi-objective matrix normalization for fine-grained visual recognition. IEEE Trans. Image Process. 29, 4996\u20135009 (2020)","journal-title":"IEEE Trans. Image Process."},{"key":"3545_CR53","doi-asserted-by":"publisher","first-page":"4683","DOI":"10.1109\/TIP.2020.2973812","volume":"29","author":"D Chang","year":"2020","unstructured":"Chang, D., Ding, Y., Xie, J., Bhunia, A.K., Li, X., Ma, Z., Wu, M., Guo, J., Song, Y.-Z.: The devil is in the channels: mutual-channel loss for fine-grained image classification. IEEE Trans. Image Process. 29, 4683\u20134695 (2020)","journal-title":"IEEE Trans. Image Process."},{"key":"3545_CR54","doi-asserted-by":"crossref","unstructured":"Ji, R., Wen, L., Zhang, L., Du, D., Wu, Y., Zhao, C., Liu, X., Huang, F.: Attention convolutional binary neural tree for fine-grained visual categorization. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 10468\u201310477 (2020)","DOI":"10.1109\/CVPR42600.2020.01048"},{"key":"3545_CR55","doi-asserted-by":"crossref","unstructured":"Gao, Y., Han, X., Wang, X., Huang, W., Scott, M.: Channel interaction networks for fine-grained image categorization. In: Proceedings of the AAAI Conference on Artificial Intelligence (AAAI), vol. 34, pp. 10818\u201310825 (2020)","DOI":"10.1609\/aaai.v34i07.6712"},{"key":"3545_CR56","unstructured":"Zheng, H., Fu, J., Zha, Z.-J., Luo, J.: Learning deep bilinear transformation for fine-grained image representation. In: Advances in Neural Information Processing Systems (NIPS), vol. 32 (2019)"},{"key":"3545_CR57","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Cao, J., Zhang, L., Liu, X., Wang, Z., Ling, F., Chen, W.: A free lunch from VIT: adaptive attention multi-scale fusion transformer for fine-grained visual recognition, pp. 3234\u20133238. IEEE (2022)","DOI":"10.1109\/ICASSP43922.2022.9747591"},{"key":"3545_CR58","doi-asserted-by":"crossref","unstructured":"Sun, H., He, X., Peng, Y.: Sim-trans: structure information modeling transformer for fine-grained visual categorization. In: Proceedings of the 30th ACM International Conference on Multimedia (ACM), pp. 5853\u20135861 (2022)","DOI":"10.1145\/3503161.3548308"},{"key":"3545_CR59","unstructured":"Kim, S., Nam, J., Ko, B.C.: Vit-net: interpretable vision transformers with neural tree decoder. In: International Conference on Machine Learning (ICML), pp. 11162\u201311172. PMLR (2022)"},{"key":"3545_CR60","doi-asserted-by":"crossref","unstructured":"Zhu, H., Ke, W., Li, D., Liu, J., Tian, L., Shan, Y.: Dual cross-attention learning for fine-grained visual categorization and object re-identification. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 4692\u20134702 (2022)","DOI":"10.1109\/CVPR52688.2022.00465"},{"key":"3545_CR61","doi-asserted-by":"crossref","unstructured":"Zhao, Y., Yan, K., Huang, F., Li, J.: Graph-based high-order relation discovery for fine-grained recognition. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 15079\u201315088 (2021)","DOI":"10.1109\/CVPR46437.2021.01483"},{"key":"3545_CR62","unstructured":"Touvron, H., Vedaldi, A., Douze, M., J\u00e9gou, H.: Fixing the train-test resolution discrepancy. In: Advances in Neural Information Processing Systems (NIPS), vol. 32 (2019)"},{"key":"3545_CR63","doi-asserted-by":"crossref","unstructured":"Lam, M., Mahasseni, B., Todorovic, S.: Fine-grained recognition as hsnet search for informative image parts. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 2520\u20132529 (2017)","DOI":"10.1109\/CVPR.2017.688"}],"container-title":["The Visual Computer"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-024-03545-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00371-024-03545-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-024-03545-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,3,3]],"date-time":"2025-03-03T11:30:12Z","timestamp":1741001412000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00371-024-03545-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,6,28]]},"references-count":63,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2025,3]]}},"alternative-id":["3545"],"URL":"https:\/\/doi.org\/10.1007\/s00371-024-03545-6","relation":{},"ISSN":["0178-2789","1432-2315"],"issn-type":[{"value":"0178-2789","type":"print"},{"value":"1432-2315","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,6,28]]},"assertion":[{"value":"7 June 2024","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"28 June 2024","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}