{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,3,27]],"date-time":"2025-03-27T02:11:18Z","timestamp":1743041478528,"version":"3.40.3"},"publisher-location":"Cham","reference-count":30,"publisher":"Springer Nature Switzerland","isbn-type":[{"type":"print","value":"9783031783821"},{"type":"electronic","value":"9783031783838"}],"license":[{"start":{"date-parts":[[2024,12,2]],"date-time":"2024-12-02T00:00:00Z","timestamp":1733097600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,12,2]],"date-time":"2024-12-02T00:00:00Z","timestamp":1733097600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-78383-8_25","type":"book-chapter","created":{"date-parts":[[2024,12,1]],"date-time":"2024-12-01T21:52:50Z","timestamp":1733089970000},"page":"374-389","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["ORA-Trans: Object Region Attention Transformer Based on Key Tokens Selector with Structure Feature Modeling for Fine-Grained Visual Classification"],"prefix":"10.1007","author":[{"given":"Yulong","family":"Xia","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jianwei","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,12,2]]},"reference":[{"key":"25_CR1","doi-asserted-by":"crossref","unstructured":"Xiu-Shen Wei, Yi-Zhe Song, Oisin Mac\u00a0Aodha, Jianxin Wu, Yuxin Peng, Jinhui Tang, Jian Yang, and Serge Belongie. Fine-grained image analysis with deep learning: A survey. IEEE transactions on pattern analysis and machine intelligence, 44(12):8927\u20138948, 2021","DOI":"10.1109\/TPAMI.2021.3126648"},{"key":"25_CR2","doi-asserted-by":"crossref","unstructured":"Thomas Berg and Peter\u00a0N Belhumeur. Poof: Part-based one-vs.-one features for fine-grained categorization, face verification, and attribute estimation. In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pages 955\u2013962, 2013","DOI":"10.1109\/CVPR.2013.128"},{"key":"25_CR3","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2022.108792","volume":"130","author":"H Tang","year":"2022","unstructured":"Tang, H., Yuan, C., Li, Z., Tang, J.: Learning attention-guided pyramidal features for few-shot fine-grained recognition. Pattern Recogn. 130, 108792 (2022)","journal-title":"Pattern Recogn."},{"key":"25_CR4","doi-asserted-by":"crossref","unstructured":"Ross Girshick, Jeff Donahue, Trevor Darrell, and Jitendra Malik. Rich feature hierarchies for accurate object detection and semantic segmentation. In Proceedings of the IEEE conference on computer vision and pattern recognition, pages 580\u2013587, 2014","DOI":"10.1109\/CVPR.2014.81"},{"issue":"5","key":"25_CR5","doi-asserted-by":"publisher","first-page":"1394","DOI":"10.1109\/TCSVT.2018.2834480","volume":"29","author":"X He","year":"2018","unstructured":"He, X., Peng, Y., Zhao, J.: Fast fine-grained image classification via weakly supervised discriminative localization. IEEE Trans. Circuits Syst. Video Technol. 29(5), 1394\u20131407 (2018)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"25_CR6","unstructured":"Alexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn, Xiaohua Zhai, Thomas Unterthiner, Mostafa Dehghani, Matthias Minderer, Georg Heigold, Sylvain Gelly, et\u00a0al. An image is worth 16x16 words: Transformers for image recognition at scale. arXiv preprint arXiv:2010.11929, 2020"},{"key":"25_CR7","unstructured":"Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan\u00a0N Gomez, \u0141ukasz Kaiser, and Illia Polosukhin. Attention is all you need. Advances in neural information processing systems, 30, 2017"},{"issue":"10","key":"25_CR8","doi-asserted-by":"publisher","first-page":"5063","DOI":"10.3390\/app12105063","volume":"12","author":"R Zeng","year":"2022","unstructured":"Zeng, R., He, J.: Grouping bilinear pooling for fine-grained image classification. Appl. Sci. 12(10), 5063 (2022)","journal-title":"Appl. Sci."},{"key":"25_CR9","doi-asserted-by":"crossref","unstructured":"Xiruo Shi, Liutong Xu, and Pengfei Wang. Fine-grained image classification combined with label description. In 2019 IEEE 31st International Conference on Tools with Artificial Intelligence (ICTAI), pages 1057\u20131064. IEEE, 2019","DOI":"10.1109\/ICTAI.2019.00148"},{"key":"25_CR10","doi-asserted-by":"crossref","unstructured":"Ze\u00a0Yang, Tiange Luo, Dong Wang, Zhiqiang Hu, Jun Gao, and Liwei Wang. Learning to navigate for fine-grained classification. In Proceedings of the European conference on computer vision (ECCV), pages 420\u2013435, 2018","DOI":"10.1007\/978-3-030-01264-9_26"},{"key":"25_CR11","unstructured":"Po-Yung Chou, Yu-Yung Kao, and Cheng-Hung Lin. Fine-grained visual classification with high-temperature refinement and background suppression. arXiv preprint arXiv:2303.06442, 2023"},{"key":"25_CR12","doi-asserted-by":"crossref","unstructured":"Xiaohan Yu, Jun Wang, and Yongsheng Gao. Cle-vit: contrastive learning encoded transformer for ultra-fine-grained visual categorization. In Proceedings of the Thirty-Second International Joint Conference on Artificial Intelligence, pages 4531\u20134539, 2023","DOI":"10.24963\/ijcai.2023\/504"},{"key":"25_CR13","doi-asserted-by":"crossref","unstructured":"Abhimanyu Dubey, Otkrist Gupta, Pei Guo, Ramesh Raskar, Ryan Farrell, and Nikhil Naik. Pairwise confusion for fine-grained visual classification. In Proceedings of the European conference on computer vision (ECCV), pages 70\u201386, 2018","DOI":"10.1007\/978-3-030-01258-8_5"},{"key":"25_CR14","unstructured":"Jianlong Fu, Heliang Zheng, and Tao Mei. Look closer to see better: Recurrent attention convolutional neural network for fine-grained image recognition. In Proceedings of the IEEE conference on computer vision and pattern recognition, pages 4438\u20134446, 2017"},{"key":"25_CR15","doi-asserted-by":"publisher","first-page":"13130","DOI":"10.1609\/aaai.v34i07.7016","volume":"34","author":"P Zhuang","year":"2020","unstructured":"Zhuang, P., Wang, Y., Qiao, Yu.: Learning attentive pairwise interaction for fine-grained classification. In Proceedings of the AAAI conference on artificial intelligence 34, 13130\u201313137 (2020)","journal-title":"In Proceedings of the AAAI conference on artificial intelligence"},{"key":"25_CR16","unstructured":"Jun Wang, Xiaohan Yu, and Yongsheng Gao. Feature fusion vision transformer for fine-grained visual categorization. arXiv preprint arXiv:2107.02341, 2021"},{"key":"25_CR17","doi-asserted-by":"publisher","first-page":"852","DOI":"10.1609\/aaai.v36i1.19967","volume":"36","author":"J He","year":"2022","unstructured":"He, J., Chen, J.-N., Liu, S., Kortylewski, A., Yang, C., Bai, Y., Wang, C.: Transfg: A transformer architecture for fine-grained recognition. In Proceedings of the AAAI Conference on Artificial Intelligence 36, 852\u2013860 (2022)","journal-title":"In Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"25_CR18","doi-asserted-by":"crossref","unstructured":"Yuan Zhang, Jian Cao, Ling Zhang, Xiangcheng Liu, Zhiyi Wang, Feng Ling, and Weiqian Chen. A free lunch from vit: Adaptive attention multi-scale fusion transformer for fine-grained visual recognition. In ICASSP 2022-2022 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pages 3234\u20133238. IEEE, 2022","DOI":"10.1109\/ICASSP43922.2022.9747591"},{"key":"25_CR19","doi-asserted-by":"crossref","unstructured":"Yunqing Hu, Xuan Jin, Yin Zhang, Haiwen Hong, Jingfeng Zhang, Yuan He, and Hui Xue. Rams-trans: Recurrent attention multi-scale transformer for fine-grained image recognition. In Proceedings of the 29th ACM International Conference on Multimedia, pages 4239\u20134248, 2021","DOI":"10.1145\/3474085.3475561"},{"key":"25_CR20","unstructured":"Hongbo Sun, Xiangteng He, and Yuxin Peng. Sim-trans: Structure information modeling transformer for fine-grained visual categorization. In Proceedings of the 30th ACM International Conference on Multimedia, pages 5853\u20135861, 2022"},{"issue":"2","key":"25_CR21","doi-asserted-by":"publisher","first-page":"307","DOI":"10.1016\/S0016-0032(96)00063-4","volume":"334","author":"ML Men\u00e9ndez","year":"1997","unstructured":"Men\u00e9ndez, M.L., Pardo, J.A., Pardo, L., Pardo, M.C.: The jensen-shannon divergence. J. Franklin Inst. 334(2), 307\u2013318 (1997)","journal-title":"J. Franklin Inst."},{"key":"25_CR22","unstructured":"Catherine Wah, Steve Branson, Peter Welinder, Pietro Perona, and Serge Belongie. The caltech-ucsd birds-200-2011 dataset. 2011"},{"key":"25_CR23","unstructured":"Aditya Khosla, Nityananda Jayadevaprakash, Bangpeng Yao, and Fei-Fei Li. Novel dataset for fine-grained image categorization: Stanford dogs. In Proc. CVPR workshop on fine-grained visual categorization (FGVC), volume\u00a02. Citeseer, 2011"},{"key":"25_CR24","unstructured":"Xiaoping Wu, Chi Zhan, Yu-Kun Lai, Ming-Ming Cheng, and Jufeng Yang. Ip102: A large-scale benchmark dataset for insect pest recognition. In Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pages 8787\u20138796, 2019"},{"key":"25_CR25","doi-asserted-by":"publisher","first-page":"12741","DOI":"10.1609\/aaai.v34i07.6968","volume":"34","author":"Yu Xiaohan","year":"2020","unstructured":"Xiaohan, Yu., Zhao, Y., Gao, Y., Xiong, S., Yuan, X.: Patchy image structure classification using multi-orientation region transform. In Proceedings of the AAAI conference on artificial intelligence 34, 12741\u201312748 (2020)","journal-title":"In Proceedings of the AAAI conference on artificial intelligence"},{"key":"25_CR26","unstructured":"Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun. Deep residual learning for image recognition. In Proceedings of the IEEE conference on computer vision and pattern recognition, pages 770\u2013778, 2016"},{"key":"25_CR27","doi-asserted-by":"publisher","first-page":"1983","DOI":"10.1109\/LSP.2021.3114622","volume":"28","author":"Z Miao","year":"2021","unstructured":"Miao, Z., Zhao, X., Wang, J., Li, Y., Li, H.: Complemental attention multi-feature fusion network for fine-grained classification. IEEE Signal Process. Lett. 28, 1983\u20131987 (2021)","journal-title":"IEEE Signal Process. Lett."},{"key":"25_CR28","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2023.109547","volume":"140","author":"Q Wang","year":"2023","unstructured":"Wang, Q., Wang, J.J., Deng, H., Xue, W., Wang, Y., Hao, G.: Aa-trans: Core attention aggregating transformer with information entropy selector for fine-grained visual classification. Pattern Recogn. 140, 109547 (2023)","journal-title":"Pattern Recogn."},{"key":"25_CR29","doi-asserted-by":"crossref","unstructured":"Qin Xu, Jiahui Wang, Bo\u00a0Jiang, and Bin Luo. Fine-grained visual classification via internal ensemble learning transformer. IEEE Transactions on Multimedia, 2023","DOI":"10.1109\/TMM.2023.3244340"},{"key":"25_CR30","doi-asserted-by":"crossref","unstructured":"Ziye Fang, Xin Jiang, Hao Tang, and Zechao Li. Learning contrastive self-distillation for ultra-fine-grained visual categorization targeting limited samples. IEEE Transactions on Circuits and Systems for Video Technology, 2024","DOI":"10.1109\/TCSVT.2024.3370731"}],"container-title":["Lecture Notes in Computer Science","Pattern Recognition"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-78383-8_25","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,12,1]],"date-time":"2024-12-01T23:41:43Z","timestamp":1733096503000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-78383-8_25"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,12,2]]},"ISBN":["9783031783821","9783031783838"],"references-count":30,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-78383-8_25","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2024,12,2]]},"assertion":[{"value":"2 December 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ICPR","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Pattern Recognition","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Kolkata","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"India","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"1 December 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"5 December 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"27","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"icpr2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/icpr2024.org\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}