{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,21]],"date-time":"2026-04-21T14:54:44Z","timestamp":1776783284121,"version":"3.51.2"},"publisher-location":"New York, NY, USA","reference-count":56,"publisher":"ACM","license":[{"start":{"date-parts":[[2020,10,12]],"date-time":"2020-10-12T00:00:00Z","timestamp":1602460800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"funder":[{"name":"National Key Research and Development Program of China","award":["No. 2018AAA0102200"],"award-info":[{"award-number":["No. 2018AAA0102200"]}]},{"name":"Fundamental Research Funds for the Central Universities","award":["ZYGX2019Z015"],"award-info":[{"award-number":["ZYGX2019Z015"]}]},{"name":"Sichuan Science and Technology Program China","award":["2020YFS0057 2020YJ0038"],"award-info":[{"award-number":["2020YFS0057 2020YJ0038"]}]},{"name":"Dongguan Songshan Lake Introduction Program of Leading Innovative and Entrepreneurial Talents"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2020,10,12]]},"DOI":"10.1145\/3394171.3413638","type":"proceedings-article","created":{"date-parts":[[2020,10,12]],"date-time":"2020-10-12T13:10:44Z","timestamp":1602508244000},"page":"211-219","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":8,"title":["Text-Embedded Bilinear Model for Fine-Grained Visual Recognition"],"prefix":"10.1145","author":[{"given":"Liang","family":"Sun","sequence":"first","affiliation":[{"name":"University of Electronic Science and Technology of China, Cheng Du, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiang","family":"Guan","sequence":"additional","affiliation":[{"name":"University of Electronic Science and Technology of China, Cheng Du, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yang","family":"Yang","sequence":"additional","affiliation":[{"name":"University of Electronic Science and Technology of China, Cheng Du, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lei","family":"Zhang","sequence":"additional","affiliation":[{"name":"Chongqing University, Chong Qing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2020,10,12]]},"reference":[{"key":"e_1_3_2_2_1_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2015.7301270"},{"key":"e_1_3_2_2_2_1","volume-title":"Serge J. Belongie, and Pietro Perona.","author":"Branson Steve","year":"2014","unstructured":"Steve Branson , Grant Van Horn , Serge J. Belongie, and Pietro Perona. 2014 . Bird Species Categorization Using Pose Normalized Deep Convolutional Nets. CoRR , Vol. abs\/ 1406 .2952 (2014). Steve Branson, Grant Van Horn, Serge J. Belongie, and Pietro Perona. 2014. Bird Species Categorization Using Pose Normalized Deep Convolutional Nets. CoRR, Vol. abs\/1406.2952 (2014)."},{"key":"e_1_3_2_2_3_1","volume-title":"Xiaoxu Li, Zhanyu Ma, Ming Wu, Jun Guo, and Yi-Zhe Song.","author":"Chang Dongliang","year":"2020","unstructured":"Dongliang Chang , Yifeng Ding , Jiyang Xie , Ayan Kumar Bhunia , Xiaoxu Li, Zhanyu Ma, Ming Wu, Jun Guo, and Yi-Zhe Song. 2020 . The Devil is in the Channels : Mutual-Channel Loss for Fine-Grained Image Classification. IEEE Trans. Image Processing ( 2020), 4683--4695. Dongliang Chang, Yifeng Ding, Jiyang Xie, Ayan Kumar Bhunia, Xiaoxu Li, Zhanyu Ma, Ming Wu, Jun Guo, and Yi-Zhe Song. 2020. The Devil is in the Channels: Mutual-Channel Loss for Fine-Grained Image Classification. IEEE Trans. Image Processing (2020), 4683--4695."},{"key":"e_1_3_2_2_4_1","doi-asserted-by":"crossref","unstructured":"Tianshui Chen Liang Lin Riquan Chen Yang Wu and Xiaonan Luo. 2018a. Knowledge-Embedded Representation Learning for Fine-Grained Image Recognition. In IJCAI. 627--634.  Tianshui Chen Liang Lin Riquan Chen Yang Wu and Xiaonan Luo. 2018a. Knowledge-Embedded Representation Learning for Fine-Grained Image Recognition. In IJCAI. 627--634.","DOI":"10.24963\/ijcai.2018\/87"},{"key":"e_1_3_2_2_5_1","doi-asserted-by":"crossref","unstructured":"Tianshui Chen Zhouxia Wang Guanbin Li and Liang Lin. 2018b. Recurrent Attentional Reinforcement Learning for Multi-Label Image Recognition. In AAAI. 6730--6737.  Tianshui Chen Zhouxia Wang Guanbin Li and Liang Lin. 2018b. Recurrent Attentional Reinforcement Learning for Multi-Label Image Recognition. In AAAI. 6730--6737.","DOI":"10.1609\/aaai.v32i1.12281"},{"key":"e_1_3_2_2_6_1","doi-asserted-by":"crossref","unstructured":"Yue Chen Yalong Bai Wei Zhang and Tao Mei. 2019. Destruction and Construction Learning for Fine-Grained Image Recognition. In CVPR. 5157--5166.  Yue Chen Yalong Bai Wei Zhang and Tao Mei. 2019. Destruction and Construction Learning for Fine-Grained Image Recognition. In CVPR. 5157--5166.","DOI":"10.1109\/CVPR.2019.00530"},{"key":"e_1_3_2_2_7_1","volume-title":"Belongie","author":"Cui Yin","year":"2016","unstructured":"Yin Cui , Feng Zhou , Yuanqing Lin , and Serge J . Belongie . 2016 . Fine-Grained Categorization and Dataset Bootstrapping Using Deep Metric Learning with Humans in the Loop. In CVPR. 1153--1162. Yin Cui, Feng Zhou, Yuanqing Lin, and Serge J. Belongie. 2016. Fine-Grained Categorization and Dataset Bootstrapping Using Deep Metric Learning with Humans in the Loop. In CVPR. 1153--1162."},{"key":"e_1_3_2_2_8_1","unstructured":"Jianlong Fu Heliang Zheng and Tao Mei. 2017. Look Closer to See Better: Recurrent Attention Convolutional Neural Network for Fine-Grained Image Recognition. In CVPR. 4476--4484.  Jianlong Fu Heliang Zheng and Tao Mei. 2017. Look Closer to See Better: Recurrent Attention Convolutional Neural Network for Fine-Grained Image Recognition. In CVPR. 4476--4484."},{"key":"e_1_3_2_2_9_1","doi-asserted-by":"crossref","unstructured":"Yang Gao Oscar Beijbom Ning Zhang and Trevor Darrell. 2016. Compact Bilinear Pooling. In CVPR. 317--326.  Yang Gao Oscar Beijbom Ning Zhang and Trevor Darrell. 2016. Compact Bilinear Pooling. In CVPR. 317--326.","DOI":"10.1109\/CVPR.2016.41"},{"key":"e_1_3_2_2_10_1","unstructured":"Weifeng Ge Xiangru Lin and Yizhou Yu. 2019. Weakly Supervised Complementary Parts Models for Fine-Grained Image Classification From the Bottom Up. In CVPR. 3034--3043.  Weifeng Ge Xiangru Lin and Yizhou Yu. 2019. Weakly Supervised Complementary Parts Models for Fine-Grained Image Classification From the Bottom Up. In CVPR. 3034--3043."},{"key":"e_1_3_2_2_11_1","unstructured":"Kaiming He Xiangyu Zhang Shaoqing Ren and Jian Sun. 2016. Deep Residual Learning for Image Recognition. In CVPR. 770--778.  Kaiming He Xiangyu Zhang Shaoqing Ren and Jian Sun. 2016. Deep Residual Learning for Image Recognition. In CVPR. 770--778."},{"key":"e_1_3_2_2_12_1","unstructured":"Xiangteng He and Yuxin Peng. 2017. Fine-Grained Image Classification via Combining Vision and Language. In CVPR. 7332--7340.  Xiangteng He and Yuxin Peng. 2017. Fine-Grained Image Classification via Combining Vision and Language. In CVPR. 7332--7340."},{"key":"e_1_3_2_2_13_1","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2019.2892802"},{"key":"e_1_3_2_2_14_1","doi-asserted-by":"crossref","unstructured":"Jie Hu Li Shen and Gang Sun. 2018b. Squeeze-and-Excitation Networks. In CVPR. 7132--7141.  Jie Hu Li Shen and Gang Sun. 2018b. Squeeze-and-Excitation Networks. In CVPR. 7132--7141.","DOI":"10.1109\/CVPR.2018.00745"},{"key":"e_1_3_2_2_15_1","volume-title":"Weakly Supervised Local Attention Network for Fine-Grained Visual Classification. CoRR","author":"Hu Tao","year":"2018","unstructured":"Tao Hu , Honggang Qi , Cong Huang , Qingming Huang , Yan Lu , and Jizheng Xu. 2018a. Weakly Supervised Local Attention Network for Fine-Grained Visual Classification. CoRR , Vol. abs\/ 1808 .02152 ( 2018 ). Tao Hu, Honggang Qi, Cong Huang, Qingming Huang, Yan Lu, and Jizheng Xu. 2018a. Weakly Supervised Local Attention Network for Fine-Grained Visual Classification. CoRR, Vol. abs\/1808.02152 (2018)."},{"key":"e_1_3_2_2_16_1","first-page":"673","article-title":"PBC","volume":"19","author":"Huang Chao","year":"2017","unstructured":"Chao Huang , Hongliang Li , Yurui Xie , Qingbo Wu , and Bing Luo . 2017 . PBC : Polygon-Based Classifier for Fine-Grained Categorization. IEEE Trans. Multimedia , Vol. 19 (2017), 673 -- 684 . Chao Huang, Hongliang Li, Yurui Xie, Qingbo Wu, and Bing Luo. 2017. PBC: Polygon-Based Classifier for Fine-Grained Categorization. IEEE Trans. Multimedia, Vol. 19 (2017), 673--684.","journal-title":"Polygon-Based Classifier for Fine-Grained Categorization. IEEE Trans. Multimedia"},{"key":"e_1_3_2_2_17_1","doi-asserted-by":"crossref","unstructured":"Shaoli Huang Zhe Xu Dacheng Tao and Ya Zhang. 2016. Part-Stacked CNN for Fine-Grained Visual Categorization. In CVPR. 1173--1182.  Shaoli Huang Zhe Xu Dacheng Tao and Ya Zhang. 2016. Part-Stacked CNN for Fine-Grained Visual Categorization. In CVPR. 1173--1182.","DOI":"10.1109\/CVPR.2016.132"},{"key":"e_1_3_2_2_18_1","doi-asserted-by":"crossref","unstructured":"Yuqi Huo Yao Lu Yulei Niu Zhiwu Lu and Ji-Rong Wen. 2019. Coarse-to-Fine Grained Classification. In SIGIR. 1033--1036.  Yuqi Huo Yao Lu Yulei Niu Zhiwu Lu and Ji-Rong Wen. 2019. Coarse-to-Fine Grained Classification. In SIGIR. 1033--1036.","DOI":"10.1145\/3331184.3331336"},{"key":"e_1_3_2_2_19_1","unstructured":"Max Jaderberg Karen Simonyan Andrew Zisserman and Koray Kavukcuoglu. 2015. Spatial Transformer Networks. In Advances in Neural Information Processing Systems 28. 2017--2025.  Max Jaderberg Karen Simonyan Andrew Zisserman and Koray Kavukcuoglu. 2015. Spatial Transformer Networks. In Advances in Neural Information Processing Systems 28. 2017--2025."},{"key":"e_1_3_2_2_20_1","volume-title":"Woosang Lim, Jeonghee Kim, Jung-Woo Ha, and Byoung-Tak Zhang.","author":"Kim Jin-Hwa","year":"2017","unstructured":"Jin-Hwa Kim , Kyoung Woon On , Woosang Lim, Jeonghee Kim, Jung-Woo Ha, and Byoung-Tak Zhang. 2017 . Hadamard Product for Low-rank Bilinear Pooling. In ICLR. Jin-Hwa Kim, Kyoung Woon On, Woosang Lim, Jeonghee Kim, Jung-Woo Ha, and Byoung-Tak Zhang. 2017. Hadamard Product for Low-rank Bilinear Pooling. In ICLR."},{"key":"e_1_3_2_2_21_1","volume-title":"Fowlkes","author":"Kong Shu","year":"2017","unstructured":"Shu Kong and Charless C . Fowlkes . 2017 . Low-Rank Bilinear Pooling for Fine-Grained Classification. In CVPR. 7025--7034. Shu Kong and Charless C. Fowlkes. 2017. Low-Rank Bilinear Pooling for Fine-Grained Classification. In CVPR. 7025--7034."},{"key":"e_1_3_2_2_22_1","doi-asserted-by":"crossref","unstructured":"Jonathan Krause Hailin Jin Jianchao Yang and Fei-Fei Li. 2015. Fine-grained recognition without part annotations. In CVPR. 5546--5555.  Jonathan Krause Hailin Jin Jianchao Yang and Fei-Fei Li. 2015. Fine-grained recognition without part annotations. In CVPR. 5546--5555.","DOI":"10.1109\/CVPR.2015.7299194"},{"key":"e_1_3_2_2_23_1","unstructured":"Michael Lam Behrooz Mahasseni and Sinisa Todorovic. 2017. Fine-Grained Recognition as HSnet Search for Informative Image Parts. In CVPR. 6497--6506.  Michael Lam Behrooz Mahasseni and Sinisa Todorovic. 2017. Fine-Grained Recognition as HSnet Search for Informative Image Parts. In CVPR. 6497--6506."},{"key":"e_1_3_2_2_24_1","doi-asserted-by":"publisher","DOI":"10.3233\/SW-140134"},{"key":"e_1_3_2_2_25_1","unstructured":"Jingjing Li Lei Zhu Zi Huang Ke Lu and Jidong Zhao. 2018. I read I saw I tell: Texts Assisted Fine-Grained Visual Classification. In MM. 663--671.  Jingjing Li Lei Zhu Zi Huang Ke Lu and Jidong Zhao. 2018. I read I saw I tell: Texts Assisted Fine-Grained Visual Classification. In MM. 663--671."},{"key":"e_1_3_2_2_26_1","unstructured":"Yanghao Li Naiyan Wang Jiaying Liu and Xiaodi Hou. 2017. Factorized Bilinear Models for Image Recognition. In ICCV. 2098--2106.  Yanghao Li Naiyan Wang Jiaying Liu and Xiaodi Hou. 2017. Factorized Bilinear Models for Image Recognition. In ICCV. 2098--2106."},{"key":"e_1_3_2_2_27_1","doi-asserted-by":"crossref","unstructured":"Di Lin Xiaoyong Shen Cewu Lu and Jiaya Jia. 2015b. Deep LAC: Deep localization alignment and classification for fine-grained recognition. In CVPR. 1666--1674.  Di Lin Xiaoyong Shen Cewu Lu and Jiaya Jia. 2015b. Deep LAC: Deep localization alignment and classification for fine-grained recognition. In CVPR. 1666--1674.","DOI":"10.1109\/CVPR.2015.7298775"},{"key":"e_1_3_2_2_28_1","volume-title":"Aruni Roy Chowdhury, and Subhransu Maji","author":"Lin Tsung-Yu","year":"2015","unstructured":"Tsung-Yu Lin , Aruni Roy Chowdhury, and Subhransu Maji . 2015 a. Bilinear CNN Models for Fine-Grained Visual Recognition. In ICCV. 1449--1457. Tsung-Yu Lin, Aruni Roy Chowdhury, and Subhransu Maji. 2015a. Bilinear CNN Models for Fine-Grained Visual Recognition. In ICCV. 1449--1457."},{"key":"e_1_3_2_2_29_1","doi-asserted-by":"crossref","unstructured":"Maria-Elena Nilsback and Andrew Zisserman. 2008. Automated Flower Classification over a Large Number of Classes. In ICVGIP. 722--729.  Maria-Elena Nilsback and Andrew Zisserman. 2008. Automated Flower Classification over a Large Number of Classes. In ICVGIP. 722--729.","DOI":"10.1109\/ICVGIP.2008.47"},{"key":"e_1_3_2_2_30_1","doi-asserted-by":"crossref","unstructured":"Liang Peng Yang Yang Zheng Wang Xiao Wu and Zi Huang. 2019. CRA-Net: Composed Relation Attention Network for Visual Question Answering. In ACM MM. 1202--1210.  Liang Peng Yang Yang Zheng Wang Xiao Wu and Zi Huang. 2019. CRA-Net: Composed Relation Attention Network for Visual Question Answering. In ACM MM. 1202--1210.","DOI":"10.1145\/3343031.3350925"},{"key":"e_1_3_2_2_31_1","volume-title":"Answer Again: Imporving VQA with Cascaded-Answering Model. TKDE","author":"Peng Liang","year":"2020","unstructured":"Liang Peng , Yang Yang , Xiaopeng Zhang , Yanli Ji , Huimin Lu , and Heng Tao Shen . 2020 . Answer Again: Imporving VQA with Cascaded-Answering Model. TKDE (2020), 1--12. Liang Peng, Yang Yang, Xiaopeng Zhang, Yanli Ji, Huimin Lu, and Heng Tao Shen. 2020. Answer Again: Imporving VQA with Cascaded-Answering Model. TKDE (2020), 1--12."},{"key":"e_1_3_2_2_32_1","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2017.2774041"},{"key":"e_1_3_2_2_33_1","doi-asserted-by":"crossref","unstructured":"Ninh Pham and Rasmus Pagh. 2013. Fast and scalable polynomial kernels via explicit feature maps. In TSIGKDD. 239--247.  Ninh Pham and Rasmus Pagh. 2013. Fast and scalable polynomial kernels via explicit feature maps. In TSIGKDD. 239--247.","DOI":"10.1145\/2487575.2487591"},{"key":"e_1_3_2_2_34_1","doi-asserted-by":"crossref","unstructured":"Qi Qian Rong Jin Shenghuo Zhu and Yuanqing Lin. 2015. Fine-grained visual categorization via multi-stage metric learning. In CVPR. 3716--3724.  Qi Qian Rong Jin Shenghuo Zhu and Yuanqing Lin. 2015. Fine-grained visual categorization via multi-stage metric learning. In CVPR. 3716--3724.","DOI":"10.1109\/CVPR.2015.7298995"},{"key":"e_1_3_2_2_35_1","doi-asserted-by":"crossref","unstructured":"Ali Sharif Razavian Hossein Azizpour Josephine Sullivan and Stefan Carlsson. 2014. CNN Features Off-the-Shelf: An Astounding Baseline for Recognition. In CVPR. 512--519.  Ali Sharif Razavian Hossein Azizpour Josephine Sullivan and Stefan Carlsson. 2014. CNN Features Off-the-Shelf: An Astounding Baseline for Recognition. In CVPR. 512--519.","DOI":"10.1109\/CVPRW.2014.131"},{"key":"e_1_3_2_2_36_1","doi-asserted-by":"crossref","unstructured":"Scott E. Reed Zeynep Akata Honglak Lee and Bernt Schiele. 2016. Learning Deep Representations of Fine-Grained Visual Descriptions. In CVPR. 49--58.  Scott E. Reed Zeynep Akata Honglak Lee and Bernt Schiele. 2016. Learning Deep Representations of Fine-Grained Visual Descriptions. In CVPR. 49--58.","DOI":"10.1109\/CVPR.2016.13"},{"key":"e_1_3_2_2_37_1","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-015-0816-y"},{"key":"e_1_3_2_2_38_1","doi-asserted-by":"crossref","unstructured":"Marcel Simon and Erik Rodner. 2015. Neural Activation Constellations: Unsupervised Part Model Discovery with Convolutional Networks. In ICCV. 1143--1151.  Marcel Simon and Erik Rodner. 2015. Neural Activation Constellations: Unsupervised Part Model Discovery with Convolutional Networks. In ICCV. 1143--1151.","DOI":"10.1109\/ICCV.2015.136"},{"key":"e_1_3_2_2_39_1","first-page":"834","article-title":"Multi-Attention Multi-Class Constraint for Fine-grained Image Recognition","volume":"11220","author":"Sun Ming","year":"2018","unstructured":"Ming Sun , Yuchen Yuan , Feng Zhou , and Errui Ding . 2018 . Multi-Attention Multi-Class Constraint for Fine-grained Image Recognition . In Computer Vision - ECCV , Vol. 11220. 834 -- 850 . Ming Sun, Yuchen Yuan, Feng Zhou, and Errui Ding. 2018. Multi-Attention Multi-Class Constraint for Fine-grained Image Recognition. In Computer Vision - ECCV, Vol. 11220. 834--850.","journal-title":"Computer Vision - ECCV"},{"key":"e_1_3_2_2_40_1","volume-title":"Belongie","author":"Wah Catherine","year":"2011","unstructured":"Catherine Wah , Steve Branson , Peter Welinder , Pietro Perona , and Serge J . Belongie . 2011 . The Caltech-UCSD Birds-200--2011 Dataset . Catherine Wah, Steve Branson, Peter Welinder, Pietro Perona, and Serge J. Belongie. 2011. The Caltech-UCSD Birds-200--2011 Dataset."},{"key":"e_1_3_2_2_41_1","doi-asserted-by":"crossref","unstructured":"Dequan Wang Zhiqiang Shen Jie Shao Wei Zhang Xiangyang Xue and Zheng Zhang. 2015. Multiple Granularity Descriptors for Fine-Grained Categorization. In ICCV. 2399--2406.  Dequan Wang Zhiqiang Shen Jie Shao Wei Zhang Xiangyang Xue and Zheng Zhang. 2015. Multiple Granularity Descriptors for Fine-Grained Categorization. In ICCV. 2399--2406.","DOI":"10.1109\/ICCV.2015.276"},{"key":"e_1_3_2_2_42_1","volume-title":"Davis","author":"Wang Yaming","year":"2018","unstructured":"Yaming Wang , Vlad I. Morariu , and Larry S . Davis . 2018 . Learning a Discriminative Filter Bank Within a CNN for Fine-Grained Recognition. In CVPR. 4148--4157. Yaming Wang, Vlad I. Morariu, and Larry S. Davis. 2018. Learning a Discriminative Filter Bank Within a CNN for Fine-Grained Recognition. In CVPR. 4148--4157."},{"key":"e_1_3_2_2_43_1","doi-asserted-by":"publisher","DOI":"10.1016\/j.ipm.2019.102130"},{"key":"e_1_3_2_2_44_1","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2017.10.002"},{"key":"e_1_3_2_2_45_1","volume-title":"CBAM: Convolutional Block Attention Module. In Computer Vision - ECCV,","author":"Woo Sanghyun","year":"2018","unstructured":"Sanghyun Woo , Jongchan Park , Joon-Young Lee , and In So Kweon . 2018 . CBAM: Convolutional Block Attention Module. In Computer Vision - ECCV, , Vittorio Ferrari, Martial Hebert, Cristian Sminchisescu, and Yair Weiss (Eds.), Vol. 11211 . 3--19. Sanghyun Woo, Jongchan Park, Joon-Young Lee, and In So Kweon. 2018. CBAM: Convolutional Block Attention Module. In Computer Vision - ECCV,, Vittorio Ferrari, Martial Hebert, Cristian Sminchisescu, and Yair Weiss (Eds.), Vol. 11211. 3--19."},{"key":"e_1_3_2_2_46_1","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-016-0970-x"},{"key":"e_1_3_2_2_47_1","doi-asserted-by":"crossref","unstructured":"Zhe Xu Shaoli Huang Ya Zhang and Dacheng Tao. 2015. Augmenting Strong Supervision Using Web Data for Fine-Grained Categorization. In ICCV. 2524--2532.  Zhe Xu Shaoli Huang Ya Zhang and Dacheng Tao. 2015. Augmenting Strong Supervision Using Web Data for Fine-Grained Categorization. In ICCV. 2524--2532.","DOI":"10.1109\/ICCV.2015.290"},{"key":"e_1_3_2_2_48_1","first-page":"438","article-title":"Learning to Navigate for Fine-Grained Classification","volume":"11218","author":"Yang Ze","year":"2018","unstructured":"Ze Yang , Tiange Luo , Dong Wang , Zhiqiang Hu , Jun Gao , and Liwei Wang . 2018 . Learning to Navigate for Fine-Grained Classification . In Computer Vision - ECCV , Vol. 11218. 438 -- 454 . Ze Yang, Tiange Luo, Dong Wang, Zhiqiang Hu, Jun Gao, and Liwei Wang. 2018. Learning to Navigate for Fine-Grained Classification. In Computer Vision - ECCV, Vol. 11218. 438--454.","journal-title":"Computer Vision - ECCV"},{"key":"e_1_3_2_2_49_1","first-page":"595","article-title":"Hierarchical Bilinear Pooling for Fine-Grained Visual Recognition","volume":"11220","author":"Yu Chaojian","year":"2018","unstructured":"Chaojian Yu , Xinyi Zhao , Qi Zheng , Peng Zhang , and Xinge You . 2018 . Hierarchical Bilinear Pooling for Fine-Grained Visual Recognition . In Computer Vision - ECCV , Vol. 11220. 595 -- 610 . Chaojian Yu, Xinyi Zhao, Qi Zheng, Peng Zhang, and Xinge You. 2018. Hierarchical Bilinear Pooling for Fine-Grained Visual Recognition. In Computer Vision - ECCV, Vol. 11220. 595--610.","journal-title":"Computer Vision - ECCV"},{"key":"e_1_3_2_2_50_1","doi-asserted-by":"crossref","unstructured":"Hua Zhang Xiaochun Cao and Rui Wang. 2018a. Audio Visual Attribute Discovery for Fine-Grained Object Recognition. In AAAI. 7542--7549.  Hua Zhang Xiaochun Cao and Rui Wang. 2018a. Audio Visual Attribute Discovery for Fine-Grained Object Recognition. In AAAI. 7542--7549.","DOI":"10.1609\/aaai.v32i1.12295"},{"key":"e_1_3_2_2_51_1","doi-asserted-by":"crossref","unstructured":"Lianbo Zhang Shaoli Huang Wei Liu and Dacheng Tao. 2019. Learning a Mixture of Granularity-Specific Experts for Fine-Grained Categorization. In ICCV. 8330--8339.  Lianbo Zhang Shaoli Huang Wei Liu and Dacheng Tao. 2019. Learning a Mixture of Granularity-Specific Experts for Fine-Grained Categorization. In ICCV. 8330--8339.","DOI":"10.1109\/ICCV.2019.00842"},{"key":"e_1_3_2_2_52_1","first-page":"834","article-title":"Part-Based R-CNNs for Fine-Grained Category Detection","volume":"8689","author":"Zhang Ning","year":"2014","unstructured":"Ning Zhang , Jeff Donahue , Ross B. Girshick , and Trevor Darrell . 2014 . Part-Based R-CNNs for Fine-Grained Category Detection . In Computer Vision - ECCV , Vol. 8689. 834 -- 849 . Ning Zhang, Jeff Donahue, Ross B. Girshick, and Trevor Darrell. 2014. Part-Based R-CNNs for Fine-Grained Category Detection. In Computer Vision - ECCV, Vol. 8689. 834--849.","journal-title":"Computer Vision - ECCV"},{"key":"e_1_3_2_2_53_1","doi-asserted-by":"crossref","unstructured":"Shaofeng Zhang Zheng Wang Xing Xu Xiang Guan and Yang Yang. 2020. Fooled by Imagination: Adversarial Attack to Image Captioning Via Perturbation in Complex Domain. In ICME. 1--6.  Shaofeng Zhang Zheng Wang Xing Xu Xiang Guan and Yang Yang. 2020. Fooled by Imagination: Adversarial Attack to Image Captioning Via Perturbation in Complex Domain. In ICME. 1--6.","DOI":"10.1109\/ICME46284.2020.9102842"},{"key":"e_1_3_2_2_54_1","first-page":"241","article-title":"Fine-Grained Visual Categorization Using Meta-learning Optimization with Sample Selection of Auxiliary Data","volume":"11212","author":"Zhang Yabin","year":"2018","unstructured":"Yabin Zhang , Hui Tang , and Kui Jia . 2018 b. Fine-Grained Visual Categorization Using Meta-learning Optimization with Sample Selection of Auxiliary Data . In Computer Vision - ECCV , Vol. 11212. 241 -- 256 . Yabin Zhang, Hui Tang, and Kui Jia. 2018b. Fine-Grained Visual Categorization Using Meta-learning Optimization with Sample Selection of Auxiliary Data. In Computer Vision - ECCV, Vol. 11212. 241--256.","journal-title":"Computer Vision - ECCV"},{"key":"e_1_3_2_2_55_1","doi-asserted-by":"crossref","unstructured":"Heliang Zheng Jianlong Fu Tao Mei and Jiebo Luo. 2017. Learning Multi-attention Convolutional Neural Network for Fine-Grained Image Recognition. In ICCV. 5219--5227.  Heliang Zheng Jianlong Fu Tao Mei and Jiebo Luo. 2017. Learning Multi-attention Convolutional Neural Network for Fine-Grained Image Recognition. In ICCV. 5219--5227.","DOI":"10.1109\/ICCV.2017.557"},{"key":"e_1_3_2_2_56_1","doi-asserted-by":"crossref","unstructured":"Heliang Zheng Jianlong Fu Zheng-Jun Zha and Jiebo Luo. 2019. Looking for the Devil in the Details: Learning Trilinear Attention Sampling Network for Fine-Grained Image Recognition. In CVPR. 5012--5021.  Heliang Zheng Jianlong Fu Zheng-Jun Zha and Jiebo Luo. 2019. Looking for the Devil in the Details: Learning Trilinear Attention Sampling Network for Fine-Grained Image Recognition. In CVPR. 5012--5021.","DOI":"10.1109\/CVPR.2019.00515"}],"event":{"name":"MM '20: The 28th ACM International Conference on Multimedia","location":"Seattle WA USA","acronym":"MM '20","sponsor":["SIGMM ACM Special Interest Group on Multimedia"]},"container-title":["Proceedings of the 28th ACM International Conference on Multimedia"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3394171.3413638","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3394171.3413638","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T20:47:15Z","timestamp":1750193235000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3394171.3413638"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,10,12]]},"references-count":56,"alternative-id":["10.1145\/3394171.3413638","10.1145\/3394171"],"URL":"https:\/\/doi.org\/10.1145\/3394171.3413638","relation":{},"subject":[],"published":{"date-parts":[[2020,10,12]]},"assertion":[{"value":"2020-10-12","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}