{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,11,26]],"date-time":"2025-11-26T16:31:29Z","timestamp":1764174689988,"version":"build-2065373602"},"publisher-location":"Cham","reference-count":44,"publisher":"Springer International Publishing","isbn-type":[{"type":"print","value":"9783030208868"},{"type":"electronic","value":"9783030208875"}],"license":[{"start":{"date-parts":[[2019,1,1]],"date-time":"2019-01-01T00:00:00Z","timestamp":1546300800000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2019]]},"DOI":"10.1007\/978-3-030-20887-5_33","type":"book-chapter","created":{"date-parts":[[2019,5,27]],"date-time":"2019-05-27T12:03:59Z","timestamp":1558958639000},"page":"530-546","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":5,"title":["Deep Multiple Instance Learning for Zero-Shot Image Tagging"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-7169-0318","authenticated-orcid":false,"given":"Shafin","family":"Rahman","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9502-1749","authenticated-orcid":false,"given":"Salman","family":"Khan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2019,5,28]]},"reference":[{"doi-asserted-by":"crossref","unstructured":"Akata, Z., Reed, S., Walter, D., Lee, H., Schiele, B.: Evaluation of output embeddings for fine-grained image classification. In: CVPR, 07\u201312 June 2015, pp. 2927\u20132936 (2015)","key":"33_CR1","DOI":"10.1109\/CVPR.2015.7298911"},{"doi-asserted-by":"crossref","unstructured":"Akata, Z., Malinowski, M., Fritz, M., Schiele, B.: Multi-cue zero-shot learning with strong supervision. In: CVPR, June 2016","key":"33_CR2","DOI":"10.1109\/CVPR.2016.14"},{"unstructured":"Bourbaki, N.: El\u00e9ments de math\u00e9matiques: th\u00e9orie des ensembles, chapitres 1 \u00e0 4, vol. 1. Masson (1990)","key":"33_CR3"},{"unstructured":"Chen, M., Zheng, A., Weinberger, K.Q.: Fast image tagging. In: ICML, January 2013","key":"33_CR4"},{"doi-asserted-by":"crossref","unstructured":"Cheng, M.M., Zhang, Z., Lin, W.Y., Torr, P.: Bing: binarized normed gradients for objectness estimation at 300fps. In: CVPR, pp. 3286\u20133293 (2014)","key":"33_CR5","DOI":"10.1109\/CVPR.2014.414"},{"doi-asserted-by":"crossref","unstructured":"Chua, T.S., Tang, J., Hong, R., Li, H., Luo, Z., Zheng, Y.T.: NUS-WIDE: a real-world web image database from National University of Singapore. In: CIVR, Santorini, Greece, 8\u201310 July 2009","key":"33_CR6","DOI":"10.1145\/1646396.1646452"},{"doi-asserted-by":"crossref","unstructured":"Demirel, B., Gokberk Cinbis, R., Ikizler-Cinbis, N.: Attributes2classname: a discriminative model for attribute-based unsupervised zero-shot learning. In: ICCV, October 2017","key":"33_CR7","DOI":"10.1109\/ICCV.2017.139"},{"doi-asserted-by":"crossref","unstructured":"Deutsch, S., Kolouri, S., Kim, K., Owechko, Y., Soatto, S.: Zero shot learning via multi-scale manifold regularization. In: CVPR, July 2017","key":"33_CR8","DOI":"10.1109\/CVPR.2017.562"},{"doi-asserted-by":"crossref","unstructured":"Feng, J., Zhou, Z.H.: Deep MIML network. In: AAAI, pp. 1884\u20131890 (2017)","key":"33_CR9","DOI":"10.1609\/aaai.v31i1.10890"},{"doi-asserted-by":"crossref","unstructured":"Fu, Y., Yang, Y., Hospedales, T., Xiang, T., Gong, S.: Transductive multi-label zero-shot learning. arXiv preprint arXiv:1503.07790 (2015)","key":"33_CR10","DOI":"10.5244\/C.28.7"},{"doi-asserted-by":"crossref","unstructured":"Girshick, R.: Fast R-CNN. In: ICCV, December 2015","key":"33_CR11","DOI":"10.1109\/ICCV.2015.169"},{"unstructured":"Gong, Y., Jia, Y., Leung, T., Toshev, A., Ioffe, S.: Deep convolutional ranking for multilabel image annotation. arXiv preprint arXiv:1312.4894 (2013)","key":"33_CR12"},{"key":"33_CR13","volume-title":"Fundamentals of Artificial Neural Networks","author":"MH Hassoun","year":"1995","unstructured":"Hassoun, M.H.: Fundamentals of Artificial Neural Networks. MIT Press, Cambridge (1995)"},{"doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition, vol. 2016, pp. 770\u2013778, January 2016. Cited by 107","key":"33_CR14","DOI":"10.1109\/CVPR.2016.90"},{"unstructured":"Dai, J., Li, Y., He, K., Sun, J.: R-FCN: object detection via region-based fully convolutional networks. arXiv preprint arXiv:1605.06409 (2016)","key":"33_CR15"},{"doi-asserted-by":"crossref","unstructured":"Li, X., Liao, S., Lan, W., Du, X., Yang, G.: Zero-shot image tagging by hierarchical semantic embedding. In: RDIR, pp. 879\u2013882. ACM (2015)","key":"33_CR16","DOI":"10.1145\/2766462.2767773"},{"doi-asserted-by":"crossref","unstructured":"Li, Y., Wang, D., Hu, H., Lin, Y., Zhuang, Y.: Zero-shot recognition using dual visual-semantic mapping paths. In: CVPR, July 2017","key":"33_CR17","DOI":"10.1109\/CVPR.2017.553"},{"key":"33_CR18","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"21","DOI":"10.1007\/978-3-319-46448-0_2","volume-title":"Computer Vision \u2013 ECCV 2016","author":"W Liu","year":"2016","unstructured":"Liu, W., et al.: SSD: single shot multibox detector. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) ECCV 2016. LNCS, vol. 9905, pp. 21\u201337. Springer, Cham (2016). https:\/\/doi.org\/10.1007\/978-3-319-46448-0_2"},{"doi-asserted-by":"crossref","unstructured":"Mensink, T., Gavves, E., Snoek, C.G.: COSTA: co-occurrence statistics for zero-shot classification. In: CVPR, pp. 2441\u20132448 (2014)","key":"33_CR19","DOI":"10.1109\/CVPR.2014.313"},{"unstructured":"Mikolov, T., Sutskever, I., Chen, K., Corrado, G.S., Dean, J.: Distributed representations of words and phrases and their compositionality. In: NIPS, pp. 3111\u20133119 (2013)","key":"33_CR20"},{"doi-asserted-by":"crossref","unstructured":"Morgado, P., Vasconcelos, N.: Semantically consistent regularization for zero-shot recognition. In: CVPR, July 2017","key":"33_CR21","DOI":"10.1109\/CVPR.2017.220"},{"unstructured":"Norouzi, M., et al.: Zero-shot learning by convex combination of semantic embeddings. In: ICLR (2014)","key":"33_CR22"},{"doi-asserted-by":"crossref","unstructured":"Pennington, J., Socher, R., Manning, C.D.: GloVe: global vectors for word representation. In: EMNLP, pp. 1532\u20131543 (2014)","key":"33_CR23","DOI":"10.3115\/v1\/D14-1162"},{"unstructured":"Qi, C.R., Su, H., Mo, K., Guibas, L.J.: PointNet: deep learning on point sets for 3D classification and segmentation. In: CVPR, vol. 1, no. 2, p. 4 (2017)","key":"33_CR24"},{"issue":"11","key":"33_CR25","doi-asserted-by":"publisher","first-page":"5652","DOI":"10.1109\/TIP.2018.2861573","volume":"27","author":"S Rahman","year":"2018","unstructured":"Rahman, S., Khan, S., Porikli, F.: A unified approach for conventional zero-shot, generalized zero-shot, and few-shot learning. IEEE Trans. Image Process. 27(11), 5652\u20135667 (2018)","journal-title":"IEEE Trans. Image Process."},{"unstructured":"Rahman, S., Khan, S., Porikli, F.: Zero-shot object detection: learning to simultaneously recognize and localize novel concepts. In: Asian Conference on Computer Vision (ACCV). Springer, December 2018","key":"33_CR26"},{"doi-asserted-by":"crossref","unstructured":"Redmon, J., Farhadi, A.: Yolo9000: Better, faster, stronger. arXiv preprint arXiv:1612.08242 (2016)","key":"33_CR27","DOI":"10.1109\/CVPR.2017.690"},{"issue":"6","key":"33_CR28","doi-asserted-by":"publisher","first-page":"1137","DOI":"10.1109\/TPAMI.2016.2577031","volume":"39","author":"S Ren","year":"2017","unstructured":"Ren, S., He, K., Girshick, R., Sun, J.: Faster R-CNN: towards real-time object detection with region proposal networks. IEEE TPAMI 39(6), 1137\u20131149 (2017)","journal-title":"IEEE TPAMI"},{"doi-asserted-by":"crossref","unstructured":"Ren, Z., Jin, H., Lin, Z., Fang, C., Yuille, A.: Multiple instance visual-semantic embedding. In: BMVC (2017)","key":"33_CR29","DOI":"10.5244\/C.31.89"},{"unstructured":"Simonyan, K., Zisserman, A.: Very deep convolutional networks for large-scale image recognition. arXiv preprint arXiv:1409.1556 (2014)","key":"33_CR30"},{"doi-asserted-by":"crossref","unstructured":"Szegedy, C., et al.: Going deeper with convolutions. In: CVPR, 07\u201312 June 2015, pp. 1\u20139 (2015)","key":"33_CR31","DOI":"10.1109\/CVPR.2015.7298594"},{"issue":"7","key":"33_CR32","first-page":"3385","volume":"26","author":"P Tang","year":"2017","unstructured":"Tang, P., Wang, X., Feng, B., Liu, W.: Learning multi-instance deep discriminative patterns for image classification. IEEE TIP 26(7), 3385\u20133396 (2017)","journal-title":"IEEE TIP"},{"key":"33_CR33","doi-asserted-by":"publisher","first-page":"446","DOI":"10.1016\/j.patcog.2017.05.001","volume":"71","author":"P Tang","year":"2017","unstructured":"Tang, P., Wang, X., Huang, Z., Bai, X., Liu, W.: Deep patch learning for weakly supervised object classification and discovery. Pattern Recogn. 71, 446\u2013459 (2017)","journal-title":"Pattern Recogn."},{"issue":"2","key":"33_CR34","doi-asserted-by":"publisher","first-page":"154","DOI":"10.1007\/s11263-013-0620-5","volume":"104","author":"JRR Uijlings","year":"2013","unstructured":"Uijlings, J.R.R., van de Sande, K.E.A., Gevers, T., Smeulders, A.W.M.: Selective search for object recognition. IJCV 104(2), 154\u2013171 (2013)","journal-title":"IJCV"},{"unstructured":"Wah, C., Branson, S., Welinder, P., Perona, P., Belongie, S.: The Caltech-UCSD Birds-200-2011 dataset. Technical report, CNS-TR-2011-001, California Institute of Technology (2011)","key":"33_CR35"},{"doi-asserted-by":"crossref","unstructured":"Wang, X., Zhu, Z., Yao, C., Bai, X.: Relaxed multiple-instance SVM with application to object discovery, pp. 1224\u20131232 (2015)","key":"33_CR36","DOI":"10.1109\/ICCV.2015.145"},{"issue":"9","key":"33_CR37","doi-asserted-by":"publisher","first-page":"1901","DOI":"10.1109\/TPAMI.2015.2491929","volume":"38","author":"Y Wei","year":"2016","unstructured":"Wei, Y., et al.: HCP: a flexible CNN framework for multi-label image classification. IEEE TPAMI 38(9), 1901\u20131907 (2016)","journal-title":"IEEE TPAMI"},{"doi-asserted-by":"crossref","unstructured":"Wu, J., Yu, Y., Huang, C., Yu, K.: Deep multiple instance learning for image classification and auto-annotation. In: CVPR, pp. 3460\u20133469, June 2015","key":"33_CR38","DOI":"10.1109\/CVPR.2015.7298968"},{"doi-asserted-by":"crossref","unstructured":"Xian, Y., Akata, Z., Sharma, G., Nguyen, Q., Hein, M., Schiele, B.: Latent embeddings for zero-shot classification. In: CVPR, June 2016","key":"33_CR39","DOI":"10.1109\/CVPR.2016.15"},{"doi-asserted-by":"crossref","unstructured":"Xian, Y., Schiele, B., Akata, Z.: Zero-shot learning - the good, the bad and the ugly. In: CVPR (2017)","key":"33_CR40","DOI":"10.1109\/CVPR.2017.328"},{"doi-asserted-by":"crossref","unstructured":"Zhang, L., Xiang, T., Gong, S.: Learning a deep embedding model for zero-shot learning. In: CVPR, July 2017","key":"33_CR41","DOI":"10.1109\/CVPR.2017.321"},{"doi-asserted-by":"crossref","unstructured":"Zhang, Y., Gong, B., Shah, M.: Fast zero-shot image tagging. In: CVPR, June 2016","key":"33_CR42","DOI":"10.1109\/CVPR.2016.644"},{"unstructured":"Zhou, Y., Sun, X., Liu, D., Zha, Z., Zeng, W.: Adaptive pooling in multi-instance learning for web video annotation. In: ICCV, October 2017","key":"33_CR43"},{"key":"33_CR44","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"391","DOI":"10.1007\/978-3-319-10602-1_26","volume-title":"Computer Vision \u2013 ECCV 2014","author":"CL Zitnick","year":"2014","unstructured":"Zitnick, C.L., Doll\u00e1r, P.: Edge boxes: locating object proposals from edges. In: Fleet, D., Pajdla, T., Schiele, B., Tuytelaars, T. (eds.) ECCV 2014. LNCS, vol. 8693, pp. 391\u2013405. Springer, Cham (2014). https:\/\/doi.org\/10.1007\/978-3-319-10602-1_26"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ACCV 2018"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-030-20887-5_33","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,9,18]],"date-time":"2022-09-18T18:04:12Z","timestamp":1663524252000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-030-20887-5_33"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019]]},"ISBN":["9783030208868","9783030208875"],"references-count":44,"URL":"https:\/\/doi.org\/10.1007\/978-3-030-20887-5_33","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2019]]},"assertion":[{"value":"28 May 2019","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ACCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Asian Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Perth, WA","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Australia","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2018","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2 December 2018","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"6 December 2018","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"14","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"accv2018","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/accv2018.net\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Double-blind","order":1,"name":"type","label":"Type","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"Microsoft CMT","order":2,"name":"conference_management_system","label":"Conference Management System","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"979","order":3,"name":"number_of_submissions_sent_for_review","label":"Number of Submissions Sent for Review","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"274","order":4,"name":"number_of_full_papers_accepted","label":"Number of Full Papers Accepted","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"0","order":5,"name":"number_of_short_papers_accepted","label":"Number of Short Papers Accepted","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"28% - The value is computed by the equation \"Number of Full Papers Accepted \/ Number of Submissions Sent for Review * 100\" and then rounded to a whole number.","order":6,"name":"acceptance_rate_of_full_papers","label":"Acceptance Rate of Full Papers","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"3","order":7,"name":"average_number_of_reviews_per_paper","label":"Average Number of Reviews per Paper","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"2.7","order":8,"name":"average_number_of_papers_per_reviewer","label":"Average Number of Papers per Reviewer","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"No","order":9,"name":"external_reviewers_involved","label":"External Reviewers Involved","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}}]}}