{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,3]],"date-time":"2026-07-03T17:27:33Z","timestamp":1783099653754,"version":"3.54.6"},"publisher-location":"Cham","reference-count":33,"publisher":"Springer International Publishing","isbn-type":[{"value":"9783319464657","type":"print"},{"value":"9783319464664","type":"electronic"}],"license":[{"start":{"date-parts":[[2016,1,1]],"date-time":"2016-01-01T00:00:00Z","timestamp":1451606400000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2016,1,1]],"date-time":"2016-01-01T00:00:00Z","timestamp":1451606400000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2016]]},"DOI":"10.1007\/978-3-319-46466-4_6","type":"book-chapter","created":{"date-parts":[[2016,9,16]],"date-time":"2016-09-16T09:31:58Z","timestamp":1474018318000},"page":"85-100","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":68,"title":["COCO Attributes: Attributes for People, Animals, and Objects"],"prefix":"10.1007","author":[{"given":"Genevieve","family":"Patterson","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"James","family":"Hays","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2016,9,17]]},"reference":[{"key":"6_CR1","doi-asserted-by":"crossref","unstructured":"Antol, S., Agrawal, A., Lu, J., Mitchell, M., Batra, D., Lawrence Zitnick, C., Parikh, D.: VQA: visual question answering. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 2425\u20132433 (2015)","DOI":"10.1109\/ICCV.2015.279"},{"issue":"12","key":"6_CR2","doi-asserted-by":"crossref","first-page":"3618","DOI":"10.1073\/pnas.1422953112","volume":"112","author":"D Geman","year":"2015","unstructured":"Geman, D., Geman, S., Hallonquist, N., Younes, L.: Visual turing test for computer vision systems. Proc. Natl. Acad. Sci. 112(12), 3618\u20133623 (2015)","journal-title":"Proc. Natl. Acad. Sci."},{"key":"6_CR3","doi-asserted-by":"crossref","unstructured":"Farhadi, A., Endres, I., Hoiem, D., Forsyth, D.: Describing objects by their attributes. In: CVPR (2009)","DOI":"10.1109\/CVPR.2009.5206772"},{"key":"6_CR4","doi-asserted-by":"crossref","unstructured":"Lampert, C.H., Nickisch, H., Harmeling, S.: Learning to detect unseen object classes by between-class attribute transfer. In: CVPR (2009)","DOI":"10.1109\/CVPR.2009.5206594"},{"key":"6_CR5","doi-asserted-by":"crossref","unstructured":"Rohrbach, M., Stark, M., Szarvas, G., Gurevych, I., Schiele, B.: What helps where-and why? semantic relatedness for knowledge transfer. In: 2010 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 910\u2013917. IEEE (2010)","DOI":"10.1109\/CVPR.2010.5540121"},{"key":"6_CR6","doi-asserted-by":"crossref","unstructured":"Deng, J., Krause, J., Fei-Fei, L.: Fine-grained crowdsourcing for fine-grained recognition. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), June 2013","DOI":"10.1109\/CVPR.2013.81"},{"key":"6_CR7","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"438","DOI":"10.1007\/978-3-642-15561-1_32","volume-title":"Computer Vision \u2013 ECCV 2010","author":"S Branson","year":"2010","unstructured":"Branson, S., Wah, C., Schroff, F., Babenko, B., Welinder, P., Perona, P., Belongie, S.: Visual recognition with humans in the loop. In: Daniilidis, K., Maragos, P., Paragios, N. (eds.) ECCV 2010. LNCS, vol. 6314, pp. 438\u2013451. Springer, Heidelberg (2010). doi: 10.1007\/978-3-642-15561-1_32"},{"key":"6_CR8","doi-asserted-by":"crossref","unstructured":"Patterson, G., Hays, J.: Sun attribute database: discovering, annotating, and recognizing scene attributes. In: 2012 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 2751\u20132758. IEEE (2012)","DOI":"10.1109\/CVPR.2012.6247998"},{"key":"6_CR9","doi-asserted-by":"crossref","unstructured":"Dow, S., Kulkarni, A., Klemmer, S., Hartmann, B.: Shepherding the crowd yields better work. In: Proceedings of the ACM 2012 Conference on Computer Supported Cooperative Work, pp. 1013\u20131022. ACM (2012)","DOI":"10.1145\/2145204.2145355"},{"key":"6_CR10","doi-asserted-by":"crossref","unstructured":"Krishna, R., Zhu, Y., Groth, O., Johnson, J., Hata, K., Kravitz, J., Chen, S., Kalantidis, Y., Li, L.J., Shamma, D.A., et al.: Visual genome: connecting language and vision using crowdsourced dense image annotations. arXiv preprint arXiv:1602.07332 (2016)","DOI":"10.1007\/s11263-016-0981-7"},{"key":"6_CR11","unstructured":"Wah, C., Branson, S., Welinder, P., Perona, P., Belongie, S.: The Caltech-UCSD Birds-200-2011 Dataset. Technical report CNS-TR-2011-001, California Institute of Technology (2011)"},{"key":"6_CR12","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"663","DOI":"10.1007\/978-3-642-15549-9_48","volume-title":"Computer Vision \u2013 ECCV 2010","author":"TL Berg","year":"2010","unstructured":"Berg, T.L., Berg, A.C., Shih, J.: Automatic attribute discovery and characterization from noisy web data. In: Daniilidis, K., Maragos, P., Paragios, N. (eds.) ECCV 2010. LNCS, vol. 6311, pp. 663\u2013676. Springer, Heidelberg (2010). doi: 10.1007\/978-3-642-15549-9_48"},{"key":"6_CR13","doi-asserted-by":"crossref","unstructured":"Parikh, D., Grauman, K.: Interactively building a discriminative vocabulary of nameable attributes. In: CVPR (2011)","DOI":"10.1109\/CVPR.2011.5995451"},{"key":"6_CR14","doi-asserted-by":"crossref","unstructured":"Farhadi, A., Endres, I., Hoiem, D.: Attribute-centric recognition for cross-category generalization. In: CVPR (2010)","DOI":"10.1109\/CVPR.2010.5539924"},{"key":"6_CR15","doi-asserted-by":"crossref","unstructured":"Kumar, N., Berg, A., Belhumeur, P., Nayar, S.: Attribute and simile classifiers for face verification. In: ICCV (2009)","DOI":"10.1109\/ICCV.2009.5459250"},{"key":"6_CR16","doi-asserted-by":"crossref","unstructured":"Liu, J., Kuipers, B., Savarese, S.: Recognizing human actions by attributes. In: CVPR (2011)","DOI":"10.1109\/CVPR.2011.5995353"},{"key":"6_CR17","doi-asserted-by":"crossref","unstructured":"Bourdev, L., Maji, S., Malik, J.: Describing people: a poselet-based approach to attribute classification. In: 2011 International Conference on Computer Vision, pp. 1543\u20131550. IEEE (2011)","DOI":"10.1109\/ICCV.2011.6126413"},{"key":"6_CR18","doi-asserted-by":"crossref","unstructured":"Vedaldi, A., Mahendran, S., Tsogkas, S., Maji, S., Girshick, R., Kannala, J., Rahtu, E., Kokkinos, I., Blaschko, M.B., Weiss, D., et al.: Understanding objects in detail with fine-grained attributes. In: 2014 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 3622\u20133629. IEEE (2014)","DOI":"10.1109\/CVPR.2014.463"},{"key":"6_CR19","doi-asserted-by":"crossref","unstructured":"Kovashka, A., Parikh, D., Grauman, K.: Whittlesearch: image search with relative attribute feedback. In: The IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2012)","DOI":"10.1109\/CVPR.2012.6248026"},{"key":"6_CR20","doi-asserted-by":"crossref","unstructured":"Parikh, D., Grauman, K.: Relative attributes. In: ICCV (2011)","DOI":"10.1109\/ICCV.2011.6126281"},{"key":"6_CR21","doi-asserted-by":"crossref","unstructured":"Vijayanarasimhan, S., Grauman, K.: Large-scale live active learning: training object detectors with crawled data and crowds. In: 2011 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 1449\u20131456. IEEE (2011)","DOI":"10.1109\/CVPR.2011.5995430"},{"key":"6_CR22","unstructured":"Abramson, Y., Freund, Y.: Active learning for visual object recognition. Technical report, UCSD (2004)"},{"key":"6_CR23","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"86","DOI":"10.1007\/978-3-540-88682-2_8","volume-title":"Computer Vision \u2013 ECCV 2008","author":"B Collins","year":"2008","unstructured":"Collins, B., Deng, J., Li, K., Fei-Fei, L.: Towards scalable dataset construction: an active learning approach. In: Forsyth, D., Torr, P., Zisserman, A. (eds.) ECCV 2008. LNCS, vol. 5302, pp. 86\u201398. Springer, Heidelberg (2008). doi: 10.1007\/978-3-540-88682-2_8"},{"key":"6_CR24","doi-asserted-by":"crossref","unstructured":"Patterson, G., Van Horn, G., Belongie, S., Perona, P., Hays, J.: Tropel: crowdsourcing detectors with minimal training. In: Third AAAI Conference on Human Computation and Crowdsourcing (2015)","DOI":"10.1609\/hcomp.v3i1.13224"},{"key":"6_CR25","doi-asserted-by":"crossref","unstructured":"Deng, J., Russakovsky, O., Krause, J., Bernstein, M.S., Berg, A., Fei-Fei, L.: Scalable multi-label annotation. In: Proceedings of the SIGCHI Conference on Human Factors in Computing Systems, pp. 3099\u20133102. ACM (2014)","DOI":"10.1145\/2556288.2557011"},{"key":"6_CR26","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"48","DOI":"10.1007\/978-3-319-10590-1_4","volume-title":"Computer Vision \u2013 ECCV 2014","author":"J Deng","year":"2014","unstructured":"Deng, J., Ding, N., Jia, Y., Frome, A., Murphy, K., Bengio, S., Li, Y., Neven, H., Adam, H.: Large-scale object classification using label relation graphs. In: Fleet, D., Pajdla, T., Schiele, B., Tuytelaars, T. (eds.) ECCV 2014. LNCS, vol. 8689, pp. 48\u201364. Springer, Heidelberg (2014). doi: 10.1007\/978-3-319-10590-1_4"},{"key":"6_CR27","unstructured":"Sandhaus, E.: The new york times annotated corpus. Linguist. Data Consortium Philadelphia 6(12), e26752 (2008)"},{"key":"6_CR28","unstructured":"Zhou, B., Lapedriza, A., Xiao, J., Torralba, A., Oliva, A.: Learning deep features for scene recognition using places database. In: Advances in Neural Information Processing Systems, pp. 487\u2013495 (2014)"},{"key":"6_CR29","doi-asserted-by":"crossref","unstructured":"Jia, Y., Shelhamer, E., Donahue, J., Karayev, S., Long, J., Girshick, R., Guadarrama, S., Darrell, T.: Caffe: convolutional architecture for fast feature embedding. In: Proceedings of the ACM International Conference on Multimedia, pp. 675\u2013678. ACM (2014)","DOI":"10.1145\/2647868.2654889"},{"key":"6_CR30","doi-asserted-by":"crossref","unstructured":"Razavian, A.S., Azizpour, H., Sullivan, J., Carlsson, S.: CNN features off-the-shelf: an astounding baseline for recognition. arXiv preprint arXiv:1403.6382 (2014)","DOI":"10.1109\/CVPRW.2014.131"},{"key":"6_CR31","doi-asserted-by":"crossref","unstructured":"Shankar, S., Garg, V.K., Cipolla, R.: Deep-carving: discovering visual attributes by carving deep neural nets. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3403\u20133412 (2015)","DOI":"10.1109\/CVPR.2015.7298962"},{"key":"6_CR32","unstructured":"Gong, Y., Jia, Y., Leung, T., Toshev, A., Ioffe, S.: Deep convolutional ranking for multilabel image annotation. arXiv preprint arXiv:1312.4894 (2013)"},{"key":"6_CR33","doi-asserted-by":"crossref","unstructured":"Guillaumin, M., Mensink, T., Verbeek, J., Schmid, C.: TagProp: discriminative metric learning in nearest neighbor models for image auto-annotation. In: 2009 IEEE 12th International Conference on Computer Vision, pp. 309\u2013316. IEEE (2009)","DOI":"10.1109\/ICCV.2009.5459266"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2016"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-319-46466-4_6","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,8,20]],"date-time":"2023-08-20T04:27:16Z","timestamp":1692505636000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-319-46466-4_6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016]]},"ISBN":["9783319464657","9783319464664"],"references-count":33,"URL":"https:\/\/doi.org\/10.1007\/978-3-319-46466-4_6","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016]]},"assertion":[{"value":"17 September 2016","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Amsterdam","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"The Netherlands","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2016","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"8 October 2016","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"16 October 2016","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"14","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2016","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/www.eccv2016.org\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"This content has been made available to all.","name":"free","label":"Free to read"}]}}