{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,7]],"date-time":"2026-04-07T16:29:17Z","timestamp":1775579357452,"version":"3.50.1"},"publisher-location":"Berlin, Heidelberg","reference-count":38,"publisher":"Springer Berlin Heidelberg","isbn-type":[{"value":"9783642337086","type":"print"},{"value":"9783642337093","type":"electronic"}],"license":[{"start":{"date-parts":[[2012,1,1]],"date-time":"2012-01-01T00:00:00Z","timestamp":1325376000000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2012]]},"DOI":"10.1007\/978-3-642-33709-3_6","type":"book-chapter","created":{"date-parts":[[2012,9,26]],"date-time":"2012-09-26T04:05:20Z","timestamp":1348632320000},"page":"73-86","source":"Crossref","is-referenced-by-count":199,"title":["Unsupervised Discovery of Mid-Level Discriminative Patches"],"prefix":"10.1007","author":[{"given":"Saurabh","family":"Singh","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Abhinav","family":"Gupta","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Alexei A.","family":"Efros","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","reference":[{"key":"6_CR1","doi-asserted-by":"crossref","unstructured":"Sivic, J., Zisserman, A.: Video Google: A text retrieval approach to object matching in videos. In: ICCV (2003)","DOI":"10.1109\/ICCV.2003.1238663"},{"key":"6_CR2","unstructured":"Lazebnik, S., Schmid, C., Ponce, J.: Beyond bags of features: Spatial pyramid matching for recognizing natural scene categories. In: CVPR (2006)"},{"key":"6_CR3","unstructured":"Li, L.-J., Su, H., Xing, E.P., Fei-fei, L.: Object bank: A high-level image representation for scene classification and semantic feature sparsification. In: NIPS (2010)"},{"key":"6_CR4","doi-asserted-by":"crossref","unstructured":"Pandey, M., Lazebnik, S.: Scene recognition and weakly supervised object localization with deformable part-based models. In: ICCV (2011)","DOI":"10.1109\/ICCV.2011.6126383"},{"key":"6_CR5","doi-asserted-by":"crossref","unstructured":"Quattoni, A., Torralba, A.: Recognizing indoor scenes. In: CVPR (2009)","DOI":"10.1109\/CVPR.2009.5206537"},{"key":"6_CR6","doi-asserted-by":"crossref","unstructured":"Torralba, A., Fergus, R., Freeman, W.T.: 80 million tiny images: a large database for non-parametric object and scene recognition. PAMI (2008)","DOI":"10.1109\/TPAMI.2008.128"},{"key":"6_CR7","doi-asserted-by":"crossref","unstructured":"Hays, J., Efros, A.A.: im2gps: estimating geographic information from a single image. In: CVPR (2008)","DOI":"10.1109\/CVPR.2008.4587784"},{"key":"6_CR8","doi-asserted-by":"crossref","unstructured":"Ullman, S., Vidal-Naquet, M., Sali, E.: Visual features of intermediate complexity and their use in classification. Nature America (2002)","DOI":"10.1038\/nn870"},{"key":"6_CR9","unstructured":"Leung, T., Malik, J.: Representing and recognizing the visual appearance of materials using three-dimensional textons (2001)"},{"key":"6_CR10","unstructured":"Brown, M., Szeliski, R., Winder, S.: Multi-image matching using multi-scale oriented patches. In: CVPR (2005)"},{"key":"6_CR11","unstructured":"Berg, A.C., Malik, J.: Geometric blur for template matching. In: CVPR (2001)"},{"key":"6_CR12","doi-asserted-by":"crossref","unstructured":"Lowe, D.: Distinctive image features from scale-invariant keypoints. IJCV (2004)","DOI":"10.1023\/B:VISI.0000029664.99615.94"},{"key":"6_CR13","unstructured":"Dalal, N., Triggs, B.: Histograms of oriented gradients for human detection. In: CVPR (2005)"},{"key":"6_CR14","doi-asserted-by":"crossref","unstructured":"Felzenszwalb, P., McAllester, D., Ramanan, D.: A discriminatively trained, multiscale, deformable part model. In: CVPR (2008)","DOI":"10.1109\/CVPR.2008.4587597"},{"key":"6_CR15","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"776","DOI":"10.1007\/978-3-642-15549-9_56","volume-title":"Computer Vision \u2013 ECCV 2010","author":"L. Torresani","year":"2010","unstructured":"Torresani, L., Szummer, M., Fitzgibbon, A.: Efficient Object Category Recognition Using Classemes. In: Daniilidis, K., Maragos, P., Paragios, N. (eds.) ECCV 2010, Part I. LNCS, vol.\u00a06311, pp. 776\u2013789. Springer, Heidelberg (2010)"},{"key":"6_CR16","doi-asserted-by":"crossref","unstructured":"Payet, N., Todorovic, S.: Scene shape from texture of objects. In: CVPR (2011)","DOI":"10.1109\/CVPR.2011.5995326"},{"key":"6_CR17","doi-asserted-by":"crossref","unstructured":"Bourdev, L., Malik, J.: Poselets: Body part detectors trained using 3d human pose annotations. In: ICCV (2009)","DOI":"10.1109\/ICCV.2009.5459303"},{"key":"6_CR18","doi-asserted-by":"crossref","unstructured":"Farhadi, A., Endres, I., Hoiem, D.: Attribute-centric recognition for cross-category generalization. In: CVPR (2010)","DOI":"10.1109\/CVPR.2010.5539924"},{"key":"6_CR19","doi-asserted-by":"crossref","unstructured":"Sadeghi, M.A., Farhadi, A.: Recognition using visual phrases. In: CVPR (2011)","DOI":"10.1109\/CVPR.2011.5995711"},{"key":"6_CR20","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/11744023_1","volume-title":"Computer Vision \u2013 ECCV 2006","author":"J. Shotton","year":"2006","unstructured":"Shotton, J., Winn, J.M., Rother, C., Criminisi, A.: TextonBoost: Joint Appearance, Shape and Context Modeling for Multi-class Object Recognition and Segmentation. In: Leonardis, A., Bischof, H., Pinz, A. (eds.) ECCV 2006. LNCS, vol.\u00a03951, pp. 1\u201315. Springer, Heidelberg (2006)"},{"key":"6_CR21","doi-asserted-by":"crossref","unstructured":"Choi, M.J., Lim, J.J., Torralba, A., Willsky, A.S.: Exploiting hierarchical context on a large database of object categories. In: CVPR (2010)","DOI":"10.1109\/CVPR.2010.5540221"},{"key":"6_CR22","doi-asserted-by":"crossref","unstructured":"Yao, B., Fei-Fei, L.: Grouplet: A structured image representation for recognizing human and object interactions. In: CVPR (2010)","DOI":"10.1109\/CVPR.2010.5540234"},{"key":"6_CR23","unstructured":"Fergus, R., Perona, P., Zisserman, A.: Object class recognition by unsupervised scale-invariant learning. In: CVPR (2003)"},{"key":"6_CR24","unstructured":"Russell, B.C., Freeman, W.T., Efros, A.A., Sivic, J., Zisserman, A.: Using multiple segmentations to discover objects and their extent in image collections. In: CVPR (2006)"},{"key":"6_CR25","doi-asserted-by":"crossref","unstructured":"Todorovic, S., Ahuja, N.: Unsupervised category modeling, recognition, and segmentation in images. PAMI (2008)","DOI":"10.1109\/TPAMI.2008.24"},{"key":"6_CR26","unstructured":"Kim, G., Faloutsos, C., Hebert, M.: Unsupervised Modeling of Object Categories Using Link Analysis Techniques. In: CVPR (2008)"},{"key":"6_CR27","doi-asserted-by":"crossref","unstructured":"Lee, Y.J., Grauman, K.: Foreground focus: Unsupervised learning from partially matching images. IJCV (2009)","DOI":"10.1007\/s11263-009-0252-y"},{"key":"6_CR28","doi-asserted-by":"crossref","unstructured":"Lee, Y.J., Grauman, K.: Object-graphs for context-aware category discovery. In: CVPR (2010)","DOI":"10.1109\/CVPR.2010.5540237"},{"key":"6_CR29","doi-asserted-by":"crossref","unstructured":"Lee, Y.J., Grauman, K.: Learning the easy things first: Self-paced visual category discovery. In: CVPR (2011)","DOI":"10.1109\/CVPR.2011.5995523"},{"key":"6_CR30","unstructured":"Kim, G., Torralba, A.: Unsupervised Detection of Regions of Interest using Iterative Link Analysis. In: NIPS (2009)"},{"key":"6_CR31","unstructured":"Kang, H., Hebert, M., Kanade, T.: Discovering object instances from scenes of daily living. In: ICCV (2011)"},{"key":"6_CR32","doi-asserted-by":"crossref","unstructured":"Shrivastava, A., Malisiewicz, T., Gupta, A., Efros, A.A.: Data-driven visual similarity for cross-domain image matching. ACM ToG (SIGGRAPH Asia) (2011)","DOI":"10.1145\/2024156.2024188"},{"key":"6_CR33","unstructured":"Ye, J., Zhao, Z., Wu, M.: Discriminative k-means for clustering. In: NIPS (2007)"},{"key":"6_CR34","unstructured":"Sivic, J., Russell, B.C., Efros, A.A., Zisserman, A., Freeman, W.T.: Discovering object categories in image collections. In: ICCV (2005)"},{"key":"6_CR35","doi-asserted-by":"crossref","unstructured":"Karlinsky, L., Dinerstein, M., Ullman, S.: Unsupervised feature optimization (ufo): Simultaneous selection of multiple features with their detection parameters. In: CVPR (2009)","DOI":"10.1109\/CVPRW.2009.5206499"},{"key":"6_CR36","unstructured":"Everingham, M., Gool, L.V., Williams, C.K.I., Winn, J., Zisserman, A.: The PASCAL Visual Object Classes Challenge (2007)"},{"key":"6_CR37","unstructured":"Zhu, J., Li, L.-J., Li, F.-F., Xing, E.P.: Large margin learning of upstream scene understanding models. In: NIPS (2010)"},{"key":"6_CR38","doi-asserted-by":"crossref","unstructured":"Doersch, C., Singh, S., Gupta, A., Sivic, J., Efros, A.A.: What makes paris look like paris? ACM Transactions on Graphics (SIGGRAPH)\u00a031 (2012)","DOI":"10.1145\/2185520.2185597"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2012"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-642-33709-3_6","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,12,2]],"date-time":"2019-12-02T09:17:40Z","timestamp":1575278260000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-642-33709-3_6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2012]]},"ISBN":["9783642337086","9783642337093"],"references-count":38,"URL":"https:\/\/doi.org\/10.1007\/978-3-642-33709-3_6","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2012]]}}}