{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,2]],"date-time":"2026-03-02T17:50:38Z","timestamp":1772473838758,"version":"3.50.1"},"reference-count":46,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2015,6]]},"DOI":"10.1109\/cvpr.2015.7299125","type":"proceedings-article","created":{"date-parts":[[2015,10,15]],"date-time":"2015-10-15T22:42:06Z","timestamp":1444948926000},"page":"4913-4922","source":"Crossref","is-referenced-by-count":6,"title":["Beyond spatial pooling: Fine-grained representation learning in multiple domains"],"prefix":"10.1109","author":[{"family":"Chi Li","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Austin","family":"Reiter","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Gregory D.","family":"Hager","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2014.6906903"},{"key":"ref38","article-title":"Descriptor learning using convex optimisation","author":"simonyan","year":"2012","journal-title":"ECCV"},{"key":"ref33","article-title":"Learnable pooling regions for image classification","author":"malinowski","year":"2013","journal-title":"arXiv preprint arXiv 1301 3516"},{"key":"ref32","article-title":"In defense of soft-assignment coding","author":"liu","year":"2011","journal-title":"ICCV"},{"key":"ref31","article-title":"Learning invariant representations and applications to face verification","author":"liao","year":"2013","journal-title":"NIPS"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2004.1315150"},{"key":"ref37","article-title":"Overfeat: Integrated recognition, localization and detection using convolutional networks","author":"sermanet","year":"2013","journal-title":"arXiv preprint arXiv 1312 6229"},{"key":"ref36","doi-asserted-by":"crossref","DOI":"10.1038\/14819","article-title":"Hierarchical models of object recognition in cortex","author":"riesenhuber","year":"1999","journal-title":"Nature Neuroscience"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1109\/WACV.2011.5711540"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-007-0118-0"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2013.91"},{"key":"ref40","article-title":"Convolutional-recursive deep learning for 3d object classification","author":"socher","year":"0","journal-title":"NIPS'2012"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2010.5539963"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2011.6126555"},{"key":"ref13","article-title":"A theoretical analysis of feature pooling in visual recognition","author":"boureau","year":"2010","journal-title":"ICML"},{"key":"ref14","article-title":"Weakly supervised sparse coding with geometric consistency pooling","author":"cao","year":"2012","journal-title":"CVPR"},{"key":"ref15","article-title":"Return of the devil in the details: Delving deep into convolutional nets","author":"chatfield","year":"2014","journal-title":"arXiv preprint arXiv 1405 3531"},{"key":"ref16","article-title":"Selecting receptive fields in deep networks","author":"coates","year":"2011","journal-title":"NIPS"},{"key":"ref17","article-title":"Decaf: A deep convolutional activation feature for generic visual recognition","author":"donahue","year":"2014","journal-title":"ICML"},{"key":"ref18","article-title":"Unique signatures of histograms for local surface description","author":"tombari","year":"2010","journal-title":"ECCV"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/ICIP.2011.6116679"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2011.5980382"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2013.128"},{"key":"ref27","article-title":"Imagenet classification with deep convolutional neural networks","author":"krizhevsky","year":"2012","journal-title":"NIPS"},{"key":"ref3","doi-asserted-by":"crossref","DOI":"10.7551\/mitpress\/7496.003.0016","article-title":"Scaling learning algorithms towards ai","author":"bengio","year":"2007","journal-title":"Large-Scale Kernel Machines"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995719"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2006.68"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2012.6225188"},{"key":"ref8","article-title":"Hierarchical matching pursuit for image classification: Architecture and fast algorithms","author":"bo","year":"2011","journal-title":"NIPS"},{"key":"ref7","article-title":"Kernel descriptors for visual recognition","author":"bo","year":"2010","journal-title":"NIPS"},{"key":"ref2","article-title":"Unsupervised learning of invariant representations in hierarchical architectures","author":"anselmi","year":"2013","journal-title":"arXiv preprint arXiv 1311 4158"},{"key":"ref9","article-title":"Unsupervised feature learning for rgb-d based object recognition","author":"bo","year":"2012","journal-title":"ISER"},{"key":"ref1","doi-asserted-by":"crossref","DOI":"10.1007\/978-3-642-32717-9_12","article-title":"OUR-CVFH-Oriented, Unique and Repeatable Clustered Viewpoint Feature Histogram for Object Recognition and 6DOF Pose Estimation","author":"aldoma","year":"2012"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2014.112"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2014.114"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.1109\/ROBIO.2011.6181760"},{"key":"ref22","article-title":"Measuring invariances in deep networks","author":"goodfellow","year":"0","journal-title":"NIPS 2009"},{"key":"ref21","article-title":"Multi-scale orderless pooling of deep convolutional activation features","author":"gong","year":"2014","journal-title":"ECCV"},{"key":"ref42","article-title":"Auto-pooling: Learning to improve invariance of image features from image sequences","author":"sukhbaatar","year":"2013","journal-title":"arXiv preprint arXiv 1301 3323"},{"key":"ref24","article-title":"Beyond spatial pyramids: Receptive field learning for pooled image features","author":"jia","year":"2012","journal-title":"CVPR"},{"key":"ref41","article-title":"Learning invariant representations with local transformations","author":"sohn","year":"2012","journal-title":"ICML"},{"key":"ref23","article-title":"Spatial pyramid pooling in deep convolutional networks for visual recognition","author":"he","year":"2014","journal-title":"ECCV"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4408875"},{"key":"ref26","article-title":"Learning convolutional feature hierarchies for visual recognition","author":"kavukcuoglu","year":"2010","journal-title":"NIPS"},{"key":"ref43","article-title":"Visual word ambiguity","author":"van","year":"2010","journal-title":"Pattern Analysis and Machine Intelligence IEEE Transactions on"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206545"}],"event":{"name":"2015 IEEE Conference on Computer Vision and Pattern Recognition (CVPR)","location":"Boston, MA, USA","start":{"date-parts":[[2015,6,7]]},"end":{"date-parts":[[2015,6,12]]}},"container-title":["2015 IEEE Conference on Computer Vision and Pattern Recognition (CVPR)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7293313\/7298593\/07299125.pdf?arnumber=7299125","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,8,15]],"date-time":"2023-08-15T11:38:11Z","timestamp":1692099491000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7299125\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2015,6]]},"references-count":46,"URL":"https:\/\/doi.org\/10.1109\/cvpr.2015.7299125","relation":{},"subject":[],"published":{"date-parts":[[2015,6]]}}}