{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,6,9]],"date-time":"2024-06-09T23:25:02Z","timestamp":1717975502015},"reference-count":42,"publisher":"Springer Science and Business Media LLC","issue":"9","license":[{"start":{"date-parts":[[2016,12,24]],"date-time":"2016-12-24T00:00:00Z","timestamp":1482537600000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2017,5]]},"DOI":"10.1007\/s11042-016-4240-2","type":"journal-article","created":{"date-parts":[[2016,12,24]],"date-time":"2016-12-24T16:58:00Z","timestamp":1482598680000},"page":"11941-11958","update-policy":"http:\/\/dx.doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":8,"title":["Learned features versus engineered features for multimedia indexing"],"prefix":"10.1007","volume":"76","author":[{"given":"Mateusz","family":"Budnik","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Efrain-Leonardo","family":"Gutierrez-Gomez","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Bahjat","family":"Safadi","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Denis","family":"Pellerin","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Georges","family":"Qu\u00e9not","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2016,12,24]]},"reference":[{"key":"4240_CR1","doi-asserted-by":"publisher","unstructured":"Ayache S, Qu\u00e9not G (2008) Video corpus annotation using active learning. In: European conference on information retrieval (ECIR). Glasgow, pp 187\u2013198","DOI":"10.1007\/978-3-540-78646-7_19"},{"key":"4240_CR2","doi-asserted-by":"publisher","unstructured":"Ayache S, Qu\u00e9not G, Gensel J (2007) Image and video indexing using networks of operators. EURASIP J Imag Vid Process 2007(1):056,928. doi: 10.1155\/2007\/56928","DOI":"10.1155\/2007\/56928"},{"key":"4240_CR3","doi-asserted-by":"publisher","unstructured":"Benoit A, Caplier A, Durette B, Herault J (2010) Using human visual system modeling for bio-inspired low level image processing. Comput Vis Imag Understand 114(7):758\u2013773. doi: 10.1016\/j.cviu.2010.01.011","DOI":"10.1016\/j.cviu.2010.01.011"},{"key":"4240_CR4","volume-title":"IRIM at TRECVid 2015: semantic indexing. In: Proceedings of TRECVID 2015","author":"HL Borgne","year":"2015","unstructured":"Borgne HL, Gosselin P, Picard D, Redi M, M\u00e9rialdo B, Mansencal B, Benois-Pineau J, Ayache S, Hamadi A, Safadi B, Derbas N, Budnik M, Qu\u00e9not G, Gao B, Zhu C, Tang Y, Dellandrea E, Bichot CE, Chen L, Benoit A, Lambert P, Strat T (2015) IRIM at TRECVid 2015: semantic indexing. In: Proceedings of TRECVID 2015. NIST, USA"},{"key":"4240_CR5","doi-asserted-by":"publisher","unstructured":"Chatfield K, Simonyan K, Vedaldi A, Zisserman A (2014) Return of the devil in the details: delving deep into convolutional nets. CoRR 1405.3531","DOI":"10.5244\/C.28.6"},{"key":"4240_CR6","unstructured":"Csurka G, Bray C, Dance C, Fan L (2004) Visual categorization with bags of keypoints. In: Workshop on statistical learning in computer vision. ECCV, pp 1\u201322"},{"key":"4240_CR7","doi-asserted-by":"crossref","unstructured":"Deng J, Dong W, Socher R, Li LJ, Li K, Fei-Fei L (2009) ImageNet: a large-scale hierarchical image database. In: CVPR09","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"4240_CR8","doi-asserted-by":"publisher","unstructured":"Everingham M, Eslami SMA, Van Gool L, Williams CKI, Winn J, Zisserman A (2015) The pascal visual object classes challenge: a retrospective. Int J Comput Vis 111(1):98\u2013136","DOI":"10.1007\/s11263-014-0733-5"},{"key":"4240_CR9","doi-asserted-by":"publisher","first-page":"193","DOI":"10.1007\/BF00344251","volume":"36","author":"K Fukushima","year":"1980","unstructured":"Fukushima K (1980) Neocognitron: a self-organizing neural network model for a mechanism of pattern recognition unaffected by shift in position. Biol Cybern 36:193\u2013202","journal-title":"Biol Cybern"},{"key":"4240_CR10","doi-asserted-by":"publisher","unstructured":"Gosselin PH, Cord M, Philipp-Foliguet S (2008) Combining visual dictionary, kernel-based similarity and learning strategy for image category retrieval. Comput Vis Imag Understand 110(3):403\u2013417. doi: 10.1016\/j.cviu.2007.09.018 . Similarity matching in computer vision and multimedia","DOI":"10.1016\/j.cviu.2007.09.018"},{"key":"4240_CR11","doi-asserted-by":"publisher","unstructured":"Hamadi A, Mulhem P, Qu\u00e9not G (2015) Extended conceptual feedback for semantic multimedia indexing. Multimed Tools Appl 74(4):1225\u20131248. doi: 10.1007\/s11042-014-1937-y","DOI":"10.1007\/s11042-014-1937-y"},{"issue":"5786","key":"4240_CR12","doi-asserted-by":"publisher","first-page":"504","DOI":"10.1126\/science.1127647","volume":"313","author":"GE Hinton","year":"2006","unstructured":"Hinton G E, Salakhutdinov R R (2006) Reducing the dimensionality of data with neural networks. Science 313(5786):504\u2013507. doi: 10.1126\/science.1127647 . http:\/\/science.sciencemag.org\/content\/313\/5786\/504","journal-title":"Science"},{"issue":"9","key":"4240_CR13","doi-asserted-by":"publisher","first-page":"1704","DOI":"10.1109\/TPAMI.2011.235","volume":"34","author":"H J\u00e9gou","year":"2012","unstructured":"J\u00e9gou H, Perronnin F, Douze M, S\u00e1nchez J, P\u00e9rez P, Schmid C (2012) Aggregating local image descriptors into compact codes. IEEE Trans Pattern Anal Mach Intel 34(9):1704\u20131716. doi: 10.1109\/TPAMI.2011.235","journal-title":"IEEE Trans Pattern Anal Mach Intel"},{"key":"4240_CR14","unstructured":"Krizhevsky A, Sutskever I, Hinton GE (2012) Imagenet classification with deep convolutional neural networks Pereira F, Burges C, Bottou L, Weinberger K (eds), vol 25, Curran Associates, Inc"},{"key":"4240_CR15","doi-asserted-by":"publisher","unstructured":"LeCun Y, Bottou L, Bengio Y, Haffner P (1998) Gradient-based learning applied to document recognition. In: Proceedings of the IEEE, pp 2278\u20132324","DOI":"10.1109\/5.726791"},{"issue":"2","key":"4240_CR16","doi-asserted-by":"publisher","first-page":"91","DOI":"10.1023\/B:VISI.0000029664.99615.94","volume":"60","author":"DG Lowe","year":"2004","unstructured":"Lowe D G (2004) Distinctive image features from scale-invariant keypoints. Int J Comput Vis 60(2):91\u2013110. doi: 10.1023\/B:VISI.0000029664.99615.94","journal-title":"Int J Comput Vis"},{"key":"4240_CR17","unstructured":"Nair V, Hinton GE (2010) Rectified linear units improve restricted boltzmann machines. In: F\u00fcrnkranz J, Joachims T (eds) Proceedings of the 27th international conference on machine learning (ICML-10). Omnipress, pp 807\u2013814. http:\/\/www.icml2010.org\/papers\/432.pdf"},{"key":"4240_CR18","doi-asserted-by":"crossref","unstructured":"Orr GB, Mueller KR (eds) (1998) Neural networks : tricks of the trade, lecture notes in computer science, vol 1524. Springer","DOI":"10.1007\/3-540-49430-8"},{"key":"4240_CR19","unstructured":"Over P, Awad G, Michel M, Fiscus J, Kraaij W, Smeaton AF, Qu\u00e9not G, Ordelman R (2015) Trecvid 2015 \u2013 an overview of the goals, tasks, data, evaluation mechanisms and metrics. In: Proceedings of TRECVID 2015. NIST, USA"},{"issue":"6","key":"4240_CR20","doi-asserted-by":"publisher","first-page":"680","DOI":"10.1016\/j.cviu.2013.02.004","volume":"117","author":"D Picard","year":"2013","unstructured":"Picard D, Gosselin PH (2013) Efficient image signatures and similarities using tensor products of local descriptors. Comput Vis Image Understand 117(6):680\u2013687. doi: 10.1016\/j.cviu.2013.02.004","journal-title":"Comput Vis Image Understand"},{"key":"4240_CR21","doi-asserted-by":"publisher","unstructured":"Razavian A, Azizpour H, Sullivan J, Carlsson S (2014) CNN features off-the-shelf: an astounding baseline for recognition. In: IEEE Conference on computer vision and pattern recognition workshops (CVPRW), pp 512\u2013519. doi: 10.1109\/CVPRW.2014.131","DOI":"10.1109\/CVPRW.2014.131"},{"key":"4240_CR22","doi-asserted-by":"publisher","unstructured":"Russakovsky O, Deng J, Su H, Krause J, Satheesh S, Ma S, Huang Z, Karpathy A, Khosla A, Bernstein M, Berg AC, Fei-Fei L (2015) ImageNet large scale visual recognition challenge. Int J Comput Vis (IJCV):1\u201342. doi: 10.1007\/s11263-015-0816-y","DOI":"10.1007\/s11263-015-0816-y"},{"key":"4240_CR23","unstructured":"Safadi B, Qu\u00e9not G (2010) Evaluations of multi-learner approaches for concept indexing in video documents. In: Adaptivity, personalization and fusion of heterogeneous information, RIAO \u201910. Le centre de hautes \u00e9tudes internationales d\u2019informatique documentaire, Paris, pp 88\u201391. http:\/\/dl.acm.org\/citation.cfm?id=1937055.1937075"},{"key":"4240_CR24","doi-asserted-by":"publisher","unstructured":"Safadi B, Qu\u00e9not G (2011) Re-ranking by local re-scoring for video indexing and retrieval. In: Craig Macdonald Iadh Ounis IR (ed) CIKM 2011 - International conference on information and knowledge management. Poster session: information retrieval. ACM, Glasgow, pp 2081\u20132084. doi: 10.1145\/2063576.2063895","DOI":"10.1145\/2063576.2063895"},{"key":"4240_CR25","doi-asserted-by":"publisher","unstructured":"Safadi B, Qu\u00e9not G (2015) A factorized model for multiple svm and multi-label classification for large scale multimedia indexing. In: 2015 13th International workshop on content-based multimedia indexing (CBMI), pp 1\u20136. doi: 10.1109\/CBMI.2015.7153610","DOI":"10.1109\/CBMI.2015.7153610"},{"key":"4240_CR26","unstructured":"Safadi B, Derbas N, Hamadi A, Budnik M, Mulhem P, Qu\u00e9not G (2014) LIG at TRECVid 2015: semantic indexing. In: Proceedings of TRECVID. Orlando"},{"key":"4240_CR27","doi-asserted-by":"publisher","unstructured":"Safadi B, Derbas N, Qu\u00e9not G (2015) Descriptor optimization for multimedia indexing and retrieval. Multimed Tools Appl 74(4):1267\u20131290. doi: 10.1007\/s11042-014-2071-6","DOI":"10.1007\/s11042-014-2071-6"},{"issue":"3","key":"4240_CR28","doi-asserted-by":"publisher","first-page":"222","DOI":"10.1007\/s11263-013-0636-x","volume":"105","author":"J S\u00e1nchez","year":"2013","unstructured":"S\u00e1nchez J, Perronnin F, Mensink T, Verbeek J (2013) Image classification with the fisher vector: theory and practice. Int J Comput Vis 105(3):222\u2013245","journal-title":"Int J Comput Vis"},{"key":"4240_CR29","doi-asserted-by":"publisher","unstructured":"Shabou A, LeBorgne H (2012) Locality-constrained and spatially regularized coding for scene categorization. In: 2012 IEEE Conference on computer vision and pattern recognition (CVPR), pp 3618\u20133625. doi: 10.1109\/CVPR.2012.6248107","DOI":"10.1109\/CVPR.2012.6248107"},{"key":"4240_CR30","unstructured":"Simonyan K, Zisserman A (2014) Very deep convolutional networks for large-scale image recognition. CoRR 1409.1556"},{"key":"4240_CR31","doi-asserted-by":"publisher","unstructured":"Sivic J, Zisserman A (2003) Video google: a text retrieval approach to object matching in videos. In: Proceedings of the Ninth IEEE international conference on computer vision - volume 2, ICCV \u201903, pp 1470. IEEE Computer Society, Washington, DC","DOI":"10.1109\/ICCV.2003.1238663"},{"key":"4240_CR32","doi-asserted-by":"publisher","unstructured":"Smeaton AF, Over P, Kraaij W (2006) Evaluation campaigns and trecvid. In: MIR \u201906: proceedings of the 8th ACM international workshop on multimedia information retrieval. ACM Press, New York, pp 321\u2013330. doi: 10.1145\/1178677.1178722","DOI":"10.1145\/1178677.1178722"},{"key":"4240_CR33","doi-asserted-by":"publisher","unstructured":"Smith J, Naphade M, Natsev A (2003) Multimedia semantic indexing using model vectors. In: 2003 International conference on multimedia and expo, 2003. ICME \u201903. Proceedings, vol 2, pp pp. II\u2013445\u20138. doi: 10.1109\/ICME.2003.1221649","DOI":"10.1109\/ICME.2003.1221649"},{"key":"4240_CR34","doi-asserted-by":"publisher","unstructured":"Snoek CGM, Worring M, Geusebroek JM, Koelma DC, Seinstra FJ (2005) On the surplus value of semantic video analysis beyond the key frame. In: IEEE International conference on multimedia & expo. https:\/\/ivi.fnwi.uva.nl\/isis\/publications\/2005\/SnoekICME2005","DOI":"10.1109\/ICME.2005.1521441"},{"key":"4240_CR35","doi-asserted-by":"publisher","unstructured":"Strat S, Benoit A, Lambert P (2013) Retina enhanced sift descriptors for video indexing. In: 2013 11th International workshop on content-based multimedia indexing (CBMI), pp 201\u2013206. doi: 10.1109\/CBMI.2013.6576582","DOI":"10.1109\/CBMI.2013.6576582"},{"key":"4240_CR36","unstructured":"Strat S, Benoit A, Lambert P (2014) Retina enhanced bag of words descriptors for video classification. In: 2014 Proceedings of the 22nd European signal processing conference (EUSIPCO), pp 1307\u2013 1311"},{"key":"4240_CR37","doi-asserted-by":"publisher","unstructured":"Strat ST, Benoit A, Lambert P, Bredin H, Qu\u00e9not G (2014) Hierarchical late fusion for concept detection in videos. In: Ionescu B, Benois-Pineau J, Piatrik T, Qu\u00e9not G (eds) Fusion in computer vision, advances in computer vision and pattern recognition. Springer International Publishing, pp 53\u201377. doi: 10.1007\/978-3-319-05696-8_3","DOI":"10.1007\/978-3-319-05696-8l_3"},{"issue":"1","key":"4240_CR38","doi-asserted-by":"publisher","first-page":"59","DOI":"10.1007\/s11263-012-0529-4","volume":"100","author":"Y Su","year":"2012","unstructured":"Su Y, Jurie F (2012) Improving image classification using semantic attributes. Int J Comput Vis 100(1):59\u201377. doi: 10.1007\/s11263-012-0529-4","journal-title":"Int J Comput Vis"},{"key":"4240_CR39","unstructured":"Szegedy C, Liu W, Jia Y, Sermanet P, Reed S, Anguelov D, Erhan D, Vanhoucke V, Rabinovich A (2014) Going deeper with convolutions. CoRR 1409.4842"},{"key":"4240_CR40","doi-asserted-by":"publisher","unstructured":"van de Sande KEA, Gevers T, Snoek CGM (2010) Evaluating color descriptors for object and scene recognition. IEEE Trans Pattern Anal Mach Intel 32(9):1582\u20131596","DOI":"10.1109\/TPAMI.2009.154"},{"key":"4240_CR41","unstructured":"Yosinski J, Clune J, Bengio Y, Lipson H (2014) How transferable are features in deep neural networks? CoRR 1411.1792"},{"key":"4240_CR42","first-page":"15","volume":"5205","author":"C Zhu","year":"2011","unstructured":"Zhu C, Bichot CE, Chen L (2011) Color orthogonal local binary patterns combination for image region description. Rapport technique RR-LIRIS-2011-012, LIRIS UMR 5205:15","journal-title":"Rapport technique RR-LIRIS-2011-012, LIRIS UMR"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11042-016-4240-2\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-016-4240-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-016-4240-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,16]],"date-time":"2019-09-16T18:55:50Z","timestamp":1568660150000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11042-016-4240-2"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,12,24]]},"references-count":42,"journal-issue":{"issue":"9","published-print":{"date-parts":[[2017,5]]}},"alternative-id":["4240"],"URL":"https:\/\/doi.org\/10.1007\/s11042-016-4240-2","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"value":"1380-7501","type":"print"},{"value":"1573-7721","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,12,24]]}}}