{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,27]],"date-time":"2025-12-27T21:04:46Z","timestamp":1766869486475,"version":"3.40.4"},"reference-count":34,"publisher":"Springer Science and Business Media LLC","issue":"20","license":[{"start":{"date-parts":[[2023,3,21]],"date-time":"2023-03-21T00:00:00Z","timestamp":1679356800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,3,21]],"date-time":"2023-03-21T00:00:00Z","timestamp":1679356800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2023,8]]},"DOI":"10.1007\/s11042-023-14787-2","type":"journal-article","created":{"date-parts":[[2023,3,21]],"date-time":"2023-03-21T13:04:33Z","timestamp":1679403873000},"page":"31591-31606","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":3,"title":["Accuracy comparisons of fingerprint based song recognition approaches using very high granularity"],"prefix":"10.1007","volume":"82","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-0507-5186","authenticated-orcid":false,"given":"Salvatore","family":"Serrano","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9560-7504","authenticated-orcid":false,"given":"Marco","family":"Scarpa","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2023,3,21]]},"reference":[{"doi-asserted-by":"crossref","unstructured":"Anguera X, Garzon A, Adamek T (2012) Mask: robust local features for audio fingerprinting. In: 2012 IEEE international conference on multimedia and expo, pp 455\u2013460. IEEE","key":"14787_CR1","DOI":"10.1109\/ICME.2012.137"},{"issue":"2","key":"14787_CR2","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3380828","volume":"16","author":"A B\u00e1ez-Su\u00e1rez","year":"2020","unstructured":"B\u00e1ez-Su\u00e1rez A, Shah N, Nolazco-Flores JA, Huang S-HS, Gnawali O, Shi W (2020) SAMAF: sequence-to-sequence autoencoder model for audio fingerprinting. ACM Transactions on Multimedia Computing Communications, and Applications (TOMM) 16(2):1\u201323","journal-title":"ACM Transactions on Multimedia Computing Communications, and Applications (TOMM)"},{"doi-asserted-by":"crossref","unstructured":"Baluja S, Covell M (2007) Audio fingerprinting: Combining computer vision & data stream processing. In: 2007 IEEE international conference on acoustics, speech and signal processing-ICASSP\u201907, vol 2, p 213. IEEE","key":"14787_CR3","DOI":"10.1109\/ICASSP.2007.366210"},{"issue":"8","key":"14787_CR4","doi-asserted-by":"publisher","first-page":"1798","DOI":"10.1109\/TPAMI.2013.50","volume":"35","author":"Y Bengio","year":"2013","unstructured":"Bengio Y, Courville A, Vincent P (2013) Representation learning: a review and new perspectives. IEEE Trans Pattern Anal Mach Intell 35(8):1798\u20131828","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"doi-asserted-by":"crossref","unstructured":"Bin Sahbudin MA, Scarpa M, Serrano S (2019) MongoDB clustering using K-means for real-time song recognition. In: 2019 Workshop on computing, networking and communications (CNC), pp 350\u2013354. IEEE","key":"14787_CR5","DOI":"10.1109\/ICCNC.2019.8685489"},{"unstructured":"Bogdanov D, Won M, Tovstogan P, Porter A, Serra X (2019) The MTG-Jamendo Dataset for Automatic Music Tagging. In: Machine learning for music discovery workshop, international conference on machine learning (ICML 2019), http:\/\/hdl.handle.net\/10230\/42015","key":"14787_CR6"},{"issue":"3","key":"14787_CR7","doi-asserted-by":"publisher","first-page":"271","DOI":"10.1007\/s11265-005-4151-3","volume":"41","author":"P Cano","year":"2005","unstructured":"Cano P, Batlle E, Kalker T, Haitsma J (2005) A review of audio fingerprinting. Journal of VLSI Signal Processing Systems for Signal, Image and Video Technology 41(3):271\u2013284","journal-title":"Journal of VLSI Signal Processing Systems for Signal, Image and Video Technology"},{"issue":"4 Special Issue","key":"14787_CR8","doi-asserted-by":"publisher","first-page":"1545","DOI":"10.5373\/JARDCS\/V12SP4\/20201634","volume":"12","author":"C Chaouch","year":"2020","unstructured":"Chaouch C, Sahbudin MAB, Scarpa M, Serrano S (2020) Audio fingerprint database structure using k-modes clustering. Journal of Advanced Research in Dynamical and Control Systems 12(4 Special Issue):1545\u20131554","journal-title":"Journal of Advanced Research in Dynamical and Control Systems"},{"issue":"2","key":"14787_CR9","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/2846092","volume":"34","author":"Z Cheng","year":"2016","unstructured":"Cheng Z, Shen J (2016) On effective location-aware music recommendation. ACM Transactions on Information Systems (TOIS) 34(2):1\u201332","journal-title":"ACM Transactions on Information Systems (TOIS)"},{"unstructured":"Drevo W (2013) Audio fingerprinting with python and numpy. https:\/\/willdrevo.com\/fingerprinting-and-audio-recognition-with-python\/. Accessed 20 Apr 2022","key":"14787_CR10"},{"unstructured":"Ellis D (2014) The 2014 LabROSA audio fingerprint system. In: ISMIR","key":"14787_CR11"},{"issue":"2","key":"14787_CR12","doi-asserted-by":"publisher","first-page":"303","DOI":"10.1109\/TMM.2010.2098858","volume":"13","author":"Z Fu","year":"2010","unstructured":"Fu Z, Lu G, Ting KM, Zhang D (2010) A survey of audio-based music classification and annotation. IEEE Trans Multimedia 13(2):303\u2013319","journal-title":"IEEE Trans Multimedia"},{"unstructured":"Global Music Report 2021 (2021) https:\/\/gmr.ifpi.org\/. Accessed 18 Feb 2022","key":"14787_CR13"},{"unstructured":"Grosse R, Raina R, Kwong H, Ng AY (2012) Shift-invariance sparse coding for audio classification arXiv:1206.5241","key":"14787_CR14"},{"unstructured":"Haitsma J, Kalker T (2002) A highly robust audio fingerprinting system. In: ISMIR, vol 2002, pp 107\u2013115","key":"14787_CR15"},{"unstructured":"Hamel P, Lemieux S, Bengio Y, Eck D (2011) Temporal pooling and multiscale learning for automatic annotation and ranking of music audio. In: ISMIR, pp 729\u2013734","key":"14787_CR16"},{"issue":"9","key":"14787_CR17","doi-asserted-by":"publisher","first-page":"1483","DOI":"10.3390\/electronics9091483","volume":"9","author":"M Jia","year":"2020","unstructured":"Jia M, Li T, Wang J (2020) Audio fingerprint extraction based on locally linear embedding for audio retrieval system. Electronics 9(9):1483","journal-title":"Electronics"},{"issue":"1","key":"14787_CR18","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3284750","volume":"15","author":"Y Peng","year":"2019","unstructured":"Peng Y, Qi J (2019) Cm-gans: cross-modal generative adversarial networks for common representation learning. ACM Transactions on Multimedia Computing Communications, and Applications (TOMM) 15(1):1\u201324","journal-title":"ACM Transactions on Multimedia Computing Communications, and Applications (TOMM)"},{"issue":"4 Special Issue","key":"14787_CR19","doi-asserted-by":"publisher","first-page":"1533","DOI":"10.5373\/JARDCS\/V12SP4\/20201633","volume":"12","author":"MAB Sahbudin","year":"2020","unstructured":"Sahbudin MAB, Chaouch C, Scarpa M, Serrano S (2020) Audio fingerprint based on power spectral density and hamming distance measure. Journal of Advanced Research in Dynamical and Control Systems 12(4 Special Issue):1533\u20131544","journal-title":"Journal of Advanced Research in Dynamical and Control Systems"},{"doi-asserted-by":"publisher","unstructured":"Serrano S, Sahbudin MAB, Chaouch C, Scarpa M (2022) A new fingerprint definition for effective song recognition. Pattern Recognition Letters. https:\/\/doi.org\/10.1016\/j.patrec.2022.06.009","key":"14787_CR20","DOI":"10.1016\/j.patrec.2022.06.009"},{"issue":"3","key":"14787_CR21","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/1508850.1508856","volume":"27","author":"J Shen","year":"2009","unstructured":"Shen J, Shepherd J, Cui B, Tan K-L (2009) A novel framework for efficient automated singer identification in large music databases. ACM Transactions on Information Systems (TOIS) 27(3):1\u201331","journal-title":"ACM Transactions on Information Systems (TOIS)"},{"issue":"6","key":"14787_CR22","doi-asserted-by":"publisher","first-page":"1179","DOI":"10.1109\/TMM.2006.884618","volume":"8","author":"J Shen","year":"2006","unstructured":"Shen J, Shepherd J, Ngu AH (2006) Towards effective content-based music retrieval with multiple acoustic feature combination. IEEE Trans Multimedia 8(6):1179\u20131189","journal-title":"IEEE Trans Multimedia"},{"doi-asserted-by":"crossref","unstructured":"Shibuya T, Abe M, Nishiguchi M (2013) Audio fingerprinting robust against reverberation and noise based on quantification of sinusoidality. In: 2013 IEEE international conference on multimedia and expo (ICME), pp 1\u20136. IEEE","key":"14787_CR23","DOI":"10.1109\/ICME.2013.6607520"},{"unstructured":"Six J, Leman M (2014) Panako: a scalable acoustic fingerprinting system handling time-scale and pitch modification. In: 15th International society for music information retrieval conference (ISMIR-2014)","key":"14787_CR24"},{"key":"14787_CR25","doi-asserted-by":"publisher","first-page":"172343","DOI":"10.1109\/ACCESS.2020.3024951","volume":"8","author":"H-S Son","year":"2020","unstructured":"Son H-S, Byun S-W, Lee S-P (2020) A robust audio fingerprinting using a new hashing method. IEEE Access 8:172343\u2013172351","journal-title":"IEEE Access"},{"issue":"1","key":"14787_CR26","doi-asserted-by":"publisher","first-page":"145","DOI":"10.1109\/TMM.2007.911305","volume":"10","author":"Y Song","year":"2007","unstructured":"Song Y, Zhang C (2007) Content-based information fusion for semi-supervised music genre classification. IEEE Trans Multimedia 10(1):145\u2013152","journal-title":"IEEE Trans Multimedia"},{"issue":"3","key":"14787_CR27","doi-asserted-by":"publisher","first-page":"409","DOI":"10.1109\/TASLP.2015.2509248","volume":"24","author":"R Sonnleitner","year":"2015","unstructured":"Sonnleitner R, Widmer G (2015) Robust quad-based audio fingerprinting. IEEE\/ACM Transactions on Audio Speech, and Language Processing 24 (3):409\u2013421","journal-title":"IEEE\/ACM Transactions on Audio Speech, and Language Processing"},{"issue":"3","key":"14787_CR28","doi-asserted-by":"publisher","first-page":"185","DOI":"10.1121\/1.1915893","volume":"8","author":"SS Stevens","year":"1937","unstructured":"Stevens SS, Volkmann J, Newman EB (1937) A scale for the measurement of the psychological magnitude pitch. J Acoust Soc Am 8(3):185\u2013190","journal-title":"J Acoust Soc Am"},{"unstructured":"Wang AL-C (2003) An industrial strength audio search algorithm. In: ISMIR, vol 2003, pp 7\u201313. Washington, DC","key":"14787_CR29"},{"unstructured":"Wang AL-C, Smith III JO (2018) Systems and methods for recognizing sound and music signals in high noise and distortion. Google Patents. USPatent 9,899,030","key":"14787_CR30"},{"unstructured":"Weisstein EW (2022) Least Squares Fitting\u2013Exponential From MathWorld\u2013A Wolfram Web Resource. http:\/\/mathworld.wolfram.com\/LeastSquaresFittingExponential.html. Accessed 20 Apr 2022","key":"14787_CR31"},{"issue":"1","key":"14787_CR32","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1186\/s13636-017-0114-4","volume":"2017","author":"D Williams","year":"2017","unstructured":"Williams D, Pooransingh A, Saitoo J (2017) Efficient music identification using orb descriptors of the spectrogram image. EURASIP Journal on Audio Speech, and Music Processing 2017(1):1\u201317","journal-title":"EURASIP Journal on Audio Speech, and Music Processing"},{"issue":"9","key":"14787_CR33","doi-asserted-by":"publisher","first-page":"1984","DOI":"10.1109\/TMM.2017.2723846","volume":"19","author":"S Yao","year":"2017","unstructured":"Yao S, Niu B, Liu J (2017) Audio identification by sampling sub-fingerprints and counting matches. IEEE Trans Multimedia 19(9):1984\u20131995","journal-title":"IEEE Trans Multimedia"},{"issue":"9","key":"14787_CR34","doi-asserted-by":"publisher","first-page":"1450","DOI":"10.1109\/TMM.2015.2460121","volume":"17","author":"S Yao","year":"2015","unstructured":"Yao S, Wang Y, Niu B (2015) An efficient cascaded filtering retrieval method for big audio data. IEEE Trans Multimedia 17(9):1450\u20131459","journal-title":"IEEE Trans Multimedia"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-023-14787-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11042-023-14787-2\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-023-14787-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,4,9]],"date-time":"2025-04-09T16:04:18Z","timestamp":1744214658000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11042-023-14787-2"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,3,21]]},"references-count":34,"journal-issue":{"issue":"20","published-print":{"date-parts":[[2023,8]]}},"alternative-id":["14787"],"URL":"https:\/\/doi.org\/10.1007\/s11042-023-14787-2","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"type":"print","value":"1380-7501"},{"type":"electronic","value":"1573-7721"}],"subject":[],"published":{"date-parts":[[2023,3,21]]},"assertion":[{"value":"30 June 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"30 August 2022","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"5 February 2023","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"21 March 2023","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}