{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,9,5]],"date-time":"2024-09-05T23:22:32Z","timestamp":1725578552448},"publisher-location":"Berlin, Heidelberg","reference-count":35,"publisher":"Springer Berlin Heidelberg","isbn-type":[{"type":"print","value":"9783642197567"},{"type":"electronic","value":"9783642197574"}],"license":[{"start":{"date-parts":[[2011,1,1]],"date-time":"2011-01-01T00:00:00Z","timestamp":1293840000000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2011]]},"DOI":"10.1007\/978-3-642-19757-4_2","type":"book-chapter","created":{"date-parts":[[2011,3,2]],"date-time":"2011-03-02T09:28:58Z","timestamp":1299058138000},"page":"16-34","source":"Crossref","is-referenced-by-count":0,"title":["Sound Recognition"],"prefix":"10.1007","author":[{"given":"Yang","family":"Cai","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"K\u00e1roly D.","family":"Pados","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","reference":[{"key":"2_CR1","unstructured":"Logan, B., et al.: Mel Frequency Cepstral Coefficients for Music Modelling. Cambridge Research Laboratory (2000)"},{"key":"2_CR2","unstructured":"Lindsay, I., Smith, A.: Tutorial on Principal Components Analysis (2002)"},{"key":"2_CR3","unstructured":"Shannon, B.J., Paliwal, K.K.: A Comparative Study of Filter Bank Spacing for Speech Recognition. In: Microelectronic Engineering Research Conference (2003)"},{"key":"2_CR4","unstructured":"Sigurdsson, S., et al.: Mel Frequency Cepstral Coefficients: An Evaluation of Robustness of MP3 Encoded Music, Technical University of Denmark (2006)"},{"key":"2_CR5","unstructured":"Breebaart, J., McKinney, M.: Features for Audio Classification, Philips Research Laboratories (2008)"},{"key":"2_CR6","doi-asserted-by":"crossref","unstructured":"Spina, M.S., Zue, V.W.: Automatic transcription of general audio data: Preliminary analysis. In: Proc. 4th Int. Conf. on Spoken Language Processing, Philadelphia, PA (1997)","DOI":"10.21437\/ICSLP.1996-150"},{"key":"2_CR7","unstructured":"Dellaert, F.: The Expectation Maximization Algorithm, College of Computing, Georgia Institute of Technology (2002)"},{"key":"2_CR8","unstructured":"Hsieh, P.-F., Landgrebe, D.: Classification of High Dimensional Data, Purdue University School of Electrical and Computer Engineering, ECE Technical Reports (1998)"},{"key":"2_CR9","unstructured":"Jensen, J.H., et al.: Evaluation of MFCC Estimation Techniques for Music Similarity"},{"key":"2_CR10","unstructured":"Shlens, J.: A Tutorial on Principal Component Analysis: Derivation, Discussion and Singular Value Decomposition (2003)"},{"key":"2_CR11","unstructured":"Bengio, S.: An Introduction to Statistical Machine Learning - EM for GMMs -, Dalle Molle Institute for Perceptual Artificial Intelligence (IDIAP) slides (2004)"},{"key":"2_CR12","unstructured":"Li, J.: Mixture Models, Department of Statistics slides, The Pennsylvania State University (2008)"},{"key":"2_CR13","doi-asserted-by":"publisher","first-page":"293","DOI":"10.1109\/TSA.2002.800560","volume":"10","author":"G. Tzanetakis","year":"2002","unstructured":"Tzanetakis, G., Cook, P.: Musical genre classification of audio signals. IEEE Trans. Speech Audio Processing\u00a010, 293\u2013301 (2002)","journal-title":"IEEE Trans. Speech Audio Processing"},{"key":"2_CR14","doi-asserted-by":"crossref","unstructured":"Pfeiffer, S., Fischer, S., Effelsberg, W.: Automatic audio content analysis. Tech. Rep. No. 96-008, University of Mannheim (1996)","DOI":"10.1145\/244130.244139"},{"key":"2_CR15","doi-asserted-by":"crossref","unstructured":"Foote, J.: Content-based retrieval of music and audio. Multimedia Storage and Archiving Systems II, 138-147 (1997)","DOI":"10.1117\/12.290336"},{"key":"2_CR16","unstructured":"Bouman, C.A.: CLUSTER: An Unsupervised Algorithm for Modeling Gaussian Mixtures, School of Electrical Engineering, Purdue University (2005)"},{"key":"2_CR17","unstructured":"Window function, http:\/\/en.wikipedia.org\/wiki\/Window_function (retrieved on 07\/30\/2010)"},{"key":"2_CR18","unstructured":"Spectrogram, http:\/\/en.wikipedia.org\/wiki\/Spectrogram (retrieved on 07\/30\/2010)"},{"key":"2_CR19","doi-asserted-by":"crossref","unstructured":"Siegel, M., et al.: Vehicle Sound Signature Recognition by Frequency Vector Principal Component Analysis. IEEE Trans. on Instrumentation And Measurement\u00a048(5) (October 1999)","DOI":"10.1109\/19.799662"},{"key":"2_CR20","doi-asserted-by":"publisher","first-page":"873","DOI":"10.1016\/S0140-6736(88)91613-3","volume":"2","author":"M.A. Spiteri","year":"1988","unstructured":"Spiteri, M.A., Cook, D.G., Clark, S.W.: Reliability of eliciting physical signs in examination of the chest. Lancet.\u00a02, 873\u2013875 (1988)","journal-title":"Lancet."},{"key":"2_CR21","doi-asserted-by":"publisher","first-page":"974","DOI":"10.1164\/ajrccm.156.3.9701115","volume":"156","author":"H. Pasterkamp","year":"1997","unstructured":"Pasterkamp, H., Kraman, S.S., Wodicka, G.R.: Respiratory sounds:advances beyond the stethoscope. American Journal of Respiratory Critical Care Medicine\u00a0156, 974\u2013987 (1997)","journal-title":"American Journal of Respiratory Critical Care Medicine"},{"key":"2_CR22","doi-asserted-by":"publisher","first-page":"1343","DOI":"10.1016\/S0140-6736(01)06451-0","volume":"358","author":"K. Anderson","year":"2001","unstructured":"Anderson, K., Qiu, Y., Whittaker, A.R., Lucas, M.: Breath sounds, asthma, and the mobile phone. Lancet.\u00a0358, 1343\u20131344 (2001)","journal-title":"Lancet."},{"key":"2_CR23","series-title":"Lecture Notes in Artificial Intelligence","doi-asserted-by":"crossref","DOI":"10.1007\/11825890","volume-title":"Ambient Intelligence in Everyday Life","author":"Y. Cai","year":"2006","unstructured":"Cai, Y., Abascal, J.: Ambient Intelligence in Everyday Life. LNCS (LNAI), vol.\u00a03864. Springer, Heidelberg (2006)"},{"key":"2_CR24","series-title":"Lecture Notes in Artificial Intelligence","doi-asserted-by":"publisher","first-page":"178","DOI":"10.1007\/11825890_9","volume-title":"Ambient Intelligence in Everyday Life","author":"G. Peter","year":"2006","unstructured":"Peter, G., Cukierman, D., Anthony, C., Schwartz, M.: Online music search by tapping. In: Cai, Y., Abascal, J. (eds.) Ambient Intelligence in Everyday Life. LNCS (LNAI), vol.\u00a03864, pp. 178\u2013197. Springer, Heidelberg (2006)"},{"key":"2_CR25","doi-asserted-by":"crossref","unstructured":"Liao, W.-H., Lin, Y.-K.: Classification of Non-Speech Human Sounds: Feature Selection and Snoring Sound Analysis. In: Proc. of the 2009 IEEE Int. Conf. on Systems, Man and Cybernetics (2009)","DOI":"10.1109\/ICSMC.2009.5346556"},{"key":"2_CR26","volume-title":"A Noise-Robust FFT-Based Spectrum for Audio Classification, Department of Electrical and Computer Engineering","author":"W. Chu","year":"2006","unstructured":"Chu, W., Champagne, B.: A Noise-Robust FFT-Based Spectrum for Audio Classification, Department of Electrical and Computer Engineering. McGill University, Montreal (2006)"},{"key":"2_CR27","unstructured":"TIMIT Acoustic-Phonetic Continuous Speech Corpus, Linguistic Data Consortium, University of Pennsylvania, http:\/\/www.ldc.upenn.edu\/Catalog\/CatalogEntry.jsp?catalogId=LDC93S1"},{"key":"2_CR28","unstructured":"FFmpeg, http:\/\/ffmpeg.org"},{"key":"2_CR29","unstructured":"Smith, S.W.: The Scientist & Engineer\u2019s Guide to Digital Signal Processing. California Technical Pub. (1997) ISBN 0966017633"},{"key":"2_CR30","unstructured":"Hearing Central LLC, How the Human Ear Works, http:\/\/www.hearingaidscentral.com\/howtheearworks.asp (retrieved on 10\/25\/2010)"},{"key":"2_CR31","volume-title":"Unsupervised feature learning for audio classification using convolutional deep belief networks","author":"H. Lee","year":"2009","unstructured":"Lee, H., et al.: Unsupervised feature learning for audio classification using convolutional deep belief networks. Stanford University, Stanford (2009)"},{"key":"2_CR32","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"149","DOI":"10.1007\/978-3-642-15825-4_20","volume-title":"Artificial Neural Networks \u2013 ICANN 2010","author":"L.A. Forero Mendoza","year":"2010","unstructured":"Forero Mendoza, L.A., Cataldo, E., Vellasco, M., Silva, M.: Classification of Voice Aging Using Parameters Extracted from the Glottal Signal. In: Diamantaras, K., Duch, W., Iliadis, L.S. (eds.) ICANN 2010. LNCS, vol.\u00a06354, pp. 149\u2013156. Springer, Heidelberg (2010)"},{"key":"2_CR33","unstructured":"Angier, N.: In Mammals, a Complex Journey. New York Times (October 13, 2009)"},{"issue":"5950","key":"2_CR34","doi-asserted-by":"crossref","first-page":"278","DOI":"10.1126\/science.1178501","volume":"326","author":"Q. Ji","year":"2009","unstructured":"Ji, Q., Luo, Z.X., Zhang, X.L., Yuan, C.X., Xu, L.: Evolutionary Development of the Middle Ear in Mesozoic Therian Mammals. Science 9\u00a0326(5950), 278\u2013281 (2009)","journal-title":"Science 9"},{"issue":"5950","key":"2_CR35","doi-asserted-by":"publisher","first-page":"243","DOI":"10.1126\/science.1181131","volume":"326","author":"T. Martin","year":"2009","unstructured":"Martin, T., Ruf, I.: On the Mammalian Ear. Science\u00a0326(5950), 243\u2013244 (2009)","journal-title":"Science"}],"container-title":["Lecture Notes in Computer Science","Computing with Instinct"],"original-title":[],"link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-642-19757-4_2","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,6,5]],"date-time":"2023-06-05T13:13:04Z","timestamp":1685970784000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-642-19757-4_2"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2011]]},"ISBN":["9783642197567","9783642197574"],"references-count":35,"URL":"https:\/\/doi.org\/10.1007\/978-3-642-19757-4_2","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2011]]}}}