{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,3]],"date-time":"2026-06-03T11:28:29Z","timestamp":1780486109165,"version":"3.54.1"},"reference-count":49,"publisher":"Springer Science and Business Media LLC","issue":"2","license":[{"start":{"date-parts":[[2022,2,1]],"date-time":"2022-02-01T00:00:00Z","timestamp":1643673600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2022,2,1]],"date-time":"2022-02-01T00:00:00Z","timestamp":1643673600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Sign Process Syst"],"published-print":{"date-parts":[[2022,2]]},"DOI":"10.1007\/s11265-021-01720-9","type":"journal-article","created":{"date-parts":[[2022,2,28]],"date-time":"2022-02-28T02:02:35Z","timestamp":1646013755000},"page":"197-213","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":3,"title":["Unsupervised Domain Adaptation via Principal Subspace Projection for Acoustic Scene Classification"],"prefix":"10.1007","volume":"94","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-9438-3190","authenticated-orcid":false,"given":"Alessandro Ilic","family":"Mezza","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Emanu\u00ebl A. P.","family":"Habets","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Meinard","family":"M\u00fcller","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Augusto","family":"Sarti","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2022,2,28]]},"reference":[{"key":"1720_CR1","doi-asserted-by":"crossref","unstructured":"Wang, W. (Ed.) (2011). Machine Audition. IGI Global.","DOI":"10.4018\/978-1-61520-919-4"},{"key":"1720_CR2","unstructured":"Wang, D., & Brown, G.\u00a0J. (Eds.) (2006). Computational auditory scene analysis: Principles, algorithms, and applications. Wiley-IEEE press."},{"key":"1720_CR3","doi-asserted-by":"crossref","unstructured":"Virtanen, T., Plumbley, M.\u00a0D., & Ellis, D. (Eds.) (2018). Computational Analysis of Sound Scenes and Events. Springer International Publishing.","DOI":"10.1007\/978-3-319-63450-0"},{"key":"1720_CR4","doi-asserted-by":"publisher","first-page":"103339","DOI":"10.1109\/ACCESS.2020.2999388","volume":"8","author":"T Chan","year":"2020","unstructured":"Chan, T., & Chin, C. S. (2020). A comprehensive review of polyphonic sound event detection. IEEE Access, 8, 103339\u2013103373.","journal-title":"IEEE Access"},{"key":"1720_CR5","doi-asserted-by":"publisher","first-page":"1733","DOI":"10.1109\/TMM.2015.2428998","volume":"17","author":"D Stowell","year":"2015","unstructured":"Stowell, D., Giannoulis, D., Benetos, E., Lagrange, M., & Plumbley, M. D. (2015). Detection and classification of acoustic scenes and events. IEEE Transactions on Multimedia, 17, 1733\u20131746.","journal-title":"IEEE Transactions on Multimedia"},{"key":"1720_CR6","doi-asserted-by":"publisher","first-page":"16","DOI":"10.1109\/MSP.2014.2326181","volume":"32","author":"D Barchiesi","year":"2015","unstructured":"Barchiesi, D., Giannoulis, D., Stowell, D., & Plumbley, M. D. (2015). Acoustic scene classification: Classifying environments from the sounds they produce. IEEE Signal Processing Magazine, 32, 16\u201334.","journal-title":"IEEE Signal Processing Magazine"},{"key":"1720_CR7","unstructured":"Heittola, T., Mesaros, A., & Virtanen, T. (2020). Acoustic scene classification in DCASE 2020 challenge: Generalization across devices and low complexity solutions. arXiv preprint, arXiv:2005.14623"},{"key":"1720_CR8","doi-asserted-by":"publisher","first-page":"379","DOI":"10.1109\/TASLP.2017.2778423","volume":"26","author":"A Mesaros","year":"2017","unstructured":"Mesaros, A., Heittola, T., Benetos, E., Foster, P., Lagrange, M., Virtanen, T., & Plumbley, M. D. (2017). Detection and classification of acoustic scenes and events: Outcome of the DCASE 2016 challenge. IEEE\/ACM Transactions on Audio, Speech, and Language Processing, 26, 379\u2013393.","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"1720_CR9","doi-asserted-by":"crossref","unstructured":"Mesaros, A., Heittola, T., & Virtanen, T. (2018a). Acoustic scene classification: An overview of DCASE 2017 challenge entries. In 2018 16th International Workshop on Acoustic Signal Enhancement (IWAENC) (pp. 411\u2013415).","DOI":"10.1109\/IWAENC.2018.8521242"},{"key":"1720_CR10","unstructured":"Mesaros, A., Heittola, T., & Virtanen, T. (2018b). A multi-device dataset for urban acoustic scene classification. In Proceedings of the Detection and Classification of Acoustic Scenes and Events 2018 Workshop (DCASE2018) (pp. 9\u201313)."},{"key":"1720_CR11","doi-asserted-by":"crossref","unstructured":"Mesaros, A., Heittola, T., & Virtanen, T. (2019). Acoustic scene classification in DCASE 2019 challenge: Closed and open set classification and data mismatch setups. In Proceedings of the Detection and Classification of Acoustic Scenes and Events 2019 Workshop (DCASE2019) (pp. 164\u2013168).","DOI":"10.33682\/m5kp-fa97"},{"key":"1720_CR12","first-page":"10","volume-title":"A review of deep learning based methods for acoustic scene classification","author":"J Abe\u00dfer","year":"2020","unstructured":"Abe\u00dfer, J. (2020). A review of deep learning based methods for acoustic scene classification (p. 10). Sci.: Appl."},{"key":"1720_CR13","doi-asserted-by":"crossref","unstructured":"Mesaros, A., Heittola, T., & Virtanen, T. (2017b). Assessment of human and machine performance in acoustic scene classification: DCASE 2016 case study. In 2017 IEEE Workshop on Applications of Signal Processing to Audio and Acoustics (WASPAA) (pp. 319\u2013323).","DOI":"10.1109\/WASPAA.2017.8170047"},{"key":"1720_CR14","doi-asserted-by":"crossref","unstructured":"Schilit, B., Adams, N., & Want, R. (1994). Context-aware computing applications. In 1994 First Workshop on Mobile Computing Systems and Applications (pp. 85\u201390).","DOI":"10.1109\/WMCSA.1994.16"},{"key":"1720_CR15","doi-asserted-by":"crossref","unstructured":"Vivek, V.\u00a0S., Vidhya, S., & Madhanmohan, P. (2020). Acoustic scene classification in hearing aid using deep learning. In 2020 International Conference on Communication and Signal Processing (ICCSP) (pp. 695\u2013699).","DOI":"10.1109\/ICCSP48568.2020.9182160"},{"key":"1720_CR16","unstructured":"Sehili, M.\u00a0A., Istrate, D., Dorizzi, B., & Boudy, J. (2012). Daily sound recognition using a combination of GMM and SVM for home automation. In Proceedings of the 20th European Signal Processing Conference (EUSIPCO) (pp. 1673\u20131677)."},{"key":"1720_CR17","doi-asserted-by":"crossref","unstructured":"Radhakrishnan, R., Divakaran, A., & Smaragdis, A. (2005). Audio analysis for surveillance applications. In IEEE Workshop on Applications of Signal Processing to Audio and Acoustics (pp. 158\u2013161).","DOI":"10.1109\/ASPAA.2005.1540194"},{"key":"1720_CR18","doi-asserted-by":"publisher","first-page":"414","DOI":"10.1109\/SURV.2013.042313.00197","volume":"16","author":"C Perera","year":"2013","unstructured":"Perera, C., Zaslavsky, A., Christen, P., & Georgakopoulos, D. (2013). Context aware computing for the internet of things: A survey. IEEE Communications Surveys & Tutorials, 16, 414\u2013454.","journal-title":"IEEE Communications Surveys & Tutorials"},{"key":"1720_CR19","unstructured":"Abe\u00dfer, J., Mimilakis, S.\u00a0I., Gr\u00e4fe, R., Lukashevich, H., & Fraunhofer, I. (2017). Acoustic scene classification by combining autoencoder-based dimensionality reduction and convolutional neural networks. In Proceedings of the Detection and Classification of Acoustic Scenes and Events 2017 Workshop (DCASE2017) (pp. 7\u201311)."},{"key":"1720_CR20","doi-asserted-by":"crossref","unstructured":"Chu, S., Narayanan, S., Kuo, C. C.\u00a0J., & Mataric, M.\u00a0J. (2006). Where am I? Scene recognition for mobile robots using audio features. In 2006 IEEE International conference on multimedia and expo (pp. 885\u2013888).","DOI":"10.1109\/ICME.2006.262661"},{"key":"1720_CR21","unstructured":"Gharib, S., Drossos, K., Cakir, E., Serdyuk, D., & Virtanen, T. (2018). Unsupervised adversarial domain adaptation for acoustic scene classification. In Proceedings of the Detection and Classification of Acoustic Scenes and Events 2018 Workshop (DCASE2018) (pp. 138\u2013142)."},{"key":"1720_CR22","doi-asserted-by":"crossref","unstructured":"Sun, B., Feng, J., & Saenko, K. (2016). Return of frustratingly easy domain adaptation. In Proceedings of the AAAI Conference on Artificial Intelligence. volume\u00a030.","DOI":"10.1609\/aaai.v30i1.10306"},{"key":"1720_CR23","doi-asserted-by":"crossref","unstructured":"Torralba, A., & Efros, A.\u00a0A. (2011). Unbiased look at dataset bias. In Proceedings of the IEEE conference on Computer Vision and Pattern Recognition (CVPR) (pp. 1521\u20131528).","DOI":"10.1109\/CVPR.2011.5995347"},{"key":"1720_CR24","doi-asserted-by":"publisher","first-page":"227","DOI":"10.1016\/S0378-3758(00)00115-4","volume":"90","author":"H Shimodaira","year":"2000","unstructured":"Shimodaira, H. (2000). Improving predictive inference under covariate shift by weighting the log-likelihood function. Journal of Statistical Planning and Inference, 90, 227\u2013244.","journal-title":"Journal of Statistical Planning and Inference"},{"key":"1720_CR25","doi-asserted-by":"crossref","unstructured":"Wang, R., Wang, M., Zhang, X., & Rahardja, S. (2019). Domain adaptation neural network for acoustic scene classification in mismatched conditions. In 2019 Asia-Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA ASC) (pp. 1501\u20131505).","DOI":"10.1109\/APSIPAASC47483.2019.9023057"},{"key":"1720_CR26","first-page":"2096","volume":"17","author":"Y Ganin","year":"2016","unstructured":"Ganin, Y., Ustinova, E., Ajakan, H., Germain, P., Larochelle, H., Laviolette, F., et al. (2016). Domain-adversarial training of neural networks. Journal of Machine Learning Research, 17, 2096\u20132030.","journal-title":"Journal of Machine Learning Research"},{"key":"1720_CR27","doi-asserted-by":"crossref","unstructured":"Chin, C.\u00a0S., Kek, X.\u00a0Y., & Chan, T.\u00a0K. (2020). Wavelet scattering based gated recurrent units for binaural acoustic scenes classification. In 2020 International Conference on Internet of Things and Intelligent Applications (ITIA) (pp. 1\u20135). IEEE.","DOI":"10.1109\/ITIA50152.2020.9312349"},{"key":"1720_CR28","doi-asserted-by":"crossref","unstructured":"Chin, C.\u00a0S., Kek, X.\u00a0Y., & Chan, T.\u00a0K. (2021). Scattering transform of averaged data augmentation for ensemble random subspace discriminant classifiers in audio recognition. In 2021 7th International Conference on Advanced Computing and Communication Systems (ICACCS) (pp. 454\u2013458). IEEE volume\u00a01.","DOI":"10.1109\/ICACCS51430.2021.9441716"},{"key":"1720_CR29","doi-asserted-by":"publisher","first-page":"1331","DOI":"10.1002\/cpa.21413","volume":"65","author":"S Mallat","year":"2012","unstructured":"Mallat, S. (2012). Group invariant scattering. Communications on Pure and Applied Mathematics, 65, 1331\u20131398.","journal-title":"Communications on Pure and Applied Mathematics"},{"key":"1720_CR30","doi-asserted-by":"crossref","unstructured":"Tzeng, E., Hoffman, J., Saenko, K., & Darrell, T. (2017). Adversarial discriminative domain adaptation. In Proceedings of the IEEE conference on Computer Vision and Pattern Recognition (CVPR) (pp. 7167\u20137176).","DOI":"10.1109\/CVPR.2017.316"},{"key":"1720_CR31","doi-asserted-by":"crossref","unstructured":"Drossos, K., Magron, P., & Virtanen, T. (2019). Unsupervised adversarial domain adaptation based on the Wasserstein distance for acoustic scene classification. In 2019 IEEE Workshop on Applications of Signal Processing to Audio and Acoustics (WASPAA) (pp. 259\u2013263).","DOI":"10.1109\/WASPAA.2019.8937231"},{"key":"1720_CR32","unstructured":"Arjovsky, M., Chintala, S., & Bottou, L. (2017). Wasserstein generative adversarial networks. In Proceedings of the International Conference on Machine Learning (ICML) (pp. 214\u2013223). PMLR."},{"key":"1720_CR33","doi-asserted-by":"crossref","unstructured":"Primus, P., Eghbal-zadeh, H., Eitelsebner, D., Koutini, K., Arzt, A., & Widmer, G. (2019). Exploiting parallel audio recordings to enforce device invariance in CNN-based acoustic scene classification. In Proceedings of the Detection and Classification of Acoustic Scenes and Events 2019 Workshop (DCASE2019) (pp. 204\u2013208).","DOI":"10.33682\/v9qj-8954"},{"key":"1720_CR34","doi-asserted-by":"crossref","unstructured":"Mun, S., & Shon, S. (2019). Domain mismatch robust acoustic scene classification using channel information conversion. In Proceedings of the 2019 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) (pp. 845\u2013849).","DOI":"10.1109\/ICASSP.2019.8683514"},{"key":"1720_CR35","unstructured":"Hsu, W., Zhang, Y., & Glass, J.\u00a0R. (2017). Unsupervised learning of disentangled and interpretable representations from sequential data. In Advances in Neural Information Processing Systems 30 (NIPS) (pp. 1878\u20131889)."},{"key":"1720_CR36","doi-asserted-by":"crossref","unstructured":"Mezza, A.\u00a0I., Habets, E. A.\u00a0P., M\u00fcller, M., & Sarti, A. (2021). Unsupervised domain adaptation for acoustic scene classification using band-wise statistics matching. In Proceedings of the 28th European Signal Processing Conference (EUSIPCO) (pp. 11\u201315).","DOI":"10.23919\/Eusipco47968.2020.9287533"},{"key":"1720_CR37","unstructured":"Kosmider, M. (2019). Calibrating Neural Networks for Secondary Recording Devices. Technical Report DCASE2019 Challenge."},{"key":"1720_CR38","doi-asserted-by":"crossref","unstructured":"Ko\u015bmider, M. (2020). Spectrum correction: Acoustic scene classification with mismatched recording devices. Interspeech 2020, (pp. 4641\u20134645).","DOI":"10.21437\/Interspeech.2020-3088"},{"key":"1720_CR39","unstructured":"Kim, B., Yang, S., Kim, J., & Chang, S. (2021b). QTI Submission to DCASE 2021: Residual Normalization for Device-Imbalanced Acoustic Scene Classification with Efficient Design. Technical Report DCASE2021 Challenge."},{"key":"1720_CR40","doi-asserted-by":"crossref","unstructured":"Isola, P., Zhu, J.-Y., Zhou, T., & Efros, A.\u00a0A. (2017). Image-to-image translation with conditional adversarial networks. In Proceedings of the IEEE conference on computer vision and pattern recognition (pp. 1125\u20131134).","DOI":"10.1109\/CVPR.2017.632"},{"key":"1720_CR41","unstructured":"Ulyanov, D., Vedaldi, A., & Lempitsky, V.\u00a0S. (2016). Instance normalization: The missing ingredient for fast stylization. CoRR, arXiv:1607.08022"},{"key":"1720_CR42","doi-asserted-by":"crossref","unstructured":"Mezza, A.\u00a0I., Habets, E. A.\u00a0P., Muller, M., & Sarti, A. (2020). Feature projection-based unsupervised domain adaptation for acoustic scene classification. In 2020 IEEE 30th International Workshop on Machine Learning for Signal Processing (MLSP) (pp. 1\u20136).","DOI":"10.1109\/MLSP49062.2020.9231836"},{"key":"1720_CR43","doi-asserted-by":"publisher","first-page":"217","DOI":"10.1137\/090771806","volume":"53","author":"N Halko","year":"2011","unstructured":"Halko, N., Martinsson, P.-G., & Tropp, J. A. (2011). Finding structure with randomness: Probabilistic algorithms for constructing approximate matrix decompositions. SIAM Review, 53, 217\u2013288.","journal-title":"SIAM Review"},{"key":"1720_CR44","doi-asserted-by":"publisher","first-page":"133","DOI":"10.1016\/S0167-6393(98)00033-8","volume":"25","author":"O Viikki","year":"1998","unstructured":"Viikki, O., & Laurila, K. (1998). Cepstral domain segmental feature vector normalization for noise robust speech recognition. Speech Communication, 25, 133\u2013147.","journal-title":"Speech Communication"},{"key":"1720_CR45","unstructured":"Ioffe, S., & Szegedy, C. (2015). Batch normalization: Accelerating deep network training by reducing internal covariate shift. In International conference on machine learning (pp. 448\u2013456). PMLR."},{"key":"1720_CR46","unstructured":"Kingma, D.\u00a0P., & Ba, J. (2015). Adam: A method for stochastic optimization. CoRR, arXiv:1412.6980"},{"key":"1720_CR47","first-page":"2579","volume":"9","author":"L Van der Maaten","year":"2008","unstructured":"Van der Maaten, L., & Hinton, G. (2008). Visualizing data using t-SNE. Journal of Machine Learning Research, 9, 2579\u20132605.","journal-title":"Journal of Machine Learning Research"},{"key":"1720_CR48","doi-asserted-by":"crossref","unstructured":"Kim, B., Chang, S., Lee, J., & Sung, D. (2021a). Broadcasted residual learning for efficient keyword spotting. arXiv preprint arXiv:2106.04140","DOI":"10.21437\/Interspeech.2021-383"},{"key":"1720_CR49","unstructured":"Loshchilov, I., & Hutter, F. (2016). SGDR: stochastic gradient descent with restarts. CoRR, arXiv:1608.03983"}],"container-title":["Journal of Signal Processing Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11265-021-01720-9.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11265-021-01720-9\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11265-021-01720-9.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,1,28]],"date-time":"2023-01-28T00:29:39Z","timestamp":1674865779000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11265-021-01720-9"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,2]]},"references-count":49,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2022,2]]}},"alternative-id":["1720"],"URL":"https:\/\/doi.org\/10.1007\/s11265-021-01720-9","relation":{},"ISSN":["1939-8018","1939-8115"],"issn-type":[{"value":"1939-8018","type":"print"},{"value":"1939-8115","type":"electronic"}],"subject":[],"published":{"date-parts":[[2022,2]]},"assertion":[{"value":"15 March 2021","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"9 September 2021","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"9 November 2021","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"28 February 2022","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of Interest"}}]}}