{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,9,11]],"date-time":"2024-09-11T13:26:42Z","timestamp":1726061202291},"publisher-location":"Cham","reference-count":26,"publisher":"Springer International Publishing","isbn-type":[{"type":"print","value":"9783030362034"},{"type":"electronic","value":"9783030362041"}],"license":[{"start":{"date-parts":[[2019,1,1]],"date-time":"2019-01-01T00:00:00Z","timestamp":1546300800000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2019]]},"DOI":"10.1007\/978-3-030-36204-1_4","type":"book-chapter","created":{"date-parts":[[2019,11,28]],"date-time":"2019-11-28T14:03:54Z","timestamp":1574949834000},"page":"53-64","update-policy":"http:\/\/dx.doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Non-local MMDenseNet with Cross-Band Features for Audio Source Separation"],"prefix":"10.1007","author":[{"given":"Yi","family":"Huang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2019,11,29]]},"reference":[{"key":"4_CR1","doi-asserted-by":"crossref","unstructured":"Cao, Y., Xu, J., Lin, S., Wei, F., Hu, H.: Gcnet: Non-local networks meet squeeze-excitation networks and beyond. arXiv preprint arXiv:1904.11492 (2019)","DOI":"10.1109\/ICCVW.2019.00246"},{"key":"4_CR2","doi-asserted-by":"crossref","unstructured":"Fu, J., et al.: Dual attention network for scene segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3146\u20133154 (2019)","DOI":"10.1109\/CVPR.2019.00326"},{"key":"4_CR3","doi-asserted-by":"crossref","unstructured":"Huang, G., Liu, Z., Van Der Maaten, L., Weinberger, K.Q.: Densely connected convolutional networks. In: Computer Vision and Pattern Recognition, pp. 4700\u20134708 (2017)","DOI":"10.1109\/CVPR.2017.243"},{"key":"4_CR4","doi-asserted-by":"crossref","unstructured":"Huang, P.S., Chen, S.D., Smaragdis, P., Hasegawa-Johnson, M.: Singing-voice separation from monaural recordings using robust principal component analysis. In: Acoustics, Speech and Signal Processing, pp. 57\u201360 (2012)","DOI":"10.1109\/ICASSP.2012.6287816"},{"key":"4_CR5","unstructured":"Huang, P.S., Kim, M., Hasegawa-Johnson, M., Smaragdis, P.: Singing-voice separation from monaural recordings using deep recurrent neural networks. In: ISMIR, pp. 477\u2013482 (2014)"},{"issue":"12","key":"4_CR6","doi-asserted-by":"publisher","first-page":"2136","DOI":"10.1109\/TASLP.2015.2468583","volume":"23","author":"Po-Sen Huang","year":"2015","unstructured":"Huang, P.S., Kim, M., Hasegawa-Johnson, M., Smaragdis, P.: Joint optimization of masks and deep recurrent neural networks for monaural source separation. IEEE\/ACM Trans. Audio Speech Lang. Process. 23(12), 2136\u20132147 (2015)","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"4_CR7","unstructured":"Jansson, A., Humphrey, E., Montecchio, N., Bittner, R., Kumar, A., Weyde, T.: Singing voice separation with deep u-net convolutional networks (2017)"},{"key":"4_CR8","doi-asserted-by":"publisher","first-page":"553","DOI":"10.1007\/978-3-319-53547-0_52","volume-title":"Latent Variable Analysis and Signal Separation","author":"Il-Young Jeong","year":"2017","unstructured":"Jeong, I.Y., Lee, K.: Singing voice separation using rpca with weighted $$\\rm {l}\\_1$$-norm. In: International Conference on Latent Variable Analysis and Signal Separation, pp. 553\u2013562 (2017)"},{"key":"4_CR9","doi-asserted-by":"crossref","unstructured":"Le Roux, J., Hershey, J.R., Weninger, F.: Deep NMF for speech separation. In: Acoustics, Speech and Signal Processing, pp. 66\u201370 (2015)","DOI":"10.1109\/ICASSP.2015.7177933"},{"issue":"10","key":"4_CR10","doi-asserted-by":"publisher","first-page":"2085","DOI":"10.1109\/TPAMI.2015.2400461","volume":"37","author":"Zechao Li","year":"2015","unstructured":"Li, Z., Liu, J., Tang, J., Lu, H.: Robust structured subspace learning for data representation. IEEE Trans. Pattern Anal. Mach. Intell. 37(10), 2085\u20132098 (2015)","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"9","key":"4_CR11","doi-asserted-by":"publisher","first-page":"2070","DOI":"10.1109\/TPAMI.2018.2852750","volume":"41","author":"Zechao Li","year":"2019","unstructured":"Li, Z., Tang, J., Mei, T.: Deep collaborative embedding for social image understanding. IEEE Trans. Pattern Anal. Mach. Intell. 41(9), 2070\u20132083 (2019)","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"4_CR12","unstructured":"Miron, M., Janer Mestres, J., G\u00f3mez Guti\u00e9rrez, E.: Generating data to train convolutional neural networks for classical music source separation. In: The 14th Sound and Music Computing Conference (2017)"},{"issue":"9","key":"4_CR13","doi-asserted-by":"publisher","first-page":"1652","DOI":"10.1109\/TASLP.2016.2580946","volume":"24","author":"Aditya Arie Nugraha","year":"2016","unstructured":"Nugraha, A.A., Liutkus, A., Vincent, E.: Multichannel audio source separation with deep neural networks. IEEE\/ACM Trans. Audio Speech Lang. Process. 24(9), 1652\u20131664 (2016)","journal-title":"IEEE\/ACM Transactions on Audio, Speech, and Language Processing"},{"key":"4_CR14","unstructured":"Park, S., Kim, T., Lee, K., Kwak, N.: Music source separation using stacked hourglass networks. arXiv preprint arXiv:1805.08559 (2018)"},{"key":"4_CR15","doi-asserted-by":"crossref","unstructured":"Rafii, Z., Pardo, B.: A simple music\/voice separation method based on the extraction of the repeating musical structure. In: Acoustics, Speech and Signal Processing, pp. 221\u2013224 (2011)","DOI":"10.1109\/ICASSP.2011.5946380"},{"key":"4_CR16","doi-asserted-by":"crossref","unstructured":"Sebastian, J., Murthy, H.A.: Group delay based music source separation using deep recurrent neural networks. In: Signal Processing and Communications, pp. 1\u20135 (2016)","DOI":"10.1109\/SPCOM.2016.7746672"},{"key":"4_CR17","unstructured":"Sprechmann, P., Bronstein, A.M., Sapiro, G.: Real-time online singing voice separation from monaural recordings using robust low-rank modeling. In: ISMIR, pp. 67\u201372 (2012)"},{"key":"4_CR18","unstructured":"Sutskever, I., Vinyals, O., Le, Q.V.: Sequence to sequence learning with neural networks. In: Advances in Neural Information Processing Systems, pp. 3104\u20133112 (2014)"},{"key":"4_CR19","doi-asserted-by":"crossref","unstructured":"Takahashi, N., Goswami, N., Mitsufuji, Y.: MMDenseLSTM: an efficient combination of convolutional and recurrent neural networks for audio source separation. In: International Workshop on Acoustic Signal Enhancement, pp. 106\u2013110 (2018)","DOI":"10.1109\/IWAENC.2018.8521383"},{"key":"4_CR20","doi-asserted-by":"crossref","unstructured":"Takahashi, N., Mitsufuji, Y.: Multi-scale multi-band densenets for audio source separation. In: Applications of Signal Processing to Audio and Acoustics, pp. 21\u201325 (2017)","DOI":"10.1109\/WASPAA.2017.8169987"},{"key":"4_CR21","doi-asserted-by":"crossref","unstructured":"Uhlich, S., et al.: Improving music source separation based on deep neural networks through data augmentation and network blending. In: Acoustics, Speech and Signal Processing, pp. 261\u2013265 (2017)","DOI":"10.1109\/ICASSP.2017.7952158"},{"key":"4_CR22","unstructured":"Vaswani, A., et al.: Attention is all you need. In: Advances in Neural Information Processing Systems, pp. 6000\u20136010 (2017)"},{"key":"4_CR23","doi-asserted-by":"crossref","unstructured":"Wang, X., Girshick, R., Gupta, A., He, K.: Non-local neural networks. In: Proceedings of IEEE Computer Vision and Pattern Recognition, pp. 7794\u20137803 (2018)","DOI":"10.1109\/CVPR.2018.00813"},{"key":"4_CR24","doi-asserted-by":"crossref","unstructured":"Weninger, F., Roux, J.L., Hershey, J.R., Watanabe, S.: Discriminative NMF and its application to single-channel source separation. In: Annual Conference of the International Speech Communication Association (2014)","DOI":"10.21437\/Interspeech.2014-218"},{"key":"4_CR25","unstructured":"Yang, P.K., Hsu, C.C., Chien, J.T.: Bayesian singing-voice separation. In: ISMIR, pp. 507\u2013512 (2014)"},{"key":"4_CR26","unstructured":"Zhang, H., Goodfellow, I., Metaxas, D., Odena, A.: Self-attention generative adversarial networks. arXiv preprint arXiv:1805.08318 (2018)"}],"container-title":["Lecture Notes in Computer Science","Intelligence Science and Big Data Engineering. Big Data and Machine Learning"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-030-36204-1_4","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,10,7]],"date-time":"2022-10-07T04:00:49Z","timestamp":1665115249000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-030-36204-1_4"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019]]},"ISBN":["9783030362034","9783030362041"],"references-count":26,"URL":"https:\/\/doi.org\/10.1007\/978-3-030-36204-1_4","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2019]]},"assertion":[{"value":"29 November 2019","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"IScIDE","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Intelligent Science and Big Data Engineering","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Nanjing","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"China","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2019","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"18 October 2019","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"20 October 2019","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"9","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"iscide2019","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/iscide.njust.edu.cn\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}