{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,18]],"date-time":"2025-06-18T04:27:43Z","timestamp":1750220863142,"version":"3.41.0"},"publisher-location":"New York, NY, USA","reference-count":18,"publisher":"ACM","license":[{"start":{"date-parts":[[2019,12,20]],"date-time":"2019-12-20T00:00:00Z","timestamp":1576800000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2019,12,20]]},"DOI":"10.1145\/3377170.3377199","type":"proceedings-article","created":{"date-parts":[[2020,3,20]],"date-time":"2020-03-20T11:16:22Z","timestamp":1584702982000},"page":"40-44","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["Multi-level Data Filter for Speaker Recognition on Imbalanced Datasets"],"prefix":"10.1145","author":[{"given":"Chen","family":"Sun","sequence":"first","affiliation":[{"name":"Department of Mathematics, Dalian Maritime University, Dalian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yunjie","family":"Zhang","sequence":"additional","affiliation":[{"name":"Department of Mathematics, Dalian Maritime University, Dalian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yiwei","family":"Liu","sequence":"additional","affiliation":[{"name":"Department of Mathematics, Dalian Maritime University, Dalian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2020,3,20]]},"reference":[{"key":"e_1_3_2_1_1_1","volume-title":"Alan Papir and Ignacio Lopez-Moreno. Generalized End-to-End Loss for Speaker Verification. 2018 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 4879--4883","author":"Wan Li","year":"2017","unstructured":"Wan , Li , Quan Wang , Alan Papir and Ignacio Lopez-Moreno. Generalized End-to-End Loss for Speaker Verification. 2018 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 4879--4883 , 2017 . Wan, Li, Quan Wang, Alan Papir and Ignacio Lopez-Moreno. Generalized End-to-End Loss for Speaker Verification. 2018 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 4879--4883, 2017."},{"key":"e_1_3_2_1_2_1","volume-title":"Ye Jia and Ignacio Lopez-Moreno. VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking. ArXiv abs\/1810.04826","author":"Wang Quan","year":"2018","unstructured":"Wang , Quan , Hannah Muckenhirn , Kevin W. Wilson , Prashant Sridhar , Zelin Wu , John R . Hershey , Rif A . Saurous , Ron J . Weiss , Ye Jia and Ignacio Lopez-Moreno. VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking. ArXiv abs\/1810.04826 , 2018 Wang, Quan, Hannah Muckenhirn, Kevin W. Wilson, Prashant Sridhar, Zelin Wu, John R. Hershey, Rif A. Saurous, Ron J. Weiss, Ye Jia and Ignacio Lopez-Moreno. VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking. ArXiv abs\/1810.04826, 2018"},{"key":"e_1_3_2_1_3_1","volume-title":"Shaoqing Ren and Jian Sun. Deep Residual Learning for Image Recognition. 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 770--778","author":"He Kaiming","year":"2015","unstructured":"He , Kaiming , Xiangyu Zhang , Shaoqing Ren and Jian Sun. Deep Residual Learning for Image Recognition. 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 770--778 , 2015 . He, Kaiming, Xiangyu Zhang, Shaoqing Ren and Jian Sun. Deep Residual Learning for Image Recognition. 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 770--778, 2015."},{"key":"e_1_3_2_1_4_1","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2011-53"},{"key":"e_1_3_2_1_5_1","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2018-1929"},{"key":"e_1_3_2_1_6_1","doi-asserted-by":"crossref","unstructured":"Xie Weidi Arsha Nagrani Joon Son Chung and Andrew Zisserman. Utterance-level Aggregation for Speaker Recognition in the Wild. ICASSP 2019-2019 IEEE International Conference on Acoustics Speech and Signal Processing (ICASSP) 5791--5795 2019.  Xie Weidi Arsha Nagrani Joon Son Chung and Andrew Zisserman. Utterance-level Aggregation for Speaker Recognition in the Wild. ICASSP 2019-2019 IEEE International Conference on Acoustics Speech and Signal Processing (ICASSP) 5791--5795 2019.","DOI":"10.1109\/ICASSP.2019.8683120"},{"key":"e_1_3_2_1_7_1","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2017-950"},{"key":"e_1_3_2_1_8_1","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2008.239"},{"key":"e_1_3_2_1_9_1","volume-title":"2016 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 5115--5119","author":"Heigold Georg","year":"2015","unstructured":"Heigold , Georg , Ignacio Gil Moreno , Samy Bengio and Noam Shazeer . End-to-end text-dependent speaker verification . 2016 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 5115--5119 , 2015 . Heigold, Georg, Ignacio Gil Moreno, Samy Bengio and Noam Shazeer. End-to-end text-dependent speaker verification. 2016 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 5115--5119, 2015."},{"key":"e_1_3_2_1_10_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.572"},{"key":"e_1_3_2_1_11_1","volume-title":"ACCV","author":"Zhong Yujie","year":"2018","unstructured":"Zhong , Yujie , Relja Arandjelovic and Andrew Zisserman . GhostVLAD for Set-Based Face Recognition . ACCV , 2018 . Zhong, Yujie, Relja Arandjelovic and Andrew Zisserman. GhostVLAD for Set-Based Face Recognition. ACCV, 2018."},{"key":"e_1_3_2_1_12_1","doi-asserted-by":"publisher","DOI":"10.1109\/LSP.2018.2822810"},{"key":"e_1_3_2_1_13_1","volume-title":"Bhiksha Raj and Le Song. SphereFace: Deep Hypersphere Embedding for Face Recognition. 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 6738--6746","author":"Liu Weiyang","year":"2017","unstructured":"Liu , Weiyang , Yandong Wen , Zhiding Yu , Ming Min Li , Bhiksha Raj and Le Song. SphereFace: Deep Hypersphere Embedding for Face Recognition. 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 6738--6746 , 2017 . Liu, Weiyang, Yandong Wen, Zhiding Yu, Ming Min Li, Bhiksha Raj and Le Song. SphereFace: Deep Hypersphere Embedding for Face Recognition. 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 6738--6746, 2017."},{"key":"e_1_3_2_1_14_1","doi-asserted-by":"crossref","unstructured":"Xia Wei Jing Huang and John H. L. Hansen. Cross-lingual Text-independent Speaker Verification Using Unsupervised Adversarial Discriminative Domain Adaptation. 2019 IEEE International Conference on Acoustics Speech and Signal Processing (ICASSP) 5816--5820 2019.  Xia Wei Jing Huang and John H. L. Hansen. Cross-lingual Text-independent Speaker Verification Using Unsupervised Adversarial Discriminative Domain Adaptation. 2019 IEEE International Conference on Acoustics Speech and Signal Processing (ICASSP) 5816--5820 2019.","DOI":"10.1109\/ICASSP.2019.8682259"},{"key":"e_1_3_2_1_15_1","volume-title":"Florin. Front-End Factor Analysis For Speaker Verification. 2018 International Conference on Communications (COMM), 101--106","author":"Curelaru","year":"2018","unstructured":"Curelaru , Florin. Front-End Factor Analysis For Speaker Verification. 2018 International Conference on Communications (COMM), 101--106 , 2018 . Curelaru, Florin. Front-End Factor Analysis For Speaker Verification. 2018 International Conference on Communications (COMM), 101--106, 2018."},{"key":"e_1_3_2_1_16_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICSDA.2017.8384449"},{"key":"e_1_3_2_1_17_1","volume-title":"Junichi Yamagishi and Kirsten Macdonald. CSTR VCTK Corpus: English Multi-speaker Corpus for CSTR Voice Cloning Toolkit","author":"Veaux Christophe","year":"2017","unstructured":"Veaux , Christophe , Junichi Yamagishi and Kirsten Macdonald. CSTR VCTK Corpus: English Multi-speaker Corpus for CSTR Voice Cloning Toolkit . 2017 . Veaux, Christophe, Junichi Yamagishi and Kirsten Macdonald. CSTR VCTK Corpus: English Multi-speaker Corpus for CSTR Voice Cloning Toolkit. 2017."},{"key":"e_1_3_2_1_18_1","volume-title":"Adam: A Method for Stochastic Optimization. CoRR, abs\/1412.6980","author":"Kingma Diederik P","year":"2014","unstructured":"Kingma , Diederik P . and Jimmy Ba . Adam: A Method for Stochastic Optimization. CoRR, abs\/1412.6980 , 2014 . Kingma, Diederik P. and Jimmy Ba. Adam: A Method for Stochastic Optimization. CoRR, abs\/1412.6980, 2014."}],"event":{"name":"ICIT 2019: IoT and Smart City","sponsor":["Shanghai Jiao Tong University Shanghai Jiao Tong University","The Hong Kong Polytechnic The Hong Kong Polytechnic University","University of Malaya University of Malaya"],"location":"Shanghai China","acronym":"ICIT 2019"},"container-title":["Proceedings of the 2019 7th International Conference on Information Technology: IoT and Smart City"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3377170.3377199","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3377170.3377199","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T23:23:39Z","timestamp":1750202619000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3377170.3377199"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019,12,20]]},"references-count":18,"alternative-id":["10.1145\/3377170.3377199","10.1145\/3377170"],"URL":"https:\/\/doi.org\/10.1145\/3377170.3377199","relation":{},"subject":[],"published":{"date-parts":[[2019,12,20]]},"assertion":[{"value":"2020-03-20","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}