{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,6]],"date-time":"2025-12-06T16:42:13Z","timestamp":1765039333954},"reference-count":50,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"6","license":[{"start":{"date-parts":[[2017,6,1]],"date-time":"2017-06-01T00:00:00Z","timestamp":1496275200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"}],"funder":[{"name":"RGC of Hong Kong","award":["PolyU 152518\/16E","PolyU 152068\/15E"],"award-info":[{"award-number":["PolyU 152518\/16E","PolyU 152068\/15E"]}]},{"name":"Taiwan MOST","award":["105-2221-E-009-137-MY2"],"award-info":[{"award-number":["105-2221-E-009-137-MY2"]}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE\/ACM Trans. Audio Speech Lang. Process."],"published-print":{"date-parts":[[2017,6]]},"DOI":"10.1109\/taslp.2017.2692304","type":"journal-article","created":{"date-parts":[[2017,4,7]],"date-time":"2017-04-07T19:09:34Z","timestamp":1491592174000},"page":"1371-1383","source":"Crossref","is-referenced-by-count":16,"title":["DNN-Driven Mixture of PLDA for Robust Speaker Verification"],"prefix":"10.1109","volume":"25","author":[{"given":"Na","family":"Li","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Man-Wai","family":"Mak","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jen-Tzung","family":"Chien","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref39","first-page":"249","article-title":"Analysis of i-vector length normalization in speaker recognition systems","author":"garcia-romero","year":"0","journal-title":"Proc Annu Conf Int Speech Commun Assoc"},{"key":"ref38","first-page":"686","article-title":"Application of convolutional neural networks to speaker recognition in noisy conditions","author":"mclaren","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2014.6853888"},{"key":"ref32","first-page":"3661","article-title":"Improvement of distant-talking speaker identification using bottleneck features of DNN","author":"yamada","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref31","first-page":"105","article-title":"Bottleneck features for speaker recognition","author":"yaman","year":"0","journal-title":"Proc Speaker Recognition Workshop"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/ISCSLP.2016.7918462"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2015.7178887"},{"key":"ref36","first-page":"1141","article-title":"Insights into deep neural networks for speaker recognition","author":"garcia-romero","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref35","first-page":"1151","article-title":"Investigation of bottleneck features and multilingual deep neural networks for speaker verification","author":"tian","year":"0","journal-title":"Proc Annu Conf Int Speech Commun Assoc"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2014.6854363"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.21437\/Odyssey.2016-9"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.21437\/Odyssey.2016-54"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.21437\/Odyssey.2016-32"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2006.1659966"},{"key":"ref1","first-page":"1559","article-title":"Support vector machines versus fast scoring in the low-dimensional total variability space for speaker verification","author":"dehak","year":"0","journal-title":"Proc 10th Annu Conf Int Speech Commun Assoc"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638971"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2013.2279332"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2015.2442757"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.21437\/Odyssey.2016-52"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1016\/j.specom.2015.05.009"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2015.7178760"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638976"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1989.266481"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2015.2499038"},{"key":"ref11","doi-asserted-by":"crossref","first-page":"238","DOI":"10.1002\/0471721182.ch8","article-title":"Mixtures of factor analyzers","author":"mclachlan","year":"2000","journal-title":"Finite Mixture Models"},{"key":"ref40","article-title":"The EM algorithm for mixtures of factor analyzers","author":"ghahramani","year":"1996"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1016\/j.csl.2013.07.003"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2014.6853887"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/SLT.2016.7846263"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/j.patrec.2013.03.032"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2012.2226161"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2013.2292356"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638975"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2012.6288859"},{"key":"ref4","author":"bishop","year":"2006","journal-title":"Pattern Recognition and Machine Learning"},{"key":"ref3","article-title":"Comparison between factor analysis and GMM support vector machines for speaker verification","author":"dehak","year":"0","journal-title":"Proc Speaker Lang Recognition Workshop"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4409052"},{"key":"ref5","first-page":"1471","article-title":"Within-class covariance normalization for SVM-based speaker recognition","author":"hatch","year":"2006","journal-title":"Proc Int Conf Spoken Lang Process"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2016.7472742"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1017\/CBO9780511996504"},{"key":"ref49","first-page":"55","article-title":"Source normalization for language-independent speaker recognition using i-vectors","author":"mclaren","year":"0","journal-title":"Proc Speaker Recognition Workshop"},{"key":"ref9","first-page":"3006","article-title":"Analysis of mutual duration and noise effects in speaker recognition: Benefits of condition-matched cohort selection in score normalization","author":"nautsch","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1121\/1.1914702"},{"key":"ref45","first-page":"2353","article-title":"Comparison of voice activity detectors for interview speech in NIST speaker recognition evaluation","author":"yu","year":"0","journal-title":"Proc 12th Ann Conf Int Speech Commun Assoc"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1145\/1961189.1961199"},{"key":"ref47","first-page":"213","article-title":"Feature warping for robust speaker verification","author":"pelecanos","year":"2001","journal-title":"Proc Speaker Recognition Workshop"},{"key":"ref42","first-page":"625","article-title":"Why does unsupervised pre-training help deep learning","volume":"11","author":"erhan","year":"2010","journal-title":"J Mach Learn Res"},{"key":"ref41","first-page":"25","article-title":"Mixture of PLDA models in i-vector space for gender-independent speaker recognition","author":"senoussaoui","year":"0","journal-title":"Proc 12th Ann Conf Int Speech Commun Assoc"},{"key":"ref44","article-title":"The NIST year 2012 speaker recognition evaluation plan","year":"2012"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1109\/APSIPA.2015.7415337"}],"container-title":["IEEE\/ACM Transactions on Audio, Speech, and Language Processing"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6570655\/7933016\/07894162.pdf?arnumber=7894162","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,23]],"date-time":"2024-06-23T13:38:59Z","timestamp":1719149939000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7894162\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2017,6]]},"references-count":50,"journal-issue":{"issue":"6"},"URL":"https:\/\/doi.org\/10.1109\/taslp.2017.2692304","relation":{},"ISSN":["2329-9290","2329-9304"],"issn-type":[{"value":"2329-9290","type":"print"},{"value":"2329-9304","type":"electronic"}],"subject":[],"published":{"date-parts":[[2017,6]]}}}