{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,1]],"date-time":"2025-06-01T04:14:08Z","timestamp":1748751248955,"version":"3.41.0"},"reference-count":20,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2015,8]]},"DOI":"10.1109\/eusipco.2015.7362751","type":"proceedings-article","created":{"date-parts":[[2015,12,28]],"date-time":"2015-12-28T21:30:25Z","timestamp":1451338225000},"page":"2082-2086","source":"Crossref","is-referenced-by-count":17,"title":["Speaker diarization through speaker embeddings"],"prefix":"10.1109","author":[{"given":"Mickael","family":"Rouvier","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Pierre-Michel","family":"Bousquet","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Benoit","family":"Favre","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","article-title":"Word representations: a simple and general method for semi-supervised learning","author":"turian","year":"2010","journal-title":"Association for Computational Linguistics"},{"key":"ref11","article-title":"Phone recognition with the mean-covariance restricted boltzmann machine","author":"dahl","year":"2010","journal-title":"Advances in neural information processing systems"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4409052"},{"key":"ref13","doi-asserted-by":"crossref","DOI":"10.21437\/Interspeech.2009-385","article-title":"Support vector machines versus fast scoring in the low-dimensional total variability space for speaker verification","author":"dehak","year":"2009","journal-title":"InterSpeech"},{"key":"ref14","doi-asserted-by":"crossref","DOI":"10.21437\/Interspeech.2011-53","article-title":"Analysis of i-vector length normalization in speaker recognition systems","author":"garcia-romero","year":"2011","journal-title":"InterSpeech"},{"key":"ref15","article-title":"Variance-spectra based normalization for i-vector standard and probabilistic linear discriminant analysis","author":"bousquet","year":"2012","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref16","doi-asserted-by":"crossref","DOI":"10.21437\/Interspeech.2013-383","article-title":"An open-source state-of-the-art toolbox for broadcast news diarization","author":"rouvier","year":"2013","journal-title":"InterSpeech"},{"key":"ref17","article-title":"A global optimization framework for speaker diarization","author":"rouvier","year":"2012","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref18","article-title":"The etape corpus for the evaluation of speech-based tv content processing in the french language","author":"gravier","year":"2012","journal-title":"Proc Language Resources Evaluation Conf (LREC)"},{"key":"ref19","first-page":"43","article-title":"The first official repere evaluation","author":"galibert","year":"2013","journal-title":"SLAM INTERSPEECH"},{"key":"ref4","article-title":"Duration mismatch compensation for i-vector based speaker recognition systems","author":"taufiq","year":"2013","journal-title":"Int Conference on Acoustics Speech and Signal Processing (ICASSP)"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6639151"},{"key":"ref6","doi-asserted-by":"crossref","DOI":"10.21437\/Odyssey.2014-36","article-title":"In-corporating duration information into i-vector-based speaker-recognition systems","author":"vesnicer","year":"2014","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref5","doi-asserted-by":"crossref","DOI":"10.21437\/Odyssey.2014-32","article-title":"Short-duration speaker modelling with phone adaptive training","author":"soldi","year":"2014","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref8","doi-asserted-by":"crossref","DOI":"10.21437\/ICSLP.2002-406","article-title":"Speaker identification by location in an optimal space of anchor models","author":"mami","year":"2002","journal-title":"International Conference on Spoken Language Processing (ICSLP)"},{"key":"ref7","article-title":"Non directly acoustic process for costless speaker recognition and indexation","author":"merlin","year":"1999","journal-title":"Intelligent Communication Technologies and Applications"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2010.2064307"},{"key":"ref1","article-title":"Bayesian speaker verification with heavy-tailed priors","author":"kenny","year":"2010","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref9","article-title":"Learning deep face representation","author":"fan","year":"2014","journal-title":"ArXiv Preprint arXiv 1403 2802"},{"key":"ref20","article-title":"The kaldi speech recognition toolkit","author":"povey","year":"2011","journal-title":"Automatic Speech Recognition and Understanding (ASRU)"}],"event":{"name":"2015 23rd European Signal Processing Conference (EUSIPCO)","start":{"date-parts":[[2015,8,31]]},"location":"Nice","end":{"date-parts":[[2015,9,4]]}},"container-title":["2015 23rd European Signal Processing Conference (EUSIPCO)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7362053\/7362087\/07362751.pdf?arnumber=7362751","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,5,31]],"date-time":"2025-05-31T23:15:20Z","timestamp":1748733320000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7362751\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2015,8]]},"references-count":20,"URL":"https:\/\/doi.org\/10.1109\/eusipco.2015.7362751","relation":{},"subject":[],"published":{"date-parts":[[2015,8]]}}}