{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,10,23]],"date-time":"2024-10-23T09:57:45Z","timestamp":1729677465711,"version":"3.28.0"},"reference-count":29,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2016,3]]},"DOI":"10.1109\/icassp.2016.7472746","type":"proceedings-article","created":{"date-parts":[[2016,6,24]],"date-time":"2016-06-24T01:58:30Z","timestamp":1466733510000},"page":"5585-5589","source":"Crossref","is-referenced-by-count":1,"title":["Investigation of speaker embeddings for cross-show speaker diarization"],"prefix":"10.1109","author":[{"given":"Michael","family":"Rouvier","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Benoit","family":"Favre","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4409052"},{"key":"ref11","article-title":"Variance-spectra based normalization for i-vector standard and probabilistic linear discriminant analysis","author":"pierre-michel","year":"2012","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref12","article-title":"An open-source state-of-the-art toolbox for broadcast news diarization","author":"mickael","year":"2013","journal-title":"InterSpeech"},{"key":"ref13","article-title":"A global optimization framework for speaker diarization","author":"mickael","year":"2012","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref14","article-title":"The repere corpus: a multimodal corpus for person recognition","author":"aude","year":"2012","journal-title":"Proc Language Resources Evaluation Conf (LREC)"},{"key":"ref15","article-title":"Corpus description of the ester evaluation campaign for the rich transcription of french broadcast news","author":"sylvain","year":"2006","journal-title":"Proc Language Resources Evaluation Conf (LREC)"},{"key":"ref16","article-title":"The ester 2 evaluation campaign for the rich transcription of french radio broadcasts","author":"sylvain","year":"2009","journal-title":"InterSpeech"},{"key":"ref17","article-title":"The epac corpus: Manual and automatic annotations of conversational speech in french broadcast news","author":"yannick","year":"2010","journal-title":"Proc Language Resources Evaluation Conf (LREC)"},{"key":"ref18","article-title":"The etape corpus for the evaluation of speech-based tv content processing in the french language","author":"guillaume","year":"2012","journal-title":"Proc Language Resources Evaluation Conf (LREC)"},{"key":"ref19","first-page":"43","article-title":"The first official repere evaluation","author":"olivier","year":"2013","journal-title":"SLAM"},{"key":"ref28","article-title":"Fast single-and cross-show speaker diarization using binary key speaker modeling","author":"hector","year":"2015","journal-title":"IEEE Transactions on Audio Speech and Language Processing"},{"key":"ref4","article-title":"Front-end factor analysis for speaker verification","author":"najim","year":"2011","journal-title":"IEEE Transactions on Audio Speech and Language Processing"},{"key":"ref27","article-title":"Recent improvements on ilp-based clustering for broadcast news speaker diarization","author":"gr\u00e9gor","year":"2014","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref3","article-title":"Bayesian speaker verification with heavy-tailed priors","author":"patrick","year":"2010","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref6","article-title":"Duration mismatch compensation for i-vector based speaker recognition systems","author":"taufiq","year":"2013","journal-title":"Int Conference on Acoustics Speech and Signal Processing (ICASSP)"},{"key":"ref29","article-title":"A novel scheme for speaker recognition using a phonetically-aware deep neural network","author":"yun","year":"2014","journal-title":"Int Conference on Acoustics Speech and Signal Processing (ICASSP)"},{"key":"ref5","article-title":"Plda for speaker verification with utterances of arbitrary duration","author":"patrick","year":"2013","journal-title":"Int Conference on Acoustics Speech and Signal Processing (ICASSP)"},{"key":"ref8","doi-asserted-by":"crossref","DOI":"10.21437\/Odyssey.2014-36","article-title":"Incorporating duration information into i-vector-based speaker-recognition systems","author":"vesnicer","year":"2014","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref7","article-title":"Short-duration speaker modelling with phone adaptive training","author":"giovanni","year":"2014","journal-title":"Odyssey The Speaker and Language Recognition Workshop"},{"key":"ref2","article-title":"I-vectors and ilp clustering adapted to cross-show speaker diarization","author":"gr\u00e9gor","year":"2012","journal-title":"InterSpeech"},{"key":"ref9","article-title":"Speaker diarization through speaker embeddings","author":"mickael","year":"2015","journal-title":"European Signal Processing Conference (EUSIPCO)"},{"key":"ref1","article-title":"Comparing multi-stage approaches for cross-show speaker diarization","author":"viet-anh","year":"2011","journal-title":"InterSpeech"},{"key":"ref20","article-title":"The kaldi speech recognition toolkit","author":"daniel","year":"2011","journal-title":"Automatic Speech Recognition and Understanding (ASRU)"},{"key":"ref22","article-title":"Non directly acoustic process for costless speaker recognition and indexation","author":"teva","year":"1999","journal-title":"Intelligent Communication Technologies and Applications"},{"key":"ref21","article-title":"Visualizing higher-layer features of a deep network","volume":"4323","author":"dumitru","year":"2009","journal-title":"Dept IRO Universit&#x00E9; de Montr&#x00E9;al Tech Rep"},{"key":"ref24","article-title":"Learning deep face representation","author":"haoqiang","year":"2014","journal-title":"ArXiv Preprint arXiv 1403 2802"},{"key":"ref23","article-title":"Speaker identification by location in an optimal space of anchor models","author":"yassine","year":"2002","journal-title":"International Conference on Spoken Language Processing (ICSLP)"},{"key":"ref26","article-title":"Phone recognition with the mean-covariance restricted boltzmann machine","author":"george","year":"2010","journal-title":"Advances in neural information processing systems"},{"key":"ref25","article-title":"Word representations: a simple and general method for semi-supervised learning","author":"joseph","year":"2010","journal-title":"Association for Computational Linguistics"}],"event":{"name":"2016 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","start":{"date-parts":[[2016,3,20]]},"location":"Shanghai","end":{"date-parts":[[2016,3,25]]}},"container-title":["2016 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7465907\/7471614\/07472746.pdf?arnumber=7472746","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,17]],"date-time":"2024-06-17T21:25:14Z","timestamp":1718659514000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7472746\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,3]]},"references-count":29,"URL":"https:\/\/doi.org\/10.1109\/icassp.2016.7472746","relation":{},"subject":[],"published":{"date-parts":[[2016,3]]}}}