{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,7,27]],"date-time":"2025-07-27T07:44:42Z","timestamp":1753602282668,"version":"3.28.0"},"reference-count":25,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2021,1,24]]},"DOI":"10.1109\/iscslp49672.2021.9362084","type":"proceedings-article","created":{"date-parts":[[2021,3,1]],"date-time":"2021-03-01T23:37:05Z","timestamp":1614641825000},"page":"1-5","source":"Crossref","is-referenced-by-count":3,"title":["Age-Invariant Speaker Embedding for Diarization of Cognitive Assessments"],"prefix":"10.1109","author":[{"given":"Sean Shensheng","family":"Xu","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Man-Wai","family":"Mak","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ka Ho","family":"Wong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Helen","family":"Meng","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Timothy C. Y.","family":"Kwok","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","first-page":"6799","article-title":"Frame-level phoneme-invariant speaker embedding for text-independent speaker recognition on extremely short utterances","author":"tawara","year":"2020","journal-title":"Proc ICASSP"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1145\/3123266.3123338"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2125954"},{"key":"ref13","first-page":"2096","article-title":"Domain-adversarial training of neural networks","volume":"17","author":"ganin","year":"2016","journal-title":"The Journal of Machine Learning Research"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2020.3004760"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4409052"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1017\/9781108552332"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1007\/b107408"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/34.868688"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2017.7953152"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.2174\/1567205014666170829111942"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1002\/1099-1166(200011)15:11<1021::AID-GPS234>3.0.CO;2-6"},{"key":"ref6","first-page":"5554","article-title":"Single channel target speaker extraction and recognition with speakerbeam","author":"delcroix","year":"0","journal-title":"Proc ICASSP2018"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1049\/el.2019.1228"},{"key":"ref8","doi-asserted-by":"crossref","first-page":"999","DOI":"10.21437\/Interspeech.2017-620","article-title":"Deep neural network embeddings for text-independent speaker verification","author":"snyder","year":"2017","journal-title":"Proc INTERSPEECH"},{"key":"ref7","first-page":"4930","article-title":"Speaker diarization using deep neural network embeddings","author":"garcia-romero","year":"2017","journal-title":"Proc ICASSP"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1111\/j.1532-5415.1992.tb01992.x"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2018-1158"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1111\/j.1532-5415.2005.53221.x"},{"article-title":"Musan: A music, speech, and noise corpus","year":"2015","author":"snyder","key":"ref20"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2008.2002085"},{"key":"ref21","article-title":"The Kaldi speech recognition toolkit","author":"povey","year":"2011","journal-title":"Proc IEEE Workshop on Automatic Speech Recognition and Understanding"},{"key":"ref24","first-page":"309","article-title":"The rich transcription 2006 spring meeting recognition evaluation","author":"fiscus","year":"1980","journal-title":"5th International Workshop on Machine Learning for Multimodal Interaction"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2019-2813"},{"key":"ref25","first-page":"2579","article-title":"Visualizing data using t-SNE","volume":"9","author":"maaten","year":"2008","journal-title":"J Mach Learn Res"}],"event":{"name":"2021 12th International Symposium on Chinese Spoken Language Processing (ISCSLP)","start":{"date-parts":[[2021,1,24]]},"location":"Hong Kong","end":{"date-parts":[[2021,1,27]]}},"container-title":["2021 12th International Symposium on Chinese Spoken Language Processing (ISCSLP)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/9362048\/9362049\/09362084.pdf?arnumber=9362084","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,3,29]],"date-time":"2021-03-29T22:56:32Z","timestamp":1617058592000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9362084\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,1,24]]},"references-count":25,"URL":"https:\/\/doi.org\/10.1109\/iscslp49672.2021.9362084","relation":{},"subject":[],"published":{"date-parts":[[2021,1,24]]}}}