{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,10,22]],"date-time":"2024-10-22T16:57:40Z","timestamp":1729616260217,"version":"3.28.0"},"reference-count":24,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2015,10]]},"DOI":"10.1109\/sped.2015.7343105","type":"proceedings-article","created":{"date-parts":[[2015,12,3]],"date-time":"2015-12-03T21:11:55Z","timestamp":1449177115000},"page":"1-6","source":"Crossref","is-referenced-by-count":1,"title":["Phonetic segmentation of speech using STEP and t-SNE"],"prefix":"10.1109","author":[{"given":"Adriana","family":"Stan","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Cassia","family":"Valentini-Botinhao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mircea","family":"Giurgiu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Simon","family":"King","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"crossref","DOI":"10.21437\/Interspeech.2006-230","article-title":"On the relation between maximum spectral transition positions and phone boundaries","author":"dusan","year":"2006","journal-title":"Proc INTERSPEECH"},{"key":"ref11","first-page":"2292","article-title":"Acoustic segmentation of speech using zero time liftering (ZTL)","author":"prasad","year":"2013","journal-title":"Proc INTERSPEECH"},{"key":"ref12","first-page":"2302","article-title":"Combination of auditory attention features with phone posteriors for better automatic phoneme segmentation","author":"kalinli","year":"2013","journal-title":"Proc of Intersneech"},{"article-title":"DARPA TIMIT Acoustic Phonetic Continuous Speech Corpus CDROM","year":"1993","author":"garofolo","key":"ref13"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1007\/978-0-387-30164-8"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/S0095-4470(03)00013-5"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1121\/1.2166600"},{"key":"ref17","doi-asserted-by":"crossref","first-page":"1837","DOI":"10.21437\/Interspeech.2011-42","article-title":"Can objective measures predict the intelligibility of modified HMM -based synthetic speech in noise?","author":"valentini-botinhao","year":"2011","journal-title":"Proc INTERSPEECH"},{"key":"ref18","first-page":"335","article-title":"A revision of Zwicker's loudness model","volume":"82","author":"moore","year":"1996","journal-title":"Acta Acustica"},{"key":"ref19","first-page":"2579","article-title":"Visualizing High-Dimensional Data Using T-SNE","volume":"9","author":"van der maaten","year":"2008","journal-title":"Journal of Machine Learning Research"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2014.6854665"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1016\/0167-6393(93)90083-W"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1007\/s10772-009-9038-4"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TSA.2003.813579"},{"key":"ref8","article-title":"Automatic phoneme segmentation using auditory attention features","author":"kalinli","year":"2012","journal-title":"Proc of Intersneech"},{"key":"ref7","doi-asserted-by":"crossref","DOI":"10.21437\/Interspeech.2012-601","article-title":"Toward an optimum feature set and HMM model parameters for automatic phonetic alignment of spontaneous speech","author":"karnjanadecha","year":"2012","journal-title":"Proc INTERSPEECH"},{"key":"ref2","doi-asserted-by":"crossref","first-page":"454","DOI":"10.21437\/Interspeech.2010-196","article-title":"Comparison of HMM and TMDN methods for lip synchronisation","author":"hofer","year":"2010","journal-title":"Proc INTERSPEECH"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1016\/j.specom.2008.11.003"},{"key":"ref9","doi-asserted-by":"crossref","first-page":"429","DOI":"10.21437\/Interspeech.2011-167","article-title":"Exploiting phone-class specific landmarks for refinement of segment boundaries in TTS databases","author":"peddinti","year":"2011","journal-title":"Proc INTERSPEECH"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1007\/s10994-011-5273-4"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.5772\/17600"},{"key":"ref21","first-page":"833","article-title":"Stochastic neighbor embedding","volume":"15","author":"hinton","year":"2003","journal-title":"Advances in neural information processing systems"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1016\/S0167-6393(98)00085-5"},{"key":"ref23","first-page":"2306","article-title":"Automatic phonetic segmentation using boundary models","author":"yuan","year":"2013","journal-title":"Proc of Intersneech"}],"event":{"name":"2015 International Conference on Speech Technology and Human-Computer Dialogue (SpeD)","start":{"date-parts":[[2015,10,14]]},"location":"Bucharest, Romania","end":{"date-parts":[[2015,10,17]]}},"container-title":["2015 International Conference on Speech Technology and Human-Computer Dialogue (SpeD)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7332342\/7343073\/07343105.pdf?arnumber=7343105","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,5,28]],"date-time":"2022-05-28T05:19:56Z","timestamp":1653715196000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7343105\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2015,10]]},"references-count":24,"URL":"https:\/\/doi.org\/10.1109\/sped.2015.7343105","relation":{},"subject":[],"published":{"date-parts":[[2015,10]]}}}