{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,1,11]],"date-time":"2024-01-11T23:58:23Z","timestamp":1705017503520},"reference-count":30,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"7","license":[{"start":{"date-parts":[[2008,11,1]],"date-time":"2008-11-01T00:00:00Z","timestamp":1225497600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Multimedia"],"published-print":{"date-parts":[[2008,11]]},"DOI":"10.1109\/tmm.2008.2004908","type":"journal-article","created":{"date-parts":[[2008,11,12]],"date-time":"2008-11-12T20:38:11Z","timestamp":1226522291000},"page":"1299-1306","source":"Crossref","is-referenced-by-count":9,"title":["Real-Time Continuous Phoneme Recognition System Using Class-Dependent Tied-Mixture HMM With HBT Structure for Speech-Driven Lip-Sync"],"prefix":"10.1109","volume":"10","author":[{"family":"Junho Park","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"family":"Hanseok Ko","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1142\/S0218001406005113"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1998.674466"},{"key":"ref11","first-page":"429","article-title":"modeling phonetic context using head-body-tail models for connected digit recognition","author":"strum","year":"2000","journal-title":"Proc ICSLP"},{"key":"ref12","first-page":"1583","article-title":"a new state-dependent phonetic tied-mixture model with head-body-tail structured hmm for real-time continuous phoneme recognition system","author":"park","year":"2006","journal-title":"Proc INTERSPEECH"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/5.664274"},{"key":"ref14","first-page":"352","article-title":"real-time lip-sync face animation driven by human voice","author":"huang","year":"1998","journal-title":"Proc IEEE Workshop on Multimedia Signal Processing"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1145\/311535.311537"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/CONTEL.2005.185904"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1023\/A:1011171430700"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/JPROC.2003.817141"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/TMM.2006.888009"},{"key":"ref28","author":"young","year":"2002","journal-title":"HTK Book\/Tech Rep"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1016\/S0167-6393(98)00054-5"},{"key":"ref27","first-page":"1453","article-title":"audiovisual speech synthesis from ground truth to models","author":"bailly","year":"2002","journal-title":"Proc ICSLP"},{"key":"ref3","first-page":"221","article-title":"visual speech synthesis based on parameter generation from hmm: speech driven and text-and-speech driven approaches","author":"tamura","year":"1998","journal-title":"Proc AVSP 98"},{"key":"ref6","first-page":"36","article-title":"lip movements synthesis using time delay neural networks","author":"curinga","year":"1996","journal-title":"Proc EUSIPCO 96Systems and Computers"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1016\/j.sigpro.2006.02.038"},{"key":"ref5","first-page":"195","article-title":"real-time talking head driven by voice and its application to communication and entertainment","author":"morishima","year":"1998","journal-title":"Proc AVSP 98"},{"key":"ref8","first-page":"299","article-title":"achieving real-time lip synch via svm-based phoneme classification and lip shape refinement","author":"kim","year":"2002","journal-title":"Proc ICMI'02"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1002\/vis.4340020404"},{"key":"ref2","doi-asserted-by":"crossref","first-page":"225","DOI":"10.1145\/259081.259312","article-title":"lip synchronization for animation","author":"mcallister","year":"1997","journal-title":"Proc Siggraph 97"},{"key":"ref9","first-page":"439","article-title":"minimum error rate training of inter-word context-dependent acoustic model units in speech recognition","author":"chou","year":"1994","journal-title":"Proc ICSLP"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/ACSSC.1994.471519"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/29.1486"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1121\/1.1909864"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1983.1171971"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1016\/j.specom.2005.10.001"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/29.61531"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1007\/978-4-431-66911-1_13"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1016\/S0167-6393(99)00013-8"}],"container-title":["IEEE Transactions on Multimedia"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx5\/6046\/4674662\/04668497.pdf?arnumber=4668497","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,11,29]],"date-time":"2021-11-29T20:49:42Z","timestamp":1638218982000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/4668497\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2008,11]]},"references-count":30,"journal-issue":{"issue":"7"},"URL":"https:\/\/doi.org\/10.1109\/tmm.2008.2004908","relation":{},"ISSN":["1520-9210","1941-0077"],"issn-type":[{"value":"1520-9210","type":"print"},{"value":"1941-0077","type":"electronic"}],"subject":[],"published":{"date-parts":[[2008,11]]}}}