{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,3,25]],"date-time":"2025-03-25T14:56:14Z","timestamp":1742914574643,"version":"3.40.3"},"publisher-location":"Berlin, Heidelberg","reference-count":21,"publisher":"Springer Berlin Heidelberg","isbn-type":[{"type":"print","value":"9783540877332"},{"type":"electronic","value":"9783540877349"}],"license":[{"start":{"date-parts":[[2008,1,1]],"date-time":"2008-01-01T00:00:00Z","timestamp":1199145600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2008,1,1]],"date-time":"2008-01-01T00:00:00Z","timestamp":1199145600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2008]]},"DOI":"10.1007\/978-3-540-87734-9_94","type":"book-chapter","created":{"date-parts":[[2008,8,31]],"date-time":"2008-08-31T06:03:30Z","timestamp":1220162610000},"page":"830-839","source":"Crossref","is-referenced-by-count":0,"title":["Using the Tandem Approach for AF Classification in an AVSR System"],"prefix":"10.1007","author":[{"given":"Tian","family":"Gan","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wolfgang","family":"Menzel","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jianwei","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","reference":[{"key":"94_CR1","first-page":"265","volume-title":"IEEE Conference on Computer Vision and Pattern Recognition","author":"E.D. Petajan","year":"1985","unstructured":"Petajan, E.D.: Automatic Lipreading to Enhance Speech Recognition. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 265\u2013272. IEEE Press, San Francisco (1985)"},{"key":"94_CR2","first-page":"356","volume-title":"Issues in Visual and Audio-Visual Speech Processing","author":"G. Potamianos","year":"2004","unstructured":"Potamianos, G., Neti, L.J., Matthews, I.: Audio-Visual Automatic Speech Recognition: An Overview. In: Bailly, G., Vatikiotis-Bateson, E., Perrier, P. (eds.) Issues in Visual and Audio-Visual Speech Processing, pp. 356\u2013396. MIT Press, Cambridge (2004)"},{"key":"94_CR3","unstructured":"Watson, R.: A Survey of Gesture Recognition Techniques. Technical report, Trinity College Dublin (1993)"},{"key":"94_CR4","doi-asserted-by":"publisher","first-page":"259","DOI":"10.1016\/S0031-3203(02)00052-3","volume":"36","author":"B. Fasel","year":"2003","unstructured":"Fasel, B., Luettin, J.: Automatic Facial Expression Analysis: A Survey. J. Pat. Rec.\u00a036, 259\u2013275 (2003)","journal-title":"J. Pat. Rec."},{"key":"94_CR5","unstructured":"Kirchhoff, K.: Robust Speech Recognition Using Articulatory Information. PhD Thesis, University of Bielefeld (1999)"},{"key":"94_CR6","doi-asserted-by":"crossref","unstructured":"Abu-Amer, T., Carson-Berndsen, J.: HARTFEX: A Multi-Dimensional System of HMM Based Recognizers for Articulatory Feature Extraction. In: 8th European Conference on Speech Communication and Technology, Geneva, Switzerland, pp. 2541\u20132544 (2003)","DOI":"10.21437\/Eurospeech.2003-696"},{"key":"94_CR7","doi-asserted-by":"publisher","first-page":"688","DOI":"10.1121\/1.403994","volume":"92","author":"J. Papcun","year":"1992","unstructured":"Papcun, J., Hochberg, J., Thomas, T.R., Laroche, F., Zacks, J., Levy, S.: Inferring Articulation and Recognizing Gestures from Acoustics with A Neural Network Trained on X-ray Microbeam Data. J. Acoust. Soc. Am.\u00a092, 688\u2013700 (1992)","journal-title":"J. Acoust. Soc. Am."},{"key":"94_CR8","doi-asserted-by":"publisher","first-page":"189","DOI":"10.1006\/csla.1994.1009","volume":"8","author":"J. Zacks","year":"1994","unstructured":"Zacks, J., Thomas, T.R.: A new Neural Network for Articulatory Speech Recognition and Its Application to Vowel Identification. J. Com. Sp. Lan.\u00a08, 189\u2013209 (1994)","journal-title":"J. Com. Sp. Lan."},{"key":"94_CR9","doi-asserted-by":"crossref","unstructured":"Frankel, J., King, S.: ASR - Articulatory Speech Recognition. In: 7th European Conference on Speech Communication and Technology, Scandinavia, Aalborg, pp. 599\u2013602 (2003)","DOI":"10.21437\/Eurospeech.2001-159"},{"key":"94_CR10","doi-asserted-by":"publisher","first-page":"483","DOI":"10.1109\/ICASSP.1993.319347","volume-title":"18th International Conference on Acoustics Speech and Signal Processing","author":"E. Eide","year":"1993","unstructured":"Eide, E., Rohlicek, J.R., Gish, H., Mitter, S.: A Linguistic Feature Representation of the Speech Waveform. In: 18th International Conference on Acoustics Speech and Signal Processing, pp. 483\u2013486. IEEE Press, Minneapolis (1993)"},{"key":"94_CR11","first-page":"193","volume-title":"International Conference on Acoustics Speech and Signal Processing","author":"L. Deng","year":"1991","unstructured":"Deng, L., Erler, K.: Microstructural Speech Units and Their HMM Representations for Discrete Utterance Speech Recognition. In: International Conference on Acoustics Speech and Signal Processing, pp. 193\u2013196. IEEE Press, Washington (1991)"},{"key":"94_CR12","first-page":"137","volume-title":"7th International Coference on Auditory-Visual Speech Processing","author":"T. Gan","year":"2007","unstructured":"Gan, T., Menzel, W.: An Audio Visual Speech Recognition Framework Based on Articulatory Features. In: 7th International Coference on Auditory-Visual Speech Processing, pp. 137\u2013141. Tilburg University, Tilburg (2007)"},{"key":"94_CR13","doi-asserted-by":"crossref","unstructured":"Hennecke, M.E., Stork, D.G., Prasad, K.V.: Visionary Speech: Looking ahead to Practical Speechreading Systems. J. Spe. Hum. Mach., 331\u2013349 (1996)","DOI":"10.1007\/978-3-662-13015-5_25"},{"key":"94_CR14","unstructured":"Luettin, J.: Visual Speech and Speaker Recognition. PhD thesis, University of Sheffeld (1997)"},{"key":"94_CR15","first-page":"621","volume-title":"32nd IEEE International Conference on Acoustics Speech and Signal Processing","author":"K. Livescu","year":"2007","unstructured":"Livescu, K., Cetin, O., Johnson, M.H., King, S., Bartels, C., Borges, N., Kantor, A., Lal, P., Yung, L., Bezman, A., Haggerty, S.D., Woods, B., Frankel, J., Doss, M.M., Saenko, K.: Articulatory Feature-based Methods for Acoustic and Audio-Visual Speech Recognition: JHU Summer Workshop Final Report. In: 32nd IEEE International Conference on Acoustics Speech and Signal Processing, pp. 621\u2013624. IEEE Press, Honolulu (2007)"},{"key":"94_CR16","doi-asserted-by":"publisher","first-page":"152","DOI":"10.1145\/1027933.1027960","volume-title":"6th International Conference on Multimodal Interfaces","author":"K. Saenko","year":"2004","unstructured":"Saenko, K., Darrell, T., Glass, J.: Articulatory Features for Robust Visual Speech Recognition. In: 6th International Conference on Multimodal Interfaces, pp. 152\u2013158. ACM, New York (2004)"},{"key":"94_CR17","doi-asserted-by":"publisher","first-page":"449","DOI":"10.1016\/j.dsp.2004.05.001","volume":"14","author":"C. Sanderson","year":"2004","unstructured":"Sanderson, C., Paliwal, K.K.: Identity Verification Using Speech and Face Information. J. Dig. Sig. Proc.\u00a014, 449\u2013480 (2004)","journal-title":"J. Dig. Sig. Proc."},{"key":"94_CR18","first-page":"1635","volume-title":"25th International Conference on Acoustics Speech and Signal Processing","author":"H. Hermansky","year":"2000","unstructured":"Hermansky, H., Ellis, D.I.W., Shamza, S.: Tandem Connectionist Feature Extraction for Conventional HMM Systems. In: 25th International Conference on Acoustics Speech and Signal Processing, pp. 1635\u20131638. IEEE Press, Istanbul (2000)"},{"key":"94_CR19","doi-asserted-by":"crossref","unstructured":"Hermansky, H., Morgan, N., Bayya, A., Kohn, P.: RASTA-PLP Speech Analysis Technique. In: Proceedings of the International Conference Acoustics Speech Signal Processing, San Francisco, California, pp. 1121\u20131124 (1991)","DOI":"10.1109\/ICASSP.1992.225957"},{"key":"94_CR20","unstructured":"Fisher, W.M., Doddington, G.R., Goudie-Marshall, K.M.: The DARPA Speech Recognition Research Database: Specifications and Status. In: The DARPA Speech Recognition Workshop, Palo Alto, Canada, pp. 93\u201399 (1986)"},{"key":"94_CR21","doi-asserted-by":"publisher","first-page":"137","DOI":"10.1023\/B:VISI.0000013087.49260.fb","volume":"57","author":"P. Viola","year":"2004","unstructured":"Viola, P., Jones, M.: Robust Real-Time Face Detection. J. Com. Vis.\u00a057, 137\u2013154 (2004)","journal-title":"J. Com. Vis."}],"container-title":["Lecture Notes in Computer Science","Advances in Neural Networks - ISNN 2008"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-540-87734-9_94","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,1,31]],"date-time":"2025-01-31T19:23:05Z","timestamp":1738351385000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-540-87734-9_94"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2008]]},"ISBN":["9783540877332","9783540877349"],"references-count":21,"URL":"https:\/\/doi.org\/10.1007\/978-3-540-87734-9_94","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2008]]}}}