{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,10,12]],"date-time":"2025-10-12T04:57:21Z","timestamp":1760245041993,"version":"3.28.0"},"reference-count":38,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2017,3]]},"DOI":"10.1109\/icassp.2017.7953111","type":"proceedings-article","created":{"date-parts":[[2017,6,20]],"date-time":"2017-06-20T17:35:36Z","timestamp":1497980136000},"page":"5015-5019","source":"Crossref","is-referenced-by-count":8,"title":["Joint optimisation of tandem systems using Gaussian mixture density neural network discriminative sequence training"],"prefix":"10.1109","author":[{"given":"C.","family":"Zhang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"P. C.","family":"Woodland","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref38","article-title":"The HTK Book (for HTK version 3.5)","author":"young","year":"2015","journal-title":"Cambridge University Engineering Department"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.21236\/ADA188529"},{"key":"ref32","article-title":"A novel loss function for the overall risk criterion based discriminative training of HMM models","author":"kaiser","year":"2000","journal-title":"Proc INTERSPEECH"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.3115\/1075812.1075885"},{"journal-title":"Model-based Techniques for Robust Speech Recognition","year":"1995","author":"gales","key":"ref30"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2016.7472689"},{"key":"ref36","article-title":"The MGB challenge: Evaluating multi-genre broadcast media transcription","author":"bell","year":"2015","journal-title":"Proc ASRU"},{"journal-title":"Statistical Language Models Based on Neural Networks","year":"2012","author":"mikolov","key":"ref35"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/18.61108"},{"key":"ref10","doi-asserted-by":"crossref","first-page":"171","DOI":"10.1006\/csla.1995.0010","article-title":"Maximum likelihood linear regression for speaker adaptation of continuous density hidden Markov models","volume":"9","author":"leggetter","year":"1995","journal-title":"Computer Speech and Language"},{"key":"ref11","doi-asserted-by":"crossref","first-page":"291","DOI":"10.1109\/89.279278","article-title":"Maximum a posteriori estimation for multivariate Gaussian mixture observations of Markov chains","volume":"2","author":"gauvain","year":"1994","journal-title":"IEEE Transactions on Speech and Audio Processing"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2013.6707719"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638967"},{"key":"ref14","article-title":"The Cambridge University 2014 BOLT conversational telephone Mandarin Chinese LVCSR system for speech translation","author":"liu","year":"2015","journal-title":"Proc INTERSPEECH"},{"key":"ref15","article-title":"Joint decoding of tandem and hybrid systems for improved keyword spotting on low resource languages","author":"wang","year":"2015","journal-title":"Proc INTERSPEECH"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2015.7404856"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2002.1005687"},{"journal-title":"Discriminative training for large vocabulary speech recognition","year":"2003","author":"povey","key":"ref18"},{"key":"ref19","article-title":"Hypothesis spaces for minimum Bayes risk training in large vocabulary speech recognition","author":"gibson","year":"2006","journal-title":"Proc ICASSP"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1145\/77626.79170"},{"journal-title":"Connectionist Speech Recognition A Hybrid Approach","year":"1993","author":"bourlard","key":"ref4"},{"key":"ref27","article-title":"Lattice-based training of bottleneck feature extraction neural networks","author":"paulik","year":"2013","journal-title":"Proc INTERSPEECH"},{"key":"ref3","article-title":"Context-dependent MLP for LVCSR: Tandem, hybrid or both?","author":"t\u00fcske","year":"2012","journal-title":"Proc INTERSPEECH"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2134090"},{"key":"ref29","article-title":"A general artificial neural network extension for HTK","author":"zhang","year":"2015","journal-title":"Proc INTERSPEECH"},{"key":"ref5","article-title":"Conversational speech transcription using context-dependent deep neural networks","author":"seide","year":"2011","journal-title":"Proc INTERSPEECH"},{"journal-title":"Pattern Recognition and Machine Learning","year":"2006","author":"bishop","key":"ref8"},{"key":"ref7","first-page":"2","article-title":"Deep neural networks for acoustic modelling in speech recognition","author":"hinton","year":"2012","journal-title":"IEEE Signal Processing Magazine"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2007.367023"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2014.6854674"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2000.862024"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2007.366914"},{"key":"ref22","article-title":"Rectified linear units improve restricted Boltzmann machines","author":"nair","year":"2010","journal-title":"Proc ICML"},{"key":"ref21","article-title":"Boosted MMI for model and feature-space discriminative training","author":"povey","year":"2008","journal-title":"Proc ICASSP"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2015.7178776"},{"key":"ref23","article-title":"Deep sparse rectifier networks","author":"glorot","year":"2011","journal-title":"Proc AISTATS"},{"key":"ref26","article-title":"Speaker adaptive joint training of Gaussian mixture models and bottleneck features","author":"t\u00fcske","year":"2015","journal-title":"Proc ICASSP"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2015.7178779"}],"event":{"name":"2017 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","start":{"date-parts":[[2017,3,5]]},"location":"New Orleans, LA","end":{"date-parts":[[2017,3,9]]}},"container-title":["2017 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7943262\/7951776\/07953111.pdf?arnumber=7953111","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,26]],"date-time":"2019-09-26T07:26:29Z","timestamp":1569482789000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7953111\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2017,3]]},"references-count":38,"URL":"https:\/\/doi.org\/10.1109\/icassp.2017.7953111","relation":{},"subject":[],"published":{"date-parts":[[2017,3]]}}}