{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T15:28:47Z","timestamp":1777649327460,"version":"3.51.4"},"reference-count":64,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"4","license":[{"start":{"date-parts":[[2017,4,1]],"date-time":"2017-04-01T00:00:00Z","timestamp":1491004800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"}],"funder":[{"name":"Science and Technology Department of Anhui Province","award":["15CZZ02007"],"award-info":[{"award-number":["15CZZ02007"]}]},{"DOI":"10.13039\/501100002367","name":"Chinese Academy of Sciences","doi-asserted-by":"publisher","award":["XDB02070006"],"award-info":[{"award-number":["XDB02070006"]}],"id":[{"id":"10.13039\/501100002367","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100012166","name":"National Key Research and Development Program","doi-asserted-by":"crossref","award":["2016YFB1001300"],"award-info":[{"award-number":["2016YFB1001300"]}],"id":[{"id":"10.13039\/501100012166","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE\/ACM Trans. Audio Speech Lang. Process."],"published-print":{"date-parts":[[2017,4]]},"DOI":"10.1109\/taslp.2017.2672398","type":"journal-article","created":{"date-parts":[[2017,2,20]],"date-time":"2017-02-20T19:09:34Z","timestamp":1487617774000},"page":"871-884","source":"Crossref","is-referenced-by-count":14,"title":["Nonrecurrent Neural Structure for Long-Term Dependence"],"prefix":"10.1109","volume":"25","author":[{"given":"Shiliang","family":"Zhang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Cong","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hui","family":"Jiang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Si","family":"Wei","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lirong","family":"Dai","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yu","family":"Hu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref39","article-title":"Neural machine translation by jointly learning to align and translate","author":"bahdanau","year":"0","journal-title":"Proc Int Conf on Learning Rep"},{"key":"ref38","doi-asserted-by":"crossref","first-page":"1713","DOI":"10.1109\/TASLP.2014.2346313","article-title":"Fast adaptation of deep neural network based on discriminant codes for speech recognition","volume":"22","author":"xue","year":"2014","journal-title":"IEEE\/ACM Trans Audio Speech Lang Process"},{"key":"ref33","first-page":"2440","article-title":"Reverberation robust acoustic modeling using i-vectors with time delay neural networks","author":"peddinti","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref32","first-page":"3214","article-title":"A time delay neural network architecture for efficient modeling of long temporal contexts","author":"peddinti","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref31","first-page":"343","article-title":"Unfolded recurrent neural networks for speech recognition","author":"saon","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref30","article-title":"Memory networks","author":"weston","year":"2015","journal-title":"Int Conf Learning Rep (ICLR)"},{"key":"ref37","first-page":"2365","article-title":"Restructuring of deep neural network acoustic models with singular value decomposition","author":"xue","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638949"},{"key":"ref35","volume":"2","author":"oppenheim","year":"1989","journal-title":"Discrete-Time Signal Processing"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/29.21701"},{"key":"ref60","article-title":"How to construct deep recurrent neural networks","author":"pascanu","year":"2013","journal-title":"ArXiv Preprint"},{"key":"ref62","article-title":"Character-aware neural language models","author":"kim","year":"2015","journal-title":"CoRR"},{"key":"ref61","article-title":"Recurrent neural network regularization","author":"zaremba","year":"2014","journal-title":"CoRR"},{"key":"ref63","first-page":"641","article-title":"Efficient GPU-based training of recurrent neural network language models using spliced sentence bunch","author":"chen","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref28","article-title":"Empirical evaluation of gated recurrent neural networks on sequence modeling","author":"chung","year":"2014","journal-title":"ArXiv Preprint"},{"key":"ref64","article-title":"Large-scale simple question answering with memory networks","author":"bordes","year":"2015","journal-title":"ArXiv Preprint"},{"key":"ref27","first-page":"338","article-title":"Long short-term memory based recurrent neural network architectures for large vocabulary speech recognition","author":"sak","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref29","article-title":"Neural turing machines","author":"graves","year":"2014","journal-title":"ArXiv Preprint"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2014.09.003"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1038\/nature14539"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/5.58337"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1162\/neco.1997.9.8.1735"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/72.279181"},{"key":"ref24","article-title":"Generating sequences with recurrent neural networks","author":"graves","year":"2013","journal-title":"ArXiv Preprint"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1162\/089976600300015015"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638947"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.3115\/v1\/D14-1179"},{"key":"ref50","article-title":"Discriminative training for large vocabulary speech recognition","author":"povey","year":"2005"},{"key":"ref51","first-page":"2846","article-title":"Investigation of full-sequence training of deep belief networks for speech recognition","author":"mohamed","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref59","first-page":"2440","article-title":"End-to-end memory networks","author":"sukhbaatar","year":"0","journal-title":"Proc Adv Neural Inf Process Syst"},{"key":"ref58","article-title":"Large text compression benchmark","author":"mahoney","year":"2011"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2011.5947611"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.21236\/ADA273556"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.3115\/v1\/P15-2081"},{"key":"ref54","first-page":"1045","article-title":"Recurrent neural network based language model","author":"mikolov","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref53","first-page":"1137","article-title":"A neural probabilistic language model","volume":"3","author":"bengio","year":"2003","journal-title":"J Mach Learning Res"},{"key":"ref52","first-page":"2345","article-title":"Sequence-discriminative training of deep neural networks","author":"vesely","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2014.220"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2012.6288864"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2016.7472618"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6639347"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2013.6707749"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2014.2339736"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2014.08.005"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1016\/0364-0213(90)90002-E"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/78.650093"},{"key":"ref18","first-page":"3104","article-title":"Sequence to sequence learning with neural networks","author":"sutskever","year":"0","journal-title":"Proc Adv Neural Inf Process Syst"},{"key":"ref19","article-title":"Supervised sequence labelling with recurrent neural networks","volume":"385","author":"graves","year":"2012"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/MSP.2012.2205597"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2134090"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1145\/3065386"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/5.726791"},{"key":"ref8","first-page":"1237","article-title":"Flexible, high performance convolutional neural networks for image classification","author":"ciresan","year":"0","journal-title":"Proc Int Joint Conf Artif Intell"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1113\/jphysiol.1962.sp006837"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1986.1169179"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/72.554195"},{"key":"ref46","first-page":"249","article-title":"Understanding the difficulty of training deep feedforward neural networks","author":"glorot","year":"0","journal-title":"Proc Int Conf Artif Intell Statist"},{"key":"ref45","first-page":"2635","article-title":"Rectified linear neural networks with tied-scalar regularization for LVCSR","author":"zhang","year":"0","journal-title":"Proc INTERSPEECH"},{"key":"ref48","article-title":"The kaldi speech recognition toolkit","author":"povey","year":"2011"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638951"},{"key":"ref42","article-title":"Finite impulse response neural networks for autoregressive time series prediction","volume":"xvii","author":"wan","year":"1993"},{"key":"ref41","first-page":"577","article-title":"Attention-based models for speech recognition","author":"chorowski","year":"0","journal-title":"Proc Adv Neural Inf Process Syst"},{"key":"ref44","first-page":"i","article-title":"Minimum phone error and i-smoothing for improved discriminative training","volume":"1","author":"povey","year":"0","journal-title":"Proc IEEE Int Conf Acoust Speech Signal Process"},{"key":"ref43","first-page":"243","article-title":"Neural net architectures for temporal sequence processing","volume":"15","author":"mozer","year":"1993","journal-title":"A Volume in the Santa Fe Institute Studies in the Sciences of Complexity"}],"container-title":["IEEE\/ACM Transactions on Audio, Speech, and Language Processing"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6570655\/7869428\/07859324.pdf?arnumber=7859324","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,1,12]],"date-time":"2022-01-12T16:27:18Z","timestamp":1642004838000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7859324\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2017,4]]},"references-count":64,"journal-issue":{"issue":"4"},"URL":"https:\/\/doi.org\/10.1109\/taslp.2017.2672398","relation":{},"ISSN":["2329-9290","2329-9304"],"issn-type":[{"value":"2329-9290","type":"print"},{"value":"2329-9304","type":"electronic"}],"subject":[],"published":{"date-parts":[[2017,4]]}}}