{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,22]],"date-time":"2026-04-22T18:46:55Z","timestamp":1776883615881,"version":"3.51.2"},"reference-count":33,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2018,4]]},"DOI":"10.1109\/icassp.2018.8461405","type":"proceedings-article","created":{"date-parts":[[2018,9,21]],"date-time":"2018-09-21T22:24:48Z","timestamp":1537568688000},"page":"6099-6103","source":"Crossref","is-referenced-by-count":14,"title":["Rescoring N-Best Speech Recognition List Based on One-on-One Hypothesis Comparison Using Encoder-Classifier Model"],"prefix":"10.1109","author":[{"given":"Atsunori","family":"Ogawa","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Marc","family":"Delcroix","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shigeki","family":"Karita","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Tomohiro","family":"Nakatani","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/W17-3202"},{"key":"ref32","first-page":"35","article-title":"Neural reranking improves subjective quality of machine translation: NAIST at WAT2015","author":"neubig","year":"2015","journal-title":"Proc WAT"},{"key":"ref31","article-title":"Adam: A method for stochastic optimization","author":"kingma","year":"2015","journal-title":"Proc ICLR"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1016\/j.specom.2017.02.009"},{"key":"ref10","article-title":"The RWTH\/UPB\/FORTH system combination for the 4th CHiME challenge evaluation","author":"menne","year":"2016","journal-title":"Proc of The 4th Intl Workshop on Speech Processing in Everyday Environments (CHiME 2016)"},{"key":"ref11","first-page":"191","article-title":"Exploiting the ASR N-Best by tracking multiple dialog state hypotheses","author":"williams","year":"2008","journal-title":"Proc INTERSPEECH"},{"key":"ref12","doi-asserted-by":"crossref","first-page":"1160","DOI":"10.1109\/JPROC.2012.2225812","article-title":"POMDP-based statistical spoken dialogue systems: A review","volume":"101","author":"young","year":"2016","journal-title":"Proc IEEE"},{"key":"ref13","first-page":"1045","article-title":"Recurrent neural network based language model","author":"mikolov","year":"2010","journal-title":"Proc INTERSPEECH"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2011.5947611"},{"key":"ref15","article-title":"LSTM neural networks for language modeling","author":"sundermeyer","year":"2012","journal-title":"Proc INTERSPEECH"},{"key":"ref16","first-page":"5386","article-title":"A discriminative method for recurrent neural network language models","author":"tachioka","year":"2015","journal-title":"Proc ICASSP"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2016.7472827"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1016\/j.csl.2006.06.006"},{"key":"ref19","first-page":"160","article-title":"Minimum error rate training in statistical machine translation","author":"och","year":"2003","journal-title":"Proc ACL"},{"key":"ref28","first-page":"5730","article-title":"Noise robust speech recognition using recent developments in neural networks for computer vision","author":"yoshioka","year":"2016","journal-title":"Proc ICASSP"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2164527"},{"key":"ref27","year":"0","journal-title":"Chainer A flexible framework of neural networks"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2014.2304637"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1016\/j.csl.2016.11.005"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2006.889790"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1006\/csla.2000.0152"},{"key":"ref8","article-title":"The I2R system for CHiME-4 challenge","author":"dat","year":"2016","journal-title":"Proc of The 4th Intl Workshop on Speech Processing in Everyday Environments (CHiME 2016)"},{"key":"ref7","article-title":"Multi-channel speech recognition: LSTMs all the way through","author":"erdogan","year":"2016","journal-title":"Proc of The 4th Intl Workshop on Speech Processing in Everyday Environments (CHiME 2016)"},{"key":"ref2","doi-asserted-by":"crossref","DOI":"10.1007\/978-1-4471-5779-3","author":"yu","year":"2015","journal-title":"Automatic Speech Recognition?A Deep Learning Approach"},{"key":"ref9","article-title":"The USTC-iFlytek system for CHiME-4 challenge","author":"du","year":"2016","journal-title":"Proc of The 4th Intl Workshop on Speech Processing in Everyday Environments (CHiME 2016)"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/MSP.2012.2205597"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1162\/0891201053630273"},{"key":"ref22","article-title":"The Art of Computer Programming","volume":"3","author":"knuth","year":"1998","journal-title":"Sorting and Searching"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2174225"},{"key":"ref24","article-title":"End-to-end continuous speech recognition using attention-based recurrent NN: First results","author":"chorowski","year":"2014","journal-title":"NIPS 2014 Deep Learning and Representation Learning Workshop"},{"key":"ref23","first-page":"3104","article-title":"Sequence to sequence learning with neural networks","author":"sutskever","year":"2014","journal-title":"Proc NIPS"},{"key":"ref26","first-page":"7","article-title":"Corpus of spontaneous Japanese: its design and evaluation","author":"maekawa","year":"2003","journal-title":"Proc Workshop on Spontaneous Speech Processing and Recognition (SSPR)"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2016.7472621"}],"event":{"name":"ICASSP 2018 - 2018 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","location":"Calgary, AB","start":{"date-parts":[[2018,4,15]]},"end":{"date-parts":[[2018,4,20]]}},"container-title":["2018 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8450881\/8461260\/08461405.pdf?arnumber=8461405","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,7,8]],"date-time":"2025-07-08T18:13:13Z","timestamp":1751998393000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8461405\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,4]]},"references-count":33,"URL":"https:\/\/doi.org\/10.1109\/icassp.2018.8461405","relation":{},"subject":[],"published":{"date-parts":[[2018,4]]}}}