{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,8,27]],"date-time":"2025-08-27T16:00:03Z","timestamp":1756310403000,"version":"3.28.0"},"reference-count":50,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2014,5]]},"DOI":"10.1109\/hscma.2014.6843274","type":"proceedings-article","created":{"date-parts":[[2014,7,28]],"date-time":"2014-07-28T21:22:55Z","timestamp":1406582575000},"page":"172-176","source":"Crossref","is-referenced-by-count":27,"title":["Neural networks for distant speech recognition"],"prefix":"10.1109","author":[{"given":"Steve","family":"Renals","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Pawel","family":"Swietojanski","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"35","doi-asserted-by":"publisher","DOI":"10.1109\/5.726791"},{"key":"36","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2013.6707749"},{"key":"33","first-page":"255","article-title":"Convolutional networks for images, speech and time series","author":"lecun","year":"1995","journal-title":"The Handbook of Brain Theory and Neural Networks"},{"key":"34","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2012.6288864"},{"key":"39","article-title":"Maxout networks","author":"goodfellow","year":"2013","journal-title":"Proc ICML"},{"key":"37","doi-asserted-by":"crossref","first-page":"23","DOI":"10.1016\/0893-6080(90)90044-L","article-title":"A time-delay neural network architecture for isolated","volume":"3","author":"lang","year":"1990","journal-title":"Neural Networks"},{"key":"38","first-page":"131","article-title":"Rectified linear units improve restricted Boltzmann machines","author":"nair","year":"2010","journal-title":"Proc ICML"},{"journal-title":"Pylearn2 A Machine Learning Research Library","year":"2013","author":"goodfellow","key":"43"},{"key":"42","article-title":"The Kaldi speech recognition toolkit","author":"povey","year":"2011","journal-title":"Proc IEEE ASRU"},{"key":"41","article-title":"Multiple dimension Levenshtein edit distance calculations for evaluating ASR systems during simultaneous speech","author":"fiscus","year":"2006","journal-title":"Proc LREC"},{"key":"40","doi-asserted-by":"publisher","DOI":"10.1109\/LSP.2014.2325781"},{"key":"22","doi-asserted-by":"publisher","DOI":"10.1109\/89.260359"},{"key":"23","doi-asserted-by":"publisher","DOI":"10.1109\/5.381844"},{"key":"24","doi-asserted-by":"crossref","first-page":"27","DOI":"10.1016\/S0167-6393(01)00058-9","article-title":"Connectionist speech recognition of broadcast news","volume":"37","author":"robinson","year":"2002","journal-title":"Speech Commun"},{"key":"25","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2011.6163900"},{"key":"26","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2134090"},{"key":"27","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2013.6707744"},{"key":"28","doi-asserted-by":"publisher","DOI":"10.1109\/SLT.2012.6424210"},{"key":"29","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6638312"},{"key":"3","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1996.543266"},{"key":"2","doi-asserted-by":"publisher","DOI":"10.1016\/0167-6393(90)90019-6"},{"key":"1","doi-asserted-by":"publisher","DOI":"10.1002\/9780470714089"},{"key":"7","doi-asserted-by":"publisher","DOI":"10.1109\/MSP.2012.2205029"},{"key":"30","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2013.6707745"},{"key":"6","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2013.6639033"},{"key":"5","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2005.1566470"},{"key":"32","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2014.6855088"},{"key":"4","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.1997.599610"},{"key":"31","article-title":"Deep maxout networks for lowresource speech recognition","author":"miao","year":"2013","journal-title":"Proc IEEE ASRU"},{"key":"9","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2003.1198793"},{"key":"8","doi-asserted-by":"publisher","DOI":"10.1109\/MSP.2012.2205285"},{"key":"19","doi-asserted-by":"crossref","first-page":"1281","DOI":"10.21437\/Interspeech.2011-106","article-title":"An analysis of automatic speech recognition with multiple microphones","author":"marino","year":"2011","journal-title":"Proc INTERSPEECH"},{"key":"17","doi-asserted-by":"publisher","DOI":"10.1109\/TSA.2004.832988"},{"key":"18","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2006.872614"},{"key":"15","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2007.367023"},{"key":"16","article-title":"Bridging the gap: Towards a unified framework for handsfree speech recognition using microphone arrays","author":"seltzer","year":"2008","journal-title":"Proc HSCMA"},{"key":"13","first-page":"105","article-title":"Minimum phone error and I-smoothing for improved discriminative training","author":"povey","year":"2002","journal-title":"Proc IEEE ICASSP"},{"key":"14","doi-asserted-by":"publisher","DOI":"10.1109\/ICSLP.1996.607807"},{"key":"11","first-page":"373","article-title":"The SRI-ICSI Spring 2007 meeting and lecture recognition system in LNCS","author":"stolcke","year":"2008","journal-title":"Multimodal Technologies for Perception of Humans"},{"key":"12","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2163395"},{"key":"21","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4615-3210-1"},{"key":"20","doi-asserted-by":"publisher","DOI":"10.1109\/MSP.2012.2205597"},{"key":"49","doi-asserted-by":"publisher","DOI":"10.1109\/89.759034"},{"key":"48","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2008.4518545"},{"key":"45","doi-asserted-by":"publisher","DOI":"10.1162\/neco.2006.18.7.1527"},{"key":"44","article-title":"Understanding the difficulty of training deep feedforward neural networks","author":"glorot","year":"2010","journal-title":"Proc AISTATS"},{"key":"47","first-page":"153","article-title":"Greedy layerwise training of deep networks","volume":"19","author":"bengio","year":"2007","journal-title":"Proc NIPS"},{"key":"46","first-page":"1096","article-title":"Unsupervised feature learning for audio classification using convolutional deep belief networks","volume":"22","author":"lee","year":"2009","journal-title":"Proc NIPS"},{"key":"10","doi-asserted-by":"publisher","DOI":"10.1007\/s10579-007-9040-x"},{"key":"50","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2007.902460"}],"event":{"name":"2014 4th Joint Workshop on Hands-free Speech Communication and Microphone Arrays (HSCMA)","start":{"date-parts":[[2014,5,12]]},"location":"Villers-les-Nancy, France","end":{"date-parts":[[2014,5,14]]}},"container-title":["2014 4th Joint Workshop on Hands-free Speech Communication and Microphone Arrays (HSCMA)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6835824\/6843235\/06843274.pdf?arnumber=6843274","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,4,12]],"date-time":"2022-04-12T22:11:20Z","timestamp":1649801480000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/6843274\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2014,5]]},"references-count":50,"URL":"https:\/\/doi.org\/10.1109\/hscma.2014.6843274","relation":{},"subject":[],"published":{"date-parts":[[2014,5]]}}}