{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,25]],"date-time":"2026-06-25T16:22:58Z","timestamp":1782404578826,"version":"3.54.5"},"reference-count":56,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"2","license":[{"start":{"date-parts":[[2019,5,1]],"date-time":"2019-05-01T00:00:00Z","timestamp":1556668800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2019,5,1]],"date-time":"2019-05-01T00:00:00Z","timestamp":1556668800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-009"},{"start":{"date-parts":[[2019,5,1]],"date-time":"2019-05-01T00:00:00Z","timestamp":1556668800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-001"}],"funder":[{"name":"Beijing Science and Technology Plan","award":["Z181100004618003; Z181100008818075"],"award-info":[{"award-number":["Z181100004618003; Z181100008818075"]}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61573353; 61803371; 61533017"],"award-info":[{"award-number":["61573353; 61803371; 61533017"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]},{"name":"National Key Research and Development Plan","award":["2016YFB0101003"],"award-info":[{"award-number":["2016YFB0101003"]}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Comput. Intell. Mag."],"published-print":{"date-parts":[[2019,5]]},"DOI":"10.1109\/mci.2019.2901089","type":"journal-article","created":{"date-parts":[[2019,4,12]],"date-time":"2019-04-12T02:19:01Z","timestamp":1555035541000},"page":"83-98","source":"Crossref","is-referenced-by-count":143,"title":["Reinforcement Learning and Deep Learning Based Lateral Control for Autonomous Driving [Application Notes]"],"prefix":"10.1109","volume":"14","author":[{"given":"Dong","family":"Li","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Dongbin","family":"Zhao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Qichao","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yaran","family":"Chen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref39","author":"rummery","year":"1994","journal-title":"On-line Q-learning using connectionist systems"},{"key":"ref38","author":"watkins","year":"1989","journal-title":"Learning from delayed rewards"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/URAI.2017.7992762"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/TCST.2018.2811376"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/MCI.2017.2670463"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2012.09.034"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/TCIAIG.2010.2050590"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1109\/CIG.2008.5035630"},{"key":"ref35","author":"bernhard","year":"2014","journal-title":"TORCS The Open Racing Car Simulator"},{"key":"ref34","author":"manuelli","year":"2015","journal-title":"Reinforcement learning for autonomous driving obstacle avoidance using lidar"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/TCYB.2015.2488680"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/TNN.1998.712192"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2013.2276571"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2012.6248074"},{"key":"ref1","author":"maurer","year":"2016","journal-title":"Autonomous Driving Technical Legal and Social Aspects"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC.2012.6338884"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1243\/0954407011525502"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1016\/j.ins.2017.08.035"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1504\/IJVAS.2005.008237"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1016\/j.conengprac.2014.09.015"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/MCI.2009.932261"},{"key":"ref25","first-page":"1","article-title":"Continuous control with deep reinforcement learning","author":"lillicrap","year":"0","journal-title":"Proc Int Conf Learning Representations"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.433"},{"key":"ref51","first-page":"1929","article-title":"Dropout: A simple way to prevent neural networks from overfitting","volume":"15","author":"srivastava","year":"2014","journal-title":"J Mach Learn Res"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1109\/IVS.2015.7225830"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4614-1433-9"},{"key":"ref54","first-page":"1","article-title":"Adam: A method for stochastic optimization","author":"kingma","year":"0","journal-title":"Proc Int Conf Learning Representations"},{"key":"ref53","author":"lin","year":"1993","journal-title":"Reinforcement learning for robots using neural networks"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.1109\/72.914523"},{"key":"ref10","article-title":"System and method for detecting obstacles to vehicle motion and determining time to contact therewith using sequences of images","author":"stein","year":"2006"},{"key":"ref11","article-title":"Collision warning system","author":"stein","year":"2011"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1007\/BF00115009"},{"key":"ref12","first-page":"739","article-title":"Off-road obstacle avoidance through end-to-end learning","author":"lecun","year":"0","journal-title":"Proc Advances in Neural Information Processing Systems"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.15607\/RSS.2008.IV.034"},{"key":"ref14","first-page":"661","article-title":"Efficient reductions for imitation learning","volume":"15","author":"ross","year":"0","journal-title":"Proc Int Conf Artificial Intelligence and Statistics"},{"key":"ref15","first-page":"627","article-title":"A reduction of imitation learning and structured prediction to no-regret online learning","volume":"15","author":"ross","year":"0","journal-title":"Proc Int Conf Artificial Intelligence and Statistics"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1177\/02783649922066321"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2016.12"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2015.312"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.236"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1038\/nature24270"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1038\/nature14236"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2016.2619909"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.3390\/en10101525"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1002\/rob.20258"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1002\/rob.20255"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.126"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/TCDS.2016.2614675"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1145\/1553374.1553458"},{"key":"ref45","first-page":"1306","article-title":"Adaptive multi-task lasso: With application to eQTL detection","author":"lee","year":"0","journal-title":"Proc Advances in Neural Information Processing Systems"},{"key":"ref48","article-title":"Multi-task learning using uncertainty to weigh losses for scene geometry and semantics","author":"kendall","year":"0","journal-title":"Proc IEEE Conf Computer Vision and Pattern Recognition"},{"key":"ref47","first-page":"1593","article-title":"Learning multiple tasks with multilinear relationship networks","author":"long","year":"0","journal-title":"Proc Advances in Neural Information Processing Systems"},{"key":"ref42","first-page":"387","article-title":"Deterministic policy gradient algorithms","author":"silver","year":"0","journal-title":"Proc Int Conf Machine Learning"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1007\/BF00992696"},{"key":"ref44","first-page":"41","article-title":"Multi-task feature learning","author":"argyriou","year":"0","journal-title":"Proc Advances in Neural Information Processing Systems"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1023\/A:1007379606734"}],"container-title":["IEEE Computational Intelligence Magazine"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/10207\/8686317\/08686348.pdf?arnumber=8686348","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,7,13]],"date-time":"2022-07-13T20:47:33Z","timestamp":1657745253000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8686348\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019,5]]},"references-count":56,"journal-issue":{"issue":"2"},"URL":"https:\/\/doi.org\/10.1109\/mci.2019.2901089","relation":{},"ISSN":["1556-603X","1556-6048"],"issn-type":[{"value":"1556-603X","type":"print"},{"value":"1556-6048","type":"electronic"}],"subject":[],"published":{"date-parts":[[2019,5]]}}}