{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,25]],"date-time":"2026-06-25T03:29:49Z","timestamp":1782358189757,"version":"3.54.5"},"reference-count":69,"publisher":"IEEE","license":[{"start":{"date-parts":[[2021,7,11]],"date-time":"2021-07-11T00:00:00Z","timestamp":1625961600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2021,7,11]],"date-time":"2021-07-11T00:00:00Z","timestamp":1625961600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2021,7,11]],"date-time":"2021-07-11T00:00:00Z","timestamp":1625961600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2021,7,11]]},"DOI":"10.1109\/iv48863.2021.9575880","type":"proceedings-article","created":{"date-parts":[[2021,11,1]],"date-time":"2021-11-01T20:59:16Z","timestamp":1635800356000},"page":"1073-1080","source":"Crossref","is-referenced-by-count":70,"title":["A Survey of Deep Reinforcement Learning Algorithms for Motion Planning and Control of Autonomous Vehicles"],"prefix":"10.1109","author":[{"given":"Fei","family":"Ye","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shen","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Pin","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Ching-Yao","family":"Chan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref39","first-page":"52","article-title":"Robust reinforcement learning for autonomous driving","author":"jaafra","year":"2019","journal-title":"APIa"},{"key":"ref38","article-title":"Learning deep neural network control policies for agile off-road autonomous driving","author":"pan","year":"0","journal-title":"NIPS Deep Reinforcement Learning Symposium"},{"key":"ref33","article-title":"Dave: Autonomous off-road vehicle control using end-to-end learning","author":"lecun","year":"2004","journal-title":"DARPA-IPTO Final Report"},{"key":"ref32","first-page":"305","article-title":"Alvinn: An autonomous land vehicle in a neural network","author":"pomerleau","year":"1989","journal-title":"Advances in neural information processing systems"},{"key":"ref31","article-title":"Quadratic q-network for learning continuous control for autonomous vehicles","author":"wang","year":"2019","journal-title":"ar Xiv preprint"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/IVS.2018.8500448"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2018.8460934"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2019.8793742"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.376"},{"key":"ref34","article-title":"End to end learning for self-driving cars","author":"bojarski","year":"2016","journal-title":"ArXiv Preprint"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1109\/TIV.2019.2904417"},{"key":"ref62","article-title":"Reinforcement learning with probabilistic guarantees for autonomous driving","author":"bouton","year":"2019","journal-title":"ArXiv Preprint"},{"key":"ref61","doi-asserted-by":"publisher","DOI":"10.1016\/j.robot.2019.01.003"},{"key":"ref63","doi-asserted-by":"publisher","DOI":"10.1109\/TIV.2019.2919467"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC.2019.8917306"},{"key":"ref64","article-title":"Cad2rl: Real single-image flight without a single real image","author":"sadeghi","year":"2016","journal-title":"ArXiv Preprint"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC.2019.8916781"},{"key":"ref65","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2020.2966414"},{"key":"ref66","first-page":"737","article-title":"Sim-to-real transfer in deep reinforcement learning for robotics: a survey","author":"zhao","year":"0","journal-title":"2020 IEEE Symposium Series on Computational Intelligence (SSCI)"},{"key":"ref29","article-title":"Safe, multiagent, reinforcement learning for autonomous driving","author":"shalev-shwartz","year":"2016","journal-title":"ar Xiv preprint"},{"key":"ref67","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2017.8202133"},{"key":"ref68","article-title":"Meta reinforcement learning-based lane change strategy for autonomous vehicles","author":"ye","year":"2020","journal-title":"ArXiv Preprint"},{"key":"ref69","author":"sallab","year":"2017","journal-title":"Meta learning framework for automated driving"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/TIV.2016.2578706"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2015.2498841"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/IVS.2019.8813903"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/CIVTS.2011.5949533"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/MCI.2019.2901089"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.29007\/m4jw"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/TASE.2015.2498192"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/ICTAI.2019.00034"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1016\/j.trc.2018.10.024"},{"key":"ref50","article-title":"Deep imitative models for flexible inference, planning, and control","author":"rhinehart","year":"2018","journal-title":"ArXiv Preprint"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00291"},{"key":"ref59","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC.2018.8569635"},{"key":"ref58","year":"0","journal-title":"Easily build autonomous vehicle training environments"},{"key":"ref57","first-page":"1","article-title":"CARLA: An open urban driving simulator","author":"dosovitskiy","year":"0","journal-title":"Proceedings of the 1 st Annual Conference on Robot Learning"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1109\/TCIAIG.2010.2050590"},{"key":"ref55","year":"0","journal-title":"The Open Racing Car Simulator"},{"key":"ref54","article-title":"Carma: A deep reinforcement learning approach to autonomous driving","author":"vitelli","year":"2016","journal-title":"Tech rep Stanford University Tech Rep"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2017.64"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.1145\/3309772.3309802"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2018.8593420"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN.2019.8852110"},{"key":"ref40","author":"madrigal","year":"0","journal-title":"Inside waymo's secret world for training self-driving cars"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC.2018.8569448"},{"key":"ref13","article-title":"Driving decision and control for autonomous lane change based on deep reinforcement learning","author":"shi","year":"2019","journal-title":"ArXiv Preprint"},{"key":"ref14","article-title":"Chauffeurnet: Learning to drive by imitating the best and synthesizing the worst","author":"bansal","year":"2018","journal-title":"ar Xiv preprint"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/j.trc.2019.08.011"},{"key":"ref16","article-title":"Automated lane change strategy using proximal policy optimization-based deep reinforcement learning","author":"ye","year":"2020","journal-title":"ArXiv Preprint"},{"key":"ref17","article-title":"Action permissibility in deep reinforcement learning and application to autonomous driving","author":"mazumder","year":"2018","journal-title":"KDD'18 Deep Learning Day"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/IVS.2018.8500450"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1115\/DSCC2018-9249"},{"key":"ref4","article-title":"A survey of autonomous driving: common practices and emerging technologies","author":"yurtsever","year":"2019","journal-title":"ArXiv Preprint"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1146\/annurev-control-060117-105157"},{"key":"ref6","article-title":"Deep reinforcement learning for autonomous driving: A survey","author":"kiran","year":"2020","journal-title":"ArXiv Preprint"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.5220\/0007520305640572"},{"key":"ref8","author":"levine","year":"0","journal-title":"Imitation prediction and model-based reinforcement learning for autonomous driving"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2020.3024655"},{"key":"ref49","first-page":"584","article-title":"Cirl: Controllable imitative reinforcement learning for vision-based self-driving","author":"liang","year":"0","journal-title":"Proceedings of the European Conference on Computer Vision (ECCV)"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC.2018.8569568"},{"key":"ref46","article-title":"Deep reinforcement learning for autonomous driving","author":"wang","year":"2018","journal-title":"ArXiv Preprint"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.5244\/C.31.11"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2018.8460487"},{"key":"ref47","author":"chhor","year":"2018","journal-title":"Deep Reinforcement Learning for Autonomous Driving"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1145\/2463372.2463509"},{"key":"ref41","year":"0","journal-title":"NVIDIA DRIVE Constellation Virtual reality autonomous vehicle simulator"},{"key":"ref44","article-title":"Query-efficient imitation learning for end-to-end autonomous driving","author":"zhang","year":"2016","journal-title":"ArXiv Preprint"},{"key":"ref43","article-title":"Continuous control with deep reinforcement learning","author":"lillicrap","year":"2015","journal-title":"ArXiv Preprint"}],"event":{"name":"2021 IEEE Intelligent Vehicles Symposium (IV)","location":"Nagoya, Japan","start":{"date-parts":[[2021,7,11]]},"end":{"date-parts":[[2021,7,17]]}},"container-title":["2021 IEEE Intelligent Vehicles Symposium (IV)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/9575127\/9575130\/09575880.pdf?arnumber=9575880","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,5,10]],"date-time":"2022-05-10T15:47:55Z","timestamp":1652197675000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9575880\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,7,11]]},"references-count":69,"URL":"https:\/\/doi.org\/10.1109\/iv48863.2021.9575880","relation":{},"subject":[],"published":{"date-parts":[[2021,7,11]]}}}