{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,14]],"date-time":"2026-07-14T16:31:06Z","timestamp":1784046666709,"version":"3.55.0"},"reference-count":37,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"8","license":[{"start":{"date-parts":[[2023,8,1]],"date-time":"2023-08-01T00:00:00Z","timestamp":1690848000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2023,8,1]],"date-time":"2023-08-01T00:00:00Z","timestamp":1690848000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2023,8,1]],"date-time":"2023-08-01T00:00:00Z","timestamp":1690848000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["U22A20104"],"award-info":[{"award-number":["U22A20104"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["52102460"],"award-info":[{"award-number":["52102460"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100009592","name":"Beijing Municipal Science and Technology Commission","doi-asserted-by":"publisher","award":["Z221100008122011"],"award-info":[{"award-number":["Z221100008122011"]}],"id":[{"id":"10.13039\/501100009592","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Tsinghua University-Toyota Joint Center"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Intell. Transport. Syst."],"published-print":{"date-parts":[[2023,8]]},"DOI":"10.1109\/tits.2023.3266885","type":"journal-article","created":{"date-parts":[[2023,4,18]],"date-time":"2023-04-18T17:44:24Z","timestamp":1681839864000},"page":"7932-7942","source":"Crossref","is-referenced-by-count":24,"title":["Identify, Estimate and Bound the Uncertainty of Reinforcement Learning for Autonomous Driving"],"prefix":"10.1109","volume":"24","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-1266-3843","authenticated-orcid":false,"given":"Weitao","family":"Zhou","sequence":"first","affiliation":[{"name":"School of Vehicle and Mobility, Tsinghua University, Beijing, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2243-5705","authenticated-orcid":false,"given":"Zhong","family":"Cao","sequence":"additional","affiliation":[{"name":"School of Vehicle and Mobility, Tsinghua University, Beijing, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Nanshan","family":"Deng","sequence":"additional","affiliation":[{"name":"School of Vehicle and Mobility, Tsinghua University, Beijing, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7282-172X","authenticated-orcid":false,"given":"Kun","family":"Jiang","sequence":"additional","affiliation":[{"name":"School of Vehicle and Mobility, Tsinghua University, Beijing, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0074-2448","authenticated-orcid":false,"given":"Diange","family":"Yang","sequence":"additional","affiliation":[{"name":"School of Vehicle and Mobility, Tsinghua University, Beijing, China"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref13","article-title":"On a formal model of safe and scalable self-driving cars","author":"shalev-shwartz","year":"2017","journal-title":"arXiv 1708 06374"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.2010.5509799"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/IV47402.2020.9304614"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1145\/93597.98741"},{"key":"ref15","first-page":"2380","article-title":"High confidence policy improvement","author":"thomas","year":"2015","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1016\/j.tra.2016.09.010"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1115\/DSCC2017-5099"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v30i1.10295"},{"key":"ref31","article-title":"Deep exploration via bootstrapped DQN","author":"osband","year":"2016","journal-title":"arXiv 1602 04621"},{"key":"ref30","article-title":"Prioritized experience replay","author":"schaul","year":"2015","journal-title":"arXiv 1511 05952"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC45102.2020.9294407"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/IV47402.2020.9304828"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TCST.2017.2654063"},{"key":"ref32","article-title":"CARLA: An open urban driving simulator","author":"dosovitskiy","year":"2017","journal-title":"arXiv 1711 03938"},{"key":"ref2","first-page":"44","article-title":"Autonomous driving strategies at intersections: Scenarios, state-of-the-art, and future outlooks","author":"wei","year":"2021","journal-title":"Proc IEEE Int Intell Transp Syst Conf (ITSC)"},{"key":"ref1","article-title":"Autonomy 2.0: Why is self-driving always 5 years away?","author":"jain","year":"2021","journal-title":"arXiv 2107 08142"},{"key":"ref17","first-page":"1050","article-title":"Dropout as a Bayesian approximation: Representing model uncertainty in deep learning","author":"gal","year":"2016","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1016\/j.trc.2022.103656"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC55140.2022.9921749"},{"key":"ref18","article-title":"Ensemble deep learning: A review","author":"ganaie","year":"2021","journal-title":"arXiv 2104 02395"},{"key":"ref24","first-page":"28954","article-title":"COMBO: Conservative offline model-based policy optimization","volume":"34","author":"yu","year":"2021","journal-title":"Proc Adv Neural Inf Process Syst"},{"key":"ref23","first-page":"1179","article-title":"Conservative Q-learning for offline reinforcement learning","volume":"33","author":"kumar","year":"2020","journal-title":"Proc Adv Neural Inf Process Syst"},{"key":"ref26","author":"kochenderfer","year":"2021","journal-title":"Algorithms for Decision Making"},{"key":"ref25","article-title":"Behavior regularized offline reinforcement learning","author":"wu","year":"2019","journal-title":"arXiv 1911 11361"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2022.3225538"},{"key":"ref22","first-page":"1","article-title":"Security analysis of safe and Seldonian reinforcement learning algorithms","volume":"33","author":"ozisik","year":"2020","journal-title":"Proc Adv Neural Inf Process Syst"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v33i01.33014967"},{"key":"ref28","author":"sutton","year":"2018","journal-title":"Reinforcement Learning An Introduction"},{"key":"ref27","doi-asserted-by":"crossref","first-page":"529","DOI":"10.1038\/nature14236","article-title":"Human-level control through deep reinforcement learning","volume":"518","author":"mnih","year":"2015","journal-title":"Nature"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4612-4380-9_41"},{"key":"ref8","doi-asserted-by":"crossref","first-page":"267","DOI":"10.1023\/A:1017940631555","article-title":"Risk-sensitive reinforcement learning","volume":"49","author":"mihatsch","year":"2014","journal-title":"Mach Learn"},{"key":"ref7","first-page":"1096","article-title":"Implicit quantile networks for distributional reinforcement learning","author":"dabney","year":"2018","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2019.2901817"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/ITSC45102.2020.9294275"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2019.2961739"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1007\/s10994-021-05946-3"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2021.3069497"}],"container-title":["IEEE Transactions on Intelligent Transportation Systems"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6979\/10202228\/10104197.pdf?arnumber=10104197","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,8,21]],"date-time":"2023-08-21T18:05:57Z","timestamp":1692641157000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10104197\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,8]]},"references-count":37,"journal-issue":{"issue":"8"},"URL":"https:\/\/doi.org\/10.1109\/tits.2023.3266885","relation":{},"ISSN":["1524-9050","1558-0016"],"issn-type":[{"value":"1524-9050","type":"print"},{"value":"1558-0016","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,8]]}}}