{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,10,15]],"date-time":"2025-10-15T10:36:20Z","timestamp":1760524580433,"version":"3.28.0"},"reference-count":31,"publisher":"IEEE","license":[{"start":{"date-parts":[[2023,12,13]],"date-time":"2023-12-13T00:00:00Z","timestamp":1702425600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2023,12,13]],"date-time":"2023-12-13T00:00:00Z","timestamp":1702425600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/100000181","name":"Air Force Office of Scientific Research","doi-asserted-by":"publisher","award":["FA9550-19-1-0302"],"award-info":[{"award-number":["FA9550-19-1-0302"]}],"id":[{"id":"10.13039\/100000181","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000001","name":"National Science Foundation","doi-asserted-by":"publisher","award":["1932091"],"award-info":[{"award-number":["1932091"]}],"id":[{"id":"10.13039\/100000001","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2023,12,13]]},"DOI":"10.1109\/cdc49753.2023.10383601","type":"proceedings-article","created":{"date-parts":[[2024,1,19]],"date-time":"2024-01-19T18:38:36Z","timestamp":1705689516000},"page":"4372-4378","source":"Crossref","is-referenced-by-count":2,"title":["Safe Reinforcement Learning with Probabilistic Guarantees Satisfying Temporal Logic Specifications in Continuous Action Spaces"],"prefix":"10.1109","author":[{"given":"Hanna","family":"Krasowski","sequence":"first","affiliation":[{"name":"Technical University of Munich,Munich,Germany"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Prithvi","family":"Akella","sequence":"additional","affiliation":[{"name":"California Institute of Technology,Pasadena,USA"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Aaron D.","family":"Ames","sequence":"additional","affiliation":[{"name":"California Institute of Technology,Pasadena,USA"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Matthias","family":"Althoff","sequence":"additional","affiliation":[{"name":"Technical University of Munich,Munich,Germany"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1016\/j.ifacol.2020.12.2276"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2021.109597"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v33i01.33013387"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/CDC.2014.7039601"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/OJCSYS.2023.3256305"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3063989"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v32i1.11797"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-61362-4_16"},{"key":"ref9","first-page":"483","article-title":"Cautious reinforcement learning with logical constraints","volume-title":"Proc. of the International Conference on Autonomous Agents and Multiagent Systems","author":"Hasanbeig","year":"2020"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/ICCPS48487.2020.00017"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3064220"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3101544"},{"key":"ref13","article-title":"Sample-based bounds for coherent risk measures: Applications to policy synthesis and verification","volume-title":"arXiv preprint","author":"Akella","year":"2022"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/IROS47612.2022.9981359"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1613\/jair.1.12716"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/icra.2017.7989200"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-75632-5_5"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-540-30206-3_12"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/LCSYS.2018.2853182"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TCNS.2020.3014602"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-15297-9_9"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1016\/j.tcs.2009.06.021"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1145\/3306157"},{"key":"ref24","article-title":"Provably safe reinforcement learning: A theoretical and experimental comparison","author":"Krasowski","year":"2022","journal-title":"arXiv preprint"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/IV47402.2020.9304549"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1177\/1748006X211069277"},{"key":"ref27","article-title":"Prox-imal policy optimization algorithms","author":"Schulman","year":"2017","journal-title":"arXiv preprint"},{"issue":"268","key":"ref28","first-page":"1","article-title":"Stable-Baselines3: Reliable reinforcement learning implementations","volume":"22","author":"Raffin","year":"2021","journal-title":"Journal of Machine Learning Research"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1146\/annurev-control-053018-023717"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/CDC.2014.7039363"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1145\/3054912"}],"event":{"name":"2023 62nd IEEE Conference on Decision and Control (CDC)","start":{"date-parts":[[2023,12,13]]},"location":"Singapore, Singapore","end":{"date-parts":[[2023,12,15]]}},"container-title":["2023 62nd IEEE Conference on Decision and Control (CDC)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/10383192\/10383193\/10383601.pdf?arnumber=10383601","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,1,23]],"date-time":"2024-01-23T16:25:13Z","timestamp":1706027113000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10383601\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,12,13]]},"references-count":31,"URL":"https:\/\/doi.org\/10.1109\/cdc49753.2023.10383601","relation":{},"subject":[],"published":{"date-parts":[[2023,12,13]]}}}