{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,16]],"date-time":"2026-05-16T16:18:21Z","timestamp":1778948301284,"version":"3.51.4"},"reference-count":38,"publisher":"IEEE","license":[{"start":{"date-parts":[[2025,8,30]],"date-time":"2025-08-30T00:00:00Z","timestamp":1756512000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2025,8,30]],"date-time":"2025-08-30T00:00:00Z","timestamp":1756512000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025,8,30]]},"DOI":"10.1109\/qce65121.2025.00181","type":"proceedings-article","created":{"date-parts":[[2025,12,1]],"date-time":"2025-12-01T18:22:51Z","timestamp":1764613371000},"page":"1640-1645","source":"Crossref","is-referenced-by-count":1,"title":["CleanQRL: Lightweight Single-File Implementations of Quantum Reinforcement Learning Algorithms"],"prefix":"10.1109","author":[{"given":"Georg","family":"Kruse","sequence":"first","affiliation":[{"name":"Fraunhofer IISB, Technical University Munich,Erlangen,Germany"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Rodrigo","family":"Coelho","sequence":"additional","affiliation":[{"name":"Fraunhofer IISB,Erlangen,Germany"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Andreas","family":"Rosskopf","sequence":"additional","affiliation":[{"name":"Fraunhofer IISB,Erlangen,Germany"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Robert","family":"Wille","sequence":"additional","affiliation":[{"name":"Technical University Munich,Munich,Germany"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jeanette Miriam","family":"Lorenz","sequence":"additional","affiliation":[{"name":"Fraunhofer IKS, Ludwig Maximilian University,Munich,Germany"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","article-title":"Pennylane: Automatic differentiation of hybrid quantum-classical computations","author":"Bergholm","year":"2018","journal-title":"arXiv preprint"},{"key":"ref2","author":"Biewald","year":"2020","journal-title":"Experiment tracking with weights and biases"},{"key":"ref3","article-title":"Jumanji: a diverse suite of scalable reinforcement learning environments in jax","author":"Bonnet","year":"2023","journal-title":"arXiv preprint"},{"key":"ref4","article-title":"Torchrl: A data-driven decision-making library for pytorch","author":"Bou","year":"2023","journal-title":"arXiv preprint"},{"key":"ref5","article-title":"Better than classical? the subtle art of benchmarking quantum machine learning models","author":"Bowles","year":"2024","journal-title":"arXiv preprint"},{"key":"ref6","article-title":"Openai gym","author":"Brockman","year":"2016","journal-title":"arXiv preprint"},{"key":"ref7","article-title":"Tensorflow quantum: A software framework for quantum machine learning","author":"Broughton","year":"2020","journal-title":"arXiv preprint"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.29007\/vdxr"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2020.3010470"},{"key":"ref10","article-title":"Quantum reinforcement learning for solving a stochastic frozen lake environment and the impact of quantum architecture choices","author":"Dr\u0103gan","year":"2022","journal-title":"arXiv preprint"},{"key":"ref11","article-title":"Unentangled quantum reinforcement learning agents in the openai gym","author":"Hsiao","year":"2022","journal-title":"arXiv preprint"},{"issue":"274","key":"ref12","first-page":"1","article-title":"Cleanrl: Highquality single-file implementations of deep reinforcement learning algorithms","volume":"23","author":"Huang","year":"2022","journal-title":"Journal of Machine Learning Research"},{"key":"ref13","article-title":"Open RL Benchmark: Comprehensive Tracked Experiments for Reinforcement Learning","author":"Huang","year":"2024","journal-title":"arXiv preprint"},{"key":"ref14","article-title":"Quantum computing with qiskit","author":"Javadi-Abhari","year":"2024","journal-title":"arXiv preprint"},{"key":"ref15","first-page":"28362","article-title":"Parametrized quantum policies for reinforcement learning","volume":"34","author":"Jerbi","year":"2021","journal-title":"Advances in Neural Information Processing Systems"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/QCE60285.2024.00189"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/ICTC52510.2021.9620885"},{"key":"ref18","author":"Lange","year":"2022","journal-title":"gymnax: A JAX-based reinforcement learning environment library"},{"key":"ref19","article-title":"A review of barren plateaus in variational quantum computing","author":"Larocca","year":"2024","journal-title":"arXiv preprint"},{"key":"ref20","first-page":"245","article-title":"Ray rllib: A composable and scalable reinforcement learning library","volume":"85","author":"Liang","year":"2017","journal-title":"arXiv preprint"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1525\/9780520938267-012"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1609\/aiide.v16i1.7437"},{"key":"ref23","article-title":"Systematic benchmarking of quantum computers: status and recommendations","author":"Lorenz","year":"2025","journal-title":"arXiv preprint"},{"key":"ref24","first-page":"16455","article-title":"Discovered policy optimisation","volume":"35","author":"Lu","year":"2022","journal-title":"Advances in Neural Information Processing Systems"},{"key":"ref25","first-page":"24592","article-title":"Quantum policy gradient algorithm with optimized action decoding","volume-title":"International Conference on Machine Learning","author":"Meyer","year":"2023"},{"key":"ref26","author":"Muldal","year":"2019","journal-title":"dm_env: A python interface for reinforcement learning environments"},{"issue":"268","key":"ref27","first-page":"1","article-title":"Stable-baselines3: Reliable reinforcement learning implementations","volume":"22","author":"Raffin","year":"2021","journal-title":"Journal of machine learning research"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1088\/2058-9565\/ad261b"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1007\/s42484-023-00101-8"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2023.3347219"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1038\/s41534-023-00710-y"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.22331\/q-2022-05-24-720"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1140\/epjqt\/s40507-023-00166-1"},{"key":"ref34","first-page":"15032","article-title":"Pettingzoo: Gym for multi-agent reinforcement learning","volume":"34","author":"Terry","year":"2021","journal-title":"Advances in Neural Information Processing Systems"},{"key":"ref35","article-title":"Gymnasium: A standard interface for reinforcement learning environments","author":"Towers","year":"2024","journal-title":"arXiv preprint"},{"issue":"267","key":"ref36","first-page":"1","article-title":"Tianshou: A highly modularized deep reinforcement learning library","volume":"23","author":"Weng","year":"2022","journal-title":"Journal of Machine Learning Research"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.22331\/q-2025-03-12-1660"},{"issue":"273","key":"ref38","first-page":"1","article-title":"Pearl: A production-ready reinforcement learning agent","volume":"25","author":"Zhu","year":"2024","journal-title":"Journal of Machine Learning Research"}],"event":{"name":"2025 IEEE International Conference on Quantum Computing and Engineering (QCE)","location":"Albuquerque, NM, USA","start":{"date-parts":[[2025,8,30]]},"end":{"date-parts":[[2025,9,5]]}},"container-title":["2025 IEEE International Conference on Quantum Computing and Engineering (QCE)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11249812\/11249813\/11250169.pdf?arnumber=11250169","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,12,2]],"date-time":"2025-12-02T06:18:55Z","timestamp":1764656335000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11250169\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,8,30]]},"references-count":38,"URL":"https:\/\/doi.org\/10.1109\/qce65121.2025.00181","relation":{},"subject":[],"published":{"date-parts":[[2025,8,30]]}}}