{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,8]],"date-time":"2026-05-08T15:44:06Z","timestamp":1778255046566,"version":"3.51.4"},"reference-count":51,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"4","license":[{"start":{"date-parts":[[2026,4,1]],"date-time":"2026-04-01T00:00:00Z","timestamp":1775001600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2026,4,1]],"date-time":"2026-04-01T00:00:00Z","timestamp":1775001600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,4,1]],"date-time":"2026-04-01T00:00:00Z","timestamp":1775001600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"name":"Hong Kong Research Grant Council"},{"name":"General Research Fund","award":["11216323"],"award-info":[{"award-number":["11216323"]}]},{"name":"Research Impact Fund"},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62272357"],"award-info":[{"award-number":["62272357"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Pattern Anal. Mach. Intell."],"published-print":{"date-parts":[[2026,4]]},"DOI":"10.1109\/tpami.2025.3642900","type":"journal-article","created":{"date-parts":[[2025,12,11]],"date-time":"2025-12-11T18:45:23Z","timestamp":1765478723000},"page":"4275-4289","source":"Crossref","is-referenced-by-count":1,"title":["A Unified Experience Replay Framework for Spiking Deep Reinforcement Learning"],"prefix":"10.1109","volume":"48","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-4857-5439","authenticated-orcid":false,"given":"Meng","family":"Xu","sequence":"first","affiliation":[{"name":"Department of Computer Science, City University of Hong Kong, Hong Kong, SAR, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8563-148X","authenticated-orcid":false,"given":"Xinhong","family":"Chen","sequence":"additional","affiliation":[{"name":"Department of Computer Science, City University of Hong Kong, Hong Kong, SAR, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8403-1776","authenticated-orcid":false,"given":"Bingyi","family":"Liu","sequence":"additional","affiliation":[{"name":"School of Computer Science and Artificial Intelligence, Wuhan University of Technology, Wuhan, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0005-2109-3829","authenticated-orcid":false,"given":"Yi-Rong","family":"Lin","sequence":"additional","affiliation":[{"name":"AI Research Center, Hon Hai Research Institute, Taipei, Taiwan"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0475-3689","authenticated-orcid":false,"given":"Yung-Hui","family":"Li","sequence":"additional","affiliation":[{"name":"AI Research Center, Hon Hai Research Institute, Taipei, Taiwan"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9318-1482","authenticated-orcid":false,"given":"Jianping","family":"Wang","sequence":"additional","affiliation":[{"name":"Department of Computer Science, City University of Hong Kong, Hong Kong, SAR, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2021.3054625"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1007\/s10462-021-09997-9"},{"key":"ref3","first-page":"2016","article-title":"Deep reinforcement learning with population-coded spiking neural network for continuous control","volume-title":"Proc. Conf. Robot Learn.","author":"Tang","year":"2021"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.3389\/fnins.2024.1431222"},{"key":"ref5","article-title":"Deep reinforcement learning with spiking Q-learning","author":"Chen","year":"2022"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.3389\/fnbot.2022.1075647"},{"key":"ref7","article-title":"Biologically-plausible topology improved spiking actor network for efficient deep reinforcement learning","author":"Zhang","year":"2024"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN60899.2024.10650965"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ICCSI55536.2022.9970598"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/IROS45743.2020.9340948"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2023.3264836"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/IROS55552.2023.10341738"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/RADAR54928.2023.10371008"},{"key":"ref14","first-page":"3061","article-title":"Revisiting fundamentals of experience replay","volume-title":"Proc. Proc. Int. Conf. Mach. Learn.","author":"Fedus","year":"2020"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1007\/s13042-023-01981-9"},{"key":"ref16","article-title":"Large batch experience replay","author":"Lahire","year":"2021"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58607-2_23"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.3389\/fnins.2019.00095"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR42600.2020.01357"},{"key":"ref20","article-title":"Optimal ANN-SNN conversion for high-accuracy and ultra-low-latency spiking neural networks","author":"Bu","year":"2023"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v33i01.33011311"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00266"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2021.3111897"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.00762"},{"key":"ref25","first-page":"1","article-title":"Learning to prune deep neural networks via layer-wise optimal brain surgeon","volume-title":"Proc. Adv. Neural Inform. Process. Syst.","volume":"30","author":"Dong"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/TCYB.2022.3198259"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2023\/340"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2024.3352653"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v36i1.19879"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.3389\/fnins.2024.1325062"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1007\/978-981-99-8073-4_14"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2022.3203050"},{"key":"ref33","article-title":"Prioritized experience replay","author":"Schaul"},{"key":"ref34","article-title":"Offline reinforcement learning with value-based episodic memory","author":"Ma","year":"2021"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2021\/365"},{"key":"ref36","first-page":"1","article-title":"Synthetic experience replay","volume-title":"Proc., Adv. Neural Inform. Process. Syst.","volume":"36","author":"Lu","year":"2024"},{"key":"ref37","article-title":"Memory replay with data compression for continual learning","author":"Wang","year":"2022"},{"key":"ref38","first-page":"1","article-title":"Uncertainty-based experience replay for task-agnostic continual reinforcement learning","volume":"1","author":"Remonda","year":"2025","journal-title":"Trans. Mach. Learn. Res."},{"key":"ref39","first-page":"1","article-title":"A framework of dual replay buffer: Balancing forgetting and generalization in reinforcement learning","volume-title":"Proc. 2nd Workshop Scaling Up Reinforcement Learn., Int. Joint Conf. Artif. Intell.","author":"Zhang","year":"2019"},{"key":"ref40","article-title":"InfoBatch: Lossless training speed up by unbiased dynamic data pruning","author":"Qin","year":"2023"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2023.3302804"},{"key":"ref42","first-page":"2835","article-title":"Mitigating off-policy bias in actor-critic methods with one-step Q-learning: A novel correction approach","volume":"1","author":"Saglam","year":"2024","journal-title":"Trans. Mach. Learn. Res."},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2024.3385570"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1137\/120867925"},{"key":"ref45","first-page":"2159","article-title":"Deterministic policy gradient: Convergence analysis","volume-title":"Proc. Uncertainty Artif. Intell.","author":"Xiong","year":"2022"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1109\/MCI.2025.3541572"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1109\/IROS58592.2024.10802416"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1109\/TCYB.2022.3170485"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA55743.2025.11128063"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1613\/jair.1.14819"},{"key":"ref51","article-title":"Efficient episodic memory utilization of cooperative multi-agent reinforcement learning","author":"Na","year":"2024"}],"container-title":["IEEE Transactions on Pattern Analysis and Machine Intelligence"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/34\/11424231\/11297854.pdf?arnumber=11297854","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,3,10]],"date-time":"2026-03-10T01:34:05Z","timestamp":1773106445000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11297854\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,4]]},"references-count":51,"journal-issue":{"issue":"4"},"URL":"https:\/\/doi.org\/10.1109\/tpami.2025.3642900","relation":{},"ISSN":["0162-8828","2160-9292","1939-3539"],"issn-type":[{"value":"0162-8828","type":"print"},{"value":"2160-9292","type":"electronic"},{"value":"1939-3539","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,4]]}}}