{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,25]],"date-time":"2026-04-25T14:24:27Z","timestamp":1777127067444,"version":"3.51.4"},"reference-count":36,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"13","license":[{"start":{"date-parts":[[2024,7,1]],"date-time":"2024-07-01T00:00:00Z","timestamp":1719792000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2024,7,1]],"date-time":"2024-07-01T00:00:00Z","timestamp":1719792000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2024,7,1]],"date-time":"2024-07-01T00:00:00Z","timestamp":1719792000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation Original Exploration Project of China","doi-asserted-by":"publisher","award":["62250004"],"award-info":[{"award-number":["62250004"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62001259"],"award-info":[{"award-number":["62001259"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62271244"],"award-info":[{"award-number":["62271244"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100017702","name":"Innovation and Entrepreneurship of Jiangsu Province High-Level Talent Program","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100017702","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Summit of the Six Top Talents Program of Jiangsu Province"},{"name":"Major Key Project of PCL"},{"DOI":"10.13039\/501100012457","name":"Basic and Frontier Research Project of PCL","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100012457","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Internet Things J."],"published-print":{"date-parts":[[2024,7,1]]},"DOI":"10.1109\/jiot.2024.3389208","type":"journal-article","created":{"date-parts":[[2024,4,16]],"date-time":"2024-04-16T17:27:09Z","timestamp":1713288429000},"page":"24210-24221","source":"Crossref","is-referenced-by-count":5,"title":["User-Centric Resource Allocation in FD-RAN: A Stepwise Reinforcement Learning Approach"],"prefix":"10.1109","volume":"11","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-2021-4570","authenticated-orcid":false,"given":"Jiacheng","family":"Chen","sequence":"first","affiliation":[{"name":"Department of Strategic and Advanced Interdisciplinary Research, Peng Cheng Laboratory, Shenzhen, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5862-9256","authenticated-orcid":false,"given":"Jingbo","family":"Liu","sequence":"additional","affiliation":[{"name":"School of Electronic Information and Electrical Engineering, Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6549-8917","authenticated-orcid":false,"given":"Haibo","family":"Zhou","sequence":"additional","affiliation":[{"name":"School of Electronic Science and Engineering, Nanjing University, Nanjing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.23919\/JCIN.2019.9005430"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/TCCN.2023.3266379"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/JSAC.2015.2417011"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/COMST.2018.2870996"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2017.2751467"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/TSP.2018.2862398"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/MNET.115.2200027"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/MNET.124.2200241"},{"issue":"2","key":"ref9","first-page":"171","article-title":"An introduction to prospect theory","volume":"13","author":"Levy","year":"1992","journal-title":"Political Psychol."},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2019.2905785"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2017.2653799"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/JSAC.2019.2933762"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2021.3122941"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2018.2879433"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/TCCN.2018.2809722"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/TSMC.2015.2392719"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/TSMC.2018.2813008"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/COMST.2021.3135829"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/JSAC.2023.3242704"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/JIOT.2018.2872441"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/GLOBECOM38437.2019.9013191"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2017.2769644"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2020.3032991"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2019.2961405"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2019.2897134"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/JSAC.2019.2933962"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2021.3103058"},{"key":"ref28","first-page":"1146","article-title":"Stabilising experience replay for deep multi-agent reinforcement learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Foerster"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1145\/2756543"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2023.3236146"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/6GSUMMIT49458.2020.9083808"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/TCYB.2020.2977374"},{"key":"ref33","volume-title":"Reinforcement Learning: An Introduction","author":"Sutton","year":"2018"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1038\/nature14236"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v30i1.10295"},{"key":"ref36","first-page":"1995","article-title":"Dueling network architectures for deep reinforcement learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Wang"}],"container-title":["IEEE Internet of Things Journal"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6488907\/10570342\/10500813.pdf?arnumber=10500813","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,27]],"date-time":"2024-06-27T05:10:20Z","timestamp":1719465020000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10500813\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,7,1]]},"references-count":36,"journal-issue":{"issue":"13"},"URL":"https:\/\/doi.org\/10.1109\/jiot.2024.3389208","relation":{},"ISSN":["2327-4662","2372-2541"],"issn-type":[{"value":"2327-4662","type":"electronic"},{"value":"2372-2541","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,7,1]]}}}