{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,18]],"date-time":"2026-06-18T15:41:35Z","timestamp":1781797295495,"version":"3.54.5"},"reference-count":44,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","license":[{"start":{"date-parts":[[2023,1,1]],"date-time":"2023-01-01T00:00:00Z","timestamp":1672531200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0\/"}],"funder":[{"name":"German Federal Ministry of Education and Research (BMBF) Project KICK","award":["16KIS1102K"],"award-info":[{"award-number":["16KIS1102K"]}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Open J. Commun. Soc."],"published-print":{"date-parts":[[2023]]},"DOI":"10.1109\/ojcoms.2023.3273310","type":"journal-article","created":{"date-parts":[[2023,5,11]],"date-time":"2023-05-11T00:22:28Z","timestamp":1683764548000},"page":"1141-1155","source":"Crossref","is-referenced-by-count":9,"title":["Inter-Cell Network Slicing With Transfer Learning Empowered Multi-Agent Deep Reinforcement Learning"],"prefix":"10.1109","volume":"4","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-9303-0089","authenticated-orcid":false,"given":"Tianlun","family":"Hu","sequence":"first","affiliation":[{"name":"Network Automation Department, NSSR Lab, Nokia Bell Labs, Stuttgart, Germany"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7846-3812","authenticated-orcid":false,"given":"Qi","family":"Liao","sequence":"additional","affiliation":[{"name":"Network Automation Department, NSSR Lab, Nokia Bell Labs, Stuttgart, Germany"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4307-2990","authenticated-orcid":false,"given":"Qiang","family":"Liu","sequence":"additional","affiliation":[{"name":"School of Computing, University of Nebraska&#x2013;Lincoln, Lincoln, NE, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Georg","family":"Carle","sequence":"additional","affiliation":[{"name":"Department of Computer Engineering, Technical University of Munich, Munich, Germany"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICC.2016.7511617"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1109\/JIOT.2021.3052691"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2018.2881964"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/INFOCOM.2018.8485853"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/WCNC49053.2021.9417321"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/ICBASE53849.2021.00107"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2019.2933417"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1109\/TNSE.2020.2978856"},{"key":"ref31","article-title":"Autonomic performance optimization with application to self-Architecting software systems","author":"ewing","year":"2015"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1007\/s11134-006-7587-7"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/GLOBECOM42002.2020.9322106"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/TNET.2018.2866410"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/ICNP49622.2020.9259378"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/TSP.2019.2908147"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/MCOM.2017.1601119"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/ICC45855.2022.9838518"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2009.191"},{"key":"ref39","first-page":"1008","article-title":"Actor-critic algorithms","author":"konda","year":"1999","journal-title":"Proc NIPS"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/IWCMC51323.2021.9498647"},{"key":"ref38","first-page":"2137","article-title":"Learning to communicate with deep multi-agent reinforcement learning","author":"foerster","year":"2016","journal-title":"Proc NIPS"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/TR.2021.3062045"},{"key":"ref18","article-title":"Transfer learning for future wireless networks: A comprehensive survey","author":"nguyen","year":"2021","journal-title":"arXiv 2102 07572"},{"key":"ref24","article-title":"Transfer learning in deep reinforcement learning: A survey","author":"zhu","year":"2020","journal-title":"arXiv 2009 07888"},{"key":"ref23","first-page":"1633","article-title":"Transfer learning for reinforcement learning domains: A survey","volume":"10","author":"taylor","year":"2009","journal-title":"J Mach Learn Res"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/TII.2021.3132136"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/LCN52139.2021.9524965"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TCCN.2020.2964761"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00503"},{"key":"ref41","first-page":"387","article-title":"Deterministic policy gradient algorithms","author":"silver","year":"2014","journal-title":"Proc ICML"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/JPROC.2020.3004555"},{"key":"ref44","article-title":"Wireless world initiative new radio-winner +","author":"meinil\u00e4","year":"2023"},{"key":"ref21","first-page":"2125","article-title":"Transfer learning via inter-task mappings for temporal difference learning","volume":"8","author":"taylor","year":"2007","journal-title":"J Mach Learn Res"},{"key":"ref43","year":"2009","journal-title":"White paper Self-organizing network (SON) Introducing the Nokia Siemens networks SON suite-an efficient future-proof platform for SON"},{"key":"ref28","article-title":"Technical specification group services and system aspects; management and orchestration; concepts, use cases and requirements, V17.2.0","year":"2021"},{"key":"ref27","article-title":"Transfer learning in multi-agent reinforcement learning with double Q-networks for distributed resource sharing in V2X communication","author":"zafar","year":"2021","journal-title":"arXiv 2107 06195"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/90.879343"},{"key":"ref8","article-title":"System architecture for the 5G system (5GS), V17.4.0","year":"2022"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1155\/2020\/6290375"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1145\/3005745.3005750"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/TMC.2019.2905599"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/LWC.2018.2842189"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/TNET.2020.2979667"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1155\/2021\/9966366"},{"key":"ref40","article-title":"Addressing function approximation error in actor-critic methods","author":"fujimoto","year":"2018","journal-title":"arXiv 1802 09477"}],"container-title":["IEEE Open Journal of the Communications Society"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8782661\/10008219\/10121811.pdf?arnumber=10121811","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,6,12]],"date-time":"2023-06-12T18:31:52Z","timestamp":1686594712000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10121811\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023]]},"references-count":44,"URL":"https:\/\/doi.org\/10.1109\/ojcoms.2023.3273310","relation":{},"ISSN":["2644-125X"],"issn-type":[{"value":"2644-125X","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023]]}}}