{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,21]],"date-time":"2026-07-21T12:48:04Z","timestamp":1784638084954,"version":"3.55.0"},"reference-count":52,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"4","license":[{"start":{"date-parts":[[2023,12,1]],"date-time":"2023-12-01T00:00:00Z","timestamp":1701388800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/legalcode"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Netw. Serv. Manage."],"published-print":{"date-parts":[[2023,12]]},"DOI":"10.1109\/tnsm.2023.3267809","type":"journal-article","created":{"date-parts":[[2023,4,18]],"date-time":"2023-04-18T17:36:18Z","timestamp":1681839378000},"page":"4416-4434","source":"Crossref","is-referenced-by-count":43,"title":["Multi-Agent Deep Reinforcement Learning for Cooperative Computing Offloading and Route Optimization in Multi Cloud-Edge Networks"],"prefix":"10.1109","volume":"20","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-1608-1135","authenticated-orcid":false,"given":"Akito","family":"Suzuki","sequence":"first","affiliation":[{"name":"NTT Network Service Systems Laboratories, NTT Corporation, Tokyo, Japan"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6501-7095","authenticated-orcid":false,"given":"Masahiro","family":"Kobayashi","sequence":"additional","affiliation":[{"name":"NTT Network Service Systems Laboratories, NTT Corporation, Tokyo, Japan"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-2177-5027","authenticated-orcid":false,"given":"Eiji","family":"Oki","sequence":"additional","affiliation":[{"name":"Graduate School of Informatics, Kyoto University, Kyoto, Japan"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2019.2892176"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/TASE.2020.3000946"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/TCCN.2020.3018159"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/TC.2020.2969148"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/CCGrid51090.2021.00039"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/JIOT.2021.3095677"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1587\/transinf.2021DAP0010"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2020.3043038"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/TNN.1998.712192"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v30i1.10295"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1587\/transcom.2019EBP3114"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.3233\/KES-2010-0206"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICC45855.2022.9838540"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1201\/b12733"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-60990-0_12"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1007\/s10489-022-04105-y"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1007\/s10462-021-09996-w"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1038\/nature14236"},{"key":"ref19","first-page":"29","article-title":"Deep recurrent Q-learning for partially observable MDPs","volume-title":"Proc. AAAI Fall Symp. Ser.","author":"Hausknecht"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1287\/moor.27.4.819.297"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-28929-8"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1016\/B978-1-55860-307-3.50049-6"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1371\/journal.pone.0172395"},{"key":"ref24","first-page":"2085","article-title":"Value-decomposition networks for cooperative multi-agent learning based on team reward","volume-title":"Proc. AAMAS","author":"Sunehag"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/ICCCN52240.2021.9522308"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/TNSM.2022.3149243"},{"key":"ref27","first-page":"1","article-title":"Empirical evaluation of gated recurrent neural networks on sequence modeling","volume-title":"Proc. NIPS Workshop","author":"Chung"},{"key":"ref28","article-title":"Adam: A method for stochastic optimization","author":"Kingma","year":"2014","journal-title":"arXiv:1412.6980"},{"key":"ref29","first-page":"8026","article-title":"PyTorch: An imperative style, high-performance deep learning library","volume-title":"Proc. NIPS","author":"Paszke"},{"key":"ref30","article-title":"The StarCraft multi-agent challenge","author":"Samvelyan","year":"2019","journal-title":"arXiv:1902.04043"},{"key":"ref31","article-title":"Rethinking the implementation tricks and monotonicity constraint in cooperative multi-agent reinforcement learning","author":"Hu","year":"2021","journal-title":"arXiv:2102.03479"},{"key":"ref32","volume-title":"GLPK","year":"2022"},{"key":"ref33","first-page":"1","article-title":"The new Internet2 network","volume-title":"Proc. GLIF Meeting","author":"Summerhill"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1002\/net.20371"},{"key":"ref35","article-title":"An introduction to mean field games using probabilistic methods","author":"Vasiliadis","year":"2019","journal-title":"arXiv:1907.01411"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1109\/JIOT.2020.3008299"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/TVT.2020.3043851"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1109\/JIOT.2020.2983741"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2020.3021907"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2021.3075028"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2019.2922702"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2019.2893118"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2020.2979774"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2020.2984520"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2020.2967559"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2021.3122992"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1109\/LWC.2018.2845882"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1109\/TCOMM.2021.3119075"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1109\/JSTSP.2022.3140660"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1109\/TNSM.2020.3008005"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1109\/TNSM.2022.3210012"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.1109\/TNSM.2022.3208776"}],"container-title":["IEEE Transactions on Network and Service Management"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/4275028\/10355751\/10104143.pdf?arnumber=10104143","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,12,20]],"date-time":"2023-12-20T00:04:36Z","timestamp":1703030676000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10104143\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,12]]},"references-count":52,"journal-issue":{"issue":"4"},"URL":"https:\/\/doi.org\/10.1109\/tnsm.2023.3267809","relation":{},"ISSN":["1932-4537","2373-7379"],"issn-type":[{"value":"1932-4537","type":"electronic"},{"value":"2373-7379","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,12]]}}}