{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,9,8]],"date-time":"2024-09-08T11:25:26Z","timestamp":1725794726211},"reference-count":17,"publisher":"IEEE","license":[{"start":{"date-parts":[[2023,12,4]],"date-time":"2023-12-04T00:00:00Z","timestamp":1701648000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2023,12,4]],"date-time":"2023-12-04T00:00:00Z","timestamp":1701648000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2023,12,4]]},"DOI":"10.1109\/globecom54140.2023.10436722","type":"proceedings-article","created":{"date-parts":[[2024,2,26]],"date-time":"2024-02-26T19:45:36Z","timestamp":1708976736000},"page":"3409-3414","source":"Crossref","is-referenced-by-count":1,"title":["Multi-Agent Reinforcement Learning for Wireless Networks Against Adversarial Communications"],"prefix":"10.1109","author":[{"given":"Zefang","family":"Lv","sequence":"first","affiliation":[{"name":"Xiamen University,Department of Information and Communication Engineering"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yifan","family":"Chen","sequence":"additional","affiliation":[{"name":"Xiamen University,Department of Information and Communication Engineering"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Liang","family":"Xiao","sequence":"additional","affiliation":[{"name":"Xiamen University,Department of Information and Communication Engineering"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Helin","family":"Yang","sequence":"additional","affiliation":[{"name":"Xiamen University,Department of Information and Communication Engineering"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiangyang","family":"Ji","sequence":"additional","affiliation":[{"name":"Tsinghua University,Department of Automation"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2022.3153316"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2021.3104633"},{"key":"ref3","first-page":"1883","article-title":"Adversarial policy training against deep reinforcement learning","volume-title":"Proc. USENIX Security Symposium","author":"Wu"},{"journal-title":"Gaussian process based message filtering for robust multi-agent cooperation in the presence of adversarial communication","year":"2020","author":"Mitchell","key":"ref4"},{"key":"ref5","first-page":"17271","article-title":"Succinct and robust multi-agent communication with temporal message control","volume-title":"Proc. Adv. Neural Inf. Process. Syst. (NIPS)","author":"Zhang"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/JSAC.2020.3036962"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/TCOMM.2022.3220870"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/TCOMM.2022.3229033"},{"key":"ref9","first-page":"7974","article-title":"Policy teaching via environment poisoning: Training-time adversarial attacks against rein-forcement learning","volume-title":"Proc. Int. Conf. Mach. Learn. (ICML)","author":"Rakhsha"},{"article-title":"c-MBA: Adversarial attack for cooperative MARL using learned dynamics model","volume-title":"Proc. Adv. Neural Inf. Process. Syst. (NIPS)","author":"Pham","key":"ref10"},{"key":"ref11","first-page":"21024","article-title":"Robust deep reinforcement learning against adversarial perturbations on state observations","volume-title":"Proc. Adv. NeuralInf. Process. Syst. (NIPS)","author":"Zhang"},{"article-title":"Robust multi-agent q-learning in cooperative games with adversaries","volume-title":"Proc. AAAI Conf. Artificial Intell. (AAAI)","author":"Nisioti","key":"ref12"},{"key":"ref13","first-page":"1418","article-title":"Mis-spoke or mis-lead: Achieving robustness in multi-agent communicative reinforcement learning","volume-title":"Proc. Int. Conf. Auton. Agents and Multi-Agent Syst. (AAMAS)","author":"Xue"},{"key":"ref14","first-page":"1394","article-title":"The emergence of adversarial commu-nication in multi-agent reinforcement learning","volume-title":"Proc. Conf. Robot Learn. (CoRL)","author":"Blumenkamp"},{"key":"ref15","first-page":"3040","article-title":"Social influence as intrinsic motivation for multi-agent deep reinforcement learning","volume-title":"Porc. Int. Conf. Mach. Learn. (ICML)","author":"Jaques"},{"key":"ref16","first-page":"1055","article-title":"Learning and testing resilience in cooperative multi-agent systems","volume-title":"Proc. Int. Conf. Auton. Agents and Multi-Agent Syst. (AAMAS)","author":"Phan"},{"article-title":"Certifiably robust policy learning against adversarial multi-agent communication","volume-title":"Proc. Int. Conf. Learn. Represent. (ICLR)","author":"Sun","key":"ref17"}],"event":{"name":"GLOBECOM 2023 - 2023 IEEE Global Communications Conference","start":{"date-parts":[[2023,12,4]]},"location":"Kuala Lumpur, Malaysia","end":{"date-parts":[[2023,12,8]]}},"container-title":["GLOBECOM 2023 - 2023 IEEE Global Communications Conference"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/10436708\/10436716\/10436722.pdf?arnumber=10436722","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,3,1]],"date-time":"2024-03-01T00:45:04Z","timestamp":1709253904000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10436722\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,12,4]]},"references-count":17,"URL":"https:\/\/doi.org\/10.1109\/globecom54140.2023.10436722","relation":{},"subject":[],"published":{"date-parts":[[2023,12,4]]}}}