{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,3]],"date-time":"2025-12-03T08:16:06Z","timestamp":1764749766583,"version":"3.46.0"},"reference-count":27,"publisher":"IEEE","license":[{"start":{"date-parts":[[2025,10,27]],"date-time":"2025-10-27T00:00:00Z","timestamp":1761523200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2025,10,27]],"date-time":"2025-10-27T00:00:00Z","timestamp":1761523200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100000996","name":"Department of Foreign Affairs and Trade","doi-asserted-by":"publisher","award":["LP200301507"],"award-info":[{"award-number":["LP200301507"]}],"id":[{"id":"10.13039\/501100000996","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025,10,27]]},"DOI":"10.1109\/iccais67508.2025.11262048","type":"proceedings-article","created":{"date-parts":[[2025,12,2]],"date-time":"2025-12-02T18:46:08Z","timestamp":1764701168000},"page":"110-115","source":"Crossref","is-referenced-by-count":0,"title":["Multi-Agent Planning for Pursuing Multiple Objects via Proximal Policy Optimisation"],"prefix":"10.1109","author":[{"given":"Hoa","family":"Van Nguyen","sequence":"first","affiliation":[{"name":"School of Electrical Engineering, Curtin University,Australia,WA 6102"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Diluka","family":"Moratuwage","sequence":"additional","affiliation":[{"name":"School of Engineering and Technology, Central Queensland University,Australia,QLD 4701"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Tran Thien Dat","family":"Nguyen","sequence":"additional","affiliation":[{"name":"School of Electrical Engineering, Curtin University,Australia,WA 6102"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Changbeom","family":"Shim","sequence":"additional","affiliation":[{"name":"School of Electrical Engineering, Curtin University,Australia,WA 6102"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ba-Ngu","family":"Vo","sequence":"additional","affiliation":[{"name":"School of Electrical Engineering, Curtin University,Australia,WA 6102"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1007\/s10514-011-9241-4"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/icra48891.2023.10160919"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/TIV.2023.3316196"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/TSP.2024.3423755"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/ICInfA.2015.7279288"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1177\/0278364906065023"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1145\/508791.508804"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1038\/nature14236"},{"issue":"54","key":"ref9","first-page":"1","article-title":"Deep reinforcement learning for swarm systems","volume":"20","author":"H\u00fcttenrauch","year":"2019","journal-title":"Journal of Machine Learning Research"},{"key":"ref10","first-page":"6382","article-title":"Multiagent actor-critic for mixed cooperative-competitive environments","author":"Lowe","year":"2017","journal-title":"Proc. of NeurIPS"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3068952"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2023.3331886"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1016\/B978-1-55860-307-3.50049-6"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/JAS.2021.1003814"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1287\/moor.27.4.819.297"},{"key":"ref16","first-page":"10707","article-title":"Shared experience actorcritic for multi-agent reinforcement learning","volume":"33","author":"Christianos","year":"2020","journal-title":"Proc. of NeurIPS"},{"key":"ref17","first-page":"3991","article-title":"Celebrating diversity in shared multi-agent reinforcement learning","volume":"34","author":"Li","year":"2021","journal-title":"Proc. of NeurIPS"},{"key":"ref18","first-page":"24611","article-title":"The Surprising Effectiveness of PPO in Cooperative Multi-Agent Games","volume-title":"Proc. of NeurIPS","volume":"35","author":"Yu","year":"2022"},{"key":"ref19","first-page":"2085","article-title":"Value-decomposition networks for cooperative multi-agent learning based on team reward","author":"Sunehag","year":"2018","journal-title":"Proc. of AAMAS"},{"issue":"178","key":"ref20","first-page":"1","article-title":"Monotonic value function factorisation for deep multiagent reinforcement learning","volume":"21","author":"Rashid","year":"2020","journal-title":"Journal of Machine Learning Research"},{"key":"ref21","article-title":"QPLEX: Duplex dueling multi-agent q-learning","author":"Wang","year":"2021","journal-title":"Proc. of ICLR"},{"key":"ref22","first-page":"1538","article-title":"Tarmac: Targeted multi-agent communication","author":"Das","year":"2019","journal-title":"Proc. of ICML. PMLR"},{"key":"ref23","first-page":"10 199","article-title":"Weighted QMIX: Expanding monotonic value function factorisation for deep multi-agent reinforcement learning","volume":"33","author":"Rashid","year":"2020","journal-title":"Proc. of NeurIPS"},{"volume-title":"Reinforcement learning: An introduction","year":"2018","author":"Sutton","key":"ref24"},{"key":"ref25","article-title":"Proximal policy optimization algorithms","author":"Schulman","year":"2017","journal-title":"arXiv preprint"},{"key":"ref26","article-title":"Highdimensional continuous control using generalized advantage estimation","author":"Schulman","year":"2016","journal-title":"Proc. of ICLR"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/TSP.2019.2946023"}],"event":{"name":"2025 14th International Conference on Control, Automation and Information Sciences (ICCAIS)","start":{"date-parts":[[2025,10,27]]},"location":"Jeju, Korea, Republic of","end":{"date-parts":[[2025,10,29]]}},"container-title":["2025 14th International Conference on Control, Automation and Information Sciences (ICCAIS)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11262033\/11262046\/11262048.pdf?arnumber=11262048","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,12,3]],"date-time":"2025-12-03T08:12:36Z","timestamp":1764749556000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11262048\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,10,27]]},"references-count":27,"URL":"https:\/\/doi.org\/10.1109\/iccais67508.2025.11262048","relation":{},"subject":[],"published":{"date-parts":[[2025,10,27]]}}}