{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,29]],"date-time":"2026-08-29T15:49:30Z","timestamp":1788018570517,"version":"build-2784847793"},"reference-count":28,"publisher":"IEEE","license":[{"start":{"date-parts":[[2023,10,1]],"date-time":"2023-10-01T00:00:00Z","timestamp":1696118400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2023,10,1]],"date-time":"2023-10-01T00:00:00Z","timestamp":1696118400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2023,10,1]]},"DOI":"10.1109\/iros55552.2023.10342305","type":"proceedings-article","created":{"date-parts":[[2023,12,13]],"date-time":"2023-12-13T14:17:55Z","timestamp":1702477075000},"page":"9301-9308","source":"Crossref","is-referenced-by-count":53,"title":["SCRIMP: Scalable Communication for Reinforcement- and Imitation-Learning-Based Multi-Agent Pathfinding"],"prefix":"10.1109","author":[{"given":"Yutong","family":"Wang","sequence":"first","affiliation":[{"name":"College of Design and Engineering, National University of Singapore,Department of Mechanical Engineering,Singapore"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bairan","family":"Xiang","sequence":"additional","affiliation":[{"name":"College of Design and Engineering, National University of Singapore,Department of Mechanical Engineering,Singapore"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shinan","family":"Huang","sequence":"additional","affiliation":[{"name":"College of Design and Engineering, National University of Singapore,Department of Mechanical Engineering,Singapore"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Guillaume","family":"Sartoretti","sequence":"additional","affiliation":[{"name":"College of Design and Engineering, National University of Singapore,Department of Mechanical Engineering,Singapore"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1609\/socs.v3i1.18243"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1007\/BF01840371"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1016\/j.artint.2014.11.001"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1016\/j.artint.2014.11.006"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2019.2903261"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/lra.2021.3062803"},{"key":"ref7","article-title":"SCRIMP: Scalable communication for reinforcement- and imitation-learning-based multi-agent pathfinding","author":"Wang","year":"2023","journal-title":"Accepted as an extended abstract (poster presentation) at AAMAS"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1007\/s43154-022-00091-8"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2022.3152688"},{"key":"ref10","article-title":"Efficient communication in multi-agent reinforcement learning via variance based control","volume":"32","author":"Zhang","year":"2019","journal-title":"Advances in Neural Information Processing Systems"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v32i1.11794"},{"key":"ref12","first-page":"4295","article-title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning","author":"Rashid","year":"2018","journal-title":"ICML"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3077863"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA48506.2021.9560748"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/lra.2021.3139145"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA46639.2022.9811643"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1609\/socs.v10i1.18510"},{"key":"ref18","article-title":"Attention is all you need","volume":"30","author":"Vaswani","year":"2017","journal-title":"Advances in neural information processing systems"},{"key":"ref19","first-page":"1355","article-title":"FCMNet: Full Communication Memory Net for team-level cooperation in multi-agent systems","author":"Wang","year":"2022","journal-title":"AAMAS"},{"key":"ref20","article-title":"A simple neural attentive meta-learner","author":"Mishra","year":"2017","journal-title":"arXiv preprint"},{"key":"ref21","first-page":"7487","article-title":"Stabilizing transformers for reinforcement learning","volume-title":"International conference on machine learning","author":"Parisotto"},{"key":"ref22","article-title":"Proximal policy optimization algorithms","author":"Schulman","year":"2017","journal-title":"arXiv preprint"},{"key":"ref23","article-title":"Value-decomposition networks for cooperative multi-agent learning","author":"Sunehag","year":"2017","journal-title":"arXiv preprint"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1609\/icaps.v30i1.6661"},{"key":"ref25","article-title":"Exploration in deep reinforcement learning: a comprehensive survey","author":"Yang","year":"2021","journal-title":"arXiv preprint"},{"key":"ref26","article-title":"A survey of exploration methods in reinforcement learning","author":"Amin","year":"2021","journal-title":"arXiv preprint"},{"key":"ref27","first-page":"507","article-title":"Agent57: Outperforming the atari human benchmark","volume-title":"International Conference on Machine Learning","author":"Badia"},{"key":"ref28","article-title":"Episodic curiosity through reachability","author":"Savinov","year":"2018","journal-title":"arXiv preprint"}],"event":{"name":"2023 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)","location":"Detroit, MI, USA","start":{"date-parts":[[2023,10,1]]},"end":{"date-parts":[[2023,10,5]]}},"container-title":["2023 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/10341341\/10341342\/10342305.pdf?arnumber=10342305","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,8,18]],"date-time":"2025-08-18T19:29:55Z","timestamp":1755545395000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10342305\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,10,1]]},"references-count":28,"URL":"https:\/\/doi.org\/10.1109\/iros55552.2023.10342305","relation":{},"subject":[],"published":{"date-parts":[[2023,10,1]]}}}