{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,12]],"date-time":"2026-07-12T00:09:37Z","timestamp":1783814977053,"version":"3.55.0"},"reference-count":45,"publisher":"IEEE","license":[{"start":{"date-parts":[[2022,5,23]],"date-time":"2022-05-23T00:00:00Z","timestamp":1653264000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2022,5,23]],"date-time":"2022-05-23T00:00:00Z","timestamp":1653264000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100012166","name":"National Key Research and Development Program of China","doi-asserted-by":"publisher","award":["2020AAA0107400"],"award-info":[{"award-number":["2020AAA0107400"]}],"id":[{"id":"10.13039\/501100012166","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"NSFC","doi-asserted-by":"publisher","award":["12071145"],"award-info":[{"award-number":["12071145"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100003399","name":"STCSM","doi-asserted-by":"publisher","award":["19ZR141420"],"award-info":[{"award-number":["19ZR141420"]}],"id":[{"id":"10.13039\/501100003399","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100012226","name":"Fundamental Research Funds for the Central Universities","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100012226","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2022,5,23]]},"DOI":"10.1109\/icra46639.2022.9811643","type":"proceedings-article","created":{"date-parts":[[2022,7,12]],"date-time":"2022-07-12T19:36:40Z","timestamp":1657654600000},"page":"10695-10701","source":"Crossref","is-referenced-by-count":56,"title":["Multi-Agent Path Finding with Prioritized Communication Learning"],"prefix":"10.1109","author":[{"given":"Wenhao","family":"Li","sequence":"first","affiliation":[{"name":"School of Computer Science and Technology, East China Normal University,Shanghai,China,200062"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hongjun","family":"Chen","sequence":"additional","affiliation":[{"name":"School of Computer Science and Technology, East China Normal University,Shanghai,China,200062"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bo","family":"Jin","sequence":"additional","affiliation":[{"name":"School of Computer Science and Technology, East China Normal University,Shanghai,China,200062"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Wenzhe","family":"Tan","sequence":"additional","affiliation":[{"name":"School of Computer Science and Technology, East China Normal University,Shanghai,China,200062"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hongyuan","family":"Zha","sequence":"additional","affiliation":[{"name":"School of Computer Science and Technology, East China Normal University,Shanghai,China,200062"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiangfeng","family":"Wang","sequence":"additional","affiliation":[{"name":"School of Computer Science and Technology, East China Normal University,Shanghai,China,200062"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref39","first-page":"30","article-title":"Cluster based routing protocol for mobile ad hoc networks","volume":"8","author":"rezaee","year":"2009","journal-title":"INFOCOM"},{"key":"ref38","article-title":"Social influence as intrinsic motivation for multi-agent deep reinforcement learning","author":"jaques","year":"2019","journal-title":"ICML"},{"key":"ref33","article-title":"Bootstrap your own latent: A new approach to self-supervised learning","author":"grill","year":"2020","journal-title":"NeurIPS"},{"key":"ref32","doi-asserted-by":"crossref","first-page":"529","DOI":"10.1038\/nature14236","article-title":"Human-level control through deep reinforcement learning","volume":"518","author":"mnih","year":"2015","journal-title":"Nature"},{"key":"ref31","article-title":"Learning neural network policies with guided policy search under unknown dynamics","author":"levine","year":"2014","journal-title":"NeurIPS"},{"key":"ref30","article-title":"Learning complex neural network policies with trajectory optimization","author":"levine","year":"2014","journal-title":"ICML"},{"key":"ref37","article-title":"Inequity aversion improves cooperation in intertemporal social dilemmas","author":"hughes","year":"2018","journal-title":"NeurIPS"},{"key":"ref36","article-title":"Prosocial learning agents solve generalized stag hunts better than selfish ones","author":"peysakhovich","year":"2018","journal-title":"AAMAS"},{"key":"ref35","article-title":"Consequentialist conditional cooperation in social dilemmas with imperfect information","author":"peysakhovich","year":"2018","journal-title":"AAAI Workshop"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1017\/CBO9780511811654"},{"key":"ref10","article-title":"Multi-agent pathfinding: Definitions, variants, and benchmarks","author":"stern","year":"2019","journal-title":"SOCS"},{"key":"ref40","article-title":"Asynchronous methods for deep reinforcement learning","author":"mnih","year":"2016","journal-title":"ICML"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2013.6631119"},{"key":"ref12","article-title":"Distributed reinforcement learning for multi-robot decentralized collective construction","author":"sartoretti","year":"2018","journal-title":"DARS"},{"key":"ref13","article-title":"On the pitfalls of measuring emergent communication","author":"lowe","year":"2019","journal-title":"AAMAS"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v33i01.33017643"},{"key":"ref15","article-title":"Improving collaborative pathfinding using map abstraction","author":"sturtevant","year":"2006","journal-title":"AIIDE"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2010.5649438"},{"key":"ref17","first-page":"55","article-title":"MAPP: a scalable multi-agent path planning algorithm with tractability and completeness guarantees","volume":"42","author":"wang","year":"2011","journal-title":"Journal of Artificial Intelligence Research"},{"key":"ref18","article-title":"Deep reinforcement learning based multi-agent pathfinding","author":"zhiyao","year":"2020","journal-title":"Technical Report"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2020.2972862"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.1997.606881"},{"key":"ref4","article-title":"Reciprocal n-body collision avoidance","author":"berg","year":"2009","journal-title":"ISRR"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.1989.100033"},{"key":"ref3","article-title":"Cooperative pathfinding","author":"silver","year":"2005","journal-title":"AIIDE"},{"key":"ref6","doi-asserted-by":"crossref","DOI":"10.1609\/icaps.v28i1.13883","article-title":"Adding heuristics to conflict-based search for multi-agent path finding","author":"felner","year":"2018","journal-title":"ICAPS"},{"key":"ref29","article-title":"Dynamic programming for partially observable stochastic games","author":"hansen","year":"2004","journal-title":"AAAI"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1016\/j.artint.2014.11.006"},{"key":"ref8","article-title":"Learning to cooperate: Application of deep reinforcement learning for online AGV path finding","author":"zhang","year":"2020","journal-title":"AAMAS"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2019.2903261"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1177\/0278364906065378"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3062803"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1126\/science.1254295"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA48506.2021.9560748"},{"key":"ref45","first-page":"3221","article-title":"Accelerating t-sne using tree-based algorithms","volume":"15","author":"maaten","year":"2014","journal-title":"J Mach Learn Res"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.1990.126028"},{"key":"ref21","doi-asserted-by":"crossref","first-page":"477","DOI":"10.1007\/BF01840371","article-title":"On multiple moving objects","volume":"2","author":"michael","year":"1987","journal-title":"Algorithmica"},{"key":"ref42","article-title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","author":"haarnoja","year":"2018","journal-title":"ICML"},{"key":"ref24","article-title":"Prioritized motion planning for multiple robots","author":"berg","year":"2005","journal-title":"IROS"},{"key":"ref41","article-title":"Starcraft II: A new challenge for reinforcement learning","volume":"abs 1708 4782","author":"vinyals","year":"2017","journal-title":"ArXiv"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1016\/S0921-8890(02)00256-7"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1016\/j.artint.2014.11.001"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1016\/S0921-8890(98)00051-7"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2017\/169"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.1989.100008"}],"event":{"name":"2022 IEEE International Conference on Robotics and Automation (ICRA)","location":"Philadelphia, PA, USA","start":{"date-parts":[[2022,5,23]]},"end":{"date-parts":[[2022,5,27]]}},"container-title":["2022 International Conference on Robotics and Automation (ICRA)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/9811522\/9811357\/09811643.pdf?arnumber=9811643","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,9,29]],"date-time":"2024-09-29T00:04:44Z","timestamp":1727568284000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9811643\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,5,23]]},"references-count":45,"URL":"https:\/\/doi.org\/10.1109\/icra46639.2022.9811643","relation":{},"subject":[],"published":{"date-parts":[[2022,5,23]]}}}