{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T10:16:30Z","timestamp":1783160190438,"version":"3.54.6"},"reference-count":40,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100005022","name":"Beijing Jiaotong University","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100005022","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61903022"],"award-info":[{"award-number":["61903022"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100002338","name":"Ministry of Education of the People&apos;s Republic of China","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100002338","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Neurocomputing"],"published-print":{"date-parts":[[2026,7]]},"DOI":"10.1016\/j.neucom.2026.133753","type":"journal-article","created":{"date-parts":[[2026,4,21]],"date-time":"2026-04-21T06:59:11Z","timestamp":1776754751000},"page":"133753","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["Learning-based multi-agent path finding for constrained autonomous vehicles via knowledge-embedded time-varying topology modeling"],"prefix":"10.1016","volume":"687","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-1795-6423","authenticated-orcid":false,"given":"Sizhe","family":"Xiao","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9844-1055","authenticated-orcid":false,"given":"Lijing","family":"Dong","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shengli","family":"Du","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.neucom.2026.133753_bib0005","doi-asserted-by":"crossref","DOI":"10.1016\/j.neucom.2024.128423","article-title":"Recent progress, challenges and future prospects of applied deep reinforcement learning: a practical perspective in path planning","volume":"608","author":"Zhang","year":"2024","journal-title":"Neurocomputing"},{"issue":"41","key":"10.1016\/j.neucom.2026.133753_bib0010","article-title":"Learning team-based navigation: a review of deep reinforcement learning techniques for multi-agent pathfinding","volume":"57","author":"Jaehoon","year":"2024","journal-title":"Artif. Intell. Rev."},{"key":"10.1016\/j.neucom.2026.133753_bib0015","series-title":"Proceedings of the Thirty-Second International Joint Conference on Artificial Intelligence (IJCAI)","first-page":"5503","article-title":"Multi-robot coordination and layout design for automated warehousing","author":"Zhang","year":"2023"},{"key":"10.1016\/j.neucom.2026.133753_bib0020","doi-asserted-by":"crossref","first-page":"591","DOI":"10.1613\/jair.2502","article-title":"A multiagent approach to autonomous intersection management","volume":"31","author":"Dresner","year":"2008","journal-title":"J. Artif. Intell. Res."},{"issue":"5","key":"10.1016\/j.neucom.2026.133753_bib0025","doi-asserted-by":"crossref","first-page":"1163","DOI":"10.1109\/TRO.2016.2593448","article-title":"Optimal multirobot path planning on graphs: complete algorithms and effective heuristics","volume":"32","author":"Yu","year":"2016","journal-title":"IEEE Trans. Robot."},{"key":"10.1016\/j.neucom.2026.133753_bib0030","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1016\/j.artint.2014.11.001","article-title":"Subdimensional expansion for multirobot path planning","volume":"219","author":"Wagner","year":"2015","journal-title":"Artif. Intell."},{"issue":"1","key":"10.1016\/j.neucom.2026.133753_bib0035","doi-asserted-by":"crossref","first-page":"429","DOI":"10.1007\/s10489-021-02397-0","article-title":"Prioritized planning algorithm for multi-robot collision avoidance based on artificial untraversable vertex","volume":"52","author":"Li","year":"2022","journal-title":"Appl. Intell."},{"key":"10.1016\/j.neucom.2026.133753_bib0040","series-title":"24th AAAI Conference on Artificial Intelligence (AAAI)","first-page":"173","article-title":"Finding optimal solutions to cooperative pathfinding problems","author":"Standley","year":"2010"},{"key":"10.1016\/j.neucom.2026.133753_bib0045","doi-asserted-by":"crossref","first-page":"40","DOI":"10.1016\/j.artint.2014.11.006","article-title":"Conflict-based search for optimal multi-agent pathfinding","volume":"219","author":"Sharon","year":"2015","journal-title":"Artif. Intell."},{"issue":"4","key":"10.1016\/j.neucom.2026.133753_bib0050","doi-asserted-by":"crossref","first-page":"2720","DOI":"10.1109\/TRO.2023.3258690","article-title":"Offline time-independent multiagent path planning","volume":"39","author":"Okumura","year":"2023","journal-title":"IEEE Trans. Robot."},{"key":"10.1016\/j.neucom.2026.133753_bib0055","doi-asserted-by":"crossref","first-page":"98","DOI":"10.1016\/j.neucom.2021.12.016","article-title":"A new approach to smooth path planning of mobile robot based on quartic bezier transition curve and improved PSO algorithm","volume":"473","author":"Xu","year":"2022","journal-title":"Neurocomputing"},{"key":"10.1016\/j.neucom.2026.133753_bib0060","doi-asserted-by":"crossref","DOI":"10.1016\/j.micpro.2020.103325","article-title":"Map-aco: an efficient protocol for multi-agent pathfinding in real-time wsn and decentralized iot systems","volume":"79","author":"Seyyedabbasi","year":"2020","journal-title":"Microprocess. Microsyst."},{"key":"10.1016\/j.neucom.2026.133753_bib0065","doi-asserted-by":"crossref","DOI":"10.1016\/j.neucom.2024.127764","article-title":"A hybrid optimization algorithm for multi-agent dynamic planning with guaranteed convergence in probability","volume":"592","author":"Zhang","year":"2024","journal-title":"Neurocomputing"},{"issue":"11","key":"10.1016\/j.neucom.2026.133753_bib0070","doi-asserted-by":"crossref","first-page":"13677","DOI":"10.1007\/s10489-022-04105-y","article-title":"A review of cooperative multi-agent deep reinforcement learning","volume":"53","author":"Oroojlooy","year":"2023","journal-title":"Appl. Intell."},{"key":"10.1016\/j.neucom.2026.133753_bib0075","series-title":"Proceedings of the AAAI Conference on Artificial Intelligence","first-page":"17541","article-title":"Learn to follow: decentralized lifelong multi-agent pathfinding via planning and learning","author":"Skrynnik","year":"2024"},{"key":"10.1016\/j.neucom.2026.133753_bib0080","series-title":"Proceedings of the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD)","first-page":"1400","article-title":"Learn to refine: synergistic multi-agent path optimization for lifelong conflict-free navigation of autonomous vehicles","author":"Li","year":"2025"},{"issue":"10","key":"10.1016\/j.neucom.2026.133753_bib0085","doi-asserted-by":"crossref","first-page":"10210","DOI":"10.1109\/LRA.2025.3598672","article-title":"Tasksimlf: efficient leader-follower multi-agent path finding with clustered pickup and delivery","volume":"10","author":"Zhuang","year":"2025","journal-title":"IEEE Robot. Autom. Lett."},{"issue":"1","key":"10.1016\/j.neucom.2026.133753_bib0090","doi-asserted-by":"crossref","first-page":"931","DOI":"10.1109\/TVT.2021.3129504","article-title":"Multi-agent reinforcement learning aided intelligent uav swarm for target tracking","volume":"71","author":"Xia","year":"2022","journal-title":"IEEE Trans. Veh. Technol."},{"issue":"6","key":"10.1016\/j.neucom.2026.133753_bib0095","doi-asserted-by":"crossref","first-page":"2358","DOI":"10.1109\/TNNLS.2020.3004893","article-title":"Formation control with collision avoidance through deep reinforcement learning using model-guided demonstration","volume":"32","author":"Sui","year":"2021","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"issue":"7","key":"10.1016\/j.neucom.2026.133753_bib0100","doi-asserted-by":"crossref","first-page":"4189","DOI":"10.1109\/TSMC.2023.3241337","article-title":"A deep reinforcement learning approach combined with model-based paradigms for multiagent formation control with collision avoidance","volume":"53","author":"Pu","year":"2023","journal-title":"IEEE Trans. Syst. Man Cybern. Syst."},{"issue":"3","key":"10.1016\/j.neucom.2026.133753_bib0105","doi-asserted-by":"crossref","first-page":"5896","DOI":"10.1109\/LRA.2022.3161699","article-title":"Reinforcement learned distributed multi-robot navigation with reciprocal velocity obstacle shaped rewards","volume":"7","author":"Han","year":"2022","journal-title":"IEEE Robot. Autom. Lett."},{"key":"10.1016\/j.neucom.2026.133753_bib0110","doi-asserted-by":"crossref","DOI":"10.1016\/j.ins.2023.119074","article-title":"A graph neural network based deep reinforcement learning algorithm for multi-agent leader-follower flocking","volume":"641","author":"Xiao","year":"2023","journal-title":"Inf. Sci."},{"key":"10.1016\/j.neucom.2026.133753_bib0115","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1016\/j.neunet.2022.09.012","article-title":"A leader-following paradigm based deep reinforcement learning method for multi-agent cooperation games","volume":"156","author":"Zhang","year":"2022","journal-title":"Neural Netw."},{"key":"10.1016\/j.neucom.2026.133753_bib0120","series-title":"2021 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)","first-page":"4769","article-title":"Hiding leader\u2019s identity in leader-follower navigation through multi-agent reinforcement learning","author":"Deka","year":"2021"},{"key":"10.1016\/j.neucom.2026.133753_bib0125","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1109\/TITS.2025.3573172","article-title":"An expert experience-enhanced security control approach for auvs of the underwater transportation cyber-physical systems","author":"Xi","year":"2025","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"issue":"22","key":"10.1016\/j.neucom.2026.133753_bib0130","doi-asserted-by":"crossref","first-page":"36420","DOI":"10.1109\/JIOT.2024.3409169","article-title":"High-sample-efficient multiagent reinforcement learning for navigation and collision avoidance of uav swarms in multitask environments","volume":"11","author":"Cheng","year":"2024","journal-title":"IEEE Internet Things J."},{"key":"10.1016\/j.neucom.2026.133753_bib0135","series-title":"2021 IEEE International Conference on Robotics and Automation (ICRA)","first-page":"8699","article-title":"Distributed heuristic multi-agent path finding with communication","author":"Ma","year":"2021"},{"key":"10.1016\/j.neucom.2026.133753_bib0140","doi-asserted-by":"crossref","DOI":"10.1016\/j.cie.2021.107621","article-title":"Deep deterministic policy gradient algorithm for crowd-evacuation path planning","volume":"161","author":"Li","year":"2021","journal-title":"Comput. Ind. Eng."},{"issue":"12","key":"10.1016\/j.neucom.2026.133753_bib0145","doi-asserted-by":"crossref","first-page":"17411","DOI":"10.1109\/TNNLS.2023.3303502","article-title":"When to switch: planning and learning for partially observable multi-agent pathfinding","volume":"35","author":"Skrynnik","year":"2024","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"issue":"5","key":"10.1016\/j.neucom.2026.133753_bib0150","doi-asserted-by":"crossref","first-page":"3739","DOI":"10.1109\/TRO.2023.3279903","article-title":"Dlsc: distributed multi-agent trajectory planning in maze-like dynamic environments using linear safe corridor","volume":"39","author":"Park","year":"2023","journal-title":"IEEE Trans. Robot."},{"key":"10.1016\/j.neucom.2026.133753_bib0155","series-title":"16th International Symposium on Distributed Autonomous Robotic Systems (DARS)","first-page":"42","article-title":"Vmas: a vectorized multi-agent simulator for collective robot learning","volume":"vol. 28","author":"Bettini","year":"2024"},{"key":"10.1016\/j.neucom.2026.133753_bib0160","series-title":"2021 China Automation Congress (CAC)","first-page":"3567","article-title":"Research on multi-robot path planning method based on improved maddpg algorithm","author":"Li","year":"2021"},{"issue":"19","key":"10.1016\/j.neucom.2026.133753_bib0165","doi-asserted-by":"crossref","first-page":"9295","DOI":"10.1007\/s10489-024-05679-5","article-title":"Deep reinforcement learning based mapless navigation for industrial amrs: advancements in generalization via potential risk state augmentation","volume":"54","author":"Xu","year":"2024","journal-title":"Appl. Intell."},{"key":"10.1016\/j.neucom.2026.133753_bib0170","series-title":"IEEE International Conference on Robotics and Automation (ICRA)","first-page":"448","article-title":"Cooperative multi-robot navigation in dynamic environment with deep reinforcement learning","author":"Han","year":"2020"},{"issue":"3","key":"10.1016\/j.neucom.2026.133753_bib0175","doi-asserted-by":"crossref","first-page":"177","DOI":"10.1049\/trit.2020.0024","article-title":"Multi-robot path planning based on a deep reinforcement learning DQN algorithm","volume":"5","author":"Yang","year":"2020","journal-title":"CAAI Trans. Intell. Technol."},{"issue":"1","key":"10.1016\/j.neucom.2026.133753_bib0180","doi-asserted-by":"crossref","first-page":"65","DOI":"10.1080\/00207543.2021.1998695","article-title":"Anti-conflict AGV path planning in automated container terminals based on multi-agent reinforcement learning","volume":"61","author":"Hu","year":"2023","journal-title":"Int. J. Prod. Res."},{"key":"10.1016\/j.neucom.2026.133753_bib0185","doi-asserted-by":"crossref","first-page":"63","DOI":"10.1016\/j.isatra.2023.03.009","article-title":"Adaptive formation control of leader-follower mobile robots using reinforcement learning and the Fourier series expansion","volume":"138","author":"Khodamipour","year":"2023","journal-title":"ISA Trans."},{"key":"10.1016\/j.neucom.2026.133753_bib0190","series-title":"36th Chinese Control and Decision Conference (CCDC)","first-page":"4622","article-title":"Leader-follower formation control for a multi-missile system via deep reinforcement learning","author":"Li","year":"2024"},{"key":"10.1016\/j.neucom.2026.133753_bib0195","doi-asserted-by":"crossref","DOI":"10.1016\/j.knosys.2025.113387","article-title":"A hierarchical reinforcement learning framework for multi-uav combat using leader-follower strategy","volume":"316","author":"Pang","year":"2025","journal-title":"Knowl.-based Syst."},{"key":"10.1016\/j.neucom.2026.133753_bib0200","series-title":"Proceedings of the 35th International Conference on Neural Information Processing Systems(NeurIPS)","first-page":"12208","article-title":"Facmac: factored multi-agent centralised policy gradients","author":"Peng","year":"2021"}],"container-title":["Neurocomputing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0925231226011501?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0925231226011501?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T09:24:19Z","timestamp":1783157059000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0925231226011501"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,7]]},"references-count":40,"alternative-id":["S0925231226011501"],"URL":"https:\/\/doi.org\/10.1016\/j.neucom.2026.133753","relation":{},"ISSN":["0925-2312"],"issn-type":[{"value":"0925-2312","type":"print"}],"subject":[],"published":{"date-parts":[[2026,7]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Learning-based multi-agent path finding for constrained autonomous vehicles via knowledge-embedded time-varying topology modeling","name":"articletitle","label":"Article Title"},{"value":"Neurocomputing","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.neucom.2026.133753","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier B.V. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"133753"}}