{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,24]],"date-time":"2026-07-24T03:45:53Z","timestamp":1784864753277,"version":"3.55.0"},"reference-count":37,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,10,1]],"date-time":"2026-10-01T00:00:00Z","timestamp":1790812800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,10,1]],"date-time":"2026-10-01T00:00:00Z","timestamp":1790812800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,5,28]],"date-time":"2026-05-28T00:00:00Z","timestamp":1779926400000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0\/"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["52402476"],"award-info":[{"award-number":["52402476"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100004608","name":"Natural Science Foundation of Jiangsu Province","doi-asserted-by":"publisher","award":["BK20240677"],"award-info":[{"award-number":["BK20240677"]}],"id":[{"id":"10.13039\/501100004608","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Advanced Engineering Informatics"],"published-print":{"date-parts":[[2026,10]]},"DOI":"10.1016\/j.aei.2026.104852","type":"journal-article","created":{"date-parts":[[2026,5,29]],"date-time":"2026-05-29T09:26:24Z","timestamp":1780046784000},"page":"104852","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":1,"special_numbering":"C","title":["A Lagrangian-constrained MARL approach for safe cooperative lane changing and overtaking in mixed traffic"],"prefix":"10.1016","volume":"75","author":[{"given":"Siqi","family":"Zhang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8497-0631","authenticated-orcid":false,"given":"Qun","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Dawei","family":"Pi","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Weichao","family":"Zhuang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-5485-4533","authenticated-orcid":false,"given":"Fei","family":"Ju","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.aei.2026.104852_b1","doi-asserted-by":"crossref","DOI":"10.1016\/j.trc.2024.104654","article-title":"Recent advances in reinforcement learning-based autonomous driving behavior planning: A survey","volume":"164","author":"Wu","year":"2024","journal-title":"Transp. Res. Part C: Emerg. Technol."},{"issue":"11","key":"10.1016\/j.aei.2026.104852_b2","doi-asserted-by":"crossref","first-page":"11623","DOI":"10.1109\/TITS.2023.3285442","article-title":"Deep multi-agent reinforcement learning for highway on-ramp merging in mixed traffic","volume":"24","author":"Chen","year":"2023","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"key":"10.1016\/j.aei.2026.104852_b3","doi-asserted-by":"crossref","DOI":"10.1016\/j.trc.2021.103441","article-title":"Modeling decentralized mandatory lane change for connected and autonomous vehicles: An analytical method","volume":"133","author":"Wang","year":"2021","journal-title":"Transp. Res. Part C: Emerg. Technol."},{"issue":"4","key":"10.1016\/j.aei.2026.104852_b4","doi-asserted-by":"crossref","first-page":"8671","DOI":"10.1109\/TTE.2024.3383091","article-title":"Multiagent reinforcement learning for ecological car-following control in mixed traffic","volume":"10","author":"Wang","year":"2024","journal-title":"IEEE Trans. Transp. Electrification"},{"issue":"6","key":"10.1016\/j.aei.2026.104852_b5","doi-asserted-by":"crossref","first-page":"4909","DOI":"10.1109\/TITS.2021.3054625","article-title":"Deep reinforcement learning for autonomous driving: A survey","volume":"23","author":"Kiran","year":"2021","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"key":"10.1016\/j.aei.2026.104852_b6","doi-asserted-by":"crossref","first-page":"108","DOI":"10.1016\/j.eng.2023.03.018","article-title":"Evolutionary decision-making and planning for autonomous driving based on safe and rational exploration and exploitation","volume":"33","author":"Yuan","year":"2024","journal-title":"Engineering"},{"issue":"3","key":"10.1016\/j.aei.2026.104852_b7","first-page":"428","article-title":"Learning-based decision making for autonomous driving: A survey","volume":"6","author":"Feng","year":"2021","journal-title":"IEEE Trans. Intell. Veh."},{"key":"10.1016\/j.aei.2026.104852_b8","doi-asserted-by":"crossref","DOI":"10.1109\/TPAMI.2024.3457538","article-title":"A review of safe reinforcement learning: Methods, theories and applications","author":"Gu","year":"2024","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.aei.2026.104852_b9","series-title":"A survey of constraint formulations in safe reinforcement learning","author":"Wachi","year":"2024"},{"issue":"1","key":"10.1016\/j.aei.2026.104852_b10","doi-asserted-by":"crossref","first-page":"5","DOI":"10.1007\/s43684-022-00023-5","article-title":"Multi-agent reinforcement learning for cooperative lane changing of connected and autonomous vehicles in mixed traffic","volume":"2","author":"Zhou","year":"2022","journal-title":"Auton. Intell. Syst."},{"issue":"5","key":"10.1016\/j.aei.2026.104852_b11","doi-asserted-by":"crossref","first-page":"4642","DOI":"10.1109\/TITS.2020.3047129","article-title":"Harmonious lane changing via deep reinforcement learning","volume":"23","author":"Wang","year":"2021","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"issue":"1","key":"10.1016\/j.aei.2026.104852_b12","doi-asserted-by":"crossref","first-page":"147","DOI":"10.1038\/s44172-024-00292-3","article-title":"A platform-agnostic deep reinforcement learning framework for effective Sim2Real transfer towards autonomous driving","volume":"3","author":"Li","year":"2024","journal-title":"Commun. Eng."},{"issue":"10","key":"10.1016\/j.aei.2026.104852_b13","doi-asserted-by":"crossref","first-page":"12719","DOI":"10.1007\/s10489-022-04148-1","article-title":"Sim-to-real transfer and reality gap modeling in model predictive control for autonomous driving","volume":"53","author":"Daza","year":"2023","journal-title":"Appl. Intell."},{"key":"10.1016\/j.aei.2026.104852_b14","first-page":"1","article-title":"Learning model predictive control for iterative tasks","volume":"4","author":"Rosolia","year":"2021","journal-title":"Annu. Rev. Control. Robot. Auton. Syst."},{"issue":"5","key":"10.1016\/j.aei.2026.104852_b15","doi-asserted-by":"crossref","first-page":"630","DOI":"10.1049\/itr2.12162","article-title":"A verification framework for behavioral safety of self-driving cars","volume":"16","author":"Wu","year":"2022","journal-title":"IET Intell. Transp. Syst."},{"issue":"4","key":"10.1016\/j.aei.2026.104852_b16","doi-asserted-by":"crossref","first-page":"509","DOI":"10.1007\/s42154-023-00256-x","article-title":"Towards safe autonomous driving: Decision making with observation-robust reinforcement learning","volume":"6","author":"He","year":"2023","journal-title":"Automot. Innov."},{"key":"10.1016\/j.aei.2026.104852_b17","doi-asserted-by":"crossref","first-page":"77","DOI":"10.1016\/j.eng.2023.10.005","article-title":"Toward trustworthy decision-making for autonomous vehicles: A robust reinforcement learning approach with safety guarantees","volume":"33","author":"He","year":"2024","journal-title":"Engineering"},{"key":"10.1016\/j.aei.2026.104852_b18","series-title":"An environment for autonomous driving decision-making","author":"Leurent","year":"2018"},{"key":"10.1016\/j.aei.2026.104852_b19","doi-asserted-by":"crossref","unstructured":"Wei Xiao, Noushin Mehdipour, Anne Collin, Amitai Y. Bin-Nun, Emilio Frazzoli, Radboud Duintjer Tebbens, Calin Belta, Rule-based optimal control for autonomous driving, in: Proceedings of the ACM\/IEEE 12th International Conference on Cyber-Physical Systems, 2021, pp. 143\u2013154.","DOI":"10.1145\/3450267.3450542"},{"issue":"3","key":"10.1016\/j.aei.2026.104852_b20","doi-asserted-by":"crossref","first-page":"798","DOI":"10.1109\/TRO.2020.3036624","article-title":"Fail-safe motion planning for online verification of autonomous vehicles using convex optimization","volume":"37","author":"Pek","year":"2020","journal-title":"IEEE Trans. Robot."},{"key":"10.1016\/j.aei.2026.104852_b21","first-page":"187","article-title":"Planning and decision-making for autonomous vehicles","volume":"4","author":"Schwarting","year":"2021","journal-title":"Annu. Rev. Control. Robot. Auton. Syst."},{"issue":"6","key":"10.1016\/j.aei.2026.104852_b22","doi-asserted-by":"crossref","first-page":"1593","DOI":"10.1049\/cit2.70073","article-title":"A survey on reinforcement learning for optimal decision-making and control of intelligent vehicles","volume":"10","author":"Lan","year":"2025","journal-title":"CAAI Trans. Intell. Technol."},{"issue":"2","key":"10.1016\/j.aei.2026.104852_b23","doi-asserted-by":"crossref","first-page":"294","DOI":"10.1109\/TIV.2019.2955905","article-title":"Combining planning and deep reinforcement learning in tactical decision making for autonomous driving","volume":"5","author":"Hoel","year":"2019","journal-title":"IEEE Trans. Intell. Veh."},{"key":"10.1016\/j.aei.2026.104852_b24","series-title":"2021 IEEE Intelligent Vehicles Symposium","first-page":"1073","article-title":"A survey of deep reinforcement learning algorithms for motion planning and control of autonomous vehicles","author":"Ye","year":"2021"},{"key":"10.1016\/j.aei.2026.104852_b25","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2023.122158","article-title":"A deep reinforcement learning-based approach for autonomous lane-changing velocity control in mixed flow of vehicle group level","volume":"238","author":"Wang","year":"2024","journal-title":"Expert Syst. Appl."},{"issue":"1","key":"10.1016\/j.aei.2026.104852_b26","doi-asserted-by":"crossref","first-page":"466","DOI":"10.1109\/TNNLS.2022.3175595","article-title":"Model-based chance-constrained reinforcement learning via separated proportional-integral lagrangian","volume":"35","author":"Peng","year":"2022","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"key":"10.1016\/j.aei.2026.104852_b27","article-title":"On a formal model of safe and scalable self-driving cars","volume":"125","author":"Shalev-Shwartz","year":"2020","journal-title":"Transp. Res. Part C: Emerg. Technol."},{"key":"10.1016\/j.aei.2026.104852_b28","series-title":"International Conference on Machine Learning","first-page":"9133","article-title":"Responsive safety in reinforcement learning by pid lagrangian methods","author":"Stooke","year":"2020"},{"key":"10.1016\/j.aei.2026.104852_b29","series-title":"International Conference on Machine Learning","first-page":"13644","article-title":"Constrained variational policy optimization for safe reinforcement learning","author":"Liu","year":"2022"},{"key":"10.1016\/j.aei.2026.104852_b30","article-title":"The safety filter: A unified view of safety-critical control in autonomous systems","volume":"7","author":"Hsu","year":"2023","journal-title":"Annu. Rev. Control. Robot. Auton. Syst."},{"key":"10.1016\/j.aei.2026.104852_b31","doi-asserted-by":"crossref","first-page":"100131","DOI":"10.52202\/079017-3177","article-title":"Dynamic model predictive shielding for provably safe reinforcement learning","volume":"37","author":"Banerjee","year":"2024","journal-title":"Adv. Neural Inf. Process. Syst."},{"issue":"2","key":"10.1016\/j.aei.2026.104852_b32","doi-asserted-by":"crossref","first-page":"895","DOI":"10.1007\/s10462-021-09996-w","article-title":"Multi-agent deep reinforcement learning: a survey","volume":"55","author":"Gronauer","year":"2022","journal-title":"Artif. Intell. Rev."},{"key":"10.1016\/j.aei.2026.104852_b33","series-title":"Multi-agent reinforcement learning for autonomous driving: A survey","author":"Zhang","year":"2024"},{"key":"10.1016\/j.aei.2026.104852_b34","doi-asserted-by":"crossref","first-page":"24611","DOI":"10.52202\/068431-1787","article-title":"The surprising effectiveness of ppo in cooperative multi-agent games","volume":"35","author":"Yu","year":"2022","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.aei.2026.104852_b35","series-title":"Qplex: Duplex dueling multi-agent q-learning","author":"Wang","year":"2020"},{"key":"10.1016\/j.aei.2026.104852_b36","article-title":"Boosting vehicular connectivity through resource allocation algorithm based on heterogeneous agent proximal policy optimization","volume":"50","author":"Zhao","year":"2024","journal-title":"Veh. Commun."},{"key":"10.1016\/j.aei.2026.104852_b37","series-title":"2020 IEEE 23rd International Conference on Intelligent Transportation Systems","first-page":"1","article-title":"Lgsvl simulator: A high fidelity simulator for autonomous driving","author":"Rong","year":"2020"}],"container-title":["Advanced Engineering Informatics"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1474034626005446?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1474034626005446?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T16:08:14Z","timestamp":1783181294000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S1474034626005446"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,10]]},"references-count":37,"alternative-id":["S1474034626005446"],"URL":"https:\/\/doi.org\/10.1016\/j.aei.2026.104852","relation":{},"ISSN":["1474-0346"],"issn-type":[{"value":"1474-0346","type":"print"}],"subject":[],"published":{"date-parts":[[2026,10]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"A Lagrangian-constrained MARL approach for safe cooperative lane changing and overtaking in mixed traffic","name":"articletitle","label":"Article Title"},{"value":"Advanced Engineering Informatics","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.aei.2026.104852","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 The Authors. Published by Elsevier Ltd.","name":"copyright","label":"Copyright"}],"article-number":"104852"}}