{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,15]],"date-time":"2026-07-15T07:22:17Z","timestamp":1784100137755,"version":"3.55.0"},"reference-count":40,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["52171342"],"award-info":[{"award-number":["52171342"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100007620","name":"Liaoning Province Educational Department","doi-asserted-by":"publisher","award":["LJKMZ20221106"],"award-info":[{"award-number":["LJKMZ20221106"]}],"id":[{"id":"10.13039\/501100007620","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Advanced Engineering Informatics"],"published-print":{"date-parts":[[2026,9]]},"DOI":"10.1016\/j.aei.2026.104732","type":"journal-article","created":{"date-parts":[[2026,4,28]],"date-time":"2026-04-28T09:34:52Z","timestamp":1777368892000},"page":"104732","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":1,"special_numbering":"PB","title":["AC-DiffDWA: Unmanned Surface Vehicle path planning using actor\u2013critic with differentiable dynamic window approach"],"prefix":"10.1016","volume":"74","author":[{"given":"Hengzhen","family":"Hu","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Sheng","family":"Qu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhiyuan","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"issue":"2","key":"10.1016\/j.aei.2026.104732_b1","doi-asserted-by":"crossref","first-page":"100","DOI":"10.1109\/TSSC.1968.300136","article-title":"A formal basis for the heuristic determination of minimum cost paths","volume":"4","author":"Hart","year":"1968","journal-title":"IEEE Trans. Syst. Sci. Cybern."},{"key":"10.1016\/j.aei.2026.104732_b2","article-title":"Rapidly-exploring random trees: A new tool for path planning","author":"LaValle","year":"1998","journal-title":"Res. Rep. 9811"},{"issue":"1","key":"10.1016\/j.aei.2026.104732_b3","doi-asserted-by":"crossref","first-page":"23","DOI":"10.1109\/100.580977","article-title":"The dynamic window approach to collision avoidance","volume":"4","author":"Fox","year":"1997","journal-title":"IEEE Robot. Autom. Mag."},{"issue":"1","key":"10.1016\/j.aei.2026.104732_b4","doi-asserted-by":"crossref","first-page":"90","DOI":"10.1177\/027836498600500106","article-title":"Real-time obstacle avoidance for manipulators and mobile robots","volume":"5","author":"Khatib","year":"1986","journal-title":"Int. J. Robot. Res."},{"key":"10.1016\/j.aei.2026.104732_b5","first-page":"1942","article-title":"Particle swarm optimization","volume":"vol. 4","author":"Kennedy","year":"1995"},{"key":"10.1016\/j.aei.2026.104732_b6","series-title":"Adaptation in Natural and Artificial Systems: an Introductory Analysis with Applications to Biology, Control, and Artificial Intelligence","author":"Holland","year":"1992"},{"key":"10.1016\/j.aei.2026.104732_b7","doi-asserted-by":"crossref","DOI":"10.1016\/j.oceaneng.2024.118193","article-title":"Optimal path planning for a ship in coastal waters with deep Q network","volume":"307","author":"Lee","year":"2024","journal-title":"Ocean Eng."},{"key":"10.1016\/j.aei.2026.104732_b8","doi-asserted-by":"crossref","first-page":"268","DOI":"10.1016\/j.apor.2019.02.020","article-title":"Automatic collision avoidance of multiple ships based on deep Q-learning","volume":"86","author":"Shen","year":"2019","journal-title":"Appl. Ocean Res."},{"key":"10.1016\/j.aei.2026.104732_b9","doi-asserted-by":"crossref","DOI":"10.1016\/j.oceaneng.2023.113937","article-title":"Deep reinforcement learning based controller for ship navigation","volume":"273","author":"Deraj","year":"2023","journal-title":"Ocean Eng."},{"issue":"6","key":"10.1016\/j.aei.2026.104732_b10","doi-asserted-by":"crossref","first-page":"4233","DOI":"10.1007\/s11831-022-09742-7","article-title":"UAV path planning using optimization approaches: A survey","volume":"29","author":"Ait Saadi","year":"2022","journal-title":"Arch. Comput. Methods Eng."},{"issue":"2","key":"10.1016\/j.aei.2026.104732_b11","doi-asserted-by":"crossref","first-page":"604","DOI":"10.1109\/TCYB.2019.2939174","article-title":"Asynchronous episodic deep deterministic policy gradient: Toward continuous control in computationally complex environments","volume":"51","author":"Zhang","year":"2019","journal-title":"IEEE Trans. Cybern."},{"issue":"4","key":"10.1016\/j.aei.2026.104732_b12","doi-asserted-by":"crossref","first-page":"3678","DOI":"10.1109\/TITS.2023.3235911","article-title":"Survey of deep learning for autonomous surface vehicles in marine environments","volume":"24","author":"Qiao","year":"2023","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"issue":"20","key":"10.1016\/j.aei.2026.104732_b13","doi-asserted-by":"crossref","first-page":"15","DOI":"10.1016\/j.ifacol.2024.10.026","article-title":"Reducing controller effort in a deep reinforcement learning-based autopilot for an underactuated ASV","volume":"58","author":"Jose","year":"2024","journal-title":"IFAC-PapersOnLine"},{"key":"10.1016\/j.aei.2026.104732_b14","doi-asserted-by":"crossref","DOI":"10.1016\/j.oceaneng.2022.112449","article-title":"USV path following controller based on DDPG with composite state-space and dynamic reward function","volume":"266","author":"Zhong","year":"2022","journal-title":"Ocean Eng."},{"issue":"10","key":"10.1016\/j.aei.2026.104732_b15","doi-asserted-by":"crossref","first-page":"18549","DOI":"10.1109\/JIOT.2024.3363044","article-title":"Multi-USV task planning method based on improved deep reinforcement learning","volume":"11","author":"Zhang","year":"2024","journal-title":"IEEE Internet Things J."},{"issue":"99","key":"10.1016\/j.aei.2026.104732_b16","first-page":"1","article-title":"Underactuated navigation actor-critic deep reinforcement learning framework for holistic path planning of uncrewed surface vehicles","volume":"26","author":"Wang","year":"2025","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"key":"10.1016\/j.aei.2026.104732_b17","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2025.127378","article-title":"Improved DDPG based on enhancing decision evaluation for path planning in high-density environments","volume":"279","author":"Xue","year":"2025","journal-title":"Expert Syst. Appl."},{"key":"10.1016\/j.aei.2026.104732_b18","doi-asserted-by":"crossref","first-page":"181","DOI":"10.1016\/j.neucom.2021.09.071","article-title":"Path planning and dynamic collision avoidance algorithm under COLREGs via deep reinforcement learning","volume":"468","author":"Xu","year":"2022","journal-title":"Neurocomputing"},{"issue":"12","key":"10.1016\/j.aei.2026.104732_b19","doi-asserted-by":"crossref","first-page":"5823","DOI":"10.1007\/s13042-024-02281-6","article-title":"Mobile robot path planning based on multi-experience pool deep deterministic policy gradient in unknown environment","volume":"15","author":"Wei","year":"2024","journal-title":"Int. J. Mach. Learn. Cybern."},{"key":"10.1016\/j.aei.2026.104732_b20","article-title":"A novel formation control strategy for USVs with improved DDPG: simulation and field test","author":"Wang","year":"2025","journal-title":"IEEE Internet Things J."},{"key":"10.1016\/j.aei.2026.104732_b21","series-title":"2021 IEEE International Conference on Robotics and Automation","first-page":"6057","article-title":"Dwa-rl: Dynamically feasible deep reinforcement learning policy for robot navigation among mobile obstacles","author":"Patel","year":"2021"},{"key":"10.1016\/j.aei.2026.104732_b22","series-title":"2024 International Annual Conference on Complex Systems and Intelligent Science","first-page":"267","article-title":"DDPG-MPC: A safe and efficient hybrid path planning algorithm for robots","author":"Ding","year":"2024"},{"key":"10.1016\/j.aei.2026.104732_b23","doi-asserted-by":"crossref","DOI":"10.1109\/TITS.2024.3478319","article-title":"A balanced collision avoidance algorithm for usvs in complex environment: A deep reinforcement learning approach","author":"Lou","year":"2024","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"issue":"3","key":"10.1016\/j.aei.2026.104732_b24","doi-asserted-by":"crossref","first-page":"3363","DOI":"10.1109\/JIOT.2024.3479322","article-title":"Design and field test of collision avoidance method with prediction for USVs: a deep deterministic policy gradient approach","volume":"12","author":"Lou","year":"2024","journal-title":"IEEE Internet Things J."},{"key":"10.1016\/j.aei.2026.104732_b25","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2024.124388","article-title":"A human-like collision avoidance method for USVs based on deep reinforcement learning and velocity obstacle","volume":"254","author":"Yang","year":"2024","journal-title":"Expert Syst. Appl."},{"key":"10.1016\/j.aei.2026.104732_b26","doi-asserted-by":"crossref","DOI":"10.1016\/j.oceaneng.2026.124632","article-title":"APG-DDQN: Expert-guided deep reinforcement learning for AUSV local path planning with modal switching in unstructured environments","volume":"352","author":"Wu","year":"2026","journal-title":"Ocean Eng."},{"key":"10.1016\/j.aei.2026.104732_b27","doi-asserted-by":"crossref","first-page":"156","DOI":"10.1016\/j.cogr.2024.08.002","article-title":"Mobile robot path planning using deep deterministic policy gradient with differential gaming (DDPG-DG) exploration","volume":"4","author":"Deshpande","year":"2024","journal-title":"Cogn. Robot."},{"issue":"8","key":"10.1016\/j.aei.2026.104732_b28","doi-asserted-by":"crossref","DOI":"10.1016\/j.jfranklin.2024.106821","article-title":"Hierarchical path planner combining probabilistic roadmap and deep deterministic policy gradient for unmanned ground vehicles with non-holonomic constraints","volume":"361","author":"Fan","year":"2024","journal-title":"J. Franklin Inst."},{"key":"10.1016\/j.aei.2026.104732_b29","doi-asserted-by":"crossref","DOI":"10.1016\/j.oceaneng.2024.119886","article-title":"Obstacle avoidance path planning for AUVs in a three-dimensional unknown environment based on the C-APF-TD3 algorithm","volume":"315","author":"Li","year":"2025","journal-title":"Ocean Eng."},{"key":"10.1016\/j.aei.2026.104732_b30","doi-asserted-by":"crossref","DOI":"10.1016\/j.oceaneng.2025.120907","article-title":"Dynamic path planning for multi-USV in complex ocean environments with limited perception via proximal policy optimization","volume":"326","author":"Chen","year":"2025","journal-title":"Ocean Eng."},{"key":"10.1016\/j.aei.2026.104732_b31","doi-asserted-by":"crossref","DOI":"10.1016\/j.aei.2025.103355","article-title":"Adaptive collision avoidance strategy for USVs in perception-limited environments using dynamic priority guidance","volume":"65","author":"Yin","year":"2025","journal-title":"Adv. Eng. Inform."},{"key":"10.1016\/j.aei.2026.104732_b32","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2025.127457","article-title":"Real-time distributed decision-making for simultaneous target assignment and path planning in multiple unmanned surface vehicles","volume":"279","author":"Yin","year":"2025","journal-title":"Expert Syst. Appl."},{"key":"10.1016\/j.aei.2026.104732_b33","doi-asserted-by":"crossref","first-page":"673","DOI":"10.1109\/TRO.2025.3644945","article-title":"Actor\u2013critic model predictive control: Differentiable optimization meets reinforcement learning for agile flight","volume":"42","author":"Romero","year":"2025","journal-title":"IEEE Trans. Robot."},{"key":"10.1016\/j.aei.2026.104732_b34","series-title":"2018 IEEE International Conference on Robotics and Automation","first-page":"7087","article-title":"Learning sampling distributions for robot motion planning","author":"Ichter","year":"2018"},{"issue":"4","key":"10.1016\/j.aei.2026.104732_b35","doi-asserted-by":"crossref","first-page":"9437","DOI":"10.1109\/LRA.2022.3191803","article-title":"Adaptive experience sampling for motion planning using the generator-critic framework","volume":"7","author":"Lee","year":"2022","journal-title":"IEEE Robot. Autom. Lett."},{"key":"10.1016\/j.aei.2026.104732_b36","unstructured":"G. Farquhar, T. Rockt\u00e4schel, M. Igl, S. Whiteson, TreeQN and ATreeC: Differentiable Tree-Structured Models for Deep Reinforcement Learning, in: International Conference on Learning Representations, 2018."},{"issue":"20","key":"10.1016\/j.aei.2026.104732_b37","first-page":"10","article-title":"Graph attention networks","volume":"1050","author":"Velickovic","year":"2017","journal-title":"Stat"},{"issue":"4","key":"10.1016\/j.aei.2026.104732_b38","doi-asserted-by":"crossref","first-page":"834","DOI":"10.1109\/TPAMI.2017.2699184","article-title":"Deeplab: Semantic image segmentation with deep convolutional nets, atrous convolution, and fully connected crfs","volume":"40","author":"Chen","year":"2017","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.aei.2026.104732_b39","series-title":"International Conference on Machine Learning","first-page":"387","article-title":"Deterministic policy gradient algorithms","author":"Silver","year":"2014"},{"key":"10.1016\/j.aei.2026.104732_b40","series-title":"2017 36th Chinese Control Conference","first-page":"1995","article-title":"Podded propulsion unmanned surface vehicle model identification based on field experiments","author":"Mu","year":"2017"}],"container-title":["Advanced Engineering Informatics"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1474034626004246?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1474034626004246?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T12:35:12Z","timestamp":1783168512000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S1474034626004246"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,9]]},"references-count":40,"alternative-id":["S1474034626004246"],"URL":"https:\/\/doi.org\/10.1016\/j.aei.2026.104732","relation":{},"ISSN":["1474-0346"],"issn-type":[{"value":"1474-0346","type":"print"}],"subject":[],"published":{"date-parts":[[2026,9]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"AC-DiffDWA: Unmanned Surface Vehicle path planning using actor\u2013critic with differentiable dynamic window approach","name":"articletitle","label":"Article Title"},{"value":"Advanced Engineering Informatics","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.aei.2026.104732","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier Ltd. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"104732"}}