{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,12]],"date-time":"2026-05-12T21:25:22Z","timestamp":1778621122276,"version":"3.51.4"},"reference-count":66,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2025,5,12]],"date-time":"2025-05-12T00:00:00Z","timestamp":1747008000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,5,12]],"date-time":"2025-05-12T00:00:00Z","timestamp":1747008000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100002322","name":"Coordena\u00e7\u00e3o de Aperfei\u00e7oamento de Pessoal de N\u00edvel Superior","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100002322","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001807","name":"Funda\u00e7\u00e3o de Amparo \u00e0 Pesquisa do Estado de S\u00e3o Paulo","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100001807","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Intell Robot Appl"],"published-print":{"date-parts":[[2025,12]]},"DOI":"10.1007\/s41315-025-00457-z","type":"journal-article","created":{"date-parts":[[2025,5,11]],"date-time":"2025-05-11T23:11:29Z","timestamp":1747005089000},"page":"1654-1674","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":9,"title":["Dynamic Q-planning for online UAV path planning in unknown and complex environments"],"prefix":"10.1007","volume":"9","author":[{"given":"Lidia G. S.","family":"Rocha","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kenny A. Q.","family":"Caldas","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Marco H.","family":"Terra","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Fabio","family":"Ramos","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kelen C. Teixeira","family":"Vivaldini","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2025,5,12]]},"reference":[{"key":"457_CR1","doi-asserted-by":"publisher","first-page":"270","DOI":"10.1016\/j.comcom.2019.10.014","volume":"149","author":"S Aggarwal","year":"2020","unstructured":"Aggarwal, S., Kumar, N.: Path Planning Techniques for Unmanned Aerial Vehicles: A Review, Solutions, and Challenges. Comput. Commun. 149, 270\u2013299 (2020)","journal-title":"Comput. Commun."},{"issue":"6","key":"457_CR2","doi-asserted-by":"publisher","first-page":"26","DOI":"10.1109\/MSP.2017.2743240","volume":"34","author":"K Arulkumaran","year":"2017","unstructured":"Arulkumaran, K., Deisenroth, M.P., Brundage, M., Bharath, A.A.: Deep reinforcement learning: A brief survey. IEEE Signal Process. Mag. 34(6), 26\u201338 (2017)","journal-title":"IEEE Signal Process. Mag."},{"key":"457_CR3","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s10846-021-01383-5","volume":"102","author":"T B\u00e1\u010da","year":"2021","unstructured":"B\u00e1\u010da, T., Petrl\u00edk, M., Vrba, M., Spurn\u00fd, V., P\u011bni\u010dka, R., Hert, D., Saska, M.: The MRS UAV System: Pushing the Frontiers of Reproducible Research, Real-world Deployment, and Education with Autonomous Unmanned Aerial Vehicles. Journal of Intelligent & Robotic Systems 102, 1\u201319 (2021)","journal-title":"Journal of Intelligent & Robotic Systems"},{"key":"457_CR4","doi-asserted-by":"crossref","unstructured":"Bae, Hyansu., Kim, Gidong., Kim, Jonguk., Qian, Dianwei., Lee, Sukgyu.: \u201cMulti-robot path planning method using reinforcement learning.\u201d Applied Sciences 9, no. 15 (2019): 3057. MDPI","DOI":"10.3390\/app9153057"},{"key":"457_CR5","doi-asserted-by":"publisher","DOI":"10.1016\/j.robot.2022.104071","volume":"152","author":"R Bailon-Ruiz","year":"2022","unstructured":"Bailon-Ruiz, R., Bit-Monnot, A., Lacroix, S.: Real-time wildfire monitoring with a fleet of UAVs. Robot. Auton. Syst. 152, 104071 (2022)","journal-title":"Robot. Auton. Syst."},{"key":"457_CR6","doi-asserted-by":"crossref","unstructured":"Ba\u015ftanlar, Y., \u00d6zuysal, M.: \u201cIntroduction to machine learning,\u201d miRNomics: MicroRNA biology and computational analysis, pp. 105\u2013128, 2014","DOI":"10.1007\/978-1-62703-748-8_7"},{"key":"457_CR7","doi-asserted-by":"crossref","unstructured":"Cetin, Omer., Yilmaz, Guray.: Real-time autonomous UAV formation flight with collision and obstacle avoidance in unknown environment. Journal of Intelligent & Robotic Systems, 84(1-4):415\u2013433, 2016. Springer","DOI":"10.1007\/s10846-015-0318-8"},{"key":"457_CR8","doi-asserted-by":"crossref","unstructured":"Charlton, J., Gonzalez, L. R. M., Maddock, S., Richmond, P.: \u201cFast simulation of crowd collision avoidance,\u201d in Computer Graphics International Conference, vol. 11542, pp. 266\u2013277, Springer, 2019","DOI":"10.1007\/978-3-030-22514-8_22"},{"key":"457_CR9","doi-asserted-by":"crossref","unstructured":"Chen, Yu Fan., Liu, Miao., Everett, Michael., How, Jonathan P.: Decentralized non-communicating multiagent collision avoidance with deep reinforcement learning. In 2017 IEEE international conference on robotics and automation (ICRA), pages 285\u2013292, 2017","DOI":"10.1109\/ICRA.2017.7989037"},{"key":"457_CR10","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s11370-020-00313-y","volume":"13","author":"H Chen","year":"2020","unstructured":"Chen, H., Ji, Y., Niu, L.: Reinforcement learning path planning algorithm based on obstacle area expansion strategy. Intel. Serv. Robot. 13, 1\u20139 (2020). https:\/\/doi.org\/10.1007\/s11370-020-00313-y","journal-title":"Intel. Serv. Robot."},{"key":"457_CR11","doi-asserted-by":"crossref","unstructured":"Clifton, J., Laber, E.: Q-learning: Theory and applications, Annual Review of Statistics and Its Application, vol. 7, pp. 279-301, 2020, Annual Reviews","DOI":"10.1146\/annurev-statistics-031219-041220"},{"key":"457_CR12","unstructured":"Dev Team: Pixhawk Flight Controller. User Manual, Dronecode (March 2020)"},{"key":"457_CR13","unstructured":"DJI. FlameWheel 450. User Manual, DJI, May 2015"},{"key":"457_CR14","doi-asserted-by":"crossref","unstructured":"Dooraki, Amir\u00a0Ramezani., Lee, Deok-Jin.: An innovative bio-inspired flight controller for quad-rotor drones: Quad-rotor drone learning to fly using reinforcement learning. Robotics and Autonomous Systems 135, 103671 (2021)","DOI":"10.1016\/j.robot.2020.103671"},{"key":"457_CR15","doi-asserted-by":"publisher","unstructured":"Foehn, Philipp., Romero, Angel., Scaramuzza, Davide.: \u201cTime-optimal planning for quadrotor waypoint flight,\u201d Science Robotics, vol. 6, no. 56, ISSN 2470-9476, Jul 2021, https:\/\/doi.org\/10.1126\/scirobotics.abh1221, publisher: American Association for the Advancement of Science (AAAS)","DOI":"10.1126\/scirobotics.abh1221"},{"key":"457_CR16","doi-asserted-by":"crossref","unstructured":"Goel, Utkarsh., Varshney, Shubham., Jain, Anshul., Maheshwari, Saumil., Shukla, Anupam.: Three Dimensional Path Planning for UAVs in Dynamic Environment using Glow-worm Swarm Optimization. Procedia Computer Science, 133:230\u2013239, 2018. International Conference on Robotics and Smart Manufacturing (RoSMa2018). ISSN 1877-0509","DOI":"10.1016\/j.procs.2018.07.028"},{"key":"457_CR17","doi-asserted-by":"publisher","DOI":"10.1016\/j.robot.2022.104069","volume":"152","author":"J Gyagenda","year":"2022","unstructured":"Gyagenda, J., Miller, I.D., Zekkos, D.: A review of GNSS-independent UAV navigation techniques. Robot. Auton. Syst. 152, 104069 (2022)","journal-title":"Robot. Auton. Syst."},{"key":"457_CR18","doi-asserted-by":"crossref","unstructured":"Hayat, Samira., Yanmaz, Ev\u015fen., Brown, Timothy X., Bettstetter, Christian.: Multi-objective UAV path planning for search and rescue. In 2017 IEEE International Conference on Robotics and Automation (ICRA), pages 5569\u20135574, 2017. IEEE","DOI":"10.1109\/ICRA.2017.7989656"},{"key":"457_CR19","unstructured":"Hegazy, K., Mumford, S.: \u201cComparitive automated bitcoin trading strategies,\u201d CS229 Project, vol. 27, 2016"},{"key":"457_CR20","unstructured":"James, Stephen., Johns, Edward.: \u201c3D Simulation for Robot Arm Control with Deep Q-learning,\u201d ArXiv, 2016. arXiv:1609.03759"},{"key":"457_CR21","doi-asserted-by":"publisher","unstructured":"Jang, Beakcheol., Kim, Myeonghwi., Harerimana, Gaspard., Kim, Jong Wook.: Q-learning Algorithms: A Comprehensive Classification and Applications. IEEE Access, 7:133653\u2013133667, 2019. https:\/\/doi.org\/10.1109\/ACCESS.2019.2941229.","DOI":"10.1109\/ACCESS.2019.2941229."},{"key":"457_CR22","doi-asserted-by":"crossref","unstructured":"Jang, B., Kim, M., Harerimana, G., Kim, J. W.: Q-learning algorithms: A comprehensive classification and applications, IEEE Access, vol. 7, pp. 133653-133667, 2019, IEEE","DOI":"10.1109\/ACCESS.2019.2941229"},{"key":"457_CR23","doi-asserted-by":"crossref","unstructured":"Jiang, Lan., Huang, Hongyun., Ding, Zuohua.: \u201cPath planning for intelligent robots based on deep Q-learning with experience replay and heuristic knowledge.\u201d IEEE\/CAA Journal of Automatica Sinica 7, no. 4 (2019): 1179\u20131189. IEEE","DOI":"10.1109\/JAS.2019.1911732"},{"key":"457_CR24","unstructured":"Kahn, G., Villaflor, A., Pong, V., Abbeel, P., Levine, S.: \u201cUncertainty-aware reinforcement learning for collision avoidance,\u2019 arXiv preprint arXiv:1702.01182, 2017"},{"key":"457_CR25","doi-asserted-by":"crossref","unstructured":"Kan, Xinyue., Teng, Hanzhe., Karydis, Konstantinos.: Online Exploration and Coverage Planning in Unknown Obstacle-Cluttered Environments. IEEE Robotics and Automation Letters, 5(4):5969\u20135976, 2020. IEEE","DOI":"10.1109\/LRA.2020.3010455"},{"key":"457_CR26","doi-asserted-by":"crossref","unstructured":"Khoei, Tala\u00a0Talaei., Kaabouch, Naima.: Machine learning: Models, challenges, and research directions. Future Internet 15(10), 332 (2023)","DOI":"10.3390\/fi15100332"},{"key":"457_CR27","doi-asserted-by":"publisher","unstructured":"Kulkarni, Shriyanti, Vedashree Chaphekar, Md., Chowdhury, Moin Uddin, Erden, Fatih, Guvenc, Ismail: \u201cUAV aided search and rescue operation using reinforcement learning,\u201d in 2020 SoutheastCon. IEEE 2, 1\u20138 (2020). https:\/\/doi.org\/10.1109\/SoutheastCon44009.2020.9368285","DOI":"10.1109\/SoutheastCon44009.2020.9368285"},{"key":"457_CR28","unstructured":"Levine, Sergey., Kumar, Aviral., Tucker, George., Fu, Justin.: Offline reinforcement learning: Tutorial, review, and perspectives on open problems, arXiv preprint arXiv:2005.01643, 2020"},{"key":"457_CR29","doi-asserted-by":"publisher","first-page":"13","DOI":"10.1016\/j.trpro.2018.12.003","volume":"35","author":"Y Li","year":"2018","unstructured":"Li, Y., Scanavino, M., Capello, E., Dabbene, F., Guglieri, G., Vilardi, A.: A novel distributed architecture for UAV indoor navigation. Transportation research procedia 35, 13\u201322 (2018)","journal-title":"Transportation research procedia"},{"key":"457_CR30","doi-asserted-by":"crossref","unstructured":"Liang, Xiao., Meng, Guanglei., Xu, Yimin., Luo, Haitao.: A geometrical path planning method for unmanned aerial vehicle in 2D\/3D complex environment. Intelligent Service Robotics, 11:301\u2013312, 2018. Springer","DOI":"10.1007\/s11370-018-0254-0"},{"key":"457_CR31","doi-asserted-by":"crossref","unstructured":"Liu, Y., Halev, A., Liu, X.: Policy learning with constraints in model-free reinforcement learning: A survey, The 30th International Joint Conference on Artificial Intelligence (IJCAI), 2021","DOI":"10.24963\/ijcai.2021\/614"},{"key":"457_CR32","doi-asserted-by":"crossref","unstructured":"Loquercio, Antonio., Kaufmann, Elia., Ranftl, Ren\u00e9., M\u00fcller, Matthias., Koltun, Vladlen., Scaramuzza, Davide.: \u201cLearning high-speed flight in the wild.\u201d Science Robotics 6, no. 59 (2021): eabg5810. American Association for the Advancement of Science","DOI":"10.1126\/scirobotics.abg5810"},{"key":"457_CR33","doi-asserted-by":"crossref","unstructured":"Low, Ee\u00a0Soong., Ong, Pauline., Cheah, Kah Chun.: \u201cSolving the optimal path planning of a mobile robot using improved Q-learning.\u201d Robotics and Autonomous Systems 115 (2019): 143\u2013161. Elsevier","DOI":"10.1016\/j.robot.2019.02.013"},{"key":"457_CR34","doi-asserted-by":"publisher","unstructured":"Low, E. S, Ong, P., Cheah, K. C.: Solving the optimal path planning of a mobile robot using improved Q-learning, Robotics and Autonomous Systems, vol. 115, pp. 143-161, 2019, ISSN: 0921-8890, https:\/\/doi.org\/10.1016\/j.robot.2019.02.013,","DOI":"10.1016\/j.robot.2019.02.013"},{"key":"457_CR35","doi-asserted-by":"crossref","unstructured":"Ma, Z., Wang, C., Niu, Y., Wang, X., Shen, L.: (2018). A saliency-based reinforcement learning approach for a UAV to avoid flying obstacles. Robotics and Autonomous Systems, 100, 108\u2013118. Elsevier","DOI":"10.1016\/j.robot.2017.10.009"},{"issue":"1","key":"457_CR36","first-page":"1049","volume":"45","author":"S McKinley","year":"1998","unstructured":"McKinley, S., Levine, M.: Cubic spline interpolation. College of the Redwoods 45(1), 1049\u20131060 (1998)","journal-title":"College of the Redwoods"},{"key":"457_CR37","doi-asserted-by":"crossref","unstructured":"Pandey, Prashant., Shukla, Anupam., Tiwari, Ritu.: Three-dimensional path planning for unmanned aerial vehicles using glowworm swarm optimization algorithm. International Journal of System Assurance Engineering and Management, 9(4):836\u2013852, 2018. Springer","DOI":"10.1007\/s13198-017-0663-z"},{"issue":"1","key":"457_CR38","doi-asserted-by":"publisher","first-page":"34","DOI":"10.1002\/net.21746","volume":"70","author":"S Poikonen","year":"2017","unstructured":"Poikonen, S., Wang, X., Golden, B.: The vehicle routing problem with drones: Extended models and connections. Networks 70(1), 34\u201343 (2017)","journal-title":"Networks"},{"key":"457_CR39","unstructured":"Pritsker, A., Alan B., O\u2019Reilly, Jean J.: Simulation with visual SLAM and AweSim. John Wiley & Sons, 1999"},{"key":"457_CR40","unstructured":"Puterman, M.\u00a0L.: Markov decision processes: discrete stochastic dynamic programming, vol. 1, John Wiley & Sons, 2014"},{"key":"457_CR41","doi-asserted-by":"crossref","unstructured":"Qu, C., Gai, W., Zhong, M., Zhang, J.: A novel reinforcement learning based grey wolf optimizer algorithm for unmanned aerial vehicles (UAVs) path planning, Applied Soft Computing, vol. 89, p. 106099, 2020, Elsevier","DOI":"10.1016\/j.asoc.2020.106099"},{"key":"457_CR42","doi-asserted-by":"publisher","DOI":"10.1016\/j.asoc.2020.106099","volume":"89","author":"C Qu","year":"2020","unstructured":"Qu, C., Gai, W., Zhong, M., Zhang, J.: A novel reinforcement learning based grey wolf optimizer algorithm for unmanned aerial vehicles (UAVs) path planning. Appl. Soft Comput. 89, 106099 (2020)","journal-title":"Appl. Soft Comput."},{"key":"457_CR43","doi-asserted-by":"publisher","unstructured":"Rocha, L\u00eddia., Vivaldini, Kelen.: Comparison between Meta-Heuristic Algorithms for Path Planning. In Anais Estendidos do XII Simp\u00f3sio Brasileiro de Rob\u00f3tica e XVII Simp\u00f3sio Latino Americano de Rob\u00f3tica, pages 1\u201310, Natal, 2020. SBC. https:\/\/doi.org\/10.5753\/wtdr_ctdr.2020.14950","DOI":"10.5753\/wtdr_ctdr.2020.14950"},{"key":"457_CR44","doi-asserted-by":"crossref","unstructured":"Rocha, Lidia., Vivaldini, Kelen: Plannie: A benchmark framework for autonomous robots path planning algorithms integrated to simulated and real environments. In 2022 International Conference on Unmanned Aircraft Systems (ICUAS), pages 402\u2013411. IEEE, 2022","DOI":"10.1109\/ICUAS54217.2022.9836102"},{"key":"457_CR45","doi-asserted-by":"crossref","unstructured":"Rocha, L., Vivaldini, K.: \u201cA 3D Benchmark for UAV Path Planning Algorithms: Missions Complexity, Evaluation and Performance.\u201d In 2022 International Conference on Unmanned Aircraft Systems (ICUAS), pp. 412-420. Dubrovnik, Croatia, 2022","DOI":"10.1109\/ICUAS54217.2022.9836190"},{"key":"457_CR46","doi-asserted-by":"crossref","unstructured":"San, Khin Thida., Mun, Sun Ju., Choe, Yeong Hun., Chang, Yoon Seok.: UAV delivery monitoring system. In MATEC Web of Conferences, volume 151, page 04011. EDP Sciences, 2018","DOI":"10.1051\/matecconf\/201815104011"},{"key":"457_CR47","doi-asserted-by":"crossref","unstructured":"Sankararaman, Shankar., Goebel, Kai.: Computational architecture for autonomous decision-making in unmanned aerial vehicles. In Micro- and Nanotechnology Sensors, Systems, and Applications X, volume 10639, pages 297\u2013307. SPIE, 2018","DOI":"10.1117\/12.2304506"},{"key":"457_CR48","volume-title":"and Amit Kumar Singh","author":"P Shukla","year":"2024","unstructured":"Shukla, P., Shukla, S.: and Amit Kumar Singh. A comprehensive survey. IEEE Communications Surveys & Tutorials, Trajectory-prediction techniques for unmanned aerial vehicles (UAVs) (2024)"},{"key":"457_CR49","doi-asserted-by":"crossref","unstructured":"Sichkar, V. N.: \u201cReinforcement Learning Algorithms in Global Path Planning for Mobile Robot,\u201d in 2019 International Conference on Industrial Engineering, Applications and Manufacturing (ICIEAM), 2019, pp. 1-5","DOI":"10.1109\/ICIEAM.2019.8742915"},{"issue":"1","key":"457_CR50","doi-asserted-by":"publisher","first-page":"107","DOI":"10.1109\/TITS.2019.2954952","volume":"22","author":"A Singla","year":"2019","unstructured":"Singla, A., Padakandla, S., Bhatnagar, S.: Memory-based deep reinforcement learning for obstacle avoidance in UAV with limited environment knowledge. IEEE Trans. Intell. Transp. Syst. 22(1), 107\u2013118 (2019)","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"key":"457_CR51","doi-asserted-by":"crossref","unstructured":"Song, Yunlong., Steinweg, Mats., Kaufmann, Elia., Scaramuzza, Davide.: \u201cAutonomous Drone Racing with Deep Reinforcement Learning,\u201d 2021 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 1205-1212, 2021","DOI":"10.1109\/IROS51168.2021.9636053"},{"key":"457_CR52","unstructured":"Sutton, R. S., Barto, A. G.: Reinforcement learning: An introduction. MIT press, 2018"},{"key":"457_CR53","unstructured":"Sutton, R. S., McAllester, D., Singh, S., Mansour, Y.: \u201cPolicy Gradient Methods for Reinforcement Learning with Function Approximation,\u201d in Proceedings of the 12th International Conference on Neural Information Processing Systems (NIPS\u201999), Denver, CO, 1999, pp. 1057\u20131063"},{"key":"457_CR54","doi-asserted-by":"crossref","unstructured":"Toma, A., Hsueh, H., Jaafar, H., Murai, R., Kelly, P. J., Saeedi, S.: \u201cPathBench: A Benchmarking Platform for Classical and Learned Path Planning Algorithms.\u201d In 2021 18th Conference on Robots and Vision (CRV), pp. 79-86. IEEE Computer Society, 2021","DOI":"10.1109\/CRV52889.2021.00019"},{"key":"457_CR55","doi-asserted-by":"crossref","unstructured":"Toma, A., Hsueh, H., Jaafar, H., Murai, R., Kelly, P. J., Saeedi, S.: \u201cPathBench: A Benchmarking Platform for Classical and Learned Path Planning Algorithms.\u201d In 2021 18th Conference on Robots and Vision (CRV), pp. 79-86. IEEE Computer Society, 2021","DOI":"10.1109\/CRV52889.2021.00019"},{"issue":"5","key":"457_CR56","doi-asserted-by":"publisher","first-page":"945","DOI":"10.1080\/00207728708964021","volume":"18","author":"K Toraichi","year":"1987","unstructured":"Toraichi, K., Katagishi, K., Sekita, I., Mori, R.: Computational complexity of spline interpolation. Int. J. Syst. Sci. 18(5), 945\u2013954 (1987)","journal-title":"Int. J. Syst. Sci."},{"issue":"2","key":"457_CR57","doi-asserted-by":"publisher","first-page":"57","DOI":"10.3390\/act12020057","volume":"12","author":"G-T Tu","year":"2023","unstructured":"Tu, G.-T., Juang, J.-G.: UAV Path Planning and Obstacle Avoidance Based on Reinforcement Learning in 3D Environments. Actuators 12(2), 57 (2023)","journal-title":"Actuators"},{"key":"457_CR58","doi-asserted-by":"crossref","unstructured":"Vrba, Matou\u0161, Stasinchuk, Yurii, B\u2019a\u010da, Tom\u2019a\u0161, Vojt\u011bch Spurn\u2018y, Mat\u011bj Petrl\u2019\u0131k, Daniel He\u0159t, David \u017daitl\u2019\u0131k, and Martin Saska. \"Autonomous capture of agile flying objects using UAVs: The MBZIRC,: challenge.\". Robotics and Autonomous Systems 149(2022), 103970 (2020)","DOI":"10.1016\/j.robot.2021.103970"},{"key":"457_CR59","doi-asserted-by":"crossref","unstructured":"Wang, Yingying, Li, Yuqi., Yin, Feng., Wang, Wentao., Sun, Haibo., Li, Jianchang., Zhang, Ke.: \u201cAn intelligent UAV path planning optimization method for monitoring the risk of unattended offshore oil platforms.\u201c Process Safety and Environmental Protection 160 (2022): 13-24. Elsevier","DOI":"10.1016\/j.psep.2022.02.011"},{"key":"457_CR60","doi-asserted-by":"crossref","unstructured":"Wang, C., Wang, J., Zhang, X., Zhang, X.: \u201cAutonomous navigation of UAV in large-scale unknown complex environment with deep reinforcement learning,\u201d in 2017 IEEE Global Conference on Signal and Information Processing (GlobalSIP), pp. 858\u2013862, 2017","DOI":"10.1109\/GlobalSIP.2017.8309082"},{"issue":"3","key":"457_CR61","doi-asserted-by":"publisher","first-page":"2124","DOI":"10.1109\/TVT.2018.2890773","volume":"68","author":"C Wang","year":"2019","unstructured":"Wang, C., Wang, J., Shen, Y., Zhang, X.: Autonomous navigation of UAVs in large-scale complex environments: A deep reinforcement learning approach. IEEE Trans. Veh. Technol. 68(3), 2124\u20132136 (2019)","journal-title":"IEEE Trans. Veh. Technol."},{"key":"457_CR62","doi-asserted-by":"crossref","unstructured":"Waskow, Samuel\u00a0Justo., Bazzan, Ana Lcia Cetertich.: \u201cImproving space representation in multiagent learning via tile coding.\u201d In Advances in Artificial Intelligence\u2013SBIA 2010: 20th Brazilian Symposium on Artificial Intelligence, S\u00a0ao Bernardo do Campo, Brazil, October 23-28, 2010. Proceedings 20, pp. 153\u2013162. Springer, 2010","DOI":"10.1007\/978-3-642-16138-4_16"},{"key":"457_CR63","doi-asserted-by":"publisher","first-page":"117227","DOI":"10.1109\/ACCESS.2019.2933002","volume":"7","author":"C Wu","year":"2019","unstructured":"Wu, C., Ju, B., Wu, Y., Lin, X., Xiong, N., Xu, G., Li, H., Liang, X.: UAV Autonomous Target Search Based on Deep Reinforcement Learning in Complex Disaster Scene. IEEE Access 7, 117227\u2013117245 (2019)","journal-title":"IEEE Access"},{"key":"457_CR64","doi-asserted-by":"publisher","DOI":"10.1016\/j.robot.2020.103594","volume":"131","author":"C Yan","year":"2020","unstructured":"Yan, C., Xiang, X., Wang, C.: Fixed-wing uavs flocking in continuous spaces: A deep reinforcement learning approach. Robot. Auton. Syst. 131, 103594 (2020)","journal-title":"Robot. Auton. Syst."},{"key":"457_CR65","doi-asserted-by":"crossref","unstructured":"Yang, Yang., Juntao, Li., Lingling, Peng.: \u201cMulti-robot path planning based on a deep reinforcement learning DQN algorithm.\u201d CAAI Transactions on Intelligence Technology 5, no. 3 (2020): 177\u2013183. Wiley Online Library","DOI":"10.1049\/trit.2020.0024"},{"key":"457_CR66","doi-asserted-by":"crossref","unstructured":"Yang, S., Meng, Z., Chen, X., Xie, R.: \u201cReal-Time Obstacle Avoidance with Deep Reinforcement Learning Three-Dimensional Autonomous Obstacle Avoidance for UAV,\u201d Proceedings of the 2019 International Conference on Robotics, Intelligent Control and Artificial Intelligence, pp. 324\u2013329, RICAI 2019, Association for Computing Machinery, New York, NY, USA, 2019","DOI":"10.1145\/3366194.3366251"}],"container-title":["International Journal of Intelligent Robotics and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s41315-025-00457-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s41315-025-00457-z\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s41315-025-00457-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,12,12]],"date-time":"2025-12-12T09:35:48Z","timestamp":1765532148000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s41315-025-00457-z"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,5,12]]},"references-count":66,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2025,12]]}},"alternative-id":["457"],"URL":"https:\/\/doi.org\/10.1007\/s41315-025-00457-z","relation":{"has-preprint":[{"id-type":"doi","id":"10.21203\/rs.3.rs-3942682\/v1","asserted-by":"object"}]},"ISSN":["2366-5971","2366-598X"],"issn-type":[{"value":"2366-5971","type":"print"},{"value":"2366-598X","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,5,12]]},"assertion":[{"value":"9 February 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"23 April 2025","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"12 May 2025","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"Not applicable.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethics approval and consent to participate"}},{"value":"All authors have given their consent for the publication of this work.","order":4,"name":"Ethics","group":{"name":"EthicsHeading","label":"Consent for publication"}}]}}