{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,9]],"date-time":"2026-03-09T12:26:01Z","timestamp":1773059161485,"version":"3.50.1"},"reference-count":34,"publisher":"Springer Science and Business Media LLC","issue":"12","license":[{"start":{"date-parts":[[2018,2,13]],"date-time":"2018-02-13T00:00:00Z","timestamp":1518480000000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61603150"],"award-info":[{"award-number":["61603150"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61273136"],"award-info":[{"award-number":["61273136"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61573353"],"award-info":[{"award-number":["61573353"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61533017"],"award-info":[{"award-number":["61533017"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"name":"the National Key Research and Development Plan","award":["2016YFB0101000"],"award-info":[{"award-number":["2016YFB0101000"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Soft Comput"],"published-print":{"date-parts":[[2019,6]]},"DOI":"10.1007\/s00500-018-3063-7","type":"journal-article","created":{"date-parts":[[2018,2,13]],"date-time":"2018-02-13T03:55:36Z","timestamp":1518494136000},"page":"4131-4144","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":15,"title":["Adaptive cruise control via adaptive dynamic programming with experience replay"],"prefix":"10.1007","volume":"23","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-0267-3749","authenticated-orcid":false,"given":"Bin","family":"Wang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Dongbin","family":"Zhao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jin","family":"Cheng","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2018,2,13]]},"reference":[{"issue":"2","key":"3063_CR1","doi-asserted-by":"publisher","first-page":"201","DOI":"10.1109\/TSMCC.2011.2106494","volume":"42","author":"S Adam","year":"2012","unstructured":"Adam S, Busoniu L, Babuska R (2012) Experience replay for real-time reinforcement learning control. IEEE Trans Syst Man Cybern C 42(2):201\u2013212","journal-title":"IEEE Trans Syst Man Cybern C"},{"key":"3063_CR2","volume-title":"Reinforcement learning and dynamic programming using function approximators","author":"L Busoniu","year":"2010","unstructured":"Busoniu L, Babuska R, De Schutter B, Ernst D (2010) Reinforcement learning and dynamic programming using function approximators, vol 39. CRC Press, Boca Raton"},{"key":"3063_CR3","doi-asserted-by":"crossref","unstructured":"Chowdhary G, Johnson E (2010) Concurrent learning for convergence in adaptive control without persistency of excitation. In: 2010 49th IEEE conference decision and control (CDC), pp 3674\u20133679","DOI":"10.1109\/CDC.2010.5717148"},{"issue":"5","key":"3063_CR4","doi-asserted-by":"publisher","first-page":"851","DOI":"10.1016\/j.neunet.2009.06.014","volume":"22","author":"T Dierks","year":"2009","unstructured":"Dierks T, Thumati B, Jagannathan S (2009) Optimal control of unknown affine nonlinear discrete-time systems using offline-trained neural networks with proof of convergence. Neural Netw 22(5):851\u2013860","journal-title":"Neural Netw"},{"key":"3063_CR5","unstructured":"dSPACE (2015) dSPACE ASM vehicle dynamics. \n                    http:\/\/www.dspace.com\/en\/inc\/home\/products\/sw\/automotive_simulation_models\/produkte_asm\/vehicle_dynamics_models.cfm\n                    \n                  . Accessed Oct 28, 2015"},{"issue":"6","key":"3063_CR6","doi-asserted-by":"publisher","first-page":"1291","DOI":"10.1109\/TSMCC.2012.2218595","volume":"42","author":"I Grondman","year":"2012","unstructured":"Grondman I, Busoniu L, Lopes GA, Babuska R (2012) A survey of actor-critic reinforcement learning: standard and natural policy gradients. IEEE Trans Syst Man Cybern C 42(6):1291\u20131307","journal-title":"IEEE Trans Syst Man Cybern C"},{"issue":"3","key":"3063_CR7","doi-asserted-by":"publisher","first-page":"42","DOI":"10.1109\/MCS.2006.1636309","volume":"26","author":"B Guvenc","year":"2006","unstructured":"Guvenc B, Kural E (2006) Adaptive cruise control simulator: a low-cost, multiple-driver-in-the-loop simulator. IEEE Control Syst Mag 26(3):42\u201355","journal-title":"IEEE Control Syst Mag"},{"key":"3063_CR8","doi-asserted-by":"publisher","first-page":"13","DOI":"10.1016\/j.compgeo.2014.08.010","volume":"63","author":"F Kang","year":"2015","unstructured":"Kang F, Han S, Salgado R, Li J (2015) System probabilistic stability analysis of soil slopes using gaussian process regression with latin hypercube sampling. Comput Geotech 63:13\u201325","journal-title":"Comput Geotech"},{"issue":"11","key":"3063_CR9","doi-asserted-by":"publisher","first-page":"6105","DOI":"10.1016\/j.apm.2016.01.050","volume":"40","author":"F Kang","year":"2016","unstructured":"Kang F, Xu Q, Li J (2016) Slope reliability analysis using surrogate models via new support vector machines with swarm intelligence. Appl Math Model 40(11):6105\u20136120","journal-title":"Appl Math Model"},{"issue":"1","key":"3063_CR10","doi-asserted-by":"publisher","first-page":"140","DOI":"10.1109\/TNNLS.2014.2358227","volume":"26","author":"B Kiumarsi","year":"2015","unstructured":"Kiumarsi B, Lewis FL (2015) Actor-critic-based optimal tracking for partially unknown nonlinear discrete-time systems. IEEE Trans Neural Netw Learn Syst 26(1):140\u2013151","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"key":"3063_CR11","doi-asserted-by":"crossref","unstructured":"Kyongsu Y, Ilki M (2004) A driver-adaptive stop-and-go cruise control strategy. In: 2004 IEEE International Conference on Network Sensor Control, pp 601\u2013606","DOI":"10.1109\/ICNSC.2004.1297507"},{"issue":"3\u20134","key":"3063_CR12","first-page":"293","volume":"8","author":"LJ Lin","year":"1992","unstructured":"Lin LJ (1992) Self-improving reactive agents based on reinforcement learning, planning and teaching. Mach Learn 8(3\u20134):293\u2013321","journal-title":"Mach Learn"},{"issue":"3","key":"3063_CR13","doi-asserted-by":"publisher","first-page":"628","DOI":"10.1109\/TASE.2012.2198057","volume":"9","author":"D Liu","year":"2012","unstructured":"Liu D, Wang D, Zhao D, Wei Q, Jin N (2012a) Neural-network-based optimal control for a class of unknown discrete-time nonlinear systems using globalized dual heuristic programming. IEEE Trans Autom Sci Eng 9(3):628\u2013634","journal-title":"IEEE Trans Autom Sci Eng"},{"key":"3063_CR14","doi-asserted-by":"publisher","first-page":"229","DOI":"10.1016\/j.neunet.2012.02.005","volume":"32","author":"F Liu","year":"2012","unstructured":"Liu F, Sun J, Si J, Guo W, Mei S (2012b) A boundedness result for the direct heuristic dynamic programming. Neural Netw 32:229\u2013235","journal-title":"Neural Netw"},{"issue":"7540","key":"3063_CR15","doi-asserted-by":"publisher","first-page":"529","DOI":"10.1038\/nature14236","volume":"518","author":"V Mnih","year":"2015","unstructured":"Mnih V, Kavukcuoglu K, Silver D, Rusu et al (2015) Human-level control through deep reinforcement learning. Nature 518(7540):529\u2013533","journal-title":"Nature"},{"issue":"1","key":"3063_CR16","doi-asserted-by":"publisher","first-page":"193","DOI":"10.1016\/j.automatica.2013.09.043","volume":"50","author":"H Modares","year":"2014","unstructured":"Modares H, Lewis FL, Naghibi-Sistani MB (2014) Integral reinforcement learning and experience replay for adaptive optimal control of partially-unknown constrained-input continuous-time systems. Automatica 50(1):193\u2013202","journal-title":"Automatica"},{"issue":"4","key":"3063_CR17","doi-asserted-by":"publisher","first-page":"442","DOI":"10.1016\/j.conengprac.2008.09.006","volume":"17","author":"S Moon","year":"2009","unstructured":"Moon S, Moon I, Yi K (2009) Design, tuning, and evaluation of a full-range adaptive cruise control system with collision avoidance. Control Eng Pract 17(4):442\u2013455","journal-title":"Control Eng Pract"},{"key":"3063_CR18","unstructured":"Rummery GA, Niranjan M (1994) On-line Q-learning using connectionist systems. Technical report CUED\/F-INFENG\/TR 166, Department of Engineering, University of Cambridge"},{"key":"3063_CR19","doi-asserted-by":"publisher","first-page":"160","DOI":"10.1016\/j.conengprac.2014.01.016","volume":"26","author":"P Shakouri","year":"2014","unstructured":"Shakouri P, Ordys A (2014) Nonlinear model predictive control approach in design of adaptive cruise control with automated switching to cruise control. Control Eng Pract 26:160\u2013177","journal-title":"Control Eng Pract"},{"issue":"2","key":"3063_CR20","doi-asserted-by":"publisher","first-page":"264","DOI":"10.1109\/72.914523","volume":"12","author":"J Si","year":"2001","unstructured":"Si J, Wang YT (2001) Online learning control by association and reinforcement. IEEE Trans Neural Netw 12(2):264\u2013276","journal-title":"IEEE Trans Neural Netw"},{"key":"3063_CR21","volume-title":"Reinforcement learning: an introduction","author":"RS Sutton","year":"1998","unstructured":"Sutton RS, Barto AG (1998) Reinforcement learning: an introduction. MIT press, Cambridge"},{"issue":"1","key":"3063_CR22","doi-asserted-by":"publisher","first-page":"36","DOI":"10.1080\/15472450.2012.639641","volume":"16","author":"A Tapani","year":"2012","unstructured":"Tapani A (2012) Vehicle trajectory effects of adaptive cruise control. J Intell Transp Syst 16(1):36\u201344","journal-title":"J Intell Transp Syst"},{"issue":"2","key":"3063_CR23","doi-asserted-by":"publisher","first-page":"167","DOI":"10.1007\/s10846-010-9393-z","volume":"59","author":"CC Tsai","year":"2010","unstructured":"Tsai CC, Hsieh SM, Chen CT (2010) Fuzzy longitudinal controller design and experimentation for adaptive cruise control and stop&go. J Intell Robot Syst 59(2):167\u2013189","journal-title":"J Intell Robot Syst"},{"key":"3063_CR24","doi-asserted-by":"crossref","unstructured":"Wang B, Zhao D, Li C, Dai Y (2015) Design and implementation of an adaptive cruise control system based on supervised actor-critic learning. In: 2015 5th international conference on information science technology (ICIST), pp 243\u2013248","DOI":"10.1109\/ICIST.2015.7288976"},{"issue":"3\u20134","key":"3063_CR25","first-page":"279","volume":"8","author":"CJ Watkins","year":"1992","unstructured":"Watkins CJ, Dayan P (1992) Q-learning. Mach Learn 8(3\u20134):279\u2013292","journal-title":"Mach Learn"},{"key":"3063_CR26","doi-asserted-by":"publisher","first-page":"156","DOI":"10.1016\/j.neunet.2012.11.007","volume":"41","author":"P Wawrzy\u0144ski","year":"2013","unstructured":"Wawrzy\u0144ski P, Tanwani AK (2013) Autonomous reinforcement learning with experience replay. Neural Netw 41:156\u2013167","journal-title":"Neural Netw"},{"key":"3063_CR27","doi-asserted-by":"publisher","first-page":"1184","DOI":"10.1109\/TITS.2011.2143407","volume":"12","author":"L Xiao","year":"2011","unstructured":"Xiao L, Gao F (2011) Practical string stability of platoon of adaptive cruise control vehicles. IEEE Trans Intell Transp Syst 12:1184\u20131194","journal-title":"IEEE Trans Intell Transp Syst"},{"key":"3063_CR28","doi-asserted-by":"publisher","first-page":"30","DOI":"10.1016\/j.neunet.2014.03.008","volume":"55","author":"X Yang","year":"2014","unstructured":"Yang X, Liu D, Wang D, Wei Q (2014) Discrete-time online learning control for a class of unknown nonaffine nonlinear systems using reinforcement learning. Neural Netw 55:30\u201341","journal-title":"Neural Netw"},{"issue":"7","key":"3063_CR29","doi-asserted-by":"publisher","first-page":"1071","DOI":"10.1109\/TSMC.2016.2531680","volume":"47","author":"Q Zhang","year":"2016","unstructured":"Zhang Q, Zhao D, Zhu Y (2016) Event-triggered H\n                    \n                      \n                    \n                    $$\\infty $$\n                    \n                      \n                        \u221e\n                      \n                    \n                   control for continuous-time nonlinear system via concurrent learning. IEEE Trans Syst Man Cybern Syst 47(7):1071\u20131081","journal-title":"IEEE Trans Syst Man Cybern Syst"},{"issue":"4","key":"3063_CR30","doi-asserted-by":"publisher","first-page":"990","DOI":"10.1109\/TITS.2011.2122257","volume":"12","author":"D Zhao","year":"2011","unstructured":"Zhao D, Bai X, Wang F, Xu J, Yu W (2011) DHP for coordinated freeway ramp metering. IEEE Trans Intell Transp Syst 12(4):990\u2013999","journal-title":"IEEE Trans Intell Transp Syst"},{"issue":"1","key":"3063_CR31","doi-asserted-by":"publisher","first-page":"23","DOI":"10.1016\/j.neucom.2011.05.032","volume":"78","author":"D Zhao","year":"2012","unstructured":"Zhao D, Zhang Z, Dai Y (2012) Self-teaching adaptive dynamic programming for go-moku. Neurocomputing 78(1):23\u201329","journal-title":"Neurocomputing"},{"issue":"11","key":"3063_CR32","doi-asserted-by":"publisher","first-page":"2089","DOI":"10.1007\/s00500-013-1110-y","volume":"17","author":"D Zhao","year":"2013","unstructured":"Zhao D, Wang B, Liu D (2013) A supervised actor-critic approach for adaptive cruise control. Soft Comput 17(11):2089\u20132099","journal-title":"Soft Comput"},{"issue":"4","key":"3063_CR33","doi-asserted-by":"publisher","first-page":"1461","DOI":"10.1109\/TASE.2014.2348991","volume":"12","author":"D Zhao","year":"2015","unstructured":"Zhao D, Xia Z, Wang D (2015a) Model-free optimal control for affine nonlinear systems with convergence analysis. IEEE Trans Autom Sci Eng 12(4):1461\u20131468","journal-title":"IEEE Trans Autom Sci Eng"},{"issue":"3","key":"3063_CR34","doi-asserted-by":"publisher","first-page":"854","DOI":"10.1109\/TCYB.2015.2488680","volume":"46","author":"D Zhao","year":"2015","unstructured":"Zhao D, Zhang Q, Wang D, Zhu Y (2015b) Experience replay for optimal control of nonzero-sum game systems with unknown dynamics. IEEE Trans Cybern 46(3):854\u2013865","journal-title":"IEEE Trans Cybern"}],"container-title":["Soft Computing"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s00500-018-3063-7\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s00500-018-3063-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s00500-018-3063-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,25]],"date-time":"2019-09-25T05:44:34Z","timestamp":1569390274000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s00500-018-3063-7"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,2,13]]},"references-count":34,"journal-issue":{"issue":"12","published-print":{"date-parts":[[2019,6]]}},"alternative-id":["3063"],"URL":"https:\/\/doi.org\/10.1007\/s00500-018-3063-7","relation":{},"ISSN":["1432-7643","1433-7479"],"issn-type":[{"value":"1432-7643","type":"print"},{"value":"1433-7479","type":"electronic"}],"subject":[],"published":{"date-parts":[[2018,2,13]]},"assertion":[{"value":"13 February 2018","order":1,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Compliance with ethical standards"}},{"value":"The authors declare that they have no conflict of interest. This article does not contain any studies with human participants or animals performed by any of the authors.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}