{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,30]],"date-time":"2026-01-30T01:47:03Z","timestamp":1769737623922,"version":"3.49.0"},"reference-count":30,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2016,12]]},"DOI":"10.1109\/cdc.2016.7798777","type":"proceedings-article","created":{"date-parts":[[2017,1,5]],"date-time":"2017-01-05T17:11:18Z","timestamp":1483636278000},"page":"3375-3380","source":"Crossref","is-referenced-by-count":17,"title":["Value iteration, adaptive dynamic programming, and optimal control of nonlinear systems"],"prefix":"10.1109","author":[{"given":"Tao","family":"Bian","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhong-Ping","family":"Jiang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref30","author":"vrabie","year":"2013","journal-title":"Optimal Adaptive Control and Differential Games by Reinforcement Learning Principles"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/CDC.2015.7403422"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2016.05.003"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ACC.1994.735224"},{"key":"ref13","author":"howard","year":"1960","journal-title":"Dynamic Programming and Markov Processes"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2012.06.096"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2013.2294968"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1016\/j.ejcon.2013.05.017"},{"key":"ref17","author":"khalil","year":"2002","journal-title":"Nonlinear Systems"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/TAC.1968.1098829"},{"key":"ref19","author":"lewis","year":"2013","journal-title":"Reinforcement Learning and Approximate Dynamic Programming for Feedback Control"},{"key":"ref28","author":"sutton","year":"1998","journal-title":"Reinforcement Learning An Introduction"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1515\/9781400874668"},{"key":"ref27","author":"sontag","year":"1998","journal-title":"Mathematical Control Theory Deterministic Finite Dimensional Systems"},{"key":"ref3","author":"bellman","year":"1957","journal-title":"Dynamic Programming"},{"key":"ref6","volume":"2","author":"bertsekas","year":"2007","journal-title":"Dynamic Programming and Optimal Control"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2014.10.015"},{"key":"ref5","volume":"1","author":"bertsekas","year":"2005","journal-title":"Dynamic Programming and Optimal Control"},{"key":"ref8","author":"bertsekas","year":"1996","journal-title":"Neuro-Dynamic Programming"},{"key":"ref7","author":"bertsekas","year":"2013","journal-title":"Abstract Dynamic Programming"},{"key":"ref2","doi-asserted-by":"crossref","first-page":"2159","DOI":"10.1016\/S0005-1098(97)00128-3","article-title":"Galerkin approximations of the generalized Hamilton-Jacobi-Bellman equation","volume":"33","author":"beard","year":"1997","journal-title":"Automatica"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2014.08.023"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1090\/S0002-9947-1986-0860384-4"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TSMCB.2010.2043839"},{"key":"ref22","doi-asserted-by":"crossref","DOI":"10.1515\/9781400842643","author":"liberzon","year":"2012","journal-title":"Calculus of Variations and Optimal Control Theory A Concise Introduction"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/MCS.2012.2214134"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1002\/9780470182963"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1162\/neco.1991.3.2.246"},{"key":"ref26","doi-asserted-by":"crossref","DOI":"10.1002\/9780470316887","author":"puterman","year":"1994","journal-title":"Markov Decision Processes Discrete Stochastic Dynamic Programming"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/72.623201"}],"event":{"name":"2016 IEEE 55th Conference on Decision and Control (CDC)","location":"Las Vegas, NV, USA","start":{"date-parts":[[2016,12,12]]},"end":{"date-parts":[[2016,12,14]]}},"container-title":["2016 IEEE 55th Conference on Decision and Control (CDC)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7786694\/7798233\/07798777.pdf?arnumber=7798777","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,7,20]],"date-time":"2022-07-20T19:37:27Z","timestamp":1658345847000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7798777\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,12]]},"references-count":30,"URL":"https:\/\/doi.org\/10.1109\/cdc.2016.7798777","relation":{},"subject":[],"published":{"date-parts":[[2016,12]]}}}