{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,24]],"date-time":"2026-06-24T15:02:12Z","timestamp":1782313332225,"version":"3.54.5"},"reference-count":27,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"11","license":[{"start":{"date-parts":[[2016,11,1]],"date-time":"2016-11-01T00:00:00Z","timestamp":1477958400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"}],"funder":[{"DOI":"10.13039\/100000001","name":"National Science Foundation (NSF)","doi-asserted-by":"publisher","award":["ECCS-1405173"],"award-info":[{"award-number":["ECCS-1405173"]}],"id":[{"id":"10.13039\/100000001","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000001","name":"National Science Foundation (NSF)","doi-asserted-by":"publisher","award":["IIS-1208623"],"award-info":[{"award-number":["IIS-1208623"]}],"id":[{"id":"10.13039\/100000001","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000006","name":"Office of Naval Research","doi-asserted-by":"publisher","award":["N00014-13-1-0562"],"award-info":[{"award-number":["N00014-13-1-0562"]}],"id":[{"id":"10.13039\/100000006","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000006","name":"Office of Naval Research","doi-asserted-by":"publisher","award":["N000141410718"],"award-info":[{"award-number":["N000141410718"]}],"id":[{"id":"10.13039\/100000006","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000183","name":"Army Research Office","doi-asserted-by":"publisher","award":["W911NF-11-D-0001"],"award-info":[{"award-number":["W911NF-11-D-0001"]}],"id":[{"id":"10.13039\/100000183","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000001","name":"NSF","doi-asserted-by":"publisher","award":["ECCS-1101401"],"award-info":[{"award-number":["ECCS-1101401"]}],"id":[{"id":"10.13039\/100000001","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000001","name":"NSF","doi-asserted-by":"publisher","award":["ECCS-1230040"],"award-info":[{"award-number":["ECCS-1230040"]}],"id":[{"id":"10.13039\/100000001","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Cybern."],"published-print":{"date-parts":[[2016,11]]},"DOI":"10.1109\/tcyb.2015.2477810","type":"journal-article","created":{"date-parts":[[2016,9,22]],"date-time":"2016-09-22T15:15:42Z","timestamp":1474557342000},"page":"2401-2410","source":"Crossref","is-referenced-by-count":167,"title":["Optimal Output-Feedback Control of Unknown Continuous-Time Linear Systems Using Off-policy Reinforcement Learning"],"prefix":"10.1109","volume":"46","author":[{"given":"Hamidreza","family":"Modares","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Frank L.","family":"Lewis","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhong-Ping","family":"Jiang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TCYB.2014.2319577"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2013.09.043"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ACC.2014.6859099"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/TAC.2014.2317301"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2014.05.011"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2014.02.015"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/TCST.2014.2322778"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/TSMCB.2010.2043839"},{"key":"ref18","first-page":"5815","article-title":"Approximate dynamic programming for output feedback control","author":"jiang","year":"2010","journal-title":"Proc Chin Control Conf (CCC"},{"key":"ref19","first-page":"2085","article-title":"Adaptive and optimal output feedback control of linear systems: An adaptive dynamic programming approach","author":"gao","year":"2014","journal-title":"Proc World Congr Intell Control and Autom"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1002\/9781118122631"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/CDC.1996.572749"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1002\/9780470182963"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2009.03.008"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2008.08.017"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2012.06.096"},{"key":"ref7","doi-asserted-by":"crossref","first-page":"916","DOI":"10.1109\/TNNLS.2014.2328590","article-title":"Integral reinforcement learning for continuous-time input-affine nonlinear systems with simultaneous invariant explorations","volume":"26","author":"lee","year":"2015","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"key":"ref2","author":"bertsekas","year":"1996"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2013.2294968"},{"key":"ref1","author":"sutton","year":"1998","journal-title":"Reinforcement LearningAn Introduction"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-39068-5_1"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/TNN.2011.2172628"},{"key":"ref21","first-page":"186","article-title":"Neural network ${\\rm H}{\\infty } $ tracking control of nonlinear systems using GHJI method","author":"liu","year":"2013","journal-title":"Advances in Neural Networks"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/TAC.1968.1098829"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1080\/00207179.2013.863432"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/TIE.2006.881962"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/TAC.2011.2122570"}],"container-title":["IEEE Transactions on Cybernetics"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6221036\/7586170\/07574391.pdf?arnumber=7574391","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,1,12]],"date-time":"2022-01-12T11:45:49Z","timestamp":1641987949000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/7574391\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,11]]},"references-count":27,"journal-issue":{"issue":"11"},"URL":"https:\/\/doi.org\/10.1109\/tcyb.2015.2477810","relation":{},"ISSN":["2168-2267","2168-2275"],"issn-type":[{"value":"2168-2267","type":"print"},{"value":"2168-2275","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,11]]}}}