{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,7]],"date-time":"2026-08-07T15:33:37Z","timestamp":1786116817798,"version":"build-2736575974"},"reference-count":35,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,11,1]],"date-time":"2026-11-01T00:00:00Z","timestamp":1793491200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,11,1]],"date-time":"2026-11-01T00:00:00Z","timestamp":1793491200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,11,1]],"date-time":"2026-11-01T00:00:00Z","timestamp":1793491200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,11,1]],"date-time":"2026-11-01T00:00:00Z","timestamp":1793491200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,11,1]],"date-time":"2026-11-01T00:00:00Z","timestamp":1793491200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,11,1]],"date-time":"2026-11-01T00:00:00Z","timestamp":1793491200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,11,1]],"date-time":"2026-11-01T00:00:00Z","timestamp":1793491200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100012576","name":"Guangdong Basic and Applied Basic Research Foundation","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100012576","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100010018","name":"Doctoral Scientific Research Start-up Project of Liaoning Provincial Natural Science Foundation","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100010018","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100012476","name":"Fundamental Research Funds for Central Universities of the Central South University","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100012476","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Communications in Nonlinear Science and Numerical Simulation"],"published-print":{"date-parts":[[2026,11]]},"DOI":"10.1016\/j.cnsns.2026.110489","type":"journal-article","created":{"date-parts":[[2026,7,2]],"date-time":"2026-07-02T07:03:50Z","timestamp":1782975830000},"page":"110489","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"P1","title":["A model-free Q-learning framework for input-constrained time-varying continuous nonlinear systems"],"prefix":"10.1016","volume":"163","author":[{"given":"Mei","family":"Li","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jiayue","family":"Sun","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yangjie","family":"Wei","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Huaguang","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhongyang","family":"Ming","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.cnsns.2026.110489_bib0001","doi-asserted-by":"crossref","DOI":"10.1016\/j.automatica.2023.111128","article-title":"A novel actor-critic-identifier architecture for nonlinear multiagent systems with gradient descent method","volume":"155","author":"Ming","year":"2023","journal-title":"Automatica"},{"issue":"1","key":"10.1016\/j.cnsns.2026.110489_bib0002","doi-asserted-by":"crossref","first-page":"82","DOI":"10.1016\/j.automatica.2012.09.019","article-title":"A novel actor-critic-identifier architecture for approximate optimal control of uncertain nonlinear systems","volume":"49","author":"Bhasin","year":"2013","journal-title":"Automatica"},{"issue":"5","key":"10.1016\/j.cnsns.2026.110489_bib0003","doi-asserted-by":"crossref","first-page":"1627","DOI":"10.1109\/TFUZZ.2024.3523898","article-title":"Adaptive critic-based optimal control of input-constrained stochastic systems via generalized fuzzy hyperbolic models","volume":"33","author":"Zhang","year":"2025","journal-title":"IEEE Trans Fuzzy Syst"},{"key":"10.1016\/j.cnsns.2026.110489_bib0004","first-page":"1","article-title":"Adaptive secure finite-time optimal control of unknown nonlinear systems with state constraints via generalized fuzzy hyperbolic models","author":"Su","year":"2025","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"issue":"12","key":"10.1016\/j.cnsns.2026.110489_bib0005","doi-asserted-by":"crossref","first-page":"7933","DOI":"10.1109\/TCYB.2023.3240983","article-title":"Cooperative differential game-based distributed optimal synchronization control of heterogeneous nonlinear multiagent systems","volume":"53","author":"Sun","year":"2023","journal-title":"IEEE Trans Cybern"},{"issue":"7","key":"10.1016\/j.cnsns.2026.110489_bib0006","doi-asserted-by":"crossref","first-page":"4764","DOI":"10.1109\/TSMC.2025.3526576","article-title":"Model-free inverse optimal control for completely unknown nonlinear systems by adaptive dynamic programming","volume":"55","author":"Ahmadi","year":"2025","journal-title":"IEEE Trans Syst Man Cybern Syst"},{"issue":"8","key":"10.1016\/j.cnsns.2026.110489_bib0007","doi-asserted-by":"crossref","first-page":"5112","DOI":"10.1109\/TSMC.2024.3392756","article-title":"Online off-policy reinforcement learning for optimal control of unknown nonlinear systems using neural networks","volume":"54","author":"Zhu","year":"2024","journal-title":"IEEE Trans Syst Man Cybern Syst"},{"issue":"4","key":"10.1016\/j.cnsns.2026.110489_bib0008","doi-asserted-by":"crossref","first-page":"2478","DOI":"10.1109\/TSMC.2022.3213750","article-title":"Off-policy risk-sensitive reinforcement learning-based constrained robust optimal control","volume":"53","author":"Li","year":"2023","journal-title":"IEEE Trans Syst Man Cybern Syst"},{"issue":"9","key":"10.1016\/j.cnsns.2026.110489_bib0009","doi-asserted-by":"crossref","first-page":"14099","DOI":"10.1109\/TITS.2024.3485103","article-title":"Model-free h\u221e prescribed performance control of adaptive cruise control systems via policy learning","volume":"26","author":"Zhao","year":"2025","journal-title":"IEEE Trans Intell Transp Syst"},{"issue":"1","key":"10.1016\/j.cnsns.2026.110489_bib0010","doi-asserted-by":"crossref","first-page":"69","DOI":"10.1109\/TASE.2022.3216733","article-title":"Mixed h2\/h\u221e control for nonlinear closed-loop stackelberg games with application to power systems","volume":"21","author":"Ming","year":"2024","journal-title":"IEEE Trans Autom Sci Eng"},{"issue":"12","key":"10.1016\/j.cnsns.2026.110489_bib0011","doi-asserted-by":"crossref","first-page":"20371","DOI":"10.1109\/TNNLS.2025.3595563","article-title":"Event-triggered mixed nonzero-sum game optimal control for modular robotic manipulator performing coordinated operation tasks","volume":"36","author":"An","year":"2025","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"issue":"5","key":"10.1016\/j.cnsns.2026.110489_bib0012","doi-asserted-by":"crossref","first-page":"2497","DOI":"10.1109\/TNNLS.2025.3628730","article-title":"Adaptive optimal prescribed performance tracking solutions for multiplayer systems with error constraints","volume":"37","author":"Lv","year":"2026","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"issue":"2","key":"10.1016\/j.cnsns.2026.110489_bib0013","doi-asserted-by":"crossref","first-page":"46","DOI":"10.1007\/s10462-025-11439-9","article-title":"Reinforcement learning for single-agent to multi-agent systems: from basic theory to industrial application progress, a survey","volume":"59","author":"Zhang","year":"2025","journal-title":"Artif Intell Rev"},{"issue":"1","key":"10.1016\/j.cnsns.2026.110489_bib0014","doi-asserted-by":"crossref","first-page":"18","DOI":"10.1109\/JAS.2023.123843","article-title":"Recent progress in reinforcement learning and adaptive dynamic programming for advanced control applications","volume":"11","author":"Wang","year":"2024","journal-title":"IEEE CAA J Autom Sin"},{"issue":"10","key":"10.1016\/j.cnsns.2026.110489_bib0015","doi-asserted-by":"crossref","first-page":"3341","DOI":"10.1109\/TCYB.2016.2623859","article-title":"Policy gradient adaptive dynamic programming for data-based optimal control","volume":"47","author":"Luo","year":"2017","journal-title":"IEEE Trans Cybern"},{"issue":"8","key":"10.1016\/j.cnsns.2026.110489_bib0016","doi-asserted-by":"crossref","first-page":"3578","DOI":"10.1109\/TNNLS.2020.3015767","article-title":"A parallel framework of adaptive dynamic programming algorithm with off-policy learning","volume":"32","author":"Sun","year":"2021","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"issue":"1","key":"10.1016\/j.cnsns.2026.110489_bib0017","doi-asserted-by":"crossref","first-page":"295","DOI":"10.1109\/TNNLS.2018.2844165","article-title":"Adaptive reinforcement learning control based on neural approximation for nonlinear discrete-time systems with unknown nonaffine dead-zone input","volume":"30","author":"Liu","year":"2019","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"issue":"1","key":"10.1016\/j.cnsns.2026.110489_bib0018","doi-asserted-by":"crossref","first-page":"42","DOI":"10.1016\/j.arcontrol.2012.03.004","article-title":"Reinforcement learning and optimal adaptive control: an overview and implementation examples","volume":"36","author":"Khan","year":"2012","journal-title":"Annu Rev Control"},{"key":"10.1016\/j.cnsns.2026.110489_bib0019","doi-asserted-by":"crossref","first-page":"14","DOI":"10.1016\/j.sysconle.2016.12.003","article-title":"Q-learning for continuous-time linear systems: a model-free infinite horizon optimal control approach","volume":"100","author":"Vamvoudakis","year":"2017","journal-title":"Syst Control Lett"},{"issue":"4","key":"10.1016\/j.cnsns.2026.110489_bib0020","doi-asserted-by":"crossref","first-page":"6519","DOI":"10.1109\/TASE.2023.3327264","article-title":"Optimal control for continuous-time unknown nonlinear affine systems: a Q-learning approach","volume":"21","author":"Yu","year":"2024","journal-title":"IEEE Trans Autom Sci Eng"},{"issue":"2","key":"10.1016\/j.cnsns.2026.110489_bib0021","doi-asserted-by":"crossref","first-page":"1143","DOI":"10.1109\/TETCI.2024.3449870","article-title":"Adaptive q-learning based model-free h\u221e control of continuous-time nonlinear systems: theory and application","volume":"9","author":"Zhao","year":"2025","journal-title":"IEEE Trans Emerg Top Comput Intell"},{"issue":"12","key":"10.1016\/j.cnsns.2026.110489_bib0022","doi-asserted-by":"crossref","first-page":"4958","DOI":"10.1109\/TCYB.2019.2926631","article-title":"Continuous-time time-varying policy iteration","volume":"50","author":"Wei","year":"2020","journal-title":"IEEE Trans Cybern"},{"issue":"12","key":"10.1016\/j.cnsns.2026.110489_bib0023","doi-asserted-by":"crossref","first-page":"8438","DOI":"10.1109\/TAC.2025.3589486","article-title":"Online optimal self-triggered sampling control with efficient adaptive critic learning","volume":"70","author":"Wang","year":"2025","journal-title":"IEEE Trans Autom Control"},{"issue":"5","key":"10.1016\/j.cnsns.2026.110489_bib0024","doi-asserted-by":"crossref","first-page":"779","DOI":"10.1016\/j.automatica.2004.11.034","article-title":"Nearly optimal control laws for nonlinear systems with saturating actuators using a neural network HJB approach","volume":"41","author":"Abu-Khalaf","year":"2005","journal-title":"Automatica"},{"issue":"1","key":"10.1016\/j.cnsns.2026.110489_bib0025","doi-asserted-by":"crossref","first-page":"455","DOI":"10.1109\/TCE.2026.3652706","article-title":"Event-triggered zero-sum game for input saturated nonlinear systems with state constraints","volume":"72","author":"Qin","year":"2026","journal-title":"IEEE Trans Consum Electron"},{"key":"10.1016\/j.cnsns.2026.110489_bib0026","doi-asserted-by":"crossref","DOI":"10.1016\/j.cnsns.2025.108804","article-title":"Zero-sum games-based optimal fault tolerant control for control-constrained multiplayer systems with external disturbances via adaptive dynamic programming","volume":"147","author":"Liu","year":"2025","journal-title":"Commun Nonlinear Sci Numer Simul"},{"issue":"4","key":"10.1016\/j.cnsns.2026.110489_bib0027","doi-asserted-by":"crossref","first-page":"2505","DOI":"10.1109\/TCYB.2023.3241344","article-title":"Adaptive virotherapy strategy for organism with constrained input using medicine dosage regulation mechanism","volume":"54","author":"Sun","year":"2024","journal-title":"IEEE Trans Cybern"},{"issue":"3","key":"10.1016\/j.cnsns.2026.110489_bib0028","doi-asserted-by":"crossref","first-page":"575","DOI":"10.1109\/JAS.2024.124941","article-title":"Consensus control strategy for the treatment of tumour with neuroadaptive cellular immunotherapy","volume":"12","author":"Sun","year":"2025","journal-title":"IEEE\/CAA J Autom Sin"},{"issue":"3","key":"10.1016\/j.cnsns.2026.110489_bib0029","doi-asserted-by":"crossref","first-page":"1647","DOI":"10.1109\/TSMC.2024.3510594","article-title":"Self-triggered optimal control for unknown nonlinear random power systems with markovian switching","volume":"55","author":"Ming","year":"2025","journal-title":"IEEE Trans Syst Man Cybern Syst"},{"key":"10.1016\/j.cnsns.2026.110489_bib0030","series-title":"2021 60th IEEE conference on decision and control (CDC)","first-page":"3597","article-title":"Bounded rational RRT-QX: multi-agent motion planning in dynamic human-like environments using cognitive hierarchy and Q-learning","author":"Netter","year":"2021"},{"key":"10.1016\/j.cnsns.2026.110489_bib0031","doi-asserted-by":"crossref","first-page":"1780","DOI":"10.1016\/j.automatica.2014.05.011","article-title":"Optimal tracking control of nonlinear partially-unknown constrained-input systems using integral reinforcement learning","volume":"50","author":"Modares","year":"2014","journal-title":"Automatica"},{"issue":"6","key":"10.1016\/j.cnsns.2026.110489_bib0032","doi-asserted-by":"crossref","first-page":"4234","DOI":"10.1002\/rnc.7191","article-title":"Robust optimal control of the multi-input systems with unknown disturbance based on adaptive integral reinforcement learning q-function","volume":"34","author":"Lv","year":"2024","journal-title":"Int J Robust Nonlinear Control"},{"issue":"10","key":"10.1016\/j.cnsns.2026.110489_bib0033","doi-asserted-by":"crossref","first-page":"5877","DOI":"10.1109\/TCYB.2024.3440356","article-title":"Adaptive distributed control of nonlinear multiagent systems with event-triggered for communication faults and dead-zone inputs","volume":"54","author":"Sun","year":"2024","journal-title":"IEEE Trans Cybern"},{"issue":"1","key":"10.1016\/j.cnsns.2026.110489_bib0034","doi-asserted-by":"crossref","first-page":"206","DOI":"10.1109\/TSMCB.2012.2203336","article-title":"Near-optimal control for nonzero-sum differential games of continuous-time nonlinear systems using single-network ADP","volume":"43","author":"Zhang","year":"2013","journal-title":"IEEE Trans Cybern"},{"issue":"5","key":"10.1016\/j.cnsns.2026.110489_bib0035","doi-asserted-by":"crossref","first-page":"878","DOI":"10.1016\/j.automatica.2010.02.018","article-title":"Online actor\u2013critic algorithm to solve the continuous-time infinite horizon optimal control problem","volume":"46","author":"Vamvoudakis","year":"2010","journal-title":"Automatica"}],"container-title":["Communications in Nonlinear Science and Numerical Simulation"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1007570426008439?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1007570426008439?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,8,6]],"date-time":"2026-08-06T12:23:39Z","timestamp":1786019019000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S1007570426008439"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,11]]},"references-count":35,"alternative-id":["S1007570426008439"],"URL":"https:\/\/doi.org\/10.1016\/j.cnsns.2026.110489","relation":{},"ISSN":["1007-5704"],"issn-type":[{"value":"1007-5704","type":"print"}],"subject":[],"published":{"date-parts":[[2026,11]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"A model-free Q-learning framework for input-constrained time-varying continuous nonlinear systems","name":"articletitle","label":"Article Title"},{"value":"Communications in Nonlinear Science and Numerical Simulation","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.cnsns.2026.110489","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier B.V. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"110489"}}