{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,16]],"date-time":"2026-05-16T02:07:49Z","timestamp":1778897269157,"version":"3.51.4"},"reference-count":42,"publisher":"Elsevier BV","issue":"8","license":[{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62273006"],"award-info":[{"award-number":["62273006"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62173001"],"award-info":[{"award-number":["62173001"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Journal of the Franklin Institute"],"published-print":{"date-parts":[[2026,5]]},"DOI":"10.1016\/j.jfranklin.2026.108610","type":"journal-article","created":{"date-parts":[[2026,4,13]],"date-time":"2026-04-13T17:16:19Z","timestamp":1776100579000},"page":"108610","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"title":["Optimal control for complex dynamical networks: An off-policy Q-learning scheme"],"prefix":"10.1016","volume":"363","author":[{"given":"Shi","family":"Guo","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0000-1813-5593","authenticated-orcid":false,"given":"Zheng","family":"Huang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7024-6573","authenticated-orcid":false,"given":"Hao","family":"Shen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"78","reference":[{"issue":"11","key":"10.1016\/j.jfranklin.2026.108610_bib0001","doi-asserted-by":"crossref","first-page":"2826","DOI":"10.1109\/TNNLS.2016.2599199","article-title":"Discontinuous observers design for finite-time consensus of multiagent systems with external disturbances","volume":"28","author":"Liu","year":"2016","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"issue":"8","key":"10.1016\/j.jfranklin.2026.108610_bib0002","doi-asserted-by":"crossref","first-page":"4969","DOI":"10.1109\/TSMC.2019.2943621","article-title":"Adaptively synchronize the derivative coupled complex networks with proportional delay","volume":"51","author":"Tang","year":"2019","journal-title":"IEEE Trans. Syst. Man Cybern. Syst."},{"issue":"16","key":"10.1016\/j.jfranklin.2026.108610_bib0003","doi-asserted-by":"crossref","first-page":"3351","DOI":"10.1080\/00207721.2021.1995528","article-title":"A survey on state estimation of complex dynamical networks","volume":"52","author":"Hu","year":"2021","journal-title":"Int. J. Syst. Sci."},{"issue":"9","key":"10.1016\/j.jfranklin.2026.108610_bib0004","doi-asserted-by":"crossref","first-page":"3909","DOI":"10.1109\/TNNLS.2020.3016120","article-title":"H\u221e state estimation for neural networks with general activation function and mixed time-varying delays","volume":"32","author":"Qian","year":"2020","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"issue":"18","key":"10.1016\/j.jfranklin.2026.108610_bib0005","doi-asserted-by":"crossref","first-page":"5099","DOI":"10.1016\/j.jfranklin.2016.09.009","article-title":"Adaptive synchronization for complex networks with probabilistic time-varying delays","volume":"353","author":"Cheng","year":"2016","journal-title":"J. Franklin Inst."},{"issue":"1","key":"10.1016\/j.jfranklin.2026.108610_bib0006","first-page":"213","article-title":"Consensus of multiagent systems and synchronization of complex networks: a unified viewpoint","volume":"57","author":"Li","year":"2009","journal-title":"IEEE Trans. Circuits Syst. I Reg. Pap."},{"issue":"6","key":"10.1016\/j.jfranklin.2026.108610_bib0007","doi-asserted-by":"crossref","first-page":"3428","DOI":"10.1109\/TFUZZ.2018.2832614","article-title":"Fuzzy-model-based nonfragile control for nonlinear singularly perturbed systems with semi-Markov jump parameters","volume":"26","author":"Shen","year":"2018","journal-title":"IEEE Trans. Fuzzy Syst."},{"issue":"4","key":"10.1016\/j.jfranklin.2026.108610_bib0008","doi-asserted-by":"crossref","first-page":"652","DOI":"10.1109\/TAC.2006.872760","article-title":"Adaptive synchronization of an uncertain complex dynamical network","volume":"51","author":"Zhou","year":"2006","journal-title":"IEEE Trans. Autom. Control"},{"issue":"2","key":"10.1016\/j.jfranklin.2026.108610_bib0009","doi-asserted-by":"crossref","first-page":"429","DOI":"10.1016\/j.automatica.2008.07.016","article-title":"On pinning synchronization of complex dynamical networks","volume":"45","author":"Yu","year":"2009","journal-title":"Automatica"},{"issue":"5","key":"10.1016\/j.jfranklin.2026.108610_bib0010","doi-asserted-by":"crossref","first-page":"1312","DOI":"10.1016\/j.automatica.2009.01.001","article-title":"Novel decentralized adaptive strategies for the synchronization of complex networks","volume":"45","author":"DeLellis","year":"2009","journal-title":"Automatica"},{"issue":"15","key":"10.1016\/j.jfranklin.2026.108610_bib0011","doi-asserted-by":"crossref","first-page":"11094","DOI":"10.1016\/j.jfranklin.2023.08.031","article-title":"Aperiodically intermittent pinning cluster synchronization of complex networks with hybrid delays: a region-division event-triggered protocol","volume":"360","author":"Zhu","year":"2023","journal-title":"J. Franklin Inst."},{"issue":"8","key":"10.1016\/j.jfranklin.2026.108610_bib0012","doi-asserted-by":"crossref","first-page":"3614","DOI":"10.1016\/j.jfranklin.2022.03.010","article-title":"Exponential synchronization of complex networks via feedback control and periodically intermittent noise","volume":"359","author":"He","year":"2022","journal-title":"J. Franklin Inst."},{"issue":"21","key":"10.1016\/j.jfranklin.2026.108610_bib0013","doi-asserted-by":"crossref","first-page":"29475","DOI":"10.1007\/s11071-025-11627-w","article-title":"Generalized dual-stage event-triggered fuzzy sliding mode load frequency security control for networked power systems","volume":"113","author":"Luo","year":"2025","journal-title":"Nonlinear Dyn."},{"issue":"11","key":"10.1016\/j.jfranklin.2026.108610_bib0014","doi-asserted-by":"crossref","first-page":"11581","DOI":"10.1109\/TCYB.2021.3062039","article-title":"Fully distributed synchronization of complex networks with adaptive coupling strengths","volume":"52","author":"Song","year":"2022","journal-title":"IEEE Trans. Cybern."},{"issue":"4","key":"10.1016\/j.jfranklin.2026.108610_bib0015","doi-asserted-by":"crossref","first-page":"997","DOI":"10.1016\/j.physa.2007.10.030","article-title":"Synchronization-based topology identification of weighted general complex dynamical networks with time-varying coupling delay","volume":"387","author":"Wu","year":"2008","journal-title":"Physica A"},{"issue":"2","key":"10.1016\/j.jfranklin.2026.108610_bib0016","doi-asserted-by":"crossref","first-page":"927","DOI":"10.1109\/TCYB.2019.2912336","article-title":"Output synchronization of complex dynamical networks with multiple output or output derivative couplings","volume":"51","author":"Wang","year":"2021","journal-title":"IEEE Trans. Cybern."},{"issue":"11","key":"10.1016\/j.jfranklin.2026.108610_bib0017","doi-asserted-by":"crossref","first-page":"7380","DOI":"10.1109\/TCYB.2022.3220537","article-title":"Fuzzy H\u221e control of discrete-time nonlinear Markov jump systems via a novel hybrid reinforcement Q-learning method","volume":"53","author":"Wang","year":"2023","journal-title":"IEEE Trans. Cybern."},{"issue":"10","key":"10.1016\/j.jfranklin.2026.108610_bib0018","doi-asserted-by":"crossref","first-page":"6998","DOI":"10.1109\/TSMC.2025.3595086","article-title":"Cluster synchronization for stochastic coupling delay complex networks via event-triggered impulsive control with actuation delay","volume":"55","author":"Luo","year":"2025","journal-title":"IEEE Trans. Syst. Man Cybern. Syst."},{"issue":"12","key":"10.1016\/j.jfranklin.2026.108610_bib0019","doi-asserted-by":"crossref","first-page":"6071","DOI":"10.1016\/j.jfranklin.2018.11.054","article-title":"Optimal synchronization controller design for complex dynamical networks with unknown system dynamics","volume":"356","author":"Cao","year":"2019","journal-title":"J. Franklin Inst."},{"issue":"3","key":"10.1016\/j.jfranklin.2026.108610_bib0020","first-page":"1362","article-title":"Reinforcement learning based optimal control of linear singularly perturbed systems","volume":"69","author":"Zhao","year":"2022","journal-title":"IEEE Trans. Circuits Syst. II Exp. Briefs"},{"issue":"7","key":"10.1016\/j.jfranklin.2026.108610_bib0021","doi-asserted-by":"crossref","first-page":"4689","DOI":"10.1109\/TAC.2024.3352703","article-title":"Data-driven near optimization for fast sampling singularly perturbed systems","volume":"69","author":"Shen","year":"2024","journal-title":"IEEE Trans. Autom. Control"},{"issue":"6","key":"10.1016\/j.jfranklin.2026.108610_bib0022","doi-asserted-by":"crossref","DOI":"10.1016\/j.jfranklin.2024.106715","article-title":"Data driven secure control for cyber\u2013physical systems under hybrid attacks: a Stackelberg game approach","volume":"361","author":"Fei","year":"2024","journal-title":"J. Franklin Inst."},{"key":"10.1016\/j.jfranklin.2026.108610_bib0023","doi-asserted-by":"crossref","DOI":"10.1016\/j.automatica.2025.112591","article-title":"Adversarial dynamic games for Markov jump systems: a policy iteration Q-learning method","volume":"183","author":"Shen","year":"2026","journal-title":"Automatica"},{"issue":"5","key":"10.1016\/j.jfranklin.2026.108610_bib0024","first-page":"2849","article-title":"Optimal control for interconnected multi-area power systems with unknown dynamics: an off-policy Q-learning method","volume":"71","author":"Wang","year":"2024","journal-title":"IEEE Trans. Circuits Syst. II Exp. Briefs"},{"issue":"12","key":"10.1016\/j.jfranklin.2026.108610_bib0025","doi-asserted-by":"crossref","DOI":"10.1016\/j.jfranklin.2025.107784","article-title":"Model-free optimal control for discrete-time Markovian jump linear systems: a Q-learning approach","volume":"362","author":"Badfar","year":"2025","journal-title":"J. Franklin Inst."},{"issue":"2","key":"10.1016\/j.jfranklin.2026.108610_bib0026","doi-asserted-by":"crossref","first-page":"1240","DOI":"10.1109\/COMST.2022.3160697","article-title":"Applications of multi-agent reinforcement learning in future internet: a comprehensive survey","volume":"24","author":"Li","year":"2022","journal-title":"IEEE Commun. Surv."},{"issue":"13","key":"10.1016\/j.jfranklin.2026.108610_bib0027","doi-asserted-by":"crossref","first-page":"6946","DOI":"10.1016\/j.jfranklin.2019.06.007","article-title":"Q-learning solution for optimal consensus control of discrete-time multiagent systems using reinforcement learning","volume":"356","author":"Mu","year":"2019","journal-title":"J. Franklin Inst."},{"issue":"12","key":"10.1016\/j.jfranklin.2026.108610_bib0028","doi-asserted-by":"crossref","first-page":"8314","DOI":"10.1109\/TAC.2025.3581141","article-title":"Data-driven single-loop policy iteration control of uncertain singularly perturbed systems","volume":"70","author":"Shen","year":"2025","journal-title":"IEEE Trans. Autom. Control"},{"issue":"1","key":"10.1016\/j.jfranklin.2026.108610_bib0029","doi-asserted-by":"crossref","first-page":"279","DOI":"10.1146\/annurev-statistics-031219-041220","article-title":"Q-learning: theory and applications","volume":"7","author":"Clifton","year":"2020","journal-title":"Annu. Rev. Stat."},{"key":"10.1016\/j.jfranklin.2026.108610_bib0030","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1007\/s11432-018-9602-1","article-title":"Policy iteration based Q-learning for linear nonzero-sum quadratic differential games","volume":"62","author":"Li","year":"2019","journal-title":"Sci. China Inf. Sci."},{"key":"10.1016\/j.jfranklin.2026.108610_bib0031","series-title":"IEEE Int. Symp. Ind. Electron. (ISIE)","first-page":"258","article-title":"Off-policy Q-learning for infinite horizon LQR problem with unknown dynamics","author":"Li","year":"2018"},{"issue":"1","key":"10.1016\/j.jfranklin.2026.108610_bib0032","doi-asserted-by":"crossref","first-page":"65","DOI":"10.1109\/TCYB.2014.2319577","article-title":"Off-policy reinforcement learning for H\u221e control design","volume":"45","author":"Luo","year":"2015","journal-title":"IEEE Trans. Cybern."},{"issue":"9","key":"10.1016\/j.jfranklin.2026.108610_bib0033","doi-asserted-by":"crossref","first-page":"3482","DOI":"10.1109\/TCYB.2018.2845685","article-title":"Model-free fault tolerant control for a class of complex dynamical networks with derivative couplings","volume":"49","author":"Shi","year":"2019","journal-title":"IEEE Trans. Cybern."},{"issue":"17","key":"10.1016\/j.jfranklin.2026.108610_bib0034","doi-asserted-by":"crossref","DOI":"10.1016\/j.jfranklin.2024.107284","article-title":"Output synchronization of a class of complex dynamic networks: a reinforcement learning method","volume":"361","author":"Zheng","year":"2024","journal-title":"J. Franklin Inst."},{"issue":"9","key":"10.1016\/j.jfranklin.2026.108610_bib0035","doi-asserted-by":"crossref","first-page":"4522","DOI":"10.1109\/TNNLS.2017.2755501","article-title":"Stability analysis of optimal adaptive control under value iteration using a stabilizing initial policy","volume":"29","author":"Heydari","year":"2017","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"key":"10.1016\/j.jfranklin.2026.108610_bib0036","article-title":"Reinforcement learning-based secure synchronization for two-time-scale complex dynamical networks with malicious attacks","volume":"479","author":"Huang","year":"2024","journal-title":"Appl. Math. Comput."},{"issue":"11","key":"10.1016\/j.jfranklin.2026.108610_bib0037","doi-asserted-by":"crossref","first-page":"7068","DOI":"10.1109\/TCYB.2024.3448407","article-title":"Secure control for Markov jump cyber\u2013physical systems subject to malicious attacks: a resilient hybrid learning scheme","volume":"54","author":"Shen","year":"2024","journal-title":"IEEE Trans. Cybern."},{"issue":"10","key":"10.1016\/j.jfranklin.2026.108610_bib0038","doi-asserted-by":"crossref","first-page":"6487","DOI":"10.1109\/TSMC.2022.3145693","article-title":"Q-learning for continuous-time linear systems: a data-driven implementation of the Kleinman algorithm","volume":"52","author":"Possieri","year":"2022","journal-title":"IEEE Trans. Syst. Man Cybern. Syst."},{"key":"10.1016\/j.jfranklin.2026.108610_bib0039","doi-asserted-by":"crossref","first-page":"334","DOI":"10.1016\/j.automatica.2016.05.017","article-title":"Optimal model-free output synchronization of heterogeneous systems using off-policy reinforcement learning","volume":"71","author":"Modares","year":"2016","journal-title":"Automatica"},{"issue":"10","key":"10.1016\/j.jfranklin.2026.108610_bib0040","doi-asserted-by":"crossref","first-page":"2699","DOI":"10.1016\/j.automatica.2012.06.096","article-title":"Computational adaptive optimal control for continuous-time linear systems with completely unknown dynamics","volume":"48","author":"Jiang","year":"2012","journal-title":"Automatica"},{"issue":"9","key":"10.1016\/j.jfranklin.2026.108610_bib0041","first-page":"3819","article-title":"Reinforcement learning-based sliding mode tracking control for the two-time-scale systems: dealing with actuator attacks","volume":"69","author":"Zhang","year":"2022","journal-title":"IEEE Trans. Circuits Syst. II Exp. Briefs"},{"issue":"2","key":"10.1016\/j.jfranklin.2026.108610_bib0042","doi-asserted-by":"crossref","first-page":"1487","DOI":"10.1109\/TNNLS.2022.3183447","article-title":"Hybrid adjusting variables-dependent event-based finite-time state estimation for two-time-scale Markov jump complex networks","volume":"35","author":"Wan","year":"2024","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."}],"container-title":["Journal of the Franklin Institute"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0016003226002103?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0016003226002103?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,5,16]],"date-time":"2026-05-16T01:11:33Z","timestamp":1778893893000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0016003226002103"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,5]]},"references-count":42,"journal-issue":{"issue":"8","published-print":{"date-parts":[[2026,5]]}},"alternative-id":["S0016003226002103"],"URL":"https:\/\/doi.org\/10.1016\/j.jfranklin.2026.108610","relation":{},"ISSN":["0016-0032"],"issn-type":[{"value":"0016-0032","type":"print"}],"subject":[],"published":{"date-parts":[[2026,5]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Optimal control for complex dynamical networks: An off-policy Q-learning scheme","name":"articletitle","label":"Article Title"},{"value":"Journal of the Franklin Institute","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.jfranklin.2026.108610","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 The Franklin Institute. Published by Elsevier Inc. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"108610"}}