{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,7]],"date-time":"2026-03-07T12:21:25Z","timestamp":1772886085589,"version":"3.50.1"},"reference-count":43,"publisher":"Springer Science and Business Media LLC","issue":"14","license":[{"start":{"date-parts":[[2022,6,2]],"date-time":"2022-06-02T00:00:00Z","timestamp":1654128000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2022,6,2]],"date-time":"2022-06-02T00:00:00Z","timestamp":1654128000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62071240"],"award-info":[{"award-number":["62071240"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61802175"],"award-info":[{"award-number":["61802175"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Soft Comput"],"published-print":{"date-parts":[[2022,7]]},"DOI":"10.1007\/s00500-022-07179-5","type":"journal-article","created":{"date-parts":[[2022,6,2]],"date-time":"2022-06-02T01:05:59Z","timestamp":1654131959000},"page":"6567-6575","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":23,"title":["A quantum system control method based on enhanced reinforcement learning"],"prefix":"10.1007","volume":"26","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-9317-2869","authenticated-orcid":false,"given":"Wenjie","family":"Liu","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Bosi","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jihao","family":"Fan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yebo","family":"Ge","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mohammed","family":"Zidan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2022,6,2]]},"reference":[{"key":"7179_CR1","doi-asserted-by":"publisher","first-page":"113609","DOI":"10.1016\/j.cma.2020.113609","volume":"376","author":"L Abualigah","year":"2021","unstructured":"Abualigah L, Diabat A, Mirjalili S, Abd Elaziz M, Gandomi AH (2021a) The arithmetic optimization algorithm. Comput Methods Appl Mech Eng 376:113609. https:\/\/doi.org\/10.1016\/j.cma.2020.113609","journal-title":"Comput Methods Appl Mech Eng"},{"key":"7179_CR2","doi-asserted-by":"publisher","unstructured":"Abualigah L, Diabat A, Sumari P, Gandomi A (2021b) Applications, deployments, and integration of internet of drones (iod): a review. IEEE Sens J. https:\/\/doi.org\/10.1109\/JSEN.2021.3114266","DOI":"10.1109\/JSEN.2021.3114266"},{"key":"7179_CR3","doi-asserted-by":"publisher","first-page":"116158","DOI":"10.1016\/j.eswa.2021.116158","volume":"191","author":"L Abualigah","year":"2021","unstructured":"Abualigah L, Elsayed Abd Elaziz M, Sumari P, Geem ZW, Gandomi A (2021c) Reptile search algorithm (rsa): a nature-inspired meta-heuristic optimizer. Expert Syst Appl 191:116158. https:\/\/doi.org\/10.1016\/j.eswa.2021.116158","journal-title":"Expert Syst Appl"},{"key":"7179_CR4","doi-asserted-by":"publisher","first-page":"107250","DOI":"10.1016\/j.cie.2021.107250","volume":"157","author":"L Abualigah","year":"2021","unstructured":"Abualigah L, Yousri D, Abd Elaziz M, Ewees AA, Al-qaness MA, Gandomi AH (2021d) Aquila optimizer: a novel meta-heuristic optimization algorithm. Comput Ind Eng 157:107250. https:\/\/doi.org\/10.1016\/j.cie.2021.107250","journal-title":"Comput Ind Eng"},{"issue":"6","key":"7179_CR5","doi-asserted-by":"publisher","first-page":"60002","DOI":"10.1209\/0295-5075\/126\/60002","volume":"126","author":"Z An","year":"2019","unstructured":"An Z, Zhou D (2019) Deep reinforcement learning for quantum gate control. EPL (Europhysics Letters) 126(6):60002","journal-title":"EPL (Europhysics Letters)"},{"issue":"1","key":"7179_CR6","doi-asserted-by":"publisher","first-page":"012404","DOI":"10.1103\/PhysRevA.103.012404","volume":"103","author":"Z An","year":"2021","unstructured":"An Z, Song HJ, He QK, Zhou D (2021) Quantum optimal control of multilevel dissipative quantum systems with reinforcement learning. Phys Rev A 103(1):012404","journal-title":"Phys Rev A"},{"issue":"22","key":"7179_CR7","doi-asserted-by":"publisher","first-page":"224305","DOI":"10.1103\/PhysRevB.98.224305","volume":"98","author":"M Bukov","year":"2018","unstructured":"Bukov M (2018) Reinforcement learning for autonomous preparation of floquet-engineered states: inverting the quantum kapitza oscillator. Phys Rev B 98(22):224305","journal-title":"Phys Rev B"},{"issue":"3","key":"7179_CR8","first-page":"031086","volume":"8","author":"M Bukov","year":"2018","unstructured":"Bukov M, Day AG, Sels D, Weinberg P, Polkovnikov A, Mehta P (2018) Reinforcement learning in different phases of quantum control. Phys Rev X 8(3):031086","journal-title":"Phys Rev X"},{"issue":"7","key":"7179_CR9","doi-asserted-by":"publisher","first-page":"e0200455","DOI":"10.1371\/journal.pone.0200455","volume":"13","author":"FA C\u00e1rdenas-L\u00f3pez","year":"2018","unstructured":"C\u00e1rdenas-L\u00f3pez FA, Lamata L, Retamal JC, Solano E (2018) Multiqubit and multilevel quantum reinforcement learning with quantum technologies. PLoS ONE 13(7):e0200455","journal-title":"PLoS ONE"},{"issue":"4","key":"7179_CR10","doi-asserted-by":"publisher","first-page":"671","DOI":"10.1080\/01442350701633300","volume":"26","author":"R Chakrabarti","year":"2007","unstructured":"Chakrabarti R, Rabitz H (2007) Quantum control landscapes. Int Rev Phys Chem 26(4):671\u2013735","journal-title":"Int Rev Phys Chem"},{"issue":"5","key":"7179_CR11","doi-asserted-by":"publisher","first-page":"920","DOI":"10.1109\/TNNLS.2013.2283574","volume":"25","author":"C Chen","year":"2013","unstructured":"Chen C, Dong D, Li HX, Chu J, Tarn TJ (2013) Fidelity-based probabilistic q-learning for control of quantum systems. IEEE Trans Neural Netw Learn Syst 25(5):920\u2013933","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"issue":"6877","key":"7179_CR12","doi-asserted-by":"publisher","first-page":"206","DOI":"10.1038\/416206a","volume":"416","author":"S Chu","year":"2002","unstructured":"Chu S (2002) Cold atoms and quantum control. Nature 416(6877):206\u2013210","journal-title":"Nature"},{"key":"7179_CR13","unstructured":"Chunlin C, Frank J, Daoyi D (2012) Hybrid control of uncertain quantum systems via fuzzy estimation and quantum reinforcement learning. In: Proceedings of the 31st Chinese Control Conference, IEEE, pp 7177\u20137182"},{"issue":"6","key":"7179_CR14","doi-asserted-by":"publisher","first-page":"866","DOI":"10.1109\/9.928587","volume":"46","author":"D D\u2019Alessandro","year":"2001","unstructured":"D\u2019Alessandro D, Dahleh M (2001) Optimal control of two-level quantum systems. IEEE Trans Autom Control 46(6):866\u2013876","journal-title":"IEEE Trans Autom Control"},{"issue":"5","key":"7179_CR15","doi-asserted-by":"publisher","first-page":"1207","DOI":"10.1109\/TSMCB.2008.925743","volume":"38","author":"D Dong","year":"2008","unstructured":"Dong D, Chen C, Li H, Tarn TJ (2008) Quantum reinforcement learning. IEEE Trans Syst Man Cybern Part B (Cybernetics) 38(5):1207\u20131220","journal-title":"IEEE Trans Syst Man Cybern Part B (Cybernetics)"},{"issue":"4","key":"7179_CR16","doi-asserted-by":"publisher","first-page":"957","DOI":"10.1109\/TSMCB.2008.926603","volume":"38","author":"D Dong","year":"2008","unstructured":"Dong D, Chen C, Tarn TJ, Pechen A, Rabitz H (2008) Incoherent control of quantum systems with wavefunction-controllable subspaces via quantum reinforcement learning. IEEE Trans Syst Man Cybern Part B (Cybernetics) 38(4):957\u2013962","journal-title":"IEEE Trans Syst Man Cybern Part B (Cybernetics)"},{"issue":"1","key":"7179_CR17","doi-asserted-by":"publisher","first-page":"39","DOI":"10.32604\/jai.2020.09789","volume":"2","author":"W Fang","year":"2020","unstructured":"Fang W, Pang L, Yi W (2020) Survey on the application of deep reinforcement learning in image processing. J Artif Intell 2(1):39\u201358","journal-title":"J Artif Intell"},{"issue":"3","key":"7179_CR18","first-page":"031084","volume":"8","author":"T F\u00f6sel","year":"2018","unstructured":"F\u00f6sel T, Tighineanu P, Weiss T, Marquardt F (2018) Reinforcement learning with neural networks for quantum feedback. Phys Rev X 8(3):031084","journal-title":"Phys Rev X"},{"key":"7179_CR19","doi-asserted-by":"publisher","first-page":"354","DOI":"10.1016\/j.patcog.2017.10.013","volume":"77","author":"J Gu","year":"2018","unstructured":"Gu J, Wang Z, Kuen J, Ma L, Shahroudy A, Shuai B, Liu T, Wang X, Wang G, Cai J et al (2018) Recent advances in convolutional neural networks. Pattern Recogn 77:354\u2013377","journal-title":"Pattern Recogn"},{"key":"7179_CR20","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"issue":"6","key":"7179_CR21","doi-asserted-by":"publisher","first-page":"1549","DOI":"10.32604\/iasc.2020.011721","volume":"26","author":"B Hu","year":"2020","unstructured":"Hu B, Zhao H, Yang Y, Zhou B, Raj ANJ (2020) Multiple faces tracking using feature fusion and neural network in video. Intell Autom Soft Comput 26(6):1549\u20131560","journal-title":"Intell Autom Soft Comput"},{"issue":"9","key":"7179_CR22","doi-asserted-by":"publisher","first-page":"4478","DOI":"10.1109\/TIP.2018.2839916","volume":"27","author":"Z Li","year":"2018","unstructured":"Li Z, Zhang J, Zhang K, Li Z (2018) Visual tracking with weighted adaptive local sparse appearance model via spatio-temporal context learning. IEEE Trans Image Process 27(9):4478\u20134489","journal-title":"IEEE Trans Image Process"},{"key":"7179_CR23","doi-asserted-by":"crossref","unstructured":"Ma H, Chen C (2020) Several developments in learning control of quantum systems. In: 2020 IEEE international conference on systems, man, and cybernetics (SMC), IEEE, pp 4165\u20134172","DOI":"10.1109\/SMC42975.2020.9282921"},{"key":"7179_CR24","doi-asserted-by":"publisher","DOI":"10.1088\/1742-6596\/2183\/1\/012005","volume":"2183","author":"F Meng","year":"2022","unstructured":"Meng F, Cong S (2022) Control design for state transition of open quantum system. J Phys Conf Series 2183:012005","journal-title":"J Phys Conf Series"},{"issue":"3","key":"7179_CR25","first-page":"031006","volume":"6","author":"MH Michael","year":"2016","unstructured":"Michael MH, Silveri M, Brierley R, Albert VV, Salmilehto J, Jiang L, Girvin SM (2016) New class of quantum error-correcting codes for a bosonic mode. Phys Rev X 6(3):031006","journal-title":"Phys Rev X"},{"issue":"7540","key":"7179_CR26","doi-asserted-by":"publisher","first-page":"529","DOI":"10.1038\/nature14236","volume":"518","author":"V Mnih","year":"2015","unstructured":"Mnih V, Kavukcuoglu K, Silver D, Rusu AA, Veness J, Bellemare MG, Graves A, Riedmiller M, Fidjeland AK, Ostrovski G et al (2015) Human-level control through deep reinforcement learning. Nature 518(7540):529\u2013533","journal-title":"Nature"},{"issue":"1","key":"7179_CR27","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1038\/s41534-018-0113-z","volume":"5","author":"MY Niu","year":"2019","unstructured":"Niu MY, Boixo S, Smelyanskiy VN, Neven H (2019) Universal quantum control through deep reinforcement learning. npj Quant Inform 5(1):1\u20138","journal-title":"npj Quant Inform"},{"key":"7179_CR28","doi-asserted-by":"crossref","unstructured":"Palittapongarnpim P, Wittek P, Sanders BC (2017) Robustness of learning-assisted adaptive quantum-enhanced metrology in the presence of noise. In: 2017 IEEE international conference on systems, man, and cybernetics (SMC), IEEE, pp 294\u2013299","DOI":"10.1109\/SMC.2017.8122618"},{"issue":"2","key":"7179_CR29","doi-asserted-by":"publisher","first-page":"023133","DOI":"10.1103\/PhysRevResearch.2.023133","volume":"2","author":"S Patsch","year":"2020","unstructured":"Patsch S, Maniscalco S, Koch CP (2020) Simulation of open-quantum-system dynamics using the quantum zeno effect. Phys Rev Res 2(2):023133","journal-title":"Phys Rev Res"},{"issue":"5467","key":"7179_CR30","doi-asserted-by":"publisher","first-page":"824","DOI":"10.1126\/science.288.5467.824","volume":"288","author":"H Rabitz","year":"2000","unstructured":"Rabitz H, de Vivie-Riedle R, Motzkus M, Kompa K (2000) Whither the future of controlling quantum phenomena? Science 288(5467):824\u2013828","journal-title":"Science"},{"issue":"5","key":"7179_CR31","doi-asserted-by":"publisher","first-page":"053417","DOI":"10.1103\/PhysRevA.79.053417","volume":"79","author":"J Roslund","year":"2009","unstructured":"Roslund J, Rabitz H (2009) Gradient algorithm applied to laboratory quantum control. Phys Rev A 79(5):053417","journal-title":"Phys Rev A"},{"key":"7179_CR32","doi-asserted-by":"crossref","unstructured":"Singh SP, Sutton RS (1996) Reinforcement learning with replacing eligibility traces. Mach Learn 22(1):123\u2013158","DOI":"10.1007\/BF00114726"},{"key":"7179_CR33","unstructured":"Sutton RS, Barto AG (2018) Reinforcement learning: an introduction. MIT press"},{"key":"7179_CR34","unstructured":"Sutton RS, McAllester DA, Singh SP, Mansour Y (2000) Policy gradient methods for reinforcement learning with function approximation. In: Advances in neural information processing systems, pp 1057\u20131063"},{"issue":"3","key":"7179_CR35","doi-asserted-by":"publisher","first-page":"033110","DOI":"10.1103\/PhysRevA.103.033110","volume":"103","author":"BT Torosov","year":"2021","unstructured":"Torosov BT, Shore BW, Vitanov NV (2021) Coherent control techniques for two-state quantum systems: a comparative study. Phys Rev A 103(3):033110","journal-title":"Phys Rev A"},{"issue":"5","key":"7179_CR36","doi-asserted-by":"publisher","first-page":"052326","DOI":"10.1103\/PhysRevA.77.052326","volume":"77","author":"M Tsubouchi","year":"2008","unstructured":"Tsubouchi M, Momose T (2008) Rovibrational wave-packet manipulation using shaped midinfrared femtosecond pulses toward quantum computation: optimization of pulse shape by a genetic algorithm. Phys Rev A 77(5):052326","journal-title":"Phys Rev A"},{"key":"7179_CR37","doi-asserted-by":"crossref","unstructured":"Vedaie SS, Palittapongarnpim P, Sanders BC (2018) Reinforcement learning for quantum metrology via quantum control. In: 2018 IEEE photonics society summer topical meeting series (SUM), IEEE, pp 163\u2013164","DOI":"10.1109\/PHOSST.2018.8456754"},{"issue":"2","key":"7179_CR38","doi-asserted-by":"publisher","first-page":"211","DOI":"10.1038\/s41567-019-0703-5","volume":"16","author":"A Vrajitoarea","year":"2020","unstructured":"Vrajitoarea A, Huang Z, Groszkowski P, Koch J, Houck AA (2020) Quantum control of an oscillator using a stimulated josephson nonlinearity. Nat Phys 16(2):211\u2013217","journal-title":"Nat Phys"},{"issue":"3\u20134","key":"7179_CR39","first-page":"279","volume":"8","author":"CJ Watkins","year":"1992","unstructured":"Watkins CJ, Dayan P (1992) Q-learning. Mach Learn 8(3\u20134):279\u2013292","journal-title":"Mach Learn"},{"issue":"3","key":"7179_CR40","first-page":"697","volume":"58","author":"F Xu","year":"2019","unstructured":"Xu F, Zhang X, Xin Z, Yang A (2019) Investigation on the chinese text sentiment analysis based on convolutional neural networks in deep learning. Comput Mater Contin 58(3):697\u2013709","journal-title":"Comput Mater Contin"},{"issue":"7\u20138","key":"7179_CR41","doi-asserted-by":"publisher","first-page":"1800074","DOI":"10.1002\/qute.201800074","volume":"2","author":"S Yu","year":"2019","unstructured":"Yu S, Albarr\u00e1n-Arriagada F, Retamal JC, Wang YT, Liu W, Ke ZJ, Meng Y, Li ZP, Tang JS, Solano E et al (2019) Reconstruction of a photonic qubit state with reinforcement learning. Adv Quant Technol 2(7\u20138):1800074","journal-title":"Adv Quant Technol"},{"issue":"1","key":"7179_CR42","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1038\/s41534-018-0113-z","volume":"5","author":"XM Zhang","year":"2019","unstructured":"Zhang XM, Wei Z, Asad R, Yang XC, Wang X (2019) When does reinforcement learning stand out in quantum control? A comparative study on state preparation. npj Quant Inform 5(1):1\u20137","journal-title":"npj Quant Inform"},{"issue":"139103","key":"7179_CR43","first-page":"1","volume":"63","author":"Y Zhang","year":"2020","unstructured":"Zhang Y, Wang Z (2020) Hybrid malware detection approach with feedback-directed machine learning. Inf Sci 63(139103):1\u2013139103","journal-title":"Inf Sci"}],"container-title":["Soft Computing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00500-022-07179-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00500-022-07179-5\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00500-022-07179-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,6,17]],"date-time":"2022-06-17T12:30:17Z","timestamp":1655469017000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00500-022-07179-5"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,6,2]]},"references-count":43,"journal-issue":{"issue":"14","published-print":{"date-parts":[[2022,7]]}},"alternative-id":["7179"],"URL":"https:\/\/doi.org\/10.1007\/s00500-022-07179-5","relation":{},"ISSN":["1432-7643","1433-7479"],"issn-type":[{"value":"1432-7643","type":"print"},{"value":"1433-7479","type":"electronic"}],"subject":[],"published":{"date-parts":[[2022,6,2]]},"assertion":[{"value":"5 May 2022","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"2 June 2022","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"Articles do not rely on clinical trials.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethical statement"}},{"value":"All submitted manuscripts contain research which do not involve human participants and\/or animal experimentation.","order":4,"name":"Ethics","group":{"name":"EthicsHeading","label":"Human and animal participants"}}]}}