{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,2,4]],"date-time":"2026-02-04T18:52:48Z","timestamp":1770231168834,"version":"3.49.0"},"reference-count":26,"publisher":"IEEE","license":[{"start":{"date-parts":[[2024,12,13]],"date-time":"2024-12-13T00:00:00Z","timestamp":1734048000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2024,12,13]],"date-time":"2024-12-13T00:00:00Z","timestamp":1734048000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2024,12,13]]},"DOI":"10.1109\/hpcc64274.2024.00164","type":"proceedings-article","created":{"date-parts":[[2025,7,23]],"date-time":"2025-07-23T18:33:48Z","timestamp":1753295628000},"page":"1220-1227","source":"Crossref","is-referenced-by-count":1,"title":["A Learning-Based POMDP Approach for Adaptive Cyber Defense Against Multi-Stage Attacks"],"prefix":"10.1109","author":[{"given":"Yuantian","family":"Zhang","sequence":"first","affiliation":[{"name":"Chinese Academy of Sciences,Institute of Information Engineering,Beijing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Weixia","family":"Cai","sequence":"additional","affiliation":[{"name":"Chinese Academy of Sciences,Institute of Information Engineering,Beijing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Huashan","family":"Chen","sequence":"additional","affiliation":[{"name":"Chinese Academy of Sciences,Institute of Information Engineering,Beijing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhenyu","family":"Qi","sequence":"additional","affiliation":[{"name":"University of Arizona,Tucson,USA"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hong","family":"Chen","sequence":"additional","affiliation":[{"name":"Chinese Academy of Sciences,Institute of Information Engineering,Beijing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Feng","family":"Liu","sequence":"additional","affiliation":[{"name":"Chinese Academy of Sciences,Institute of Information Engineering,Beijing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Sen","family":"He","sequence":"additional","affiliation":[{"name":"University of Arizona,Tucson,USA"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4419-0140-8_7"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1145\/352600.353052"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1016\/j.jnca.2012.09.004"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.14429\/dsj.66.10795"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TDSC.2011.34"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1145\/586110.586140"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/SECPRI.2000.848453"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/COMPSAC.2008.88"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1007\/0-387-24230-9_9"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/ACSAC.2009.21"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1145\/1180405.1180446"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v26i1.8363"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/TIFS.2018.2819967"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1145\/3418897"},{"key":"ref15","volume-title":"Reinforcement learning: An introduction","author":"Sutton","year":"2018"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1016\/j.engappai.2015.01.013"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1016\/j.comnet.2019.05.013"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.5220\/0006197105590566"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.3390\/app7111138"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/coins54846.2022.9855011"},{"key":"ref21","article-title":"Autonomous penetration testing using reinforcement learning","author":"Schwartz","year":"2019"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/TrustCom\/BigDataSE.2018.00041"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/ESEM.2009.5314220"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1162\/neco.1997.9.8.1735"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.5555\/3016100.3016191"},{"key":"ref26","article-title":"Proximal policy optimization algorithms","author":"Schulman","year":"2017"}],"event":{"name":"2024 IEEE International Conference on High Performance Computing and Communications (HPCC)","location":"Wuhan, China","start":{"date-parts":[[2024,12,13]]},"end":{"date-parts":[[2024,12,15]]}},"container-title":["2024 IEEE International Conference on High Performance Computing and Communications (HPCC)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11083115\/11083125\/11083181.pdf?arnumber=11083181","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,7,24]],"date-time":"2025-07-24T04:48:09Z","timestamp":1753332489000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11083181\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,12,13]]},"references-count":26,"URL":"https:\/\/doi.org\/10.1109\/hpcc64274.2024.00164","relation":{},"subject":[],"published":{"date-parts":[[2024,12,13]]}}}