{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,11]],"date-time":"2026-06-11T15:00:57Z","timestamp":1781190057198,"version":"3.54.1"},"reference-count":18,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2007]]},"DOI":"10.1109\/cdc.2007.4434328","type":"proceedings-article","created":{"date-parts":[[2008,1,28]],"date-time":"2008-01-28T16:06:38Z","timestamp":1201536398000},"page":"975-980","source":"Crossref","is-referenced-by-count":0,"title":["A model reference adaptive search method for stochastic optimization with applications to Markov decision processes"],"prefix":"10.1109","author":[{"family":"Jiaqiao Hu","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Michael C.","family":"Fu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Steven I.","family":"Marcus","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"17","doi-asserted-by":"publisher","DOI":"10.1007\/BF00992698"},{"key":"18","doi-asserted-by":"publisher","DOI":"10.1137\/0330034"},{"key":"15","doi-asserted-by":"publisher","DOI":"10.1109\/9.119632"},{"key":"16","author":"sutton","year":"1998","journal-title":"Reinforcement Learning An Introduction"},{"key":"13","author":"rubinstein","year":"2004","journal-title":"The Cross-Entropy Method A Unified Approach to Combinatorial Optimization Monte-Carlo Simulation and Machine Learning"},{"key":"14","doi-asserted-by":"publisher","DOI":"10.1023\/A:1010081212560"},{"key":"11","doi-asserted-by":"publisher","DOI":"10.1109\/WSC.1991.185617"},{"key":"12","doi-asserted-by":"publisher","DOI":"10.1214\/aoms\/1177729586"},{"key":"3","doi-asserted-by":"publisher","DOI":"10.1287\/mnsc.41.12.1946"},{"key":"2","doi-asserted-by":"publisher","DOI":"10.1287\/mnsc.45.5.748"},{"key":"1","doi-asserted-by":"publisher","DOI":"10.1016\/S0377-2217(00)00190-9"},{"key":"10","doi-asserted-by":"publisher","DOI":"10.1214\/aoms\/1177729392"},{"key":"7","doi-asserted-by":"crossref","DOI":"10.1016\/S0927-0507(06)13019-4","article-title":"stochastic gradient estimation","author":"fu","year":"2006","journal-title":"Handbooks in Operations Research and Management Science Simulation"},{"key":"6","doi-asserted-by":"publisher","DOI":"10.1287\/ijoc.14.3.192.113"},{"key":"5","doi-asserted-by":"crossref","DOI":"10.1007\/978-1-84628-690-2","author":"chang","year":"2007","journal-title":"Simulation-Based Algorithms for Markov Decision Processes"},{"key":"4","doi-asserted-by":"crossref","DOI":"10.1016\/S0927-0507(06)13020-0","article-title":"an overview of simulation optimization via random search","author":"andrado?ttir","year":"2006","journal-title":"Handbooks in Operations Research and Management Science Simulation"},{"key":"9","doi-asserted-by":"publisher","DOI":"10.1287\/opre.1060.0367"},{"key":"8","doi-asserted-by":"publisher","DOI":"10.1287\/opre.1050.0237"}],"event":{"name":"2007 46th IEEE Conference on Decision and Control","location":"New Orleans, LA, USA","start":{"date-parts":[[2007,12,12]]},"end":{"date-parts":[[2007,12,14]]}},"container-title":["2007 46th IEEE Conference on Decision and Control"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx5\/4433999\/4434000\/04434328.pdf?arnumber=4434328","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,11]],"date-time":"2026-06-11T14:19:24Z","timestamp":1781187564000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/4434328\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2007]]},"references-count":18,"URL":"https:\/\/doi.org\/10.1109\/cdc.2007.4434328","relation":{},"subject":[],"published":{"date-parts":[[2007]]}}}