{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,10,26]],"date-time":"2025-10-26T14:11:50Z","timestamp":1761487910005,"version":"3.28.0"},"reference-count":24,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2007,6]]},"DOI":"10.1109\/fuzzy.2007.4295497","type":"proceedings-article","created":{"date-parts":[[2007,8,29]],"date-time":"2007-08-29T19:57:26Z","timestamp":1188417446000},"page":"1-6","source":"Crossref","is-referenced-by-count":7,"title":["Fuzzy Approximation for Convergent Model-Based Reinforcement Learning"],"prefix":"10.1109","author":[{"given":"L.","family":"Busoniu","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"D.","family":"Ernst","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"B.","family":"De Schutter","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"R.","family":"Babuska","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1145\/1015330.1015445"},{"key":"ref11","first-page":"968","article-title":"Gradient descent for general reinforcement learning","author":"baird","year":"1998","journal-title":"Advances in Neural Information Processing Systems 11 (NIPS-98)"},{"key":"ref12","first-page":"361","article-title":"Reinforcement learning with soft state aggregation","volume":"7","author":"singh","year":"1994","journal-title":"Advances in neural information processing systems"},{"article-title":"Near optimal closed-loop control. Application to electric power systems","year":"2003","author":"ernst","key":"ref13"},{"key":"ref14","first-page":"369","article-title":"Generalization in reinforcement learning: Safely approximating the value function","author":"boyan","year":"1994","journal-title":"Advances in Neural Information Processing Systems 7 (NIPS-94)"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1007\/BF00992698"},{"key":"ref16","first-page":"17","article-title":"Reinforcement learning: An overview","author":"glorennec","year":"2000","journal-title":"Proceedings European Symposium on Intelligent Techniques (ESIT-00)"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/FUZZY.1996.551807"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/5326.704563"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/72.159061"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1007\/BF00114724"},{"key":"ref3","article-title":"Dynamic Programming and Optimal Control","volume":"2","author":"bertsekas","year":"2001"},{"key":"ref6","first-page":"1","article-title":"Variable-resolution Ie-resolution discretization in optimal control","volume":"1","author":"munos","year":"2001","journal-title":"Machine Learning"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1016\/B978-1-55860-377-6.50040-2"},{"key":"ref8","first-page":"503","article-title":"Tree-based batch mode reinforcement learning","volume":"6","author":"ernst","year":"2005","journal-title":"Journal of Machine Learning Research"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1023\/A:1017928328829"},{"key":"ref2","doi-asserted-by":"crossref","first-page":"237","DOI":"10.1613\/jair.301","article-title":"Reinforcement learning: A survey","volume":"4","author":"kaelbling","year":"1996","journal-title":"Journal of Artificial Intelligence Research"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TNN.1998.712192"},{"key":"ref9","first-page":"1107","article-title":"Least-squares policy iteration","volume":"4","author":"lagoudakis","year":"2003","journal-title":"Journal of Machine Learning Research"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2003.814834"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/5.949488"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/TSMCB.2005.846001"},{"article-title":"Closed-loop learning of visual control policies","year":"2006","author":"jodogne","key":"ref24"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1016\/S0165-0114(02)00299-3"}],"event":{"name":"2007 IEEE International Fuzzy Systems Conference","start":{"date-parts":[[2007,7,23]]},"location":"London, UK","end":{"date-parts":[[2007,7,26]]}},"container-title":["2007 IEEE International Fuzzy Systems Conference"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx5\/4295328\/4295329\/04295497.pdf?arnumber=4295497","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,3,19]],"date-time":"2021-03-19T20:57:27Z","timestamp":1616187447000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/4295497\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2007,6]]},"references-count":24,"URL":"https:\/\/doi.org\/10.1109\/fuzzy.2007.4295497","relation":{},"subject":[],"published":{"date-parts":[[2007,6]]}}}