{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,10,26]],"date-time":"2025-10-26T14:23:16Z","timestamp":1761488596994,"version":"3.28.0"},"reference-count":15,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2010,10]]},"DOI":"10.1109\/iros.2010.5650243","type":"proceedings-article","created":{"date-parts":[[2010,12,11]],"date-time":"2010-12-11T02:37:26Z","timestamp":1292035046000},"page":"3219-3225","source":"Crossref","is-referenced-by-count":30,"title":["Using dimensionality reduction to exploit constraints in reinforcement learning"],"prefix":"10.1109","author":[{"given":"S","family":"Bitzer","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"M","family":"Howard","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"S","family":"Vijayakumar","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1145\/1015706.1015755"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1163\/156855308X397569"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1007\/s10514-009-9129-8"},{"journal-title":"Pattern Recognition and Machine Learning","year":"2006","author":"bishop","key":"ref13"},{"key":"ref14","first-page":"1783","article-title":"Probabilistic non-linear principal component analysis with gaussian process latent variable models","volume":"6","author":"lawrence","year":"2005","journal-title":"J Machine Learning Research"},{"journal-title":"The reinforcement learning toolbox reinforcement learning for optimal control tasks","year":"2005","author":"neumann","key":"ref15"},{"key":"ref4","article-title":"Skill discovery in continuous reinforcement learning domains using skill chaining","author":"konidaris","year":"2009","journal-title":"NIPS"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1023\/A:1025696116075"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1007\/s10514-009-9133-z"},{"key":"ref5","article-title":"Towards a unified theory of state abstraction for MDPs","author":"li","year":"2006","journal-title":"Proc 9th Intl Symp on AI and Math"},{"journal-title":"Gaussian Processes for Machine Learning","year":"2006","author":"rasmussen","key":"ref8"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.2008.4543621"},{"key":"ref2","doi-asserted-by":"crossref","first-page":"1521","DOI":"10.1163\/156855307782148550","article-title":"Reinforcement learning for imitating constrained reaching movements","volume":"21","author":"guenter","year":"2007","journal-title":"Adv Robotics"},{"journal-title":"Reinforcement Learning An Introduction","year":"1998","author":"sutton","key":"ref1"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1017\/CBO9780511665479"}],"event":{"name":"2010 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS 2010)","start":{"date-parts":[[2010,10,18]]},"location":"Taipei","end":{"date-parts":[[2010,10,22]]}},"container-title":["2010 IEEE\/RSJ International Conference on Intelligent Robots and Systems"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx5\/5639431\/5648787\/05650243.pdf?arnumber=5650243","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2020,6,14]],"date-time":"2020-06-14T15:19:34Z","timestamp":1592147974000},"score":1,"resource":{"primary":{"URL":"http:\/\/ieeexplore.ieee.org\/document\/5650243\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2010,10]]},"references-count":15,"URL":"https:\/\/doi.org\/10.1109\/iros.2010.5650243","relation":{},"subject":[],"published":{"date-parts":[[2010,10]]}}}