{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,16]],"date-time":"2026-01-16T00:10:25Z","timestamp":1768522225427,"version":"3.49.0"},"publisher-location":"Berlin, Heidelberg","reference-count":11,"publisher":"Springer Berlin Heidelberg","isbn-type":[{"value":"9783642344992","type":"print"},{"value":"9783642345005","type":"electronic"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2012]]},"DOI":"10.1007\/978-3-642-34500-5_16","type":"book-chapter","created":{"date-parts":[[2012,11,5]],"date-time":"2012-11-05T09:27:50Z","timestamp":1352107670000},"page":"126-133","source":"Crossref","is-referenced-by-count":22,"title":["Learn to Swing Up and Balance a Real Pole Based on Raw Visual Input Data"],"prefix":"10.1007","author":[{"given":"Jan","family":"Mattner","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Sascha","family":"Lange","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Martin","family":"Riedmiller","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","reference":[{"key":"16_CR1","unstructured":"Riedmiller, M., Lange, S., Voigtlaender, A.: Autonomous Reinforcement Learning on Raw Visual Input Data in a Real World Application. In: International Joint Conference on Neural Networks (2012)"},{"key":"16_CR2","doi-asserted-by":"publisher","first-page":"161","DOI":"10.1023\/A:1017928328829","volume":"49","author":"D. Ormoneit","year":"2002","unstructured":"Ormoneit, D., Sen, \u015a.: Kernel-Based Reinforcement Learning. Mach. Learn.\u00a049, 161\u2013178 (2002)","journal-title":"Mach. Learn."},{"key":"16_CR3","volume-title":"Reinforcement Learning: An Introduction","author":"R.S. Sutton","year":"1998","unstructured":"Sutton, R.S., Barto, A.G.: Reinforcement Learning: An Introduction. MIT Press, Cambridge (1998)"},{"key":"16_CR4","series-title":"Lecture Notes in Artificial Intelligence","doi-asserted-by":"publisher","first-page":"317","DOI":"10.1007\/11564096_32","volume-title":"Machine Learning: ECML 2005","author":"M. Riedmiller","year":"2005","unstructured":"Riedmiller, M.: Neural Fitted Q Iteration - First Experiences with a Data Efficient Neural Reinforcement Learning Method. In: Gama, J., Camacho, R., Brazdil, P.B., Jorge, A.M., Torgo, L. (eds.) ECML 2005. LNCS (LNAI), vol.\u00a03720, pp. 317\u2013328. Springer, Heidelberg (2005)"},{"key":"16_CR5","doi-asserted-by":"publisher","first-page":"3191","DOI":"10.1109\/ICSMC.2005.1571637","volume-title":"IEEE International Conference on Systems, Man and Cybernetics","author":"M. Riedmiller","year":"2005","unstructured":"Riedmiller, M.: Neural Reinforcement Learning to Swing-Up and Balance a Real Pole. In: IEEE International Conference on Systems, Man and Cybernetics, pp. 3191\u20133196. IEEE Press, New York (2005)"},{"key":"16_CR6","doi-asserted-by":"crossref","unstructured":"Tolat, V.V., Widrow, B.: An Adaptive \u2019Broom Balancer\u2019 with Visual Inputs. In: IEEE International Conference on Neural Networks, pp. 641\u2013647 (1988)","DOI":"10.1109\/ICNN.1988.23982"},{"key":"16_CR7","doi-asserted-by":"crossref","unstructured":"Wenzel, L., Vazquez, N., Nair, D., Jamal, R.: Computer Vision Based Inverted Pendulum. In: Proceedings of the 17th IEEE Instrumentation and Measurement Technology Conference, pp. 1319\u20131323 (2000)","DOI":"10.1109\/IMTC.2000.848689"},{"key":"16_CR8","doi-asserted-by":"crossref","unstructured":"Wang, H., Chamroo, A., Vasseur, C., Koncar, V.: Hybrid Control for Vision Based Cart-Inverted Pendulum System. In: American Control Conference, pp. 3845\u20133850 (2008)","DOI":"10.1109\/ACC.2008.4587093"},{"key":"16_CR9","doi-asserted-by":"publisher","first-page":"504","DOI":"10.1126\/science.1127647","volume":"313","author":"G.E. Hinton","year":"2006","unstructured":"Hinton, G.E., Salakhutdinov, R.R.: Reducing the Dimensionality of Data with Neural Networks. Science\u00a0313, 504\u2013507 (2006)","journal-title":"Science"},{"key":"16_CR10","doi-asserted-by":"publisher","first-page":"3207","DOI":"10.1162\/NECO_a_00052","volume":"22","author":"D.C. Ciresan","year":"2010","unstructured":"Ciresan, D.C., Meier, U., Gambardella, L.M., Schmidhuber, J.: Deep Big Simple Neural Nets Excel on Handwritten Digit Recognition. Neural Comput.\u00a022, 3207\u20133220 (2010)","journal-title":"Neural Comput."},{"key":"16_CR11","doi-asserted-by":"publisher","first-page":"568","DOI":"10.1109\/TAC.2003.809799","volume":"48","author":"K.V. Katsikopoulos","year":"2003","unstructured":"Katsikopoulos, K.V., Engelbrecht, S.E.: Markov Decision Processes with Delays and Asynchronous Cost Collection. IEEE Trans. Autom. Control\u00a048, 568\u2013574 (2003)","journal-title":"IEEE Trans. Autom. Control"}],"container-title":["Lecture Notes in Computer Science","Neural Information Processing"],"original-title":[],"link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-642-34500-5_16.pdf","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,4,20]],"date-time":"2025-04-20T07:00:48Z","timestamp":1745132448000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-642-34500-5_16"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2012]]},"ISBN":["9783642344992","9783642345005"],"references-count":11,"URL":"https:\/\/doi.org\/10.1007\/978-3-642-34500-5_16","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2012]]}}}