{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,10,23]],"date-time":"2024-10-23T08:02:56Z","timestamp":1729670576712,"version":"3.28.0"},"reference-count":38,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2014,10]]},"DOI":"10.1109\/devlrn.2014.6982953","type":"proceedings-article","created":{"date-parts":[[2014,12,30]],"date-time":"2014-12-30T18:48:19Z","timestamp":1419965299000},"page":"48-55","source":"Crossref","is-referenced-by-count":1,"title":["Reinforcement and shaping in learning action sequences with neural dynamics"],"prefix":"10.1109","author":[{"given":"Matthew","family":"Luciw","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yulia","family":"Sandamirskaya","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Sohrob","family":"Kazerounian","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jurgen","family":"Schmidhuber","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Gregor","family":"Schoner","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"19","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2010.07.012"},{"key":"35","doi-asserted-by":"publisher","DOI":"10.1088\/1741-2560\/3\/3\/R02"},{"key":"17","doi-asserted-by":"publisher","DOI":"10.1007\/BF00337259"},{"key":"36","doi-asserted-by":"publisher","DOI":"10.1016\/S0896-6273(02)00963-7"},{"key":"18","doi-asserted-by":"publisher","DOI":"10.1177\/02783640022066950"},{"key":"33","first-page":"585","article-title":"Sarsalandmark: An algorithm for learning in pomdps with landmarks","volume":"1","author":"james","year":"2009","journal-title":"Proceedings of the 8th International Conference on Autonomous Agents and Multiagent Systems-International Foundation for Autonomous Agents and Multiagent Systems"},{"key":"15","doi-asserted-by":"crossref","first-page":"231","DOI":"10.1016\/S0921-8890(97)00041-9","article-title":"Shaping robot behavior using principles from instrumental conditioning","volume":"22","author":"sasksida","year":"1998","journal-title":"Robotics and Autonomous Systems"},{"key":"34","doi-asserted-by":"publisher","DOI":"10.2478\/s13230-013-0109-5"},{"journal-title":"Robot Shaping an Experiment in Behaviour Engineering","year":"1998","author":"dorigo","key":"16"},{"key":"13","doi-asserted-by":"publisher","DOI":"10.1016\/B978-1-55860-335-6.50030-1"},{"key":"14","doi-asserted-by":"publisher","DOI":"10.1007\/BF00117447"},{"key":"37","first-page":"561","article-title":"Learning movement primitives","volume":"15","author":"schaal","year":"2005","journal-title":"11th Iternational Symposium on Robotics Research (ISRR2003)"},{"key":"11","doi-asserted-by":"publisher","DOI":"10.1901\/jeab.2004.82-317"},{"key":"38","first-page":"406","author":"der","year":"0","journal-title":"From Motor Babbling to Purposive Actions Emerging Self-exploration in A Dynamical Systems Approach to Early Robot Development"},{"journal-title":"Reinforcement learning and its application to control","year":"1992","author":"gullapalli","key":"12"},{"key":"21","doi-asserted-by":"publisher","DOI":"10.1016\/0022-2496(78)90016-0"},{"key":"20","article-title":"On-line Q-learning using connectionist systems. University of Cambridge","author":"rummery","year":"1994","journal-title":"Department of Engineering"},{"key":"22","article-title":"The role of exploration in learning control","author":"thrun","year":"1992","journal-title":"Handbook of Intelligent Control Neural Fuzzy and Adaptive Approaches"},{"key":"23","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN.1991.170605"},{"key":"24","doi-asserted-by":"publisher","DOI":"10.1177\/105971239700500302"},{"key":"25","article-title":"Roles of macro-actions in accelerating reinforcement learning","volume":"1317","author":"mcgovern","year":"1997","journal-title":"Grace Hopper Celebration of Women in Computing"},{"key":"26","first-page":"670","article-title":"Training and tracking in robotics","author":"selfridge","year":"1985","journal-title":"IJCAI Citeseer"},{"key":"27","doi-asserted-by":"publisher","DOI":"10.1145\/1143844.1143906"},{"key":"28","doi-asserted-by":"publisher","DOI":"10.1177\/105971239400200302"},{"key":"29","doi-asserted-by":"crossref","first-page":"199","DOI":"10.1142\/S0219843604000149","article-title":"Developmental robotics: Theory and experiments","volume":"1","author":"weng","year":"2004","journal-title":"International Journal of Humanoid Robotics"},{"key":"3","doi-asserted-by":"publisher","DOI":"10.1016\/S0921-8890(05)80025-9"},{"key":"2","first-page":"10571","article-title":"Dynamical systems approaches to neural systems and behavior","author":"sch\ufffdner","year":"2002","journal-title":"International Encyclopedia of the Social & Behavioral Sciences"},{"journal-title":"The Behavior of Organisms An Experimental Analysis","year":"1938","author":"skinner","key":"10"},{"journal-title":"Reinforcement Learning An Introduction","year":"1998","author":"sutton","key":"1"},{"journal-title":"Commercial Mobile Robot Simulation Software","year":"0","key":"30"},{"key":"7","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN.2013.6706877"},{"key":"6","first-page":"276","article-title":"Dynamic Neural Fields as a Step Towards Cognitive Neuromorphic Architectures","volume":"7","author":"sandamirskaya","year":"2013","journal-title":"Frontiers in Neuroscience"},{"key":"32","article-title":"Using eligibility traces to find the best memoryless policy in partially observable markov decision processes","author":"loch","year":"1998","journal-title":"Proceedings of the Fifteenth International Conference on Machine Learning"},{"key":"5","doi-asserted-by":"publisher","DOI":"10.1109\/DEVLRN.2011.6037353"},{"key":"31","article-title":"Tlearning","author":"graziano","year":"2012","journal-title":"CoRR"},{"key":"4","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2012.6386153"},{"key":"9","doi-asserted-by":"crossref","first-page":"237","DOI":"10.1613\/jair.301","article-title":"Reinforcement learning: A survey","volume":"4","author":"kaelbing","year":"1996","journal-title":"Journal of Artificial Intelligence Research"},{"key":"8","volume":"1","author":"sutton","year":"1998","journal-title":"Reinforcement Learning An Introduction"}],"event":{"name":"2014 Joint IEEE International Conferences on Development and Learning and Epigenetic Robotics (ICDL-Epirob)","start":{"date-parts":[[2014,10,13]]},"location":"Genoa, Italy","end":{"date-parts":[[2014,10,16]]}},"container-title":["4th International Conference on Development and Learning and on Epigenetic Robotics"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6971976\/6982939\/06982953.pdf?arnumber=6982953","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2020,10,14]],"date-time":"2020-10-14T11:19:06Z","timestamp":1602674346000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/6982953"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2014,10]]},"references-count":38,"URL":"https:\/\/doi.org\/10.1109\/devlrn.2014.6982953","relation":{},"subject":[],"published":{"date-parts":[[2014,10]]}}}