{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,7]],"date-time":"2026-07-07T15:58:49Z","timestamp":1783439929564,"version":"3.54.6"},"reference-count":57,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"10","license":[{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Robot. Autom. Lett."],"published-print":{"date-parts":[[2024,10]]},"DOI":"10.1109\/lra.2024.3445630","type":"journal-article","created":{"date-parts":[[2024,8,19]],"date-time":"2024-08-19T17:35:53Z","timestamp":1724088953000},"page":"8579-8586","source":"Crossref","is-referenced-by-count":20,"title":["A Comparison of Imitation Learning Algorithms for Bimanual Manipulation"],"prefix":"10.1109","volume":"9","author":[{"ORCID":"https:\/\/orcid.org\/0009-0000-7928-3733","authenticated-orcid":false,"given":"Michael","family":"Drolet","sequence":"first","affiliation":[{"name":"School of Computing and Augmented Intelligence, Arizona State University, Tempe, AZ, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Simon","family":"Stepputtis","sequence":"additional","affiliation":[{"name":"Robotics Institute, Carnegie Mellon University, Pittsburgh, AZ, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9247-8882","authenticated-orcid":false,"given":"Siva","family":"Kailas","sequence":"additional","affiliation":[{"name":"Robotics Institute, Carnegie Mellon University, Pittsburgh, AZ, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Ajinkya","family":"Jain","sequence":"additional","affiliation":[{"name":"[Google] Intrinsic, Mountain View, CA, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-5266-8091","authenticated-orcid":false,"given":"Jan","family":"Peters","sequence":"additional","affiliation":[{"name":"Department of Computer Science, TU Darmstadt, Darmstadt, Germany"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5660-1874","authenticated-orcid":false,"given":"Stefan","family":"Schaal","sequence":"additional","affiliation":[{"name":"[Google] Intrinsic, Mountain View, CA, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9896-8217","authenticated-orcid":false,"given":"Heni Ben","family":"Amor","sequence":"additional","affiliation":[{"name":"School of Computing and Augmented Intelligence, Arizona State University, Tempe, AZ, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/IROS47612.2022.9981802"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1016\/j.cirp.2011.03.017"},{"key":"ref3","volume-title":"Reinforcement Learning: An Introduction","author":"Sutton","year":"2018"},{"key":"ref4","first-page":"463","article-title":"Learning to drive a bicycle using reinforcement learning and shaping","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Randlv","year":"1998"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-41188-6_3"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1007\/11008941_60"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2012.6386109"},{"key":"ref8","first-page":"4565","article-title":"Generative adversarial imitation learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"29","author":"Ho","year":"2016"},{"key":"ref9","first-page":"158","article-title":"Implicit behavioral cloning","volume-title":"Proc. Conf. Robot Learn.","author":"Florence","year":"2022"},{"key":"ref10","first-page":"627","article-title":"A reduction of imitation learning and structured prediction to no-regret online learning","volume-title":"Proc. 14th Int. Conf. Artif. Intell. Statist. JMLR Workshop Conf. Proc.","author":"Ross","year":"2011"},{"key":"ref11","first-page":"305","article-title":"ALVINN: An autonomous land vehicle in a neural network","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"1","author":"Pomerleau","year":"1988"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.15607\/rss.2023.xix.016"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.15607\/rss.2023.xix.026"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1007\/s41315-019-00103-5"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1145\/3054912"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1016\/j.robot.2008.10.024"},{"key":"ref17","first-page":"2084","article-title":"Learning to walk through imitation","volume-title":"Proc. Int. Joint Conf. Artif. Intell.","author":"Chalodhorn","year":"2007"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.2009.5152385"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/TRO.2011.2159412"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1016\/j.robot.2004.03.002"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1177\/0278364912472380"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2022.3196158"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1177\/0278364918765952"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1016\/j.robot.2012.07.005"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2011.6095109"},{"key":"ref26","first-page":"1510","article-title":"Learning bimanual scooping policies for food acquisition","volume-title":"Proc. Conf. Robot Learn.","volume":"205","author":"Grannen","year":"2023"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2023.3295991"},{"key":"ref28","article-title":"Bi-manual manipulation and attachment via sim-to-real reinforcement learning","author":"Kataoka","year":"2022"},{"key":"ref29","first-page":"379","article-title":"Bayesian interaction primitives: A slam approach to human-robot interaction","volume-title":"Proc. Conf. Robot Learn.","author":"Campbell","year":"2017"},{"key":"ref30","first-page":"2327","article-title":"Deep imitation learning for bimanual robotic manipulation","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Xie","year":"2020"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/tmech.2023.3295249"},{"key":"ref32","first-page":"14656","article-title":"What matters for adversarial imitation learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Orsini","year":"2021"},{"key":"ref33","first-page":"58","article-title":"A pragmatic look at deep imitation learning","author":"Arulkumaran","year":"2021"},{"key":"ref34","first-page":"4511","article-title":"Hyperparameter selection for imitation learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Hussenot","year":"2021"},{"key":"ref35","article-title":"Open x-embodiment: Robotic learning datasets and RT-x models","author":"Padalkar","year":"2023"},{"key":"ref36","first-page":"5998","article-title":"Attention is all you need","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"30","author":"Vaswani","year":"2017"},{"key":"ref37","article-title":"Representation learning with contrastive predictive coding","author":"Oord","year":"2018"},{"key":"ref38","article-title":"Revisiting energy based models as policies: Ranking noise contrastive estimation and interpolating energy models","author":"Singh","year":"2023"},{"key":"ref39","first-page":"6840","article-title":"Denoising diffusion probabilistic models","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Ho","year":"2020"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1145\/3422622"},{"key":"ref41","first-page":"1889","article-title":"Trust region policy optimization","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Schulman","year":"2015"},{"key":"ref42","article-title":"Variational discriminator bottleneck: Improving imitation learning, inverse RL, and GANs by constraining information flow","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Peng","year":"2019"},{"key":"ref43","first-page":"3812","article-title":"Infogail: Interpretable imitation learning from visual demonstrations","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"30","author":"Li","year":"2017"},{"key":"ref44","article-title":"Wasserstein adversarial imitation learning","author":"Xiao","year":"2019"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2019.8793698"},{"key":"ref46","first-page":"2891","article-title":"Query-efficient imitation learning for end-to-end autonomous driving","volume-title":"Proc. 31st AAAI Conf. Artif. Intell.","author":"Zhang","year":"2017"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1109\/JRA.1987.1087068"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1177\/0278364907087548"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2010.5650218"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1016\/S0005-1098(99)00215-0"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1163\/156855393X00221"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.1177\/027836498600500106"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00589"},{"key":"ref54","doi-asserted-by":"publisher","DOI":"10.1145\/3292500.3330701"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.6028\/jres.113.022"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.13053\/rcs-121-1-6"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.3390\/eng4010032"}],"container-title":["IEEE Robotics and Automation Letters"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/7083369\/10638067\/10638712.pdf?arnumber=10638712","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,12,23]],"date-time":"2024-12-23T19:35:03Z","timestamp":1734982503000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10638712\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,10]]},"references-count":57,"journal-issue":{"issue":"10"},"URL":"https:\/\/doi.org\/10.1109\/lra.2024.3445630","relation":{},"ISSN":["2377-3766","2377-3774"],"issn-type":[{"value":"2377-3766","type":"electronic"},{"value":"2377-3774","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,10]]}}}