{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,10,30]],"date-time":"2024-10-30T16:36:37Z","timestamp":1730306197065,"version":"3.28.0"},"reference-count":44,"publisher":"IEEE","license":[{"start":{"date-parts":[[2022,12,11]],"date-time":"2022-12-11T00:00:00Z","timestamp":1670716800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2022,12,11]],"date-time":"2022-12-11T00:00:00Z","timestamp":1670716800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2022,12,11]]},"DOI":"10.1109\/wsc57314.2022.10015308","type":"proceedings-article","created":{"date-parts":[[2023,1,23]],"date-time":"2023-01-23T20:11:54Z","timestamp":1674504714000},"page":"2451-2462","source":"Crossref","is-referenced-by-count":0,"title":["Accelerating Training of Reinforcement Learning-Based Construction Robots in Simulation Using Demonstrations Collected in Virtual Reality"],"prefix":"10.1109","author":[{"given":"Lei","family":"Huang","sequence":"first","affiliation":[{"name":"University of British Columbia,Department of Civil Engineering,Vancouver,BC,CANADA,V6T 1Z4"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhengbo","family":"Zou","sequence":"additional","affiliation":[{"name":"University of British Columbia,Department of Civil Engineering,Vancouver,BC,CANADA,V6T 1Z4"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2021.103569"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2021.104006"},{"volume-title":"US Bureau of Labor Statistics: Construction NAICS 23","year":"2022","key":"ref3"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.22260\/ISARC2016\/0073"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TRO.2004.838027"},{"key":"ref6","first-page":"845","article-title":"Fast Policy Learning through Imitation and Reinforcement","volume-title":"Proceedings of the Thirty-Fourth Conference on Uncertainty in Artificial Intelligence, UAI 2018","author":"Cheng"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1007\/s11721-008-0012-6"},{"volume-title":"PyBullet, a Python module for physics simulation for games, robotics and machine learning","year":"2016-2021","author":"Coumans","key":"ref8"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1038\/nature14422"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2018.04.004"},{"key":"ref11","first-page":"27813","article-title":"Robust Predictable Control","volume-title":"Advances in Neural Information Processing Systems","volume":"34","author":"Eysenbach","year":"2021"},{"key":"ref12","first-page":"1587","article-title":"Addressing function approximation error in actor-critic methods","volume-title":"International conference on machine learning","author":"Fujimoto"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1111\/j.1467-8667.1995.tb00298.x"},{"key":"ref14","article-title":"Distributed Prioritized Experience Replay","volume-title":"6th International Conference on Learning Representations.","author":"Horgan","year":"2018"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1177\/0278364920987859"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.22260\/ISARC2018\/0048"},{"key":"ref17","first-page":"1273","article-title":"Offline Reinforcement Learning as One Big Sequence Modeling Problem","volume-title":"Advances in Neural Information Processing Systems","volume":"34","author":"Janner","year":"2021"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1061\/(ASCE)CO.1943-7862.0001512"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2013.08.014"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.48550\/arXiv.1406.3269"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.22260\/ISARC2019\/0164"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1016\/S0921-8890(02)00166-5"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.2008.4543596"},{"key":"ref24","article-title":"Reinforcement learning and control as probabilistic inference: Tutorial and review","author":"Levine","year":"2018","journal-title":"arXiv preprint"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2020.103370"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1061\/(ASCE)CO.1943-7862.0002154"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2018.8462901"},{"key":"ref28","first-page":"3303","article-title":"Data-Efficient Hierarchical Reinforcement Learning","volume-title":"Advances in Neural Information Processing Systems","volume":"31","author":"Nachum","year":"2018"},{"volume-title":"Oxford Economics: Future of Construction A Global Forecase for Construction to 2030","year":"2021","key":"ref29"},{"volume-title":"Occupational Safety and Health Administration, United States Department of Labor: Commonly Used Statistics","year":"2019","key":"ref30"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1061\/(ASCE)CO.1943-7862.0002007"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.15607\/RSS.2018.XIV.049"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-70866-9_2"},{"key":"ref34","first-page":"1889","article-title":"Trust Region Policy Optimization","volume-title":"Proceedings of the 32nd International Conference on Machine Learning","volume":"37","author":"Schulman"},{"key":"ref35","article-title":"Proximal policy optimization algorithms","author":"Schulman","year":"2017","journal-title":"arXiv preprint"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2015.04.016"},{"volume-title":"Reinforcement learning: An introduction","year":"2018","author":"Sutton","key":"ref37"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1097\/JOM.0000000000000913"},{"volume-title":"U. S. Chamber of Commerce: Q4 2021 Commercial Construction Index","year":"2021","key":"ref39"},{"key":"ref40","article-title":"Leveraging demonstrations for deep reinforcement learning on robotics problems with sparse rewards","author":"Vecerik","year":"2017","journal-title":"arXiv preprint"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.22260\/ISARC2020\/0055"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2019.01.010"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2019.02.020"},{"key":"ref44","article-title":"Learning Invariant Representations for Reinforcement Learning without Reconstruction","volume-title":"9th International Conference on Learning Representations (ICLR).","author":"Zhang","year":"2021"}],"event":{"name":"2022 Winter Simulation Conference (WSC)","start":{"date-parts":[[2022,12,11]]},"location":"Singapore","end":{"date-parts":[[2022,12,14]]}},"container-title":["2022 Winter Simulation Conference (WSC)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/10015196\/10015230\/10015308.pdf?arnumber=10015308","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,2,13]],"date-time":"2024-02-13T06:07:12Z","timestamp":1707804432000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10015308\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,12,11]]},"references-count":44,"URL":"https:\/\/doi.org\/10.1109\/wsc57314.2022.10015308","relation":{},"subject":[],"published":{"date-parts":[[2022,12,11]]}}}