{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,24]],"date-time":"2026-07-24T14:56:24Z","timestamp":1784904984634,"version":"3.55.0"},"reference-count":40,"publisher":"IEEE","license":[{"start":{"date-parts":[[2024,5,13]],"date-time":"2024-05-13T00:00:00Z","timestamp":1715558400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2024,5,13]],"date-time":"2024-05-13T00:00:00Z","timestamp":1715558400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2024,5,13]]},"DOI":"10.1109\/icra57147.2024.10610948","type":"proceedings-article","created":{"date-parts":[[2024,8,8]],"date-time":"2024-08-08T17:51:05Z","timestamp":1723139465000},"page":"16236-16242","source":"Crossref","is-referenced-by-count":37,"title":["Prompt, Plan, Perform: LLM-based Humanoid Control via Quantized Imitation Learning"],"prefix":"10.1109","author":[{"given":"Jingkai","family":"Sun","sequence":"first","affiliation":[{"name":"The Hong Kong University of Science and Technology,Guangzhou,China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Qiang","family":"Zhang","sequence":"additional","affiliation":[{"name":"The Hong Kong University of Science and Technology,Guangzhou,China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yiqun","family":"Duan","sequence":"additional","affiliation":[{"name":"Australia Artificial Intelligence Institute University of Technology Sydney,Human | Centric AI Centre,Ultimo,Australia,2007"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiaoyang","family":"Jiang","sequence":"additional","affiliation":[{"name":"The Hong Kong University of Science and Technology,Guangzhou,China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Chong","family":"Cheng","sequence":"additional","affiliation":[{"name":"The Hong Kong University of Science and Technology,Guangzhou,China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Renjing","family":"Xu","sequence":"additional","affiliation":[{"name":"The Hong Kong University of Science and Technology,Guangzhou,China"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","article-title":"Generative adversarial imitation learning","volume-title":"Advances in neural information processing systems","volume":"29","author":"Ho"},{"key":"ref2","article-title":"The relativistic discriminator: a key element missing from standard gan","author":"Jolicoeur-Martineau","year":"2018"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1145\/3528223.3530110"},{"key":"ref4","article-title":"Actionable models: Unsupervised offline reinforcement learning of robotic skills","author":"Chebotar","year":"2021"},{"key":"ref5","first-page":"8748","article-title":"Learning transferable visual models from natural language supervision","volume-title":"International conference on machine learning","author":"Radford"},{"key":"ref6","first-page":"27730","article-title":"Training language models to follow instructions with human feedback","volume-title":"Advances in Neural Information Processing Systems","volume":"35","author":"Ouyang"},{"key":"ref7","article-title":"Llama 2: Open foundation and fine-tuned chat models","author":"Touvron","year":"2023"},{"key":"ref8","article-title":"Inner monologue: Embodied reasoning through planning with language models","author":"Huang","year":"2022"},{"key":"ref9","first-page":"9118","article-title":"Language models as zero-shot planners: Extracting actionable knowledge for embodied agents","volume-title":"International Conference on Machine Learning","author":"Huang"},{"key":"ref10","article-title":"Towards a unified agent with foundation models","volume-title":"Workshop on Reincarnating Reinforcement Learning at ICLR 2023","author":"Di Palo"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2022.3180108"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2022.3196123"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA48891.2023.10160396"},{"key":"ref14","first-page":"894","article-title":"Cliport: What and where pathways for robotic manipulation","volume-title":"Conference on Robot Learning","author":"Shridhar"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA48891.2023.10160591"},{"key":"ref16","article-title":"Do as i can, not as i say: Grounding language in robotic affordances","author":"Ahn","year":"2022"},{"key":"ref17","article-title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","author":"Brohan","year":"2023"},{"key":"ref18","article-title":"Doremi: Grounding language model by detecting and recovering from plan-execution misalignment","author":"Guo","year":"2023"},{"key":"ref19","first-page":"20703","article-title":"Model-based imitation learning for urban driving","volume-title":"Advances in Neural Information Processing Systems","volume":"35","author":"Hu"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2022.3144867"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.3390\/s21041278"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA48506.2021.9560942"},{"key":"ref23","first-page":"1199","article-title":"Viola: Object-centric imitation learning for vision-based robot manipulation","volume-title":"Conference on Robot Learning","author":"Zhu"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2018\/687"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1145\/3450626.3459670"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA48891.2023.10160421"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1145\/3453160"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/IROS47612.2022.9981984"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2022.3222996"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1038\/s42256-021-00433-9"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1145\/3550469.3555391"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1145\/3588432.3591541"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2020.2977573"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1007\/s10846-017-0468-y"},{"key":"ref35","first-page":"561","article-title":"Benchmarking reinforcement learning algorithms on real-world robots","volume-title":"Conference on robot learning","author":"Mahmood"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.3390\/robotics2030122"},{"key":"ref37","article-title":"Generative adversarial imitation from observation","author":"Torabi","year":"2018"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1016\/S0016-0032(96)00063-4"},{"key":"ref39","article-title":"Isaac gym: High performance gpu-based physics simulation for robot learning","author":"Makoviychuk","year":"2021"},{"key":"ref40","article-title":"Proximal policy optimization algorithms","author":"Schulman","year":"2017"}],"event":{"name":"2024 IEEE International Conference on Robotics and Automation (ICRA)","location":"Yokohama, Japan","start":{"date-parts":[[2024,5,13]]},"end":{"date-parts":[[2024,5,17]]}},"container-title":["2024 IEEE International Conference on Robotics and Automation (ICRA)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/10609961\/10609862\/10610948.pdf?arnumber=10610948","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,8,10]],"date-time":"2024-08-10T05:22:12Z","timestamp":1723267332000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10610948\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,5,13]]},"references-count":40,"URL":"https:\/\/doi.org\/10.1109\/icra57147.2024.10610948","relation":{},"subject":[],"published":{"date-parts":[[2024,5,13]]}}}