{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,26]],"date-time":"2026-03-26T16:05:50Z","timestamp":1774541150744,"version":"3.50.1"},"reference-count":33,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"4","license":[{"start":{"date-parts":[[2021,10,1]],"date-time":"2021-10-01T00:00:00Z","timestamp":1633046400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2021,10,1]],"date-time":"2021-10-01T00:00:00Z","timestamp":1633046400000},"content-version":"am","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2021,10,1]],"date-time":"2021-10-01T00:00:00Z","timestamp":1633046400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2021,10,1]],"date-time":"2021-10-01T00:00:00Z","timestamp":1633046400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"name":"Learning Agents Research Group"},{"DOI":"10.13039\/100008562","name":"University of Texas at Austin","doi-asserted-by":"publisher","id":[{"id":"10.13039\/100008562","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100008982","name":"National Science Foundation","doi-asserted-by":"publisher","award":["CPS-1739964"],"award-info":[{"award-number":["CPS-1739964"]}],"id":[{"id":"10.13039\/501100008982","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100008982","name":"National Science Foundation","doi-asserted-by":"publisher","award":["IIS-1724157"],"award-info":[{"award-number":["IIS-1724157"]}],"id":[{"id":"10.13039\/501100008982","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100008982","name":"National Science Foundation","doi-asserted-by":"publisher","award":["NRI-1925082"],"award-info":[{"award-number":["NRI-1925082"]}],"id":[{"id":"10.13039\/501100008982","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000006","name":"Office of Naval Research","doi-asserted-by":"publisher","award":["N00014-18-2243"],"award-info":[{"award-number":["N00014-18-2243"]}],"id":[{"id":"10.13039\/100000006","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100017561","name":"Future of Life Institute","doi-asserted-by":"publisher","award":["RFP2-000"],"award-info":[{"award-number":["RFP2-000"]}],"id":[{"id":"10.13039\/100017561","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000183","name":"Army Research Office","doi-asserted-by":"publisher","award":["W911NF-19-2-0333"],"award-info":[{"award-number":["W911NF-19-2-0333"]}],"id":[{"id":"10.13039\/100000183","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100000183","name":"Army Research Office","doi-asserted-by":"publisher","award":["DARPA"],"award-info":[{"award-number":["DARPA"]}],"id":[{"id":"10.13039\/100000183","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100002186","name":"Lockheed Martin","doi-asserted-by":"publisher","id":[{"id":"10.13039\/100002186","id-type":"DOI","asserted-by":"publisher"}]},{"name":"General Motors"},{"DOI":"10.13039\/100012884","name":"Robert Bosch (Australia) Pty","doi-asserted-by":"publisher","id":[{"id":"10.13039\/100012884","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Robot. Autom. Lett."],"published-print":{"date-parts":[[2021,10]]},"DOI":"10.1109\/lra.2021.3100940","type":"journal-article","created":{"date-parts":[[2021,7,30]],"date-time":"2021-07-30T20:16:34Z","timestamp":1627676194000},"page":"7744-7749","source":"Crossref","is-referenced-by-count":30,"title":["APPLE: Adaptive Planner Parameter Learning From Evaluative Feedback"],"prefix":"10.1109","volume":"6","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-1934-1449","authenticated-orcid":false,"given":"Zizhao","family":"Wang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5151-2186","authenticated-orcid":false,"given":"Xuesu","family":"Xiao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3846-8787","authenticated-orcid":false,"given":"Garrett","family":"Warnell","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6795-420X","authenticated-orcid":false,"given":"Peter","family":"Stone","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2018.8594312"},{"key":"ref32","first-page":"1861","article-title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","author":"haarnoja","year":"2018","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1038\/nature14236"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/ICORR.2011.5975338"},{"key":"ref10","first-page":"116","article-title":"Benchmarking metric ground navigation","author":"perille","year":"2020","journal-title":"Proc IEEE Int Symp Safety Secur Rescue Robot"},{"key":"ref11","article-title":"Motion control for mobile robot navigation using machine learning: A survey","author":"xiao","year":"2020"},{"key":"ref12","article-title":"End to end learning for self-driving cars","author":"bojarski","year":"2016"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2017.7989182"},{"key":"ref14","first-page":"213","article-title":"Learning over subgoals for efficient navigation of structured, unknown environments","author":"stein","year":"2018","journal-title":"Proc Conf Robot Learn"},{"key":"ref15","first-page":"185","article-title":"Intention-net: Integrating planning and deep learning for goal-directed autonomous navigation","author":"gao","year":"2017","journal-title":"Proc Conf Robot Learn"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2019.2899918"},{"key":"ref17","first-page":"935?953","article-title":"Predictive dynamic window approach development with artificial neural fuzzy inference improvement","volume":"8","author":"teso-fz-beto\u00f1o","year":"2019","journal-title":"&#x201D; Electron"},{"key":"ref18","first-page":"10?598","article-title":"Differentiable gaussian process motion planning","author":"bhardwaj","year":"2019","journal-title":"Proc IEEE Int Conf Robot Automat"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA40945.2020.9196550"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1145\/375735.376334"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2020.3002217"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1145\/1597735.1597738"},{"key":"ref3","first-page":"197","article-title":"ROS navigation tuning guide","author":"zheng","year":"2017","journal-title":"Proc Robot Operating Syst"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3058927"},{"key":"ref29","first-page":"1000","article-title":"Reinforcement learning with human teachers: Evidence of feedback and guidance with implications for learning performance","volume":"6","author":"thomaz","year":"2006","journal-title":"Proc AAAI Conf Artif Intell"},{"key":"ref5","article-title":"APPLI: Adaptive planner parameter learning from interventions","author":"wang","year":"2020","journal-title":"Proc IEEE Int Conf Robot Automat"},{"key":"ref8","article-title":"Agile robot navigation through hallucinated learning and sober deployment","author":"xiao","year":"2021","journal-title":"Proc IEEE Int Conf Robot Automat"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2021.3056373"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/100.580977"},{"key":"ref9","article-title":"APPLR: Adaptive planner parameter learning from reinforcement","author":"xu","year":"2021","journal-title":"Proc IEEE Int Conf Robot Automat"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.1993.291936"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2018.8462900"},{"key":"ref22","first-page":"1312","article-title":"Badgr: An autonomous self-supervised learning-based navigation system","volume":"6","author":"kahn","year":"2021"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.15607\/RSS.2019.XV.030"},{"key":"ref24","first-page":"4221","article-title":"Crowdsteer: Realtime smooth and collision-free robot navigation in dense crowd scenarios trained using high-fidelity simulation","author":"liang","year":"2020","journal-title":"IJCAI"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-62056-1_27"},{"key":"ref26","first-page":"2285","article-title":"Interactive learning from policy-dependent human feedback","author":"macglashan","year":"2017","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2018.8593871"}],"container-title":["IEEE Robotics and Automation Letters"],"original-title":[],"link":[{"URL":"https:\/\/ieeexplore.ieee.org\/ielam\/7083369\/9475905\/9502545-aam.pdf","content-type":"application\/pdf","content-version":"am","intended-application":"syndication"},{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/7083369\/9475905\/09502545.pdf?arnumber=9502545","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,5,10]],"date-time":"2022-05-10T14:54:12Z","timestamp":1652194452000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9502545\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,10]]},"references-count":33,"journal-issue":{"issue":"4"},"URL":"https:\/\/doi.org\/10.1109\/lra.2021.3100940","relation":{},"ISSN":["2377-3766","2377-3774"],"issn-type":[{"value":"2377-3766","type":"electronic"},{"value":"2377-3774","type":"electronic"}],"subject":[],"published":{"date-parts":[[2021,10]]}}}