{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,5]],"date-time":"2026-06-05T05:14:07Z","timestamp":1780636447659,"version":"3.54.1"},"reference-count":48,"publisher":"IEEE","license":[{"start":{"date-parts":[[2021,9,27]],"date-time":"2021-09-27T00:00:00Z","timestamp":1632700800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2021,9,27]],"date-time":"2021-09-27T00:00:00Z","timestamp":1632700800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2021,9,27]],"date-time":"2021-09-27T00:00:00Z","timestamp":1632700800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2021,9,27]]},"DOI":"10.1109\/iros51168.2021.9636628","type":"proceedings-article","created":{"date-parts":[[2021,12,16]],"date-time":"2021-12-16T20:45:38Z","timestamp":1639687538000},"page":"1274-1280","source":"Crossref","is-referenced-by-count":23,"title":["Bayesian Meta-Learning for Few-Shot Policy Adaptation Across Robotic Platforms"],"prefix":"10.1109","author":[{"given":"Ali","family":"Ghadirzadeh","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xi","family":"Chen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Petra","family":"Poklukar","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Chelsea","family":"Finn","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Marten","family":"Bjorkman","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Danica","family":"Kragic","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref39","article-title":"Lgmnet: Learning to generate matching networks for few-shot learning","author":"li","year":"2019"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.01199"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2019.8793537"},{"key":"ref32","article-title":"One policy to control them all: Shared modular policies for agent-agnostic control","author":"huang","year":"2020","journal-title":"ICML"},{"key":"ref31","article-title":"Robonet: Large-scale multi-robot learning","author":"dasari","year":"2019","journal-title":"Conference on Robot Learning"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2017.7989250"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00131"},{"key":"ref36","article-title":"Prototypical networks for few-shot learning","author":"snell","year":"2017","journal-title":"NeurIPS"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2017.7989324"},{"key":"ref34","article-title":"Hardware conditioned policies for multi-robot transfer learning","author":"chen","year":"2018","journal-title":"NeurIPS"},{"key":"ref10","article-title":"Meta-learning with latent embedding optimization","author":"rusu","year":"2019","journal-title":"International Conference on Learning Representations"},{"key":"ref40","article-title":"Recasting gradient-based meta-learning as hierarchical bayes","author":"grant","year":"2018","journal-title":"ICLRE"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA40945.2020.9196540"},{"key":"ref12","article-title":"Few-shot model-based adaptation in noisy conditions","author":"arndt","year":"2020"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/IROS45743.2020.9341571"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2018.8460528"},{"key":"ref15","article-title":"One-shot imitation learning","author":"duan","year":"2017","journal-title":"NeurIPS"},{"key":"ref16","article-title":"One-shot visual imitation learning via meta-learning","author":"finn","year":"2017","journal-title":"Conference on Robot Learning"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.15607\/RSS.2018.XIV.002"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2020.2977835"},{"key":"ref19","article-title":"Task-embedded control networks for few-shot imitation learning","author":"james","year":"2018","journal-title":"Conference on Robot Learning"},{"key":"ref28","article-title":"Continuous adaptation via meta-learning in nonstationary and competitive environments","author":"al-shedivat","year":"2018","journal-title":"ICLRE"},{"key":"ref4","article-title":"Efficient adaptation for end-to-end vision-based robotic manipulation","author":"julian","year":"2020"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1177\/0278364919887447"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2017.8206046"},{"key":"ref6","article-title":"Model-agnostic meta-learning for fast adaptation of deep networks","author":"finn","year":"2017","journal-title":"ICML"},{"key":"ref29","article-title":"Deep reinforcement learning amidst lifelong non-stationarity","author":"xie","year":"2020"},{"key":"ref5","article-title":"Learning to adapt in dynamic, real-world environments through meta-reinforcement learning","author":"clavera","year":"2019","journal-title":"ICLRE"},{"key":"ref8","article-title":"Amortized bayesian meta-learning","author":"ravi","year":"2019","journal-title":"ICLRE"},{"key":"ref7","article-title":"Probabilistic model-agnostic Meta-learning","author":"finn","year":"2018","journal-title":"NeurIPS"},{"key":"ref2","article-title":"Proximal policy optimization algorithms","author":"schulman","year":"2017"},{"key":"ref9","article-title":"Meta-learning probabilistic inference for prediction","author":"gordon","year":"2019","journal-title":"ICLRE"},{"key":"ref1","article-title":"End-to-end training of deep visuomotor policies","author":"levine","year":"2016","journal-title":"The Journal of Machine Learning Research"},{"key":"ref46","article-title":"Auto-encoding variational bayes","author":"kingma","year":"2013"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.3389\/frobt.2020.00047"},{"key":"ref45","article-title":"Data-efficient visuomotor policy training using reinforcement learning and generative models","author":"ghadirzadeh","year":"2020"},{"key":"ref48","article-title":"Adam: A method for stochastic optimization","author":"kingma","year":"2014"},{"key":"ref22","article-title":"Affordance learning for end-to-end visuomotor robot control","author":"h\u00e4m\u00e4l\u00e4inen","year":"2019","journal-title":"IROS"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.15607\/RSS.2010.VI.034"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00493"},{"key":"ref42","article-title":"Meta-learning priors for efficient online bayesian regression","author":"harrison","year":"2018","journal-title":"International Workshop on the Algorithmic Foundations of Robotics"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2017.7989249"},{"key":"ref41","article-title":"Bayesian model-agnostic meta-learning","author":"yoon","year":"2018","journal-title":"NeurIPS"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA40945.2020.9197505"},{"key":"ref44","article-title":"Gradient-em bayesian meta-learning","author":"zou","year":"2020"},{"key":"ref26","article-title":"Meta-reinforcement learning of structured exploration strategies","author":"gupta","year":"2018","journal-title":"NeurIPS"},{"key":"ref43","article-title":"Probabilistic active meta-learning","author":"kaddour","year":"2020"},{"key":"ref25","article-title":"Learning an embedding space for transferable robot skills","author":"hausman","year":"2018","journal-title":"International Conference on Learning Representations"}],"event":{"name":"2021 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)","location":"Prague, Czech Republic","start":{"date-parts":[[2021,9,27]]},"end":{"date-parts":[[2021,10,1]]}},"container-title":["2021 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/9635848\/9635849\/09636628.pdf?arnumber=9636628","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,5,10]],"date-time":"2022-05-10T16:54:36Z","timestamp":1652201676000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9636628\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,9,27]]},"references-count":48,"URL":"https:\/\/doi.org\/10.1109\/iros51168.2021.9636628","relation":{},"subject":[],"published":{"date-parts":[[2021,9,27]]}}}