{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,25]],"date-time":"2026-07-25T16:40:28Z","timestamp":1784997628651,"version":"3.55.0"},"reference-count":202,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"7","license":[{"start":{"date-parts":[[2024,7,1]],"date-time":"2024-07-01T00:00:00Z","timestamp":1719792000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/legalcode"}],"funder":[{"DOI":"10.13039\/100003077","name":"Knowledge Foundation","doi-asserted-by":"publisher","id":[{"id":"10.13039\/100003077","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Pattern Anal. Mach. Intell."],"published-print":{"date-parts":[[2024,7]]},"DOI":"10.1109\/tpami.2024.3357847","type":"journal-article","created":{"date-parts":[[2024,1,24]],"date-time":"2024-01-24T18:39:08Z","timestamp":1706121548000},"page":"4763-4779","source":"Crossref","is-referenced-by-count":281,"title":["Advances and Challenges in Meta-Learning: A Technical Review"],"prefix":"10.1109","volume":"46","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-0185-5038","authenticated-orcid":false,"given":"Anna","family":"Vettoruzzo","sequence":"first","affiliation":[{"name":"Center for Applied Intelligent Systems Research (CAISR), Halmstad University, Halmstad, Sweden"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2859-6155","authenticated-orcid":false,"given":"Mohamed-Rafik","family":"Bouguelia","sequence":"additional","affiliation":[{"name":"Center for Applied Intelligent Systems Research (CAISR), Halmstad University, Halmstad, Sweden"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7044-9805","authenticated-orcid":false,"given":"Joaquin","family":"Vanschoren","sequence":"additional","affiliation":[{"name":"Automated Machine Learning Group, Eindhoven University of Technology, Eindhoven, The Netherlands"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5163-2997","authenticated-orcid":false,"given":"Thorsteinn","family":"R\u00f6gnvaldsson","sequence":"additional","affiliation":[{"name":"Center for Applied Intelligent Systems Research (CAISR), Halmstad University, Halmstad, Sweden"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4176-0236","authenticated-orcid":false,"given":"KC","family":"Santosh","sequence":"additional","affiliation":[{"name":"Applied AI Research Lab, Department of Computer Science, University of South Dakota, Vermillion, SD, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1145\/3470918"},{"key":"ref2","first-page":"1126","article-title":"Model-agnostic meta-learning for fast adaptation of deep networks","volume-title":"Proc. Int. Conf. Mach. Learn","author":"Finn"},{"key":"ref3","article-title":"A survey of meta-reinforcement learning","author":"Beck","year":"2023"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-05318-5_2"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2021.3079209"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1023\/A:1019956318069"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1007\/s10462-021-10004-4"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1016\/b978-0-323-89931-4.00010-9"},{"key":"ref9","article-title":"Talk: Model vs optimization meta learning","volume-title":"Proc. Int. conf. Neural Inf. Process. Syst.","author":"Vinyals"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.5555\/3294996.3295163"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D19-1403"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1145\/3529954"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D18-1398"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P19-1542"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P19-1253"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2019\/437"},{"key":"ref17","first-page":"357","article-title":"One-shot visual imitation learning via meta-learning","volume-title":"Proc. Conf. Robot Learn.","author":"Finn"},{"key":"ref18","article-title":"ProtoTransformer: A meta-learning approach to providing student feedback","author":"Wu","year":"2021"},{"key":"ref19","article-title":"Multi-task learning as multi-objective optimization","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Sener"},{"key":"ref20","first-page":"794","article-title":"GradNorm: Gradient normalization for adaptive loss balancing in deep multitask networks","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Chen"},{"key":"ref21","first-page":"7482","article-title":"Multi-task learning using uncertainty to weigh losses for scene geometry and semantics","volume-title":"Proc. IEEE Conf. Comput. Vis. Pattern Recognit.","author":"Kendall"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.433"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v33i01.33014822"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00332"},{"key":"ref25","doi-asserted-by":"crossref","DOI":"10.23915\/distill.00011","article-title":"Feature-wise transformations","volume-title":"Distill","author":"Dumoulin","year":"2018"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00197"},{"key":"ref27","first-page":"1593","article-title":"Learning multiple tasks with multilinear relationship networks","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Long"},{"key":"ref28","first-page":"1","article-title":"Perceiver IO: A general architecture for structured inputs & outputs","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Jaegle"},{"key":"ref29","first-page":"27 503","article-title":"Efficiently identifying task groupings for multi-task learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Fifty"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2021.3070203"},{"key":"ref31","article-title":"Multi-task learning with deep neural networks: A survey","author":"Crawshaw","year":"2020"},{"key":"ref32","article-title":"What makes imagenet good for transfer learning?","author":"Huh","year":"2016"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.48550\/arXiv.1810.04805"},{"key":"ref34","article-title":"PaLM: Scaling language modeling with pathways","author":"Chowdhery","year":"2022"},{"key":"ref35","article-title":"LLaMA: Open and efficient foundation language models","author":"Touvron","year":"2023"},{"key":"ref36","article-title":"GPT-4 technical report","year":"2023"},{"key":"ref37","first-page":"1","article-title":"Fine-tuning can distort pretrained features and underperform out-of-distribution","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Kumar"},{"key":"ref38","first-page":"1","article-title":"Surgical fine-tuning improves adaptation to distribution shifts","volume-title":"Proc. Workshop Distrib. Shifts: Connecting Methods Appl.","author":"Lee"},{"key":"ref39","article-title":"Sentence encoders on stilts: Supplementary training on intermediate labeled-data tasks","author":"Phang","year":"2018"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P18-1031"},{"key":"ref41","first-page":"1842","article-title":"Meta-learning with memory-augmented neural networks","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Santoro"},{"key":"ref42","first-page":"1","article-title":"A simple neural attentive meta-learner","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Mishra"},{"key":"ref43","first-page":"2554","article-title":"Meta networks","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Munkhdalai"},{"key":"ref44","first-page":"1704","article-title":"Conditional neural processes","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Garnelo"},{"key":"ref45","first-page":"1877","article-title":"Language models are few-shot learners","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Brown"},{"key":"ref46","first-page":"30583","article-title":"What can transformers learn in-context? A case study of simple function classes,","author":"Garg","journal-title":"Proc. Adv. Neural Inf. Process. Syst."},{"key":"ref47","first-page":"1","article-title":"General-purpose in-context learning by meta-learning transformers","volume-title":"Proc. Workshop Distrib. Shifts: Connecting Methods Appl.","author":"Kirsch"},{"key":"ref48","first-page":"1","article-title":"What learning algorithm is in-context learning? Investigations with linear models","volume-title":"proc. 11th Int. Conf. Learn. Representations","author":"Aky\u00fcrek"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.48550\/ARXIV.1706.03762"},{"key":"ref50","first-page":"1","article-title":"Optimization as a model for few-shot learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Ravi"},{"key":"ref51","first-page":"3988","article-title":"Learning to learn by gradient descent by gradient descent","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Andrychowicz"},{"key":"ref52","article-title":"Learning to optimize","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Li"},{"key":"ref53","first-page":"3751","article-title":"Learned optimizers that scale and generalize","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Wichrowska"},{"key":"ref54","first-page":"11227","article-title":"Meta architecture search","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Shaw"},{"key":"ref55","first-page":"1","article-title":"Towards fast adaptation of neural architectures with meta learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Lian"},{"key":"ref56","first-page":"1568","article-title":"Bilevel programming for hyperparameter optimization and meta-learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Franceschi"},{"key":"ref57","first-page":"1","article-title":"Bayesian model-agnostic meta-learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Kim"},{"key":"ref58","article-title":"Meta-learning and universality: Deep representations and gradient descent can approximate any learning algorithm","author":"Finn","year":"2018","journal-title":"Proc. Int. Conf. Learn. Representations"},{"key":"ref59","article-title":"Meta-SGd: Learning to learn quickly for few-shot learning","author":"Li","year":"2017"},{"key":"ref60","first-page":"1","article-title":"Alpha MAML: Adaptive model-agnostic meta-learning","volume-title":"Proc. 6th ICML Workshop Automated Mach. Learn.","author":"Behl"},{"key":"ref61","article-title":"Deep meta-learning: Learning to learn in the concept space","author":"Zhou","year":"2018"},{"key":"ref62","first-page":"1","article-title":"Rapid learning or feature reuse? Towards understanding the effectiveness of MAML","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Raghu"},{"key":"ref63","first-page":"1","article-title":"BOIL: Towards representation change for few-shot learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Oh"},{"key":"ref64","first-page":"1","article-title":"How to train your MAML","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Antoniou"},{"key":"ref65","first-page":"7693","article-title":"Fast context adaptation via meta-learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Zintgraf"},{"key":"ref66","first-page":"4059","article-title":"On enforcing better conditioned meta-learning for rapid few-shot adaptation","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Hiller"},{"key":"ref67","volume-title":"Deep Learning","author":"Goodfellow","year":"2016"},{"key":"ref68","article-title":"On first-order meta-learning algorithms","author":"Nichol","year":"2018"},{"key":"ref69","first-page":"1","article-title":"Meta-learning with differentiable closed-form solvers","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Bertinetto"},{"key":"ref70","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.01091"},{"key":"ref71","article-title":"Meta-learning with implicit gradients","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Rajeswaran"},{"key":"ref72","doi-asserted-by":"publisher","DOI":"10.1109\/TIT.1967.1053964"},{"key":"ref73","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00068"},{"key":"ref74","first-page":"1","article-title":"Siamese neural networks for one-shot image recognition","volume-title":"Proc. ICML Deep Learn. Workshop","author":"Koch"},{"key":"ref75","first-page":"3637","article-title":"Matching networks for one shot learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Vinyals"},{"key":"ref76","first-page":"24581","article-title":"On episodes, prototypical networks, and few-shot learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Laenen"},{"key":"ref77","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00131"},{"key":"ref78","first-page":"1","article-title":"Few-shot learning with graph neural networks","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Garcia"},{"key":"ref79","first-page":"232","article-title":"Infinite mixture prototypes for few-shot learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Allen"},{"key":"ref80","first-page":"1","article-title":"Learning to learn with conditional class dependencies","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Jiang"},{"key":"ref81","article-title":"Meta-learning with latent embedding optimization","author":"Rusu","year":"2019","journal-title":"Proc. Int. Conf. Learn. Representations"},{"key":"ref82","article-title":"Meta-dataset: A dataset of datasets for learning to learn from few examples","author":"Triantafillou","year":"2019","journal-title":"Proc. Int. Conf. Learn. Representations"},{"key":"ref83","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2019.03.085"},{"key":"ref84","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58568-6_16"},{"key":"ref85","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00893"},{"key":"ref86","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58583-9_8"},{"key":"ref87","first-page":"1","article-title":"A closer look at few-shot classification","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Chen"},{"key":"ref88","first-page":"1","article-title":"Multimodal model-agnostic meta-learning via task-aware modulation","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Vuorio"},{"key":"ref89","first-page":"964","article-title":"The advantage of conditional meta-learning for biased regularization and fine tuning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Denevi"},{"key":"ref90","first-page":"7045","article-title":"Hierarchically structured meta-learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Yao"},{"key":"ref91","first-page":"10177","article-title":"Subspace learning for effective meta-learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Jiang"},{"key":"ref92","first-page":"9122","article-title":"Reconciling meta-learning and continual learning with online mixtures of tasks","author":"Jerfel","year":"2019","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"ref93","first-page":"23","article-title":"Task similarity aware meta learning: Theory-inspired improvement on MAML","volume-title":"Proc. 37th Conf. Uncertainty Artif. Intell.","author":"Zhou"},{"key":"ref94","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN54540.2023.10191944"},{"key":"ref95","first-page":"3825","article-title":"LGM-Net: Learning to generate matching networks for few-shot learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Li"},{"key":"ref96","first-page":"1","article-title":"A universal representation transformer layer for few-shot image classification","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Liu"},{"key":"ref97","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00939"},{"key":"ref98","first-page":"7959","article-title":"Fast and flexible multi-task classification using conditional neural adaptive processes","author":"Requeima","year":"2019","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"ref99","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58607-2_45"},{"key":"ref100","first-page":"10424","article-title":"Learning a universal template for few-shot dataset generalization","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Triantafillou"},{"key":"ref101","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP43922.2022.9746025"},{"key":"ref102","first-page":"177","article-title":"Transferable meta learning across domains","volume-title":"Proc. Conf. Uncertainty Artif. Intell.","author":"Kang"},{"key":"ref103","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.metanlp-1.8"},{"key":"ref104","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v36i3.20230"},{"key":"ref105","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.emnlp-main.38"},{"key":"ref106","first-page":"1273","article-title":"Communication-efficient learning of deep networks from decentralized data","volume-title":"Proc. Int. Conf. Artif. Intell. Statist.","author":"McMahan"},{"key":"ref107","first-page":"429","article-title":"Federated optimization in heterogeneous networks","volume-title":"Proc. Mach. Learn. Syst.","volume":"2","author":"Li"},{"key":"ref108","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.01057"},{"key":"ref109","first-page":"5132","article-title":"Scaffold: Stochastic controlled averaging for federated learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Karimireddy"},{"key":"ref110","article-title":"Federated learning of a mixture of global and local models","author":"Hanzely","year":"2020"},{"key":"ref111","first-page":"21394","article-title":"Personalized federated learning with Moreau envelopes","author":"Dinh","year":"2020","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"ref112","first-page":"6357","article-title":"Ditto: Fair and robust federated learning through personalization","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Li"},{"key":"ref113","first-page":"1","article-title":"Personalized federated learning with feature alignment and classifier collaboration","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Xu"},{"key":"ref114","doi-asserted-by":"publisher","DOI":"10.1109\/tit.2022.3192506"},{"key":"ref115","doi-asserted-by":"publisher","DOI":"10.1109\/TPDS.2021.3134263"},{"key":"ref116","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2020.3015958"},{"key":"ref117","doi-asserted-by":"publisher","DOI":"10.1145\/3558005"},{"key":"ref118","article-title":"Improving federated learning personalization via model agnostic meta learning","author":"Jiang","year":"2019"},{"key":"ref119","first-page":"3557","article-title":"Personalized federated learning with theoretical guarantees: A model-agnostic meta-learning approach","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Fallah"},{"key":"ref120","article-title":"Federated meta-learning with fast convergence and efficient communication","author":"Chen","year":"2018"},{"key":"ref121","first-page":"5917","article-title":"Adaptive gradient-based meta-learning methods","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Khodak"},{"key":"ref122","doi-asserted-by":"publisher","DOI":"10.5555\/3524938.3525087"},{"key":"ref123","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR42600.2020.00975"},{"key":"ref124","doi-asserted-by":"publisher","DOI":"10.5555\/3495724.3497510"},{"key":"ref125","article-title":"Representation learning with contrastive predictive coding","author":"Oord","year":"2018"},{"key":"ref126","first-page":"1","article-title":"Unsupervised learning via meta-learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Hsu"},{"key":"ref127","first-page":"1","article-title":"Adversarial feature learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Donahue"},{"key":"ref128","first-page":"10542","article-title":"Large scale adversarial representation learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Donahue"},{"key":"ref129","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-01264-9_9"},{"key":"ref130","first-page":"10132","article-title":"Unsupervised meta-learning for few-shot image classification","volume-title":"Proc. Adv. Neural Inf. Processi. Syst.","author":"Khodadadeh"},{"key":"ref131","article-title":"Unsupervised meta-learning through latent-space interpolation in generative models","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Khodadadeh"},{"key":"ref132","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00020"},{"key":"ref133","first-page":"892","article-title":"R3M: A universal visual representation for robot manipulation","volume-title":"Proc. Conf. Robot Learn.","author":"Nair"},{"key":"ref134","article-title":"Viewmaker networks: Learning views for unsupervised representation learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Tamkin"},{"key":"ref135","first-page":"1","article-title":"Meta-GMVAE: Mixture of Gaussian VAE for unsupervised meta-learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Lee"},{"key":"ref136","first-page":"1","article-title":"Unsupervised meta-learning via latent space energy-based model of symbol vector coupling","volume-title":"Proc. 5th Workshop Meta- Learn. Conf. Neural Inf. Process. Syst.","author":"Kong"},{"key":"ref137","first-page":"1","article-title":"Auto-encoding variational Bayes","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Kingma"},{"issue":"Dec","key":"ref138","first-page":"1235","article-title":"Energy-based models for sparse overcomplete representations","volume":"4","author":"Teh","year":"2003","journal-title":"J. Mach. Learn. Res."},{"key":"ref139","first-page":"1","article-title":"The close relationship between contrastive learning and meta-learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Ni"},{"key":"ref140","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-20044-1_17"},{"key":"ref141","first-page":"1","article-title":"Self-supervised set representation learning for unsupervised meta-learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Lee"},{"key":"ref142","first-page":"1","article-title":"Unsupervised meta-learning via few-shot pseudo-supervised contrastive learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Jang"},{"key":"ref143","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.findings-acl.387"},{"key":"ref144","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.coling-main.448"},{"key":"ref145","article-title":"Deep domain confusion: Maximizing for domain invariance","author":"Tzeng","year":"2014"},{"key":"ref146","doi-asserted-by":"publisher","DOI":"10.5555\/2946645.2946704"},{"key":"ref147","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.244"},{"key":"ref148","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR42600.2020.01117"},{"key":"ref149","doi-asserted-by":"publisher","DOI":"10.15607\/rss.2020.xvi.024"},{"key":"ref150","first-page":"1989","article-title":"Cycada: Cycle-consistent adversarial domain adaptation","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Hoffman"},{"key":"ref151","first-page":"8568","article-title":"Adversarial multiple source domain adaptation","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Zhao"},{"key":"ref152","doi-asserted-by":"publisher","DOI":"10.1109\/WACV48630.2021.00138"},{"key":"ref153","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00235"},{"key":"ref154","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2019.2963389"},{"key":"ref155","first-page":"23 664","article-title":"Adaptive risk minimization: Learning to adapt to domain shift","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Zhang"},{"key":"ref156","doi-asserted-by":"publisher","DOI":"10.1109\/ICME52920.2022.9859804"},{"key":"ref157","doi-asserted-by":"publisher","DOI":"10.1016\/j.knosys.2021.106829"},{"key":"ref158","doi-asserted-by":"publisher","DOI":"10.1007\/s10994-023-06324-x"},{"key":"ref159","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-49409-8_35"},{"key":"ref160","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4899-7502-7_79-1"},{"key":"ref161","first-page":"6438","article-title":"Manifold mixup: Better representations by interpolating hidden states","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Verma"},{"key":"ref162","first-page":"25 407","article-title":"Improving out-of-distribution robustness via selective augmentation","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Yao"},{"key":"ref163","first-page":"6450","article-title":"Domain generalization via model-agnostic learning of semantic features","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Dou"},{"key":"ref164","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00153"},{"key":"ref165","first-page":"3915","article-title":"Feature-critic networks for heterogeneous domain generalization","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Li"},{"key":"ref166","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v32i1.11596"},{"key":"ref167","first-page":"1006","article-title":"MetaReg: Towards domain generalization using meta-regularization","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Balaji"},{"key":"ref168","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.00950"},{"key":"ref169","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2021.09.046"},{"key":"ref170","doi-asserted-by":"publisher","DOI":"10.1038\/s42256-022-00568-3"},{"key":"ref171","first-page":"6470","article-title":"Gradient episodic memory for continual learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Lopez-Paz"},{"key":"ref172","first-page":"1","article-title":"Efficient lifelong learning with A-GEM","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Chaudhry"},{"key":"ref173","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.587"},{"key":"ref174","first-page":"1","article-title":"Selfless sequential learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Aljundi"},{"key":"ref175","doi-asserted-by":"publisher","DOI":"10.1073\/pnas.1611835114"},{"key":"ref176","first-page":"4548","article-title":"Overcoming catastrophic forgetting with hard attention to the task","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Serra"},{"key":"ref177","first-page":"3925","article-title":"Learn to grow: A continual structure learning framework for overcoming catastrophic forgetting","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Li"},{"key":"ref178","first-page":"1","article-title":"Contextual transformation networks for online continual learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Pham"},{"key":"ref179","article-title":"Progressive neural networks","author":"Rusu","year":"2016"},{"key":"ref180","first-page":"992","article-title":"Learning to continually learn","volume-title":"Proc. 24th Eur. Conf. Artif. Intell.","author":"Beaulieu"},{"key":"ref181","first-page":"1","article-title":"Learning to learn without forgetting by maximizing transfer and minimizing interference","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Riemer"},{"key":"ref182","first-page":"1820","article-title":"Meta-learning representations for continual learning","volume-title":"Proc. Adv. Neural Inf. Process. Sys.","author":"Javed"},{"key":"ref183","first-page":"11 588","article-title":"Look-ahead meta learning for continual learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Gupta"},{"key":"ref184","doi-asserted-by":"publisher","DOI":"10.1016\/b978-0-32-399851-2.00022-3"},{"key":"ref185","doi-asserted-by":"publisher","DOI":"10.1145\/3474085.3475247"},{"key":"ref186","first-page":"23 716","article-title":"Flamingo: A visual language model for few-shot learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Alayrac"},{"key":"ref187","first-page":"1","article-title":"A generalist agent","author":"Reed","year":"2022","journal-title":"Trans. Mach. Learn. Res."},{"key":"ref188","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW50498.2020.00108"},{"key":"ref189","doi-asserted-by":"publisher","DOI":"10.15607\/rss.2018.xiv.002"},{"key":"ref190","first-page":"1","article-title":"Meta-learning GNN initializations for low-resource molecular property prediction","volume-title":"Proc. 4th Lifelong Mach. Learn. Workshop","author":"Nguyen"},{"key":"ref191","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-01237-3_27"},{"key":"ref192","first-page":"3232","article-title":"Meta-album: Multi-domain meta-dataset for few-shot image classification","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Ullah"},{"key":"ref193","article-title":"Nevis\u201922: A stream of 100 tasks sampled from 30 years of computer vision research","author":"Bornschein","year":"2022"},{"key":"ref194","first-page":"1094","article-title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","author":"Yu","year":"2020","journal-title":"Conf. Robot Learn."},{"key":"ref195","article-title":"A large-scale study of representation learning with the visual task adaptation benchmark","author":"Zhai","year":"2019"},{"key":"ref196","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00391"},{"key":"ref197","first-page":"1","article-title":"Value: A multi-task benchmark for video-and-language understanding evaluation","volume-title":"Proc. 35th Conf. Neural Inf. Process. Syst. Datasets Benchmarks Track","author":"Li"},{"key":"ref198","first-page":"1","article-title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models","author":"Srivastava","year":"2023","journal-title":"Trans. Mach. Learn. Res."},{"key":"ref199","article-title":"Tasks, stability, architecture, and compute: Training more effective learned optimizers, and using them to train themselves","author":"Metz","year":"2020"},{"key":"ref200","first-page":"396","article-title":"A closer look at the training strategy for modern meta-learning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Chen"},{"key":"ref201","first-page":"1","article-title":"Theoretical bounds on estimation error for meta-learning","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Lucas"},{"key":"ref202","first-page":"7930","article-title":"Fast-rate pac-Bayesian generalization bounds for meta-learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Guan"}],"container-title":["IEEE Transactions on Pattern Analysis and Machine Intelligence"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/34\/10550108\/10413635.pdf?arnumber=10413635","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,25]],"date-time":"2024-06-25T19:59:18Z","timestamp":1719345558000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10413635\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,7]]},"references-count":202,"journal-issue":{"issue":"7"},"URL":"https:\/\/doi.org\/10.1109\/tpami.2024.3357847","relation":{},"ISSN":["0162-8828","2160-9292","1939-3539"],"issn-type":[{"value":"0162-8828","type":"print"},{"value":"2160-9292","type":"electronic"},{"value":"1939-3539","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,7]]}}}