{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,8]],"date-time":"2026-08-08T18:17:26Z","timestamp":1786213046936,"version":"3.56.0"},"reference-count":241,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"5","license":[{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"name":"Startup Funding of HKUS"},{"name":"Research Grants Council of the Hong Kong Special Administrative Region","award":["CUHK 2410072"],"award-info":[{"award-number":["CUHK 2410072"]}]},{"name":"Research Grants Council of the Hong Kong Special Administrative Region","award":["RGC R1015-23"],"award-info":[{"award-number":["RGC R1015-23"]}]},{"name":"Research Grants Council of the Hong Kong Special Administrative Region","award":["CUHK 2300246"],"award-info":[{"award-number":["CUHK 2300246"]}]},{"name":"Research Grants Council of the Hong Kong Special Administrative Region","award":["RGC C1043-24G"],"award-info":[{"award-number":["RGC C1043-24G"]}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Pattern Anal. Mach. Intell."],"published-print":{"date-parts":[[2026,5]]},"DOI":"10.1109\/tpami.2026.3651700","type":"journal-article","created":{"date-parts":[[2026,1,12]],"date-time":"2026-01-12T22:00:30Z","timestamp":1768255230000},"page":"5405-5424","source":"Crossref","is-referenced-by-count":11,"title":["CLIP-Powered Domain Generalization and Domain Adaptation: A Comprehensive Survey"],"prefix":"10.1109","volume":"48","author":[{"ORCID":"https:\/\/orcid.org\/0009-0007-2228-3696","authenticated-orcid":false,"given":"Jindong","family":"Li","sequence":"first","affiliation":[{"name":"Hong Kong University of Science and Technology, (Guangzhou), Guangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0006-7702-3974","authenticated-orcid":false,"given":"Yongguang","family":"Li","sequence":"additional","affiliation":[{"name":"Jilin University, Changchun, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0003-2934-8211","authenticated-orcid":false,"given":"Yali","family":"Fu","sequence":"additional","affiliation":[{"name":"Jilin University, Changchun, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8551-120X","authenticated-orcid":false,"given":"Jiahong","family":"Liu","sequence":"additional","affiliation":[{"name":"Chinese University of Hong Kong, Hong Kong"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4309-5076","authenticated-orcid":false,"given":"Yixin","family":"Liu","sequence":"additional","affiliation":[{"name":"Griffith University, Nathan, QLD, Australia"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-2510-5282","authenticated-orcid":false,"given":"Menglin","family":"Yang","sequence":"additional","affiliation":[{"name":"Hong Kong University of Science and Technology, (Guangzhou), Guangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8106-6447","authenticated-orcid":false,"given":"Irwin","family":"King","sequence":"additional","affiliation":[{"name":"Chinese University of Hong Kong, Hong Kong"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","article-title":"GPT-4 technical report","author":"Achiam","year":"2023"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02258"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.5753\/jbcs.2024.3966"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/wacv61041.2025.00593"},{"key":"ref5","article-title":"Visual prompting: Modifying pixel space to adapt pre-trained models","author":"Bahng","year":"2022"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v38i2.27830"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-72646-0_25"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-01270-0_28"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/WACV57701.2024.00545"},{"key":"ref10","article-title":"Meta-learning to teach semantic prompts for open domain generalization in vision-language models","author":"Bose","year":"2025","journal-title":"Trans. Mach. Learn. Res."},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-10599-4_29"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/WACV51458.2022.00110"},{"key":"ref13","first-page":"11285","article-title":"Tinytl: Reduce memory, not parameters for efficient on-device learning","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Cai","year":"2020"},{"key":"ref14","first-page":"22405","article-title":"Swad: Domain generalization by seeking flat minima","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Cha","year":"2021"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2021.3083956"},{"key":"ref16","article-title":"PLOT: Prompt learning with optimal transport for vision-language models","author":"Chen","year":"2022","journal-title":"ICLR"},{"key":"ref17","article-title":"Plot: Prompt learning with optimal transport for vision-language models","author":"Chen","year":"2022"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.52202\/075280-3243"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.52202\/068431-1212"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.5555\/3524938.3525087"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-01581-6_4"},{"key":"ref22","article-title":"Vision transformer adapter for dense predictions","author":"Chen","year":"2022"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2023.3289201"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02218"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02227"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/tpami.2026.3661049"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.02011"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01439"},{"key":"ref29","article-title":"Pseudo-labeling curriculum for unsupervised domain adaptation","author":"Choi","year":"2019"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.00994"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2014.461"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW50498.2020.00359"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2025.3541868"},{"key":"ref34","article-title":"Opportunities and challenges in explainable artificial intelligence (XAI): A survey","author":"Das","year":"2020"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2021.3057446"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.01101"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2025\/272"},{"key":"ref39","article-title":"Harmonizing and merging source models for clip-based domain generalization","author":"Ding","year":"2025"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01058"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02206"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2013.208"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2024.106230"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2004.383"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.1109\/ICIP51287.2024.10647766"},{"key":"ref46","first-page":"20450","article-title":"Cloob: Modern hopfield networks with infoloob outperform clip","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"F\u00fcrst","year":"2022"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1145\/3528223.3530164"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.5555\/3045390.3045502"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1561\/0600000105"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v38i3.27950"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-023-01891-x"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.acl-long.295"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2023.3327962"},{"key":"ref54","article-title":"A systematic survey of prompt engineering on vision-language foundation models","author":"Gu","year":"2023"},{"key":"ref55","article-title":"In search of lost domain generalization","author":"Gulrajani","year":"2020"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW67362.2025.00222"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01751"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.00945"},{"key":"ref59","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR42600.2020.00975"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1109\/JSTARS.2019.2918242"},{"key":"ref61","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00823"},{"key":"ref62","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.01501"},{"key":"ref63","article-title":"Learning deep representations by mutual information estimation and maximization","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Hjelm","year":"2019"},{"key":"ref64","first-page":"2790","article-title":"Parameter-efficient transfer learning for NLP","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Houlsby","year":"2019"},{"key":"ref65","article-title":"LoRA: Low-rank adaptation of large language models","author":"Hu","year":"2021"},{"key":"ref66","doi-asserted-by":"publisher","DOI":"10.1109\/WACV57701.2024.00297"},{"key":"ref67","article-title":"Unsupervised prompt learning for vision-language models","author":"Huang","year":"2022"},{"key":"ref68","first-page":"10944","article-title":"What makes multi-modal learning better than single (provably)","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Huang","year":"2021"},{"key":"ref69","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58536-5_8"},{"key":"ref70","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01073"},{"key":"ref71","first-page":"29262","article-title":"Patching open-vocabulary models by interpolating weights","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Ilharco","year":"2022"},{"key":"ref72","article-title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","author":"Ioffe","year":"2015"},{"key":"ref73","first-page":"4904","article-title":"Scaling up visual and vision-language representation learning with noisy text supervision","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Jia","year":"2021"},{"key":"ref74","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-19827-4_41"},{"key":"ref75","doi-asserted-by":"publisher","DOI":"10.1162\/tacl_a_00324"},{"key":"ref76","doi-asserted-by":"publisher","DOI":"10.1145\/3715699"},{"key":"ref77","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-19833-5_7"},{"key":"ref78","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00699"},{"key":"ref79","doi-asserted-by":"publisher","DOI":"10.1109\/ICIP42928.2021.9506163"},{"key":"ref80","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v32i1.11651"},{"key":"ref81","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01832"},{"key":"ref82","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01394"},{"key":"ref83","doi-asserted-by":"publisher","DOI":"10.1007\/s10462-024-10922-z"},{"key":"ref84","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00246"},{"key":"ref85","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01908"},{"key":"ref86","doi-asserted-by":"publisher","DOI":"10.1109\/ICCVW.2013.77"},{"key":"ref87","article-title":"Learning multiple layers of features from tiny images","author":"Krizhevsky","year":"2009"},{"key":"ref88","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01753"},{"key":"ref89","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-73030-6_15"},{"key":"ref90","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01480"},{"key":"ref91","doi-asserted-by":"publisher","DOI":"10.1109\/WACV57701.2024.00267"},{"key":"ref92","doi-asserted-by":"publisher","DOI":"10.1109\/WACV61041.2025.00801"},{"key":"ref93","article-title":"Duet: Dual-perspective pseudo labeling and uncertainty-aware exploration & exploitation training for source-free domain adaptation","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Lee","year":"2025"},{"key":"ref94","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-19806-9_1"},{"key":"ref95","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01133"},{"key":"ref96","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.emnlp-main.243"},{"key":"ref97","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.591"},{"key":"ref98","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00566"},{"key":"ref99","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2024.3370978"},{"key":"ref100","doi-asserted-by":"publisher","DOI":"10.1109\/FUZZ52849.2023.10309671"},{"key":"ref101","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2023.3276978"},{"key":"ref102","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2023.3276978"},{"key":"ref103","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02205"},{"key":"ref104","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.acl-long.353"},{"key":"ref105","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2026.132075"},{"key":"ref106","article-title":"Revisiting CLIP for SF-OSDA: Unleashing zero-shot potential with adaptive threshold and training-free feature filtering","author":"Li","year":"2025"},{"key":"ref107","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00743"},{"key":"ref108","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-024-02181-w"},{"key":"ref109","first-page":"29667","article-title":"Realistic unsupervised clip fine-tuning with universal entropy optimization","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Liang","year":"2024"},{"key":"ref110","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2025.3576937"},{"key":"ref111","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2018.2836364"},{"key":"ref112","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2020.3018191"},{"key":"ref113","first-page":"22968","article-title":"Cycle self-training for domain adaptation","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Liu","year":"2021"},{"key":"ref114","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v39i18.34080"},{"key":"ref115","doi-asserted-by":"publisher","DOI":"10.1145\/3560815"},{"key":"ref116","first-page":"2208","article-title":"Deep transfer learning with joint adaptation networks","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Long","year":"2017"},{"key":"ref117","first-page":"1647","article-title":"Conditional adversarial domain adaptation","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Long","year":"2018"},{"key":"ref118","article-title":"Training-free unsupervised prompt for vision-language models","author":"Long","year":"2024"},{"key":"ref119","article-title":"Decoupled weight decay regularization","author":"Loshchilov","year":"2017"},{"key":"ref120","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2019.2952792"},{"key":"ref121","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00514"},{"key":"ref122","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00788"},{"key":"ref123","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01722"},{"key":"ref124","article-title":"Fine-grained visual classification of aircraft","author":"Maji","year":"2013"},{"key":"ref125","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58574-7_25"},{"key":"ref126","article-title":"Uota: Unsupervised open-set task adaptation using a vision-language foundation model","volume-title":"Proc. Int. Conf. Mach. Learn. Workshop","author":"Min","year":"2023"},{"key":"ref127","first-page":"5765","article-title":"Lafter: Label-free tuning of zero-shot classifier using language and unlabeled image collections","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Mirza","year":"2024"},{"key":"ref128","first-page":"76298","article-title":"Locoop: Few-shot out-of-distribution detection via prompt learning","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Miyai","year":"2023"},{"key":"ref129","article-title":"Zero-shot in-distribution detection in multi-object settings using vision-language foundation models","author":"Miyai","year":"2023"},{"key":"ref130","article-title":"Cosmo: Clip talks on open-set multi-target domain adaptation","author":"Monga","year":"2024"},{"key":"ref131","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v38i5.28226"},{"key":"ref132","doi-asserted-by":"publisher","DOI":"10.1109\/ICVGIP.2008.47"},{"key":"ref133","article-title":"Domain-unified prompt representations for source-free domain generalization","author":"Niu","year":"2022"},{"key":"ref134","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN60899.2024.10650639"},{"key":"ref135","doi-asserted-by":"publisher","DOI":"10.1145\/3569219.3569352"},{"key":"ref136","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2012.6248092"},{"key":"ref137","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00209"},{"key":"ref138","article-title":"Visda: The visual domain adaptation challenge","author":"Peng","year":"2017"},{"key":"ref139","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00149"},{"key":"ref140","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D19-1250"},{"key":"ref141","doi-asserted-by":"publisher","DOI":"10.1109\/AIEA62095.2024.10692575"},{"key":"ref142","article-title":"Lfpt5: A unified framework for lifelong few-shot language learning based on prompt tuning of t5","author":"Qin","year":"2021"},{"key":"ref143","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.02312"},{"key":"ref144","first-page":"8748","article-title":"Learning transferable visual models from natural language supervision","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Radford","year":"2021"},{"key":"ref145","first-page":"8821","article-title":"Zero-shot text-to-image generation","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Ramesh","year":"2021"},{"key":"ref146","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01755"},{"key":"ref147","first-page":"5389","article-title":"Do imagenet classifiers generalize to imagenet","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Recht","year":"2019"},{"key":"ref148","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01790"},{"key":"ref149","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01042"},{"key":"ref150","first-page":"82548","article-title":"Proxy denoising for source-free domain adaptation","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Tang","year":"2025"},{"key":"ref151","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-15561-1_16"},{"key":"ref152","doi-asserted-by":"publisher","DOI":"10.52202\/068431-2643"},{"key":"ref153","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58598-3_10"},{"key":"ref154","article-title":"The prompt report: A systematic survey of prompting techniques","author":"Schulhoff","year":"2024"},{"key":"ref155","doi-asserted-by":"publisher","DOI":"10.1007\/s10618-022-00867-8"},{"key":"ref156","article-title":"Generalizing across domains via cross-gradient training","author":"Shankar","year":"2018"},{"key":"ref157","doi-asserted-by":"publisher","DOI":"10.1109\/WACV57701.2024.00556"},{"key":"ref158","doi-asserted-by":"publisher","DOI":"10.1109\/FUZZ-IEEE60900.2024.10612077"},{"key":"ref159","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN60899.2024.10650901"},{"key":"ref160","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2024.3389705"},{"key":"ref161","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.emnlp-main.346"},{"key":"ref162","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.00950"},{"key":"ref163","first-page":"31716","article-title":"Clipood: Generalizing clip to out-of-distributions","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Shu","year":"2023"},{"key":"ref164","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01519"},{"key":"ref165","doi-asserted-by":"publisher","DOI":"10.1109\/ICCVW60793.2023.00470"},{"key":"ref166","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01264"},{"key":"ref167","first-page":"596","article-title":"Fixmatch: Simplifying semi-supervised learning with consistency and confidence","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Sohn","year":"2020"},{"key":"ref168","doi-asserted-by":"publisher","DOI":"10.48550\/ARXIV.1212.0402"},{"key":"ref169","first-page":"1929","article-title":"Dropout: A simple way to prevent neural networks from overfitting","volume":"15","author":"Srivastava","year":"2014","journal-title":"J. Mach. Learn. Res."},{"key":"ref170","first-page":"5986","article-title":"Bert and pals: Projected attention layers for efficient adaptation in multi-task learning","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Stickland","year":"2019"},{"key":"ref171","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-49409-8_35"},{"key":"ref172","first-page":"30569","article-title":"Dualcoop: Fast adaptation to multi-label recognition with limited annotations","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Sun","year":"2022"},{"key":"ref173","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.308"},{"key":"ref174","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02238"},{"key":"ref175","doi-asserted-by":"publisher","DOI":"10.1109\/tmm.2024.3521671"},{"key":"ref176","first-page":"33816","article-title":"Pouf: Prompt-oriented unsupervised fine-tuning for large pre-trained models","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Tanwisuth","year":"2023"},{"key":"ref177","article-title":"Gemini: A family of highly capable multimodal models","author":"Team","year":"2023"},{"key":"ref178","doi-asserted-by":"publisher","DOI":"10.1007\/s11760-024-03101-8"},{"key":"ref179","article-title":"Llama: Open and efficient foundation language models","author":"Touvron","year":"2023"},{"key":"ref180","first-page":"200","article-title":"Multimodal few-shot learning with frozen language models","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Tsimpoukelli","year":"2021"},{"key":"ref181","article-title":"Continual learning and catastrophic forgetting","author":"Ven","year":"2024"},{"key":"ref182","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.572"},{"key":"ref183","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.01860"},{"key":"ref184","first-page":"10506","article-title":"Learning robust global representations by penalizing local predictive power","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Wang","year":"2019"},{"key":"ref185","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2022.3178128"},{"key":"ref186","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.00367"},{"key":"ref187","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01062"},{"key":"ref188","doi-asserted-by":"publisher","DOI":"10.1145\/3408317"},{"key":"ref189","doi-asserted-by":"publisher","DOI":"10.1109\/tai.2025.3634277"},{"key":"ref190","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2020.2988841"},{"key":"ref191","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.00893"},{"key":"ref192","doi-asserted-by":"publisher","DOI":"10.1145\/3725735"},{"key":"ref193","doi-asserted-by":"publisher","DOI":"10.1109\/WACV61041.2025.00636"},{"key":"ref194","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00780"},{"key":"ref195","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2010.5539970"},{"key":"ref196","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01314"},{"key":"ref197","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-025-02497-1"},{"key":"ref198","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2019.2958299"},{"key":"ref199","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.01415"},{"key":"ref200","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2025.3525715"},{"key":"ref201","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2024.3479691"},{"key":"ref202","article-title":"Generalizing clip to unseen domain via text-guided diverse novel feature synthesis","author":"Yan","year":"2024"},{"key":"ref203","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02249"},{"key":"ref204","doi-asserted-by":"publisher","DOI":"10.1109\/LSP.2024.3389508"},{"key":"ref205","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.00653"},{"key":"ref206","doi-asserted-by":"publisher","DOI":"10.1016\/j.aiopen.2024.01.004"},{"key":"ref207","first-page":"11987","article-title":"Improved ood generalization via adversarial training and pretraining","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Yi","year":"2021"},{"key":"ref208","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2021.108238"},{"key":"ref209","article-title":"Domain prompt matters a lot in multi-source few-shot domain adaptation","author":"Yu","year":"2024","journal-title":"openreview.net"},{"key":"ref210","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2024.104230"},{"key":"ref211","doi-asserted-by":"publisher","DOI":"10.1109\/TGRS.2025.3531424"},{"key":"ref212","first-page":"2021","article-title":"Florence: A new foundation model for computer vision","author":"Yuan"},{"key":"ref213","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00612"},{"key":"ref214","article-title":"Unified vision and language prompt learning","author":"Zang","year":"2022"},{"key":"ref215","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.00946"},{"key":"ref216","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01107"},{"key":"ref217","doi-asserted-by":"publisher","DOI":"10.1109\/ICIP51287.2024.10647719"},{"key":"ref218","first-page":"18408","article-title":"Flexmatch: Boosting semi-supervised learning with curriculum pseudo labeling","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Zhang","year":"2021"},{"key":"ref219","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4899-7687-1_79"},{"key":"ref220","doi-asserted-by":"publisher","DOI":"10.1109\/icassp49660.2025.10888057"},{"key":"ref221","first-page":"60004","article-title":"Candidate pseudolabel learning: Enhancing vision-language models by prompt tuning with unlabeled data","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Zhang","year":"2024"},{"key":"ref222","doi-asserted-by":"publisher","DOI":"10.1016\/j.knosys.2025.114509"},{"key":"ref223","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00836"},{"key":"ref224","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00400"},{"key":"ref225","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-024-02215-3"},{"key":"ref226","doi-asserted-by":"publisher","DOI":"10.1527\/tjsai.38-6_B-MC2"},{"key":"ref227","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01539"},{"key":"ref228","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.00479"},{"key":"ref229","first-page":"2","article-title":"Contrastive learning of medical visual representations from paired images and text","volume-title":"Proc. Mach. Learn. Healthcare Conf.","author":"Zhang","year":"2022"},{"key":"ref230","doi-asserted-by":"publisher","DOI":"10.1145\/3639372"},{"key":"ref231","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.naacl-main.398"},{"key":"ref232","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-19815-1_40"},{"key":"ref233","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58517-4_33"},{"key":"ref234","article-title":"Domain generalization with mixstyle","author":"Zhou","year":"2021"},{"key":"ref235","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01631"},{"key":"ref236","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-022-01653-1"},{"key":"ref237","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2024.3391304"},{"key":"ref238","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01435"},{"key":"ref239","article-title":"Clip the divergence: Language-guided unsupervised domain adaptation","author":"Zhu","year":"2024"},{"key":"ref240","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-01219-9_18"},{"key":"ref241","doi-asserted-by":"publisher","DOI":"10.1109\/TFUZZ.2018.2853720"}],"container-title":["IEEE Transactions on Pattern Analysis and Machine Intelligence"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/34\/11474534\/11342298.pdf?arnumber=11342298","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,6]],"date-time":"2026-04-06T19:56:20Z","timestamp":1775505380000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11342298\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,5]]},"references-count":241,"journal-issue":{"issue":"5"},"URL":"https:\/\/doi.org\/10.1109\/tpami.2026.3651700","relation":{},"ISSN":["0162-8828","2160-9292","1939-3539"],"issn-type":[{"value":"0162-8828","type":"print"},{"value":"2160-9292","type":"electronic"},{"value":"1939-3539","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,5]]}}}