{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,30]],"date-time":"2026-04-30T17:36:32Z","timestamp":1777570592388,"version":"3.51.4"},"reference-count":60,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2024,6,1]],"date-time":"2024-06-01T00:00:00Z","timestamp":1717200000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,6,1]],"date-time":"2024-06-01T00:00:00Z","timestamp":1717200000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimedia Systems"],"published-print":{"date-parts":[[2024,6]]},"DOI":"10.1007\/s00530-024-01373-1","type":"journal-article","created":{"date-parts":[[2024,6,5]],"date-time":"2024-06-05T08:15:55Z","timestamp":1717575355000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":2,"title":["MLTU: mixup long-tail unsupervised zero-shot image classification on vision-language models"],"prefix":"10.1007","volume":"30","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-9583-8727","authenticated-orcid":false,"given":"Yunpeng","family":"Jia","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9812-2679","authenticated-orcid":false,"given":"Xiufen","family":"Ye","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7424-3238","authenticated-orcid":false,"given":"Xinkui","family":"Mei","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4950-6304","authenticated-orcid":false,"given":"Yusong","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0607-9798","authenticated-orcid":false,"given":"Shuxiang","family":"Guo","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,6,5]]},"reference":[{"key":"1373_CR1","unstructured":"Larochelle, H., Erhan, D., Bengio, Y.: Zero-data learning of new tasks. In: AAAI, p. 3 (2008)"},{"key":"1373_CR2","doi-asserted-by":"publisher","first-page":"453","DOI":"10.1109\/TPAMI.2013.140","volume":"36","author":"CH Lampert","year":"2013","unstructured":"Lampert, C.H., Nickisch, H., Harmeling, S.: Attribute-based classification for zero-shot visual object categorization. IEEE Trans. Pattern Anal. Mach. Intell. 36, 453\u2013465 (2013)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1373_CR3","doi-asserted-by":"crossref","unstructured":"Li, K., Min, M., Fu, Y.: Rethinking zero-shot learning: A conditional visual classification perspective. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 3583\u20133592 (2019)","DOI":"10.1109\/ICCV.2019.00368"},{"key":"1373_CR4","unstructured":"Xu, W., Xian, Y., Wang, J., Schiele, B., Akata, Z.: Attribute prototype network for zero-shot learning. In: Advances in Neural Information Processing Systems, vol. 33, pp. 21969\u201321980 (2020)"},{"key":"1373_CR5","doi-asserted-by":"crossref","unstructured":"Liang, J., Hu, D., Feng, J.: Domain adaptation with auxiliary target domain-oriented classifier. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 16632\u201316642 (2021)","DOI":"10.1109\/CVPR46437.2021.01636"},{"key":"1373_CR6","doi-asserted-by":"crossref","unstructured":"Reed, S., Akata, Z., Lee, H., Schiele, B.: Learning deep representations of fine-grained visual descriptions. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 49\u201358 (2016)","DOI":"10.1109\/CVPR.2016.13"},{"key":"1373_CR7","doi-asserted-by":"crossref","unstructured":"Chen, Z., Luo, Y., Wang, S., Qiu, R., Li, J., Huang, Z.: Mitigating generation shifts for generalized zero-shot learning. In: Proceedings of the 29th ACM International Conference on Multimedia, pp. 844\u2013852 (2021)","DOI":"10.1145\/3474085.3475258"},{"issue":"4","key":"1373_CR8","first-page":"4051","volume":"45","author":"F Pourpanah","year":"2022","unstructured":"Pourpanah, F., Abdar, M., Luo, Y., Zhou, X., Wang, R., Lim, C., Wang, X.-Z., Wu, Q.: A review of generalized zero-shot learning methods. IEEE Trans. Pattern Anal. Mach. Intell. 45(4), 4051\u20134070 (2022)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1373_CR9","unstructured":"Radford, A., Kim, J.W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J.: Learning transferable visual models from natural language supervision. In: International Conference on Machine Learning, pp. 8748\u20138763 (2021)"},{"key":"1373_CR10","unstructured":"Ramesh, A., Pavlov, M., Goh, G., Gray, S., Voss, C., Radford, A., Chen, M., Sutskever, I.: Zero-shot text-to-image generation. In: International Conference on Machine Learning, pp. 8821\u20138831 (2021)"},{"key":"1373_CR11","unstructured":"Radford, A., Narasimhan, K., Salimans, T., Sutskever, I.: Improving language understanding by generative pre-training (2018)"},{"key":"1373_CR12","doi-asserted-by":"crossref","unstructured":"Wortsman, M., Ilharco, G., Kim, J.W., Li, M., Kornblith, S., Roelofs, R., Lopes, R.G., Hajishirzi, H., Namkoong, H.: Robust fine-tuning of zero-shot models. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 7959\u20137971 (2022)","DOI":"10.1109\/CVPR52688.2022.00780"},{"key":"1373_CR13","doi-asserted-by":"crossref","unstructured":"Lin, Z., Yu, S., Kuang, Z., Pathak, D., Ramanan, D.: Multimodality helps unimodality: Cross-modal few-shot learning with multimodal models. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 19325\u201319337 (2023)","DOI":"10.1109\/CVPR52729.2023.01852"},{"key":"1373_CR14","doi-asserted-by":"publisher","first-page":"2337","DOI":"10.1007\/s11263-022-01653-1","volume":"130","author":"K Zhou","year":"2022","unstructured":"Zhou, K., Yang, J., Loy, C., Liu, Z.: Learning to prompt for vision-language models. Int. J. Comput. Vis. 130, 2337\u20132348 (2022)","journal-title":"Int. J. Comput. Vis."},{"key":"1373_CR15","doi-asserted-by":"crossref","unstructured":"Zhou, K., Yang, J., Loy, C., Liu, Z.: Conditional prompt learning for vision-language models. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 16816\u201316825 (2022)","DOI":"10.1109\/CVPR52688.2022.01631"},{"issue":"9","key":"1373_CR16","doi-asserted-by":"publisher","first-page":"4616","DOI":"10.1109\/TCSVT.2023.3245584","volume":"33","author":"C Ma","year":"2023","unstructured":"Ma, C., Liu, Y., Deng, J., Xie, L., Dong, W., Xu, C.: Understanding and mitigating overfitting in prompt tuning for vision-language models. IEEE Trans. Circuits Syst. Video Technol. 33(9), 4616\u20134629 (2023)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"1373_CR17","unstructured":"Oh, C., So, J., Byun, H., Lim, Y., Shin, M., Jeon, J.-J., Song, K.: Geodesic multi-modal mixup for robust fine-tuning. Advances in Neural Information Processing Systems 36 (2024)"},{"key":"1373_CR18","doi-asserted-by":"publisher","DOI":"10.1016\/j.knosys.2024.111726","volume":"294","author":"Y Jia","year":"2024","unstructured":"Jia, Y., Ye, X., Liu, Y., Guo, S.: Multi-modal recursive prompt learning with mixup embedding for generalization recognition. Knowl.-Based Syst. 294, 111726 (2024)","journal-title":"Knowl.-Based Syst."},{"key":"1373_CR19","unstructured":"Liu, S., Niles-Weed, J., Razavian, N., Fernandez-Granda, C.: Early-learning regularization prevents memorization of noisy labels. In: Advances in Neural Information Processing Systems, vol. 33, pp. 20331\u201320342 (2020)"},{"key":"1373_CR20","doi-asserted-by":"publisher","first-page":"2606","DOI":"10.1007\/s11263-022-01656-y","volume":"130","author":"Z Han","year":"2022","unstructured":"Han, Z., Fu, Z., Chen, S., Yang, J.: Semantic contrastive embedding for generalized zero-shot learning. Int. J. Comput. Vis. 130, 2606\u20132622 (2022)","journal-title":"Int. J. Comput. Vis."},{"issue":"2","key":"1373_CR21","doi-asserted-by":"publisher","first-page":"82","DOI":"10.1007\/s00530-024-01273-4","volume":"30","author":"X Sun","year":"2024","unstructured":"Sun, X., Tian, Y., Li, H.: Zero-shot image classification via visual\u2013semantic feature decoupling. Multimed. Syst. 30(2), 82 (2024)","journal-title":"Multimed. Syst."},{"key":"1373_CR22","doi-asserted-by":"crossref","unstructured":"Xian, Y., Lorenz, T., Schiele, B., Akata, Z.: Feature generating networks for zero-shot learning. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 5542\u20135551 (2018)","DOI":"10.1109\/CVPR.2018.00581"},{"key":"1373_CR23","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s11432-020-3032-8","volume":"64","author":"Z Ji","year":"2021","unstructured":"Ji, Z., Yan, J., Wang, Q., Pang, Y., Li, X.: Triple discriminator generative adversarial network for zero-shot image classification. Sci. China Inf. Sci. 64, 1\u201314 (2021)","journal-title":"Sci. China Inf. Sci."},{"key":"1373_CR24","doi-asserted-by":"crossref","unstructured":"Rahman, S., Khan, S., Barnes, N.: Transductive learning for zero-shot object detection. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 6082\u20136091 (2019)","DOI":"10.1109\/ICCV.2019.00618"},{"key":"1373_CR25","doi-asserted-by":"publisher","first-page":"3665","DOI":"10.1109\/TIP.2020.2964429","volume":"29","author":"R Gao","year":"2020","unstructured":"Gao, R., Hou, X., Qin, J., Chen, J., Liu, L., Zhu, F., Zhang, Z., Shao, L.: Zero-vae-gan: generating unseen features for generalized and transductive zero-shot learning. IEEE Trans. Image Process. 29, 3665\u20133680 (2020)","journal-title":"IEEE Trans. Image Process."},{"key":"1373_CR26","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2023.3297134","author":"Y Du","year":"2023","unstructured":"Du, Y., Shi, M., Wei, F., Li, G.: Boosting zero-shot learning via contrastive optimization of attribute representations. IEEE Trans. Neural Netw. Learn. Syst. (2023). https:\/\/doi.org\/10.1109\/TNNLS.2023.3297134","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"key":"1373_CR27","doi-asserted-by":"publisher","first-page":"1520","DOI":"10.1109\/TIP.2022.3143005","volume":"31","author":"Z Ji","year":"2022","unstructured":"Ji, Z., Hou, Z., Liu, X., Pang, Y., Han, J.: Information symmetry matters: a modal-alternating propagation network for few-shot learning. IEEE Trans. Image Process. 31, 1520\u20131531 (2022)","journal-title":"IEEE Trans. Image Process."},{"key":"1373_CR28","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.neunet.2019.09.029","volume":"122","author":"Q Wang","year":"2020","unstructured":"Wang, Q., Chen, K.: Multi-label zero-shot human action recognition via joint latent ranking embedding. Neural Netw. 122, 1\u201323 (2020)","journal-title":"Neural Netw."},{"issue":"04","key":"1373_CR29","first-page":"6243","volume":"34","author":"Q Wang","year":"2020","unstructured":"Wang, Q., Breckon, T.: Unsupervised domain adaptation via structured prediction based selective pseudo-labeling. Proc. AAAI Conf. Artif. Intell. 34(04), 6243\u20136250 (2020)","journal-title":"Proc. AAAI Conf. Artif. Intell."},{"key":"1373_CR30","doi-asserted-by":"publisher","first-page":"614","DOI":"10.1016\/j.neunet.2023.02.006","volume":"161","author":"Q Wang","year":"2023","unstructured":"Wang, Q., Meng, F., Breckon, T.P.: Data augmentation with norm-ae and selective pseudo-labelling for unsupervised domain adaptation. Neural Netw. 161, 614\u2013625 (2023)","journal-title":"Neural Netw."},{"key":"1373_CR31","unstructured":"Huang, T., Chu, J., Wei, F.: Unsupervised prompt learning for vision-language models. arXiv preprint arXiv:2204.03649 (2022)"},{"key":"1373_CR32","unstructured":"Shu, M., Nie, W., Huang, D.-A., Yu, Z., Goldstein, T., Anandkumar, A., Xiao, C.: Test-time prompt tuning for zero-shot generalization in vision-language models. In: Advances in Neural Information Processing Systems, vol. 35, pp. 14274\u201314289 (2022)"},{"issue":"8","key":"1373_CR33","doi-asserted-by":"publisher","first-page":"3560","DOI":"10.1109\/TCSVT.2023.3235704","volume":"33","author":"X Yang","year":"2023","unstructured":"Yang, X., Lv, F., Liu, F., Lin, G.: Self-training vision language berts with a unified conditional model. IEEE Trans. Circuits Syst. Video Technol. 33(8), 3560\u20133569 (2023)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"issue":"3","key":"1373_CR34","doi-asserted-by":"publisher","first-page":"220","DOI":"10.1038\/s42256-023-00626-4","volume":"5","author":"N Ding","year":"2023","unstructured":"Ding, N., Qin, Y., Yang, G., Wei, F., Yang, Z., Su, Y., Hu, S., Chen, Y., Chan, C.-M., Chen, W., et al.: Parameter-efficient fine-tuning of large-scale pre-trained language models. Nat. Mach. Intell. 5(3), 220\u2013235 (2023)","journal-title":"Nat. Mach. Intell."},{"key":"1373_CR35","unstructured":"Ren, J., Yu, C., Ma, X., Zhao, H., Yi, S.: Balanced meta-softmax for long-tailed visual recognition. In: Advances in Neural Information Processing Systems, vol. 33, pp. 4175\u20134186 (2020)"},{"key":"1373_CR36","doi-asserted-by":"crossref","unstructured":"Park, S., Lim, J., Jeon, Y., Choi, J.: Influence-balanced loss for imbalanced visual classification. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 735\u2013744 (2021)","DOI":"10.1109\/ICCV48922.2021.00077"},{"key":"1373_CR37","doi-asserted-by":"publisher","first-page":"6543","DOI":"10.1109\/TCYB.2020.3004641","volume":"52","author":"Z Ji","year":"2021","unstructured":"Ji, Z., Yu, X., Yu, Y., Pang, Y., Zhang, Z.: Semantic-guided class-imbalance learning model for zero-shot image classification. IEEE Trans. Cybern. 52, 6543\u20136554 (2021)","journal-title":"IEEE Trans. Cybern."},{"key":"1373_CR38","doi-asserted-by":"crossref","unstructured":"Ye, H., Zhou, F., Li, X., Zhang, Q.: Balanced mixup loss for long-tailed visual recognition. In: ICASSP 2023\u20132023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp. 1\u20135 (2023)","DOI":"10.1109\/ICASSP49357.2023.10095491"},{"key":"1373_CR39","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2023.110107","volume":"147","author":"J Baik","year":"2024","unstructured":"Baik, J., Yoon, I., Choi, J.: Dbn-mix: training dual branch network using bilateral mixup augmentation for long-tailed visual recognition. Pattern Recogn. 147, 110107 (2024)","journal-title":"Pattern Recogn."},{"key":"1373_CR40","unstructured":"Arazo, E., Ortego, D., Albert, P., O\u2019Connor, N., McGuinness, K.: Unsupervised label noise modeling and loss correction. In: International Conference on Machine Learning, pp. 312\u2013321 (2019)"},{"key":"1373_CR41","doi-asserted-by":"crossref","unstructured":"Huang, Z., Zhang, J., Shan, H.: Twin contrastive learning with noisy labels. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 11661\u201311670 (2023)","DOI":"10.1109\/CVPR52729.2023.01122"},{"key":"1373_CR42","doi-asserted-by":"publisher","DOI":"10.1016\/j.ins.2023.119852","volume":"654","author":"L Tang","year":"2024","unstructured":"Tang, L., Zhao, P., Pan, Z., Duan, X., Pardalos, P.: A two-stage denoising framework for zero-shot learning with noisy labels. Inf. Sci. 654, 119852 (2024)","journal-title":"Inf. Sci."},{"key":"1373_CR43","unstructured":"Menon, A., Van Rooyen, B., Ong, C., Williamson, B.: Learning from corrupted binary labels via class-probability estimation. In: International Conference on Machine Learning, pp. 125\u2013134 (2015)"},{"key":"1373_CR44","unstructured":"Zhang, H., Cisse, M., Dauphin, Y., Lopez-Paz, D.: mixup: Beyond empirical risk management. In: 6th Int. Conf. Learning Representations (ICLR) (2018)"},{"issue":"9","key":"1373_CR45","doi-asserted-by":"publisher","first-page":"2251","DOI":"10.1109\/TPAMI.2018.2857768","volume":"41","author":"Y Xian","year":"2018","unstructured":"Xian, Y., Lampert, C.H., Schiele, B., Akata, Z.: Zero-shot learning\u2014a comprehensive evaluation of the good, the bad and the ugly. IEEE Trans. Pattern Anal. Mach. Intell. 41(9), 2251\u20132265 (2018)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1373_CR46","unstructured":"Sheshadri, A., Endres, I., Hoiem, D., Forsyth, D.: Describing objects by their attributes. Computer Vision and, 1778\u20131785 (2012)"},{"key":"1373_CR47","unstructured":"Wah, C., Branson, S., Welinder, P., Perona, P., Belongie, S.: The caltech-ucsd birds-200\u20132011 dataset (2011)"},{"key":"1373_CR48","doi-asserted-by":"crossref","unstructured":"Patterson, G., Hays, J.: Sun attribute database: Discovering, annotating, and recognizing scene attributes. In: 2012 IEEE Conference on Computer Vision and Pattern Recognition, pp. 2751\u20132758. IEEE (2012)","DOI":"10.1109\/CVPR.2012.6247998"},{"key":"1373_CR49","doi-asserted-by":"crossref","unstructured":"Nilsback, M.-E., Zisserman, A.: Automated flower classification over a large number of classes. In: 2008 Sixth Indian Conference on Computer Vision, Graphics & Image Processing, pp. 722\u2013729. IEEE (2008)","DOI":"10.1109\/ICVGIP.2008.47"},{"key":"1373_CR50","doi-asserted-by":"crossref","unstructured":"Deng, J., Dong, W., Socher, R., Li, L.-J., Li, K., Fei-Fei, L.: Imagenet: A large-scale hierarchical image database. In: 2009 IEEE Conference on Computer Vision and Pattern Recognition, pp. 248\u2013255. IEEE (2009)","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"1373_CR51","doi-asserted-by":"publisher","first-page":"5652","DOI":"10.1109\/TIP.2018.2861573","volume":"27","author":"S Rahman","year":"2018","unstructured":"Rahman, S., Khan, S., Porikli, F.: A unified approach for conventional zero-shot, generalized zero-shot, and few-shot learning. IEEE Trans. Image Process. 27, 5652\u20135667 (2018)","journal-title":"IEEE Trans. Image Process."},{"key":"1373_CR52","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"1373_CR53","unstructured":"Dosovitskiy, A., Beyer, L., Kolesnikov, A., Weissenborn, D., Zhai, X., Unterthiner, T., Dehghani, M., Minderer, M., Heigold, G., Gelly, S.: An image is worth 16x16 words: Transformers for image recognition at scale. arXiv preprint arXiv:2010.11929 (2020)"},{"key":"1373_CR54","doi-asserted-by":"crossref","unstructured":"Lin, T.-Y., Goyal, P., Girshick, R., He, K., Doll \u0301ar, P.: Focal loss for dense object detection. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 2980\u20132988 (2017)","DOI":"10.1109\/ICCV.2017.324"},{"key":"1373_CR55","doi-asserted-by":"crossref","unstructured":"Cui, Y., Jia, M., Lin, T.-Y., Song, Y., Belongie, S.: Class-balanced loss based on effective number of samples. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 9268\u20139277 (2019)","DOI":"10.1109\/CVPR.2019.00949"},{"key":"1373_CR56","doi-asserted-by":"crossref","unstructured":"Li, M., Cheung, Y.-m., Lu, Y.: Long-tailed visual recognition via gaussian clouded logit adjustment. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 6929\u20136938 (2022)","DOI":"10.1109\/CVPR52688.2022.00680"},{"key":"1373_CR57","doi-asserted-by":"crossref","unstructured":"Chou, H.-P., Chang, S.-C., Pan, J.-Y., Wei, W., Juan, D.-C.: Remix: rebalanced mixup. In: Computer Vision\u2013ECCV 2020 Workshops: Glasgow, UK, August 23\u201328, 2020, Proceedings, Part VI, pp. 95\u2013110. Spring (2020)","DOI":"10.1007\/978-3-030-65414-6_9"},{"issue":"2","key":"1373_CR58","doi-asserted-by":"publisher","first-page":"581","DOI":"10.1007\/s11263-023-01891-x","volume":"132","author":"P Gao","year":"2024","unstructured":"Gao, P., Geng, S., Zhang, R., Ma, T., Fang, R., Zhang, Y., Li, H., Qiao, Y.: Clip-adapter: better vision-language models with feature adapters. Int. J. Comput. Vision 132(2), 581\u2013595 (2024)","journal-title":"Int. J. Comput. Vision"},{"key":"1373_CR59","unstructured":"Cuturi, M.: Sinkhorn distances: Lightspeed computation of optimal transport. In: Advances in neural information processing systems 26 (2013)"},{"key":"1373_CR60","doi-asserted-by":"crossref","unstructured":"Ouali, Y., Bulat, A., Matinez, B., Tzimiropoulos, G.: Black box few-shot adaptation for vision-language models. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 15534\u201315546 (2023)","DOI":"10.1109\/ICCV51070.2023.01424"}],"container-title":["Multimedia Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-024-01373-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00530-024-01373-1\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-024-01373-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,7,5]],"date-time":"2024-07-05T13:25:46Z","timestamp":1720185946000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00530-024-01373-1"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,6]]},"references-count":60,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2024,6]]}},"alternative-id":["1373"],"URL":"https:\/\/doi.org\/10.1007\/s00530-024-01373-1","relation":{"has-preprint":[{"id-type":"doi","id":"10.21203\/rs.3.rs-4139909\/v1","asserted-by":"object"}]},"ISSN":["0942-4962","1432-1882"],"issn-type":[{"value":"0942-4962","type":"print"},{"value":"1432-1882","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,6]]},"assertion":[{"value":"21 March 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"26 May 2024","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"5 June 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no competing interests.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"169"}}