{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,27]],"date-time":"2026-03-27T10:59:30Z","timestamp":1774609170773,"version":"3.50.1"},"reference-count":160,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2026,2,2]],"date-time":"2026-02-02T00:00:00Z","timestamp":1769990400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,2,2]],"date-time":"2026-02-02T00:00:00Z","timestamp":1769990400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2026,3]]},"DOI":"10.1007\/s11263-025-02637-7","type":"journal-article","created":{"date-parts":[[2026,2,2]],"date-time":"2026-02-02T19:15:31Z","timestamp":1770059731000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Exploring Scale Shift in Crowd Localization under the Context of Domain Generalization"],"prefix":"10.1007","volume":"134","author":[{"given":"Juncheng","family":"Wang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lei","family":"Shang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ziqi","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wang","family":"Lu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xixu","family":"Hu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhe","family":"Hu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jindong","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1495-3278","authenticated-orcid":false,"given":"Shujun","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2026,2,2]]},"reference":[{"key":"2637_CR1","first-page":"3438","volume":"34","author":"K Ahuja","year":"2021","unstructured":"Ahuja, K., Caballero, E., Zhang, D., Gagnon-Audet, J. C., Bengio, Y., Mitliagkas, I., & Rish, I. (2021). Invariance principle meets information bottleneck for out-of-distribution generalization. Advances in Neural Information Processing Systems, 34, 3438\u20133450.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR2","unstructured":"Arjovsky, M., Bottou, L., Gulrajani, I. & Lopez-Paz, D. (2019). Invariant risk minimization. arXiv preprint arXiv:1907.02893."},{"key":"2637_CR3","unstructured":"Bai, S., Chen, K., Liu, X., Wang, J., Ge, W., Song, S., Dang, K., Wang, P., Wang, S., Tang, J. et\u00a0al. (2025). Qwen2. 5-vl technical report. arXiv preprint arXiv:2502.13923"},{"key":"2637_CR4","unstructured":"Beery, S., Agarwal, A., Cole, E. & Birodkar, V. (2021). The iwildcam 2021 competition dataset. arXiv preprint arXiv:2105.03494"},{"key":"2637_CR5","doi-asserted-by":"crossref","unstructured":"Bele, P., Bundele, V., Bhattacharya, A., Jha, A., Roig, G. & Banerjee B. (2024). Learning class and domain augmentations for single-source open-domain generalization. In: Proceedings of the IEEE\/CVF winter conference on applications of computer vision, pp. 1816\u20131826.","DOI":"10.1109\/WACV57701.2024.00183"},{"key":"2637_CR6","doi-asserted-by":"crossref","unstructured":"Bhatt, G. & Balasubramanian, V. N. (2023). Learning style subspaces for controllable unpaired domain translation. In: Proceedings of the IEEE\/CVF winter conference on applications of computer vision, pp. 4220\u20134229.","DOI":"10.1109\/WACV56688.2023.00420"},{"issue":"2","key":"2637_CR7","first-page":"1","volume":"22","author":"G Blanchard","year":"2021","unstructured":"Blanchard, G., Deshmukh, A. A., Dogan, U., Lee, G., & Scott, C. (2021). Domain generalization by marginal transfer learning. Journal of Machine Learning Research, 22(2), 1\u201355.","journal-title":"Journal of Machine Learning Research"},{"key":"2637_CR8","unstructured":"Bose, S., Jha, A., Kandala, H. & Banerjee, B. (2023). Beyond boundaries: A novel data-augmentation discourse for open domain generalization. Transactions on Machine Learning Research."},{"key":"2637_CR9","doi-asserted-by":"crossref","unstructured":"Bucci, S., Loghmani, M. R. & Tommasi, T. (2020). On the effectiveness of image rotation for open set domain adaptation. In: European conference on computer vision, Springer, pp. 422\u2013438.","DOI":"10.1007\/978-3-030-58517-4_25"},{"key":"2637_CR10","doi-asserted-by":"crossref","unstructured":"Bucci, S., Borlino, F. C., Caputo, B. & Tommasi, T. (2022). Distance-based hyperspherical classification for multi-source open-set domain adaptation. In: Proceedings of the IEEE\/CVF winter conference on applications of computer vision, pp. 1119\u20131128.","DOI":"10.1109\/WACV51458.2022.00110"},{"key":"2637_CR11","first-page":"21189","volume":"34","author":"MH Bui","year":"2021","unstructured":"Bui, M. H., Tran, T., Tran, A., & Phung, D. (2021). Exploiting domain-specific features to enhance domain generalization. Advances in Neural Information Processing Systems, 34, 21189\u201321201.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR12","doi-asserted-by":"crossref","unstructured":"Carlucci, F. M., D\u2019Innocente, A., Bucci, S., Caputo, B. & Tommasi, T. (2019). Domain generalization by solving jigsaw puzzles. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 2229\u20132238.","DOI":"10.1109\/CVPR.2019.00233"},{"key":"2637_CR13","doi-asserted-by":"crossref","unstructured":"Chen, I., Chen, W. T., Liu, Y. W., Yang, M. H., Kuo, S. Y., et\u00a0al. (2024a). Improving point-based crowd counting and localization based on auxiliary point guidance. In: Proceeding of european conference on computer vision.","DOI":"10.1007\/978-3-031-72691-0_24"},{"key":"2637_CR14","doi-asserted-by":"crossref","unstructured":"Chen, I. H., Chen, W. T., Liu, Y. W., Yang, M. H. & Kuo, S. Y. (2024b). Improving point-based crowd counting and localization based on auxiliary point guidance. In: European conference on computer vision, Springer, pp 428\u2013444.","DOI":"10.1007\/978-3-031-72691-0_24"},{"issue":"8","key":"2637_CR15","doi-asserted-by":"publisher","first-page":"3172","DOI":"10.1007\/s11263-024-02028-4","volume":"132","author":"K Chen","year":"2024","unstructured":"Chen, K., Gal, E., Yan, H., & Li, H. (2024). Domain generalization with small data. International Journal of Computer Vision, 132(8), 3172\u20133190.","journal-title":"International Journal of Computer Vision"},{"issue":"6","key":"2637_CR16","doi-asserted-by":"publisher","first-page":"4240","DOI":"10.1109\/tpami.2025.3538473","volume":"47","author":"Y Chen","year":"2025","unstructured":"Chen, Y., Yuan, X., Wang, J., Wu, R., Li, X., Hou, Q., & Cheng, M. M. (2025). Yolo-ms: Rethinking multi-scale representation learning for real-time object detection. IEEE Transactions on Pattern Analysis and Machine Intelligence, 47(6), 4240\u20134252. https:\/\/doi.org\/10.1109\/tpami.2025.3538473","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"2637_CR17","doi-asserted-by":"crossref","unstructured":"Chen, Z., Zhang, S., Zheng, X., Zhao, X. & Kong, Y. (2023). Crowd counting based on multiscale spatial guided perception aggregation network. IEEE Transactions on Neural Networks and Learning Systems.","DOI":"10.1109\/TNNLS.2023.3304348"},{"key":"2637_CR18","unstructured":"Chevalley, M., Bunne, C., Krause, A. & Bauer, S. (2022). Invariant causal mechanisms through distribution matching. arXiv preprint arXiv:2206.11646."},{"issue":"10","key":"2637_CR19","doi-asserted-by":"publisher","first-page":"6614","DOI":"10.1109\/TPAMI.2021.3094760","volume":"44","author":"R Christiansen","year":"2021","unstructured":"Christiansen, R., Pfister, N., Jakobsen, M. E., Gnecco, N., & Peters, J. (2021). A causal framework for distribution generalization. IEEE Transactions on Pattern Analysis and Machine Intelligence, 44(10), 6614\u20136630.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"2637_CR20","doi-asserted-by":"crossref","unstructured":"Dayal, A., & KB, V., Cenkeramaddi, L. R., Mohan, C., Kumar, A. & N Balasubramanian, V. (2024). Madg: Margin-based adversarial learning for domain generalization. Advances in Neural Information Processing Systems,36, 58938.","DOI":"10.52202\/075280-2572"},{"key":"2637_CR21","doi-asserted-by":"crossref","unstructured":"Deng, J., Dong, W., Socher, R., Li, L. J., Li, K. & Fei-Fei, L. (2009). Imagenet: A large-scale hierarchical image database. In: 2009 IEEE conference on computer vision and pattern recognition, IEEE, pp. 248\u2013255.","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"2637_CR22","doi-asserted-by":"crossref","unstructured":"Ding, G., Liu, L., Chen, Z. & Chen, C. (2024). Domain-agnostic crowd counting via uncertainty-guided style diversity augmentation. In: Proceedings of the 32nd ACM international conference on multimedia, pp. 1642\u20131651.","DOI":"10.1145\/3664647.3681310"},{"key":"2637_CR23","doi-asserted-by":"crossref","unstructured":"Du, Y., Xu, J., Xiong, H., Qiu, Q., Zhen, X., Snoek, C. G. & Shao, L. (2020). Learning to learn with variational information bottleneck for domain generalization. In: Computer vision\u2013ECCV 2020: 16th European conference, Glasgow, UK, August 23\u201328, 2020, Proceedings, Part X 16, Springer, pp 200\u2013216.","DOI":"10.1007\/978-3-030-58607-2_12"},{"key":"2637_CR24","doi-asserted-by":"publisher","first-page":"561","DOI":"10.1609\/aaai.v37i1.25131","volume":"37","author":"Z Du","year":"2023","unstructured":"Du, Z., Deng, J., & Shi, M. (2023). Domain-general crowd counting in unseen scenarios. Proceedings of the AAAI Conference on Artificial Intelligence, 37, 561\u2013570.","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"2637_CR25","doi-asserted-by":"publisher","first-page":"561","DOI":"10.1609\/aaai.v37i1.25131","volume":"37","author":"Z Du","year":"2023","unstructured":"Du, Z., Deng, J., & Shi, M. (2023). Domain-general crowd counting in unseen scenarios. Proceedings of the AAAI Conference on Artificial Intelligence, 37, 561\u2013570.","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"2637_CR26","doi-asserted-by":"crossref","unstructured":"Du, Z., Shi, M., Deng, J. & Zafeiriou, S. (2023c). Redesigning multi-scale neural network for crowd counting. IEEE Transactions on Image Processing.","DOI":"10.1109\/TIP.2023.3289290"},{"key":"2637_CR27","unstructured":"Foret, P., Kleiner, A., Mobahi, H. & Neyshabur, B. (2021). Sharpness-aware minimization for efficiently improving generalization. In: Proceeding of international conference on learning representations."},{"issue":"59","key":"2637_CR28","first-page":"1","volume":"17","author":"Y Ganin","year":"2016","unstructured":"Ganin, Y., Ustinova, E., Ajakan, H., Germain, P., Larochelle, H., Laviolette, F., March, M., & Lempitsky, V. (2016). Domain-adversarial training of neural networks. Journal of Machine Learning Research, 17(59), 1\u201335.","journal-title":"Journal of Machine Learning Research"},{"key":"2637_CR29","unstructured":"Gao, J., Han, T., Wang, Q., Yuan, Y. & Li, X. (2020). Learning independent instance maps for crowd localization. arXiv preprint arXiv:2012.04164."},{"key":"2637_CR30","doi-asserted-by":"publisher","first-page":"94","DOI":"10.1016\/j.neucom.2022.09.113","volume":"513","author":"J Gao","year":"2022","unstructured":"Gao, J., Gong, M., & Li, X. (2022). Congested crowd instance localization with dilated convolutional swin transformer. Neurocomputing, 513, 94\u2013103.","journal-title":"Neurocomputing"},{"issue":"6","key":"2637_CR31","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3571134","volume":"19","author":"X Gao","year":"2023","unstructured":"Gao, X., Xie, J., Chen, Z., Liu, A. A., Sun, Z., & Lyu, L. (2023). Dilated convolution-based feature refinement network for crowd localization. CM Transactions on Multimedia Computing, Communications, and Applications, 19(6), 1\u201316.","journal-title":"CM Transactions on Multimedia Computing, Communications, and Applications"},{"key":"2637_CR32","doi-asserted-by":"crossref","unstructured":"Gong, S., Zhang, S., Yang, J., Dai, D. & Schiele, B. (2022). Bi-level alignment for cross-domain crowd counting. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 7542\u20137550.","DOI":"10.1109\/CVPR52688.2022.00739"},{"key":"2637_CR33","unstructured":"Gulrajani, I. & Lopez-Paz, D. (2021). In search of lost domain generalization. In: Proceeding of international conference on learning representations."},{"key":"2637_CR34","doi-asserted-by":"crossref","unstructured":"Guo, J., Qi, L. & Shi, Y. (2023). Domaindrop: Suppressing domain-sensitive channels for domain generalization. In: Proceeding of IEEE\/CVF international conference on computer vision, pp. 19114\u201319124.","DOI":"10.1109\/ICCV51070.2023.01751"},{"key":"2637_CR35","doi-asserted-by":"crossref","unstructured":"Guo, M., Chen, B., Yan, Z., Wang, Y. & Ye, Q. (2024a). Virtual classification: Modulating domain-specific knowledge for multidomain crowd counting. IEEE Transactions on Neural Networks and Learning Systems.","DOI":"10.1109\/TNNLS.2024.3350363"},{"key":"2637_CR36","doi-asserted-by":"crossref","unstructured":"Guo, M., Yuan, L., Yan, Z., Chen, B., Wang, Y. & Ye, Q. (2024b). Regressor-segmenter mutual prompt learning for crowd counting. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 28380\u201328389.","DOI":"10.1109\/CVPR52733.2024.02681"},{"key":"2637_CR37","doi-asserted-by":"crossref","unstructured":"Han, T., Bai, L., Liu, L. & Ouyang, W. (2023). Steerer: Resolving scale variations for counting and localization via selective inheritance learning. In: Proceeding of IEEE\/CVF international conference on computer vision, pp. 21848\u201321859.","DOI":"10.1109\/ICCV51070.2023.01997"},{"key":"2637_CR38","doi-asserted-by":"crossref","unstructured":"Harary, S., Schwartz, E., Arbelle, A., Staar, P., Abu-Hussein, S., Amrani, E., Herzig, R., Alfassy, A., Giryes, R., Kuehne, H., et\u00a0al. (2022). Unsupervised domain generalization by learning a bridge across domains. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 5280\u20135290.","DOI":"10.1109\/CVPR52688.2022.00521"},{"key":"2637_CR39","doi-asserted-by":"crossref","unstructured":"He, K., Chen, X., Xie, S., Li, Y., Doll\u00e1r, P. & Girshick, R. (2022). Masked autoencoders are scalable vision learners. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 16000\u201316009.","DOI":"10.1109\/CVPR52688.2022.01553"},{"key":"2637_CR40","doi-asserted-by":"crossref","unstructured":"Huang, Z. K., Chen, W. T., Chiang, Y. C., Kuo, S. Y. & Yang, M. H. (2023). Counting crowds in bad weather. arXiv preprint arXiv:2306.01209.","DOI":"10.1109\/ICCV51070.2023.02130"},{"key":"2637_CR41","doi-asserted-by":"crossref","unstructured":"Idrees, H., Tayyab, M., Athrey, K., Zhang, D., Al-Maadeed, S., Rajpoot, N. & Shah, M. (2018). Composition loss for counting, density map estimation and localization in dense crowds. In: Proceeding of european conference on computer vision, pp. 532\u2013546.","DOI":"10.1007\/978-3-030-01216-8_33"},{"key":"2637_CR42","doi-asserted-by":"crossref","unstructured":"Jeon, S., Hong, K., Lee, P., Lee, J. & Byun, H. (2021). Feature stylization and domain-aware contrastive learning for domain generalization. In: Proceedings of the 29th ACM international conference on multimedia, pp. 22\u201331.","DOI":"10.1145\/3474085.3475271"},{"key":"2637_CR43","unstructured":"Jeong, J., Verma, V., Hyun, M., Kannala, J. & Kwak, N. (2020). Interpolation-based semi-supervised learning for object detection. arXiv: 2006.02158."},{"key":"2637_CR44","doi-asserted-by":"crossref","unstructured":"Khan, M. H., talha Zaidi, S. M., Khan, S. & Khan, F. S. (2021). Mode-guided feature augmentation for domain generalization. In: BMVC, p. 176.","DOI":"10.5244\/C.35.221"},{"key":"2637_CR45","doi-asserted-by":"crossref","unstructured":"Kirillov, A., Mintun, E., Ravi, N., Mao, H., Rolland, C., Gustafson L, Xiao, T., Whitehead, S., Berg, A. C., Lo, W. Y., et\u00a0al. (2023). Segment anything. In: Proceeding of IEEE\/CVF International conference on computer vision.","DOI":"10.1109\/ICCV51070.2023.00371"},{"key":"2637_CR46","unstructured":"Krueger, D., Caballero, E., Jacobsen, J. H., Zhang, A., Binas, J., Zhang D, Le\u00a0Priol, R. & Courville, A. (2021). Out-of-distribution generalization via risk extrapolation (rex). In: Proceeding of international conference on machine learning, pp. 5815\u20135826."},{"key":"2637_CR47","doi-asserted-by":"crossref","unstructured":"Kumar, A., Bose, S., Hassan, M., & Banerjee, B. (2024). Spdg-net: Semantics preserving domain augmentation through style interpolation for multi-source domain generalization. In: ICASSP 2024-2024 IEEE international conference on acoustics, speech and signal processing (ICASSP), IEEE, pp. 7365\u20137369.","DOI":"10.1109\/ICASSP48485.2024.10447210"},{"key":"2637_CR48","doi-asserted-by":"publisher","first-page":"241","DOI":"10.1109\/TMI.2023.3298093","volume":"43","author":"I Lagogiannis","year":"2023","unstructured":"Lagogiannis, I., Meissen, F., Kaissis, G., & Rueckert, D. (2023). Unsupervised pathology detection: A deep dive into the state of the art. IEEE Transactions on Medical Imaging, 43, 241.","journal-title":"IEEE Transactions on Medical Imaging"},{"key":"2637_CR49","doi-asserted-by":"crossref","unstructured":"Lee, K., Kim, S. & Kwak, S. (2022). Cross-domain ensemble distillation for domain generalization. In: European conference on computer vision, Springer, pp. 1\u201320.","DOI":"10.1007\/978-3-031-19806-9_1"},{"key":"2637_CR50","doi-asserted-by":"publisher","first-page":"7399","DOI":"10.1609\/aaai.v36i7.20703","volume":"36","author":"B Li","year":"2022","unstructured":"Li, B., Shen, Y., Wang, Y., Zhu, W., Li, D., Keutzer, K., & Zhao, H. (2022). Invariant information bottleneck for domain generalization. Proceedings of the AAAI Conference on Artificial Intelligence, 36, 7399\u20137407.","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"2637_CR51","doi-asserted-by":"crossref","unstructured":"Li, C., Hu, X., Abousamra, S. & Chen, C. (2023). Calibrating uncertainty for semi-supervised crowd counting. In: 2023 IEEE\/CVF international conference on computer vision (ICCV), IEEE, pp. 16685\u201316695.","DOI":"10.1109\/ICCV51070.2023.01534"},{"issue":"7","key":"2637_CR52","doi-asserted-by":"publisher","first-page":"1794","DOI":"10.1109\/TIFS.2018.2801312","volume":"13","author":"H Li","year":"2018","unstructured":"Li, H., Li, W., Cao, H., Wang, S., Huang, F., & Kot, A. C. (2018). Unsupervised domain adaptation for face anti-spoofing. IEEE Transactions on Information Forensics and Security, 13(7), 1794\u20131809.","journal-title":"IEEE Transactions on Information Forensics and Security"},{"key":"2637_CR53","doi-asserted-by":"crossref","unstructured":"Li, H., Pan, S. J., Wang, S. & Kot, A. C. (2018b). Domain generalization with adversarial feature learning. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 5400\u20135409.","DOI":"10.1109\/CVPR.2018.00566"},{"key":"2637_CR54","doi-asserted-by":"crossref","unstructured":"Li, H., Pan, S. J., Wang, S. & Kot, A. C. (2018c). Domain generalization with adversarial feature learning. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 5400\u20135409.","DOI":"10.1109\/CVPR.2018.00566"},{"key":"2637_CR55","doi-asserted-by":"crossref","unstructured":"Li, L., Gao, K., Cao, J., Huang, Z., Weng, Y., Mi, X., Yu, Z., Li, X. & Xia, B. (2021a). Progressive domain expansion network for single domain generalization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 224\u2013233.","DOI":"10.1109\/CVPR46437.2021.00029"},{"key":"2637_CR56","doi-asserted-by":"crossref","unstructured":"Li, P., Li, D., Li, W., Gong, S., Fu, Y. & Hospedales, T. M. (2021b). A simple feature augmentation for domain generalization. In: Proceedings of the IEEE\/CVF international conference on computer vision, pp. 8886\u20138895.","DOI":"10.1109\/ICCV48922.2021.00876"},{"issue":"1","key":"2637_CR57","first-page":"18","volume":"36","author":"W Li","year":"2013","unstructured":"Li, W., Mahadevan, V., & Vasconcelos, N. (2013). Anomaly detection and localization in crowded scenes. IEEE Transactions on Pattern analysis and Machine Intelligence, 36(1), 18\u201332.","journal-title":"IEEE Transactions on Pattern analysis and Machine Intelligence"},{"key":"2637_CR58","doi-asserted-by":"crossref","unstructured":"Lian, D., Li, J., Zheng, J., Luo, W. & Gao, S. (2019). Density map regression guided detection network for rgb-d crowd counting and localization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 1821\u20131830.","DOI":"10.1109\/CVPR.2019.00192"},{"key":"2637_CR59","doi-asserted-by":"crossref","unstructured":"Liang, D., Xu, W. & Bai, X. (2022a). An end-to-end transformer model for crowd localization. In: Proceeding of european conference on computer vision, pp 38\u201354.","DOI":"10.1007\/978-3-031-19769-7_3"},{"key":"2637_CR60","doi-asserted-by":"publisher","first-page":"6040","DOI":"10.1109\/TMM.2022.3203870","volume":"25","author":"D Liang","year":"2022","unstructured":"Liang, D., Xu, W., Zhu, Y., & Zhou, Y. (2022). Focal inverse distance transform maps for crowd localization. IEEE Transactions on Multimedia, 25, 6040.","journal-title":"IEEE Transactions on Multimedia"},{"key":"2637_CR61","doi-asserted-by":"crossref","unstructured":"Liang, D., Xie, J., Zou, Z., Ye, X., Xu, W. & Bai, X. (2023). Crowdclip: Unsupervised crowd counting via vision-language model. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 2893\u20132903.","DOI":"10.1109\/CVPR52729.2023.00283"},{"key":"2637_CR62","doi-asserted-by":"crossref","unstructured":"Lin, C., Yuan, Z., Zhao, S., Sun, P., Wang, C. & Cai, J. (2021). Domain-invariant disentangled network for generalizable object detection. In: Proceedings of the IEEE\/CVF international conference on computer vision, pp. 8771\u20138780.","DOI":"10.1109\/ICCV48922.2021.00865"},{"key":"2637_CR63","doi-asserted-by":"publisher","first-page":"3395","DOI":"10.1609\/aaai.v38i4.28126","volume":"38","author":"H Lin","year":"2024","unstructured":"Lin, H., Ma, Z., Hong, X., Shangguan, Q., & Meng, D. (2024). Gramformer: Learning crowd counting via graph-modulated transformer. Proceedings of the AAAI Conference on Artificial Intelligence, 38, 3395\u20133403.","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"2637_CR64","doi-asserted-by":"crossref","unstructured":"Lin, T. Y., Maire, M., Belongie, S., Bourdev, L., Girshick, R., Hays, J., Perona, P., Ramanan, D., Zitnick, C. L. & Doll\u00e1r, P. (2015). Microsoft coco: Common objects in context. arXiv: 1405.0312","DOI":"10.1007\/978-3-319-10602-1_48"},{"key":"2637_CR65","doi-asserted-by":"crossref","unstructured":"Lin, T. Y., Doll\u00e1r, P., Girshick, R., He, K., Hariharan, B. & Belongie, S. (2017). Feature pyramid networks for object detection. arXiv: 1612.03144.","DOI":"10.1109\/CVPR.2017.106"},{"key":"2637_CR66","unstructured":"Lin, W., Yang, K., Ma, X., Gao, J., Liu, L., Liu, S., Hou, J., Yi, S. & Chan, A. B. (2022). Scale-prior deformable convolution for exemplar-guided class-agnostic counting. In: BMVC, p. 313."},{"key":"2637_CR67","doi-asserted-by":"crossref","unstructured":"Liu, C., Weng, X. & Mu, Y. (2019). Recurrent attentive zooming for joint crowd counting and precise localization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 1217\u20131226.","DOI":"10.1109\/CVPR.2019.00131"},{"key":"2637_CR68","doi-asserted-by":"crossref","unstructured":"Liu, C., Lu, H., Cao, Z. & Liu, T. (2023a). Point-query quadtree for crowd counting, localization, and more. In: Proceeding of IEEE\/CVF international conference on computer vision, pp. 1676\u20131685.","DOI":"10.1109\/ICCV51070.2023.00161"},{"key":"2637_CR69","unstructured":"Liu, J., Yang, S., Jia, P., Zhang, R., Lu, M., Guo, Y., Xue, W. & Zhang, S. (2023b). Vida: Homeostatic visual domain adapter for continual test time adaptation. arXiv preprint arXiv:2306.04344."},{"issue":"7","key":"2637_CR70","doi-asserted-by":"publisher","first-page":"9248","DOI":"10.1109\/TPAMI.2022.3232712","volume":"45","author":"Y Liu","year":"2022","unstructured":"Liu, Y., Ren, S., Chai, L., Wu, H., Xu, D., Qin, J., & He, S. (2022). Reducing spatial labeling redundancy for active semi-supervised crowd counting. IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(7), 9248\u20139255.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"2637_CR71","unstructured":"Lu, W., Wang, J., Li, H., Chen, Y. & Xie, X. (2022). Domain-invariant feature exploration for domain generalization. arXiv preprint arXiv:2207.12020."},{"key":"2637_CR72","doi-asserted-by":"crossref","unstructured":"Ma, Z., Hong, X., Wei, X., Qiu, Y. & Gong, Y. (2021). Towards a universal model for cross-dataset crowd counting. In: Proceeding of IEEE\/CVF international conference on computer vision, pp 3205\u20133214.","DOI":"10.1109\/ICCV48922.2021.00319"},{"key":"2637_CR73","unstructured":"Mahajan, D., Tople, S. & Sharma, A. (2021). Domain generalization using causal matching. In: International conference on machine learning, PMLR, pp. 7313\u20137324."},{"key":"2637_CR74","doi-asserted-by":"crossref","unstructured":"Mangla, P., Chandhok, S., Balasubramanian, V. N. & Khan, F. S. (2022). Cocoa: Context-conditional adaptation for recognizing unseen classes in unseen domains. In: Proceedings of the IEEE\/CVF winter conference on applications of computer vision, pp. 865\u2013874.","DOI":"10.1109\/WACV51458.2022.00168"},{"key":"2637_CR75","doi-asserted-by":"crossref","unstructured":"Marsden, M., McGuinness, K., Little, S., Keogh, C. E. & O\u2019Connor, N. E. (2018). People, penguins and petri dishes: Adapting object counting models to new visual domains and object types without forgetting. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 8070\u201380790.","DOI":"10.1109\/CVPR.2018.00842"},{"key":"2637_CR76","unstructured":"Miao, Q., Yuan, J. & Kuang, K. (2022). Domain generalization via contrastive causal learning. arXiv preprint arXiv:2210.02655."},{"key":"2637_CR77","doi-asserted-by":"crossref","unstructured":"Mo, H., Zhang, X., Tan, J., Yang, C., Gu, Q., Hang, B. & Ren, W. (2024). Countformer: Multi-view crowd counting transformer. In: European conference on computer vision, Springer, pp. 20\u201340.","DOI":"10.1007\/978-3-031-72943-0_2"},{"issue":"1","key":"2637_CR78","doi-asserted-by":"publisher","first-page":"22920","DOI":"10.1038\/s41598-021-01929-5","volume":"11","author":"R Morelli","year":"2021","unstructured":"Morelli, R., Clissa, L., Amici, R., Cerri, M., Hitrec, T., Luppi, M., Rinaldi, L., Squarcio, F., & Zoccoli, A. (2021). Automating cell counting in fluorescent microscopy through deep learning with c-resunet. Scientific Reports, 11(1), 22920.","journal-title":"Scientific Reports"},{"key":"2637_CR79","doi-asserted-by":"crossref","unstructured":"Mundhenk, T. N., Konjevod, G., Sakla, W. A. & Boakye, K. (2016). A large contextual dataset for classification, detection and counting of cars with deep learning. In: Proceeding of european conference on computer vision, pp 785\u2013800.","DOI":"10.1007\/978-3-319-46487-9_48"},{"key":"2637_CR80","first-page":"38706","volume":"35","author":"MA Munir","year":"2022","unstructured":"Munir, M. A., Khan, M. H., Sarfraz, M., & Ali, M. (2022). Towards improving calibration in object detection under domain shift. Advances in Neural Information Processing Systems, 35, 38706\u201338718.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR81","doi-asserted-by":"crossref","unstructured":"Munir, M. A., Khan, M. H., Sarfraz, M. S., & Ali, M. (2023). Domain adaptive object detection via balancing between self-training and adversarial learning. IEEE Transactions on Pattern Analysis and Machine Intelligence.","DOI":"10.1109\/TPAMI.2023.3290135"},{"key":"2637_CR82","doi-asserted-by":"crossref","unstructured":"Nam, H., Lee, H., Park, J., Yoon, W., & Yoo, D. (2021). Reducing domain gap by reducing style bias. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 8690\u20138699.","DOI":"10.1109\/CVPR46437.2021.00858"},{"key":"2637_CR83","unstructured":"Narayanan, V., Deshmukh, A. A., Dogan, U., & Balasubramanian, V. N. (2022). On challenges in unsupervised domain generalization. In: NeurIPS 2021 workshop on pre-registration in machine learning, PMLR, pp. 42\u201358."},{"key":"2637_CR84","doi-asserted-by":"crossref","unstructured":"Ni, J., Yang, S., Xu, R., Liu, J., Li, X., Jiao, W., Chen, Z., Liu Y, & Zhang, S. (2024). Distribution-aware continual test-time adaptation for semantic segmentation. In: 2024 IEEE international conference on robotics and automation (ICRA), IEEE, pp. 3044\u20133050.","DOI":"10.1109\/ICRA57147.2024.10610045"},{"key":"2637_CR85","unstructured":"Oquab, M., Darcet, T., Moutakanni, T., Vo, H., Szafraniec, M., Khalidov, V., Fernandez, P., Haziza, D., Massa, F., El-Nouby, A., et\u00a0al. (2023). Dinov2: Learning robust visual features without supervision. Transactions on Machine Learning Research."},{"key":"2637_CR86","doi-asserted-by":"crossref","unstructured":"Pandey, P., Raman, M., Varambally, S., & Ap, P. (2021). Generalization on unseen domains via inference-time label-preserving target projections. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 12924\u201312933.","DOI":"10.1109\/CVPR46437.2021.01273"},{"key":"2637_CR87","doi-asserted-by":"crossref","unstructured":"Pathiraja, B., Gunawardhana, M., & Khan, M. H. (2023). Multiclass confidence and localization calibration for object detection. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 19734\u201319743.","DOI":"10.1109\/CVPR52729.2023.01890"},{"key":"2637_CR88","doi-asserted-by":"crossref","unstructured":"Peng, Z., & Chan, S. H. G. (2024a). Single domain generalization for crowd counting. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 28025\u201328034.","DOI":"10.1109\/CVPR52733.2024.02647"},{"key":"2637_CR89","doi-asserted-by":"crossref","unstructured":"Peng, Z., & Chan, S. H. G. (2024b). Single domain generalization for crowd counting. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 28025\u201328034.","DOI":"10.1109\/CVPR52733.2024.02647"},{"key":"2637_CR90","first-page":"1256","volume":"34","author":"M Pezeshki","year":"2021","unstructured":"Pezeshki, M., Kaba, O., Bengio, Y., Courville, A. C., Precup, D., & Lajoie, G. (2021). Gradient starvation: A learning proclivity in neural networks. Advances in Neural Information Processing Systems, 34, 1256\u20131272.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR91","unstructured":"Phan, H., Le, T., Phung, T., Bui, A. T., Ho, N., & Phung, D. (2023). Global-local regularization via distributional robustness. In: International conference on artificial intelligence and statistics, PMLR, pp. 7644\u20137664."},{"key":"2637_CR92","doi-asserted-by":"crossref","unstructured":"Planamente, M., Plizzari, C., Alberti, E., & Caputo, B. (2022). Domain generalization through audio-visual relative norm alignment in first person action recognition. In: Proceedings of the IEEE\/CVF winter conference on app.lications of computer vision, pp. 1807\u20131818.","DOI":"10.1109\/WACV51458.2022.00024"},{"key":"2637_CR93","unstructured":"Radford, A., Kim, J. W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et\u00a0al. (2021). Learning transferable visual models from natural language supervision. In: Proceeding of international conference on machine learning, PMLR, pp. 8748\u20138763."},{"key":"2637_CR94","doi-asserted-by":"crossref","unstructured":"Ranasinghe, Y., Nair, N. G., Bandara, W. G. C., & Patel, V. M. (2024). Crowddiff: Multi-hypothesis crowd density estimation using diffusion models. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 12809\u201312819.","DOI":"10.1109\/CVPR52733.2024.01217"},{"key":"2637_CR95","doi-asserted-by":"crossref","unstructured":"Reynolds, D. A., et\u00a0al. (2009). Gaussian mixture models. Encyclopedia of biometrics 741(659-663).","DOI":"10.1007\/978-0-387-73003-5_196"},{"key":"2637_CR96","first-page":"25278","volume":"35","author":"C Schuhmann","year":"2022","unstructured":"Schuhmann, C., Beaumont, R., Vencu, R., Gordon, C., Wightman, R., Cherti, M., Coombes, T., Katta, A., Mullis, C., Wortsman, M., et al. (2022). Laion-5b: An open large-scale dataset for training next generation image-text models. Advances in neural information processing systems, 35, 25278\u201325294.","journal-title":"Advances in neural information processing systems"},{"key":"2637_CR97","doi-asserted-by":"crossref","unstructured":"Segu, M., Tonioni, A., & Tombari, F. (2023). Batch normalization embeddings for deep domain generalization. Pattern Recognition,135, Article 109115.","DOI":"10.1016\/j.patcog.2022.109115"},{"key":"2637_CR98","unstructured":"Shi, Y., Seely, J., Torr, P. H., Siddharth, N., Hannun, A., Usunier, N., & Synnaeve, G. (2021). Gradient matching for domain generalization. arXiv preprint arXiv:2104.09937"},{"key":"2637_CR99","doi-asserted-by":"crossref","unstructured":"Shi, Z., Mettes, P., & Snoek, C. G. (2024). Focus for free in density-based counting. International Journal of Computer Vision pp. 1\u201318.","DOI":"10.1007\/s11263-024-01990-3"},{"key":"2637_CR100","doi-asserted-by":"crossref","unstructured":"Shu, W., Wan, J., & Chan, A. B. (2023). Generalized characteristic function loss for crowd analysis in the frequency domain. IEEE Transactions on Pattern Analysis and Machine Intelligence.","DOI":"10.1109\/TPAMI.2023.3336196"},{"key":"2637_CR101","doi-asserted-by":"crossref","unstructured":"Shu, Y., Cao, Z., Wang, C., Wang, J., & Long, M. (2021). Open domain generalization with domain-augmented meta-learning. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 9624\u20139633.","DOI":"10.1109\/CVPR46437.2021.00950"},{"issue":"5","key":"2637_CR102","first-page":"2594","volume":"44","author":"VA Sindagi","year":"2020","unstructured":"Sindagi, V. A., Yasarla, R., & Patel, V. M. (2020). Jhu-crowd++: Large-scale crowd counting dataset and a benchmark method. IEEE Transactions on Pattern Analysis and Machine Intelligence, 44(5), 2594\u20132609.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"2637_CR103","unstructured":"Sinha, A., Namkoong, H., Volpi, R., & Duchi, J. (2017). Certifying some distributional robustness with principled adversarial training. arXiv preprint arXiv:1710.10571"},{"key":"2637_CR104","doi-asserted-by":"crossref","unstructured":"Song, Q., Wang, C., Jiang, Z., Wang, Y., Tai, Y., Wang, C., Li, J., Huang, F., & Wu, Y. (2021). Rethinking counting and localization in crowds: A purely point-based framework. In: Proceeding of IEEE\/CVF international conference on computer vision, pp. 3365\u20133374.","DOI":"10.1109\/ICCV48922.2021.00335"},{"key":"2637_CR105","doi-asserted-by":"crossref","unstructured":"Sun, B., & Saenko, K. (2016). Deep coral: Correlation alignment for deep domain adaptation. In: Proceeding of European conference on computer vision, pp. 443\u2013450.","DOI":"10.1007\/978-3-319-49409-8_35"},{"key":"2637_CR106","first-page":"16846","volume":"34","author":"X Sun","year":"2021","unstructured":"Sun, X., Wu, B., Zheng, X., Liu, C., Chen, W., Qin, T., & Liu, T. Y. (2021). Recovering latent causal factor for generalization to distributional shifts. Advances in Neural Information Processing Systems, 34, 16846\u201316859.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR107","doi-asserted-by":"crossref","unstructured":"Tommasi, T., & Tuytelaars, T. (2015). A testbed for cross-dataset analysis. In: Computer Vision-ECCV 2014 Workshops: Zurich, Switzerland, September 6-7 and 12, 2014, Proceedings, Part III 13, Springer, pp. 18\u201331.","DOI":"10.1007\/978-3-319-16199-0_2"},{"issue":"5","key":"2637_CR108","doi-asserted-by":"publisher","first-page":"988","DOI":"10.1109\/72.788640","volume":"10","author":"VN Vapnik","year":"1999","unstructured":"Vapnik, V. N. (1999). An overview of statistical learning theory. IEEE Transactions on Neural Networks, 10(5), 988\u2013999.","journal-title":"IEEE Transactions on Neural Networks"},{"key":"2637_CR109","unstructured":"Verma, V., Lamb, A., Beckham, C., Najafi, A., Mitliagkas, I., Lopez-Paz, D., & Bengio, Y. (2019). Manifold mixup: Better representations by interpolating hidden states. In: Proceeding of international conference on machine learning, pp. 6438\u20136447."},{"issue":"4","key":"2637_CR110","doi-asserted-by":"publisher","first-page":"1224","DOI":"10.1109\/TAES.2005.1561884","volume":"41","author":"BN Vo","year":"2005","unstructured":"Vo, B. N., Singh, S., & Doucet, A. (2005). Sequential monte carlo methods for multitarget filtering with random finite sets. IEEE Transactions on Aerospace and Electronic Systems, 41(4), 1224\u20131245.","journal-title":"IEEE Transactions on Aerospace and Electronic Systems"},{"key":"2637_CR111","doi-asserted-by":"crossref","unstructured":"Wan, J., & Chan, A. (2019). Adaptive density map generation for crowd counting. In: Proceedings of the IEEE\/CVF international conference on computer vision, pp. 1130\u20131139.","DOI":"10.1109\/ICCV.2019.00122"},{"key":"2637_CR112","first-page":"3386","volume":"33","author":"J Wan","year":"2020","unstructured":"Wan, J., & Chan, A. (2020). Modeling noisy annotations for crowd counting. Advances in Neural Information Processing Systems, 33, 3386\u20133396.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR113","doi-asserted-by":"crossref","unstructured":"Wan, J., Liu, Z., & Chan, A. B. (2021). A generalized loss function for crowd counting and localization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 1974\u20131983.","DOI":"10.1109\/CVPR46437.2021.00201"},{"key":"2637_CR114","doi-asserted-by":"crossref","unstructured":"Wang, J., Feng, W., Chen, Y., Yu, H., Huang, M., & Yu, P. S. (2018). Visual domain adaptation with manifold embedded distribution alignment. In: Proceedings of the 26th ACM international conference on Multimedia, pp. 402\u2013410.","DOI":"10.1145\/3240508.3240512"},{"issue":"10","key":"2637_CR115","doi-asserted-by":"publisher","first-page":"3349","DOI":"10.1109\/TPAMI.2020.2983686","volume":"43","author":"J Wang","year":"2020","unstructured":"Wang, J., Sun, K., Cheng, T., Jiang, B., Deng, C., Zhao, Y., Liu, D., Mu, Y., Tan, M., Wang, X., et al. (2020). Deep high-resolution representation learning for visual recognition. IEEE Transactions on Pattern Analysis and Machine Intelligence, 43(10), 3349\u20133364.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"2637_CR116","first-page":"8052","volume":"35","author":"J Wang","year":"2022","unstructured":"Wang, J., Lan, C., Liu, C., Ouyang, Y., Qin, T., Lu, W., Chen, Y., Zeng, W., & Yu, P. (2022). Generalizing to unseen domains: A survey on domain generalization. IEEE Transactions on Knowledge and Data Engineering, 35, 8052.","journal-title":"IEEE Transactions on Knowledge and Data Engineering"},{"key":"2637_CR117","doi-asserted-by":"publisher","first-page":"1802","DOI":"10.1109\/TIP.2023.3251727","volume":"32","author":"J Wang","year":"2023","unstructured":"Wang, J., Gao, J., Yuan, Y., & Wang, Q. (2023). Crowd localization from gaussian mixture scoped knowledge and scoped teacher. IEEE Transactions on Image Processing, 32, 1802\u20131814.","journal-title":"IEEE Transactions on Image Processing"},{"key":"2637_CR118","unstructured":"Wang, J., Wang, J., Hu, X., Wang, S., & Xie, X. (2023b). Frustratingly easy model generalization by dummy risk minimization. arXiv preprint arXiv:2308.02287"},{"key":"2637_CR119","doi-asserted-by":"crossref","unstructured":"Wang, P., Zhang, Z., Lei, Z., & Zhang, L. (2023c). Sharpness-aware gradient matching for domain generalization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 3769\u20133778.","DOI":"10.1109\/CVPR52729.2023.00367"},{"key":"2637_CR120","doi-asserted-by":"crossref","unstructured":"Wang, Q., Gao, J., Lin, W., & Yuan, Y. (2019). Learning from synthetic data for crowd counting in the wild. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 8198\u20138207.","DOI":"10.1109\/CVPR.2019.00839"},{"issue":"6","key":"2637_CR121","doi-asserted-by":"publisher","first-page":"2141","DOI":"10.1109\/TPAMI.2020.3013269","volume":"43","author":"Q Wang","year":"2020","unstructured":"Wang, Q., Gao, J., Lin, W., & Li, X. (2020). Nwpu-crowd: A large-scale benchmark for crowd counting and localization. IEEE Transactions on Pattern Analysis and Machine Intelligence, 43(6), 2141\u20132149.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"2637_CR122","unstructured":"Wang, Q., Wang, J., Gao, J., Yuan, Y., & Li, X. (2022b). Counting like human: Anthropoid crowd counting on modeling the similarity of objects. arXiv preprint arXiv:2212.02248"},{"key":"2637_CR123","unstructured":"Wang, T., Li, D., Zhou, K., Xiang, T., & Song, Y. Z. (2022c). Learning to augment via implicit differentiation for domain generalization. arXiv preprint arXiv:2210.14271"},{"key":"2637_CR124","doi-asserted-by":"publisher","first-page":"1227","DOI":"10.1109\/TIP.2024.3361730","volume":"33","author":"X Wang","year":"2024","unstructured":"Wang, X., Zhan, Y., Zhao, Y., Yang, T., & Ruan, Q. (2024). Hybrid perturbation strategy for semi-supervised crowd counting. IEEE Transactions on Image Processing, 33, 1227.","journal-title":"IEEE Transactions on Image Processing"},{"key":"2637_CR125","doi-asserted-by":"crossref","unstructured":"Wang, Y., Li, H., & Kot, A. C. (2020). Heterogeneous domain generalization via domain mixup. ICASSP 2020\u20132020 IEEE International Conference on Acoustics (pp. 3622\u20133626). Speech and Signal Processing (ICASSP): IEEE.","DOI":"10.1109\/ICASSP40776.2020.9053273"},{"key":"2637_CR126","unstructured":"Wang, Y., Li, H., Cheng, H., Wen, B., Chau, L. P., & Kot, A. C. (2021). Variational disentanglement for domain generalization. arXiv preprint arXiv:2109.05826"},{"key":"2637_CR127","doi-asserted-by":"crossref","unstructured":"Wang, Y., Hu, Q., & Chau, L. P. (2024). Weakly-supervised crowd counting with token attention and fusion: A simple and effective baseline. ICASSP 2024\u20132024 IEEE International Conference on Acoustics (pp. 13456\u201313460). Speech and Signal Processing (ICASSP): IEEE.","DOI":"10.1109\/ICASSP48485.2024.10446636"},{"key":"2637_CR128","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2024.106131","volume":"172","author":"C Wen","year":"2024","unstructured":"Wen, C., He, H., Qian, Y., Xie, Y., & Wang, W. (2024). Fourier feature decorrelation based sample attention for dense crowd localization. Neural Networks, 172, Article 106131.","journal-title":"Neural Networks"},{"key":"2637_CR129","doi-asserted-by":"crossref","unstructured":"Wu, G., & Gong, S. (2021). Collaborative optimization and aggregation for decentralized domain generalization and adaptation. In: Proceedings of the IEEE\/CVF international conference on computer vision, pp. 6484\u20136493.","DOI":"10.1109\/ICCV48922.2021.00642"},{"key":"2637_CR130","doi-asserted-by":"crossref","unstructured":"Wu, Q., Wan, J., & Chan, A. B. (2021). Dynamic momentum adaptation for zero-shot cross-domain crowd counting. In: Proceedings of the 29th ACM international conference on multimedia, pp. 658\u2013666.","DOI":"10.1145\/3474085.3475230"},{"key":"2637_CR131","doi-asserted-by":"crossref","unstructured":"Wu, S., & Yang, F. (2023). Boosting detection in crowd analysis via underutilized output features. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 15609\u201315618.","DOI":"10.1109\/CVPR52729.2023.01498"},{"key":"2637_CR132","doi-asserted-by":"crossref","unstructured":"Xie, H., Yang, Z., Zhu, H., & Wang, Z. (2023). Striking a balance: Unsupervised cross-domain crowd counting via knowledge diffusion. In: Proceedings of the 31st ACM international conference on multimedia, pp. 6520\u20136529.","DOI":"10.1145\/3581783.3611797"},{"issue":"2","key":"2637_CR133","doi-asserted-by":"publisher","first-page":"405","DOI":"10.1007\/s11263-021-01542-z","volume":"130","author":"C Xu","year":"2022","unstructured":"Xu, C., Liang, D., Xu, Y., Bai, S., Zhan, W., Bai, X., & Tomizuka, M. (2022). Autoscale: Learning to scale for crowd counting. International Journal of Computer Vision, 130(2), 405\u2013434.","journal-title":"International Journal of Computer Vision"},{"key":"2637_CR134","unstructured":"Yan, S., Song, H., Li, N., Zou, L., & Ren, L. (2020). Improve unsupervised domain adaptation with mixup training. arXiv preprint arXiv:2001.00677"},{"key":"2637_CR135","first-page":"19448","volume":"34","author":"FE Yang","year":"2021","unstructured":"Yang, F. E., Cheng, Y. C., Shiau, Z. Y., & Wang, Y. C. F. (2021). Adversarial teacher-student representation learning for domain generalization. Advances in Neural Information Processing Systems, 34, 19448\u201319460.","journal-title":"Advances in Neural Information Processing Systems"},{"issue":"12","key":"2637_CR136","doi-asserted-by":"publisher","first-page":"5635","DOI":"10.1007\/s11263-024-02117-4","volume":"132","author":"J Yang","year":"2024","unstructured":"Yang, J., Zhou, K., Li, Y., & Liu, Z. (2024). Generalized out-of-distribution detection: A survey. International Journal of Computer Vision, 132(12), 5635\u20135662.","journal-title":"International Journal of Computer Vision"},{"key":"2637_CR137","doi-asserted-by":"publisher","first-page":"16334","DOI":"10.1609\/aaai.v38i15.29569","volume":"38","author":"S Yang","year":"2024","unstructured":"Yang, S., Wu, J., Liu, J., Li, X., Zhang, Q., Pan, M., Gan, Y., Chen, Z., & Zhang, S. (2024). Exploring sparse visual prompt for domain adaptive dense prediction. Proceedings of the AAAI Conference on Artificial Intelligence, 38, 16334\u201316342.","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"2637_CR138","first-page":"23519","volume":"34","author":"H Ye","year":"2021","unstructured":"Ye, H., Xie, C., Cai, T., Li, R., Li, Z., & Wang, L. (2021). Towards a theoretical framework of out-of-distribution generalization. Advances in Neural Information Processing Systems, 34, 23519\u201323531.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR139","doi-asserted-by":"crossref","unstructured":"Ye, N., Li, K., Bai, H., Yu, R., Hong, L., Zhou, F., Li, Z., & Zhu, J. (2022). Ood-bench: Quantifying and understanding two dimensions of out-of-distribution generalization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 7947\u20137958.","DOI":"10.1109\/CVPR52688.2022.00779"},{"key":"2637_CR140","doi-asserted-by":"publisher","first-page":"3420","DOI":"10.1109\/TITS.2023.3328000","volume":"25","author":"J Yi","year":"2023","unstructured":"Yi, J., Pang, Y., Zhou, W., Zhao, M., & Zheng, F. (2023). A perspective-embedded scale-selection network for crowd counting in public transportation. IEEE Transactions on Intelligent Transportation Systems, 25, 3420.","journal-title":"IEEE Transactions on Intelligent Transportation Systems"},{"key":"2637_CR141","doi-asserted-by":"crossref","unstructured":"Yuan, J., Ma, X., Chen, D., Kuang, K., Wu, F., & Lin, L. (2022a). Label-efficient domain generalization via collaborative exploration and generalization. In: Proceedings of the 30th ACM international conference on multimedia, pp. 2361\u20132370.","DOI":"10.1145\/3503161.3548059"},{"key":"2637_CR142","doi-asserted-by":"crossref","unstructured":"Yuan, M., Wang, Y., & Wei, X. (2022b). Translation, scale and rotation: cross-modal alignment meets rgb-infrared vehicle detection. In: European conference on computer vision, Springer, pp. 509\u2013525.","DOI":"10.1007\/978-3-031-20077-9_30"},{"key":"2637_CR143","doi-asserted-by":"crossref","unstructured":"Zhang, C., Chen, J., Li, B., Feng, M., Yang, Y., Zhu, Q., & Bu, H. (2023a). Learning pseudo scale instance maps for cell localization. Authorea Preprints.","DOI":"10.36227\/techrxiv.22678171.v1"},{"key":"2637_CR144","first-page":"10957","volume":"34","author":"G Zhang","year":"2021","unstructured":"Zhang, G., Zhao, H., Yu, Y., & Poupart, P. (2021). Quantifying and improving transferability in domain generalization. Advances in Neural Information Processing Systems, 34, 10957\u201310970.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"2637_CR145","unstructured":"Zhang, H., Cisse, M., Dauphin, Y. N., & Lopez-Paz, D. (2018). Mixup: Beyond empirical risk minimization. In: Proceeding of international conference on learning representations."},{"key":"2637_CR146","doi-asserted-by":"crossref","unstructured":"Zhang, H., Zhang, Y. F., Liu, W., Weller, A., Sch\u00f6lkopf, B., & Xing, E. P. (2022a). Towards principled disentanglement for domain generalization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 8024\u20138034.","DOI":"10.1109\/CVPR52688.2022.00786"},{"key":"2637_CR147","first-page":"23664","volume":"34","author":"M Zhang","year":"2021","unstructured":"Zhang, M., Marklund, H., Dhawan, N., Gupta, A., Levine, S., & Finn, C. (2021). Adaptive risk minimization: Learning to adapt to domain shift. Advances in Neural Information Processing Systems, 34, 23664\u201323678.","journal-title":"Advances in Neural Information Processing Systems"},{"issue":"8","key":"2637_CR148","doi-asserted-by":"publisher","first-page":"1938","DOI":"10.1007\/s11263-022-01626-4","volume":"130","author":"Q Zhang","year":"2022","unstructured":"Zhang, Q., & Chan, A. B. (2022). Wide-area crowd counting: Multi-view fusion networks for counting in large scenes. International Journal of Computer Vision, 130(8), 1938\u20131960.","journal-title":"International Journal of Computer Vision"},{"key":"2637_CR149","doi-asserted-by":"publisher","first-page":"7242","DOI":"10.1609\/aaai.v38i7.28553","volume":"38","author":"Q Zhang","year":"2024","unstructured":"Zhang, Q., Gong, Y., Chen, D., Chan, A. B., & Huang, H. (2024). Multi-view people detection in large scenes via supervised view-wise contribution weighting. Proceedings of the AAAI Conference on Artificial Intelligence, 38, 7242\u20137250.","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"2637_CR150","doi-asserted-by":"crossref","unstructured":"Zhang, S., Ke, W., Liu, S., Hong, X., & Zhang, T. (2024b). Boosting semi-supervised crowd counting with scale-based active learning. In: Proceedings of the 32nd ACM international conference on multimedia, pp. 8681\u20138690.","DOI":"10.1145\/3664647.3680976"},{"key":"2637_CR151","doi-asserted-by":"crossref","unstructured":"Zhang, X., Cui, P., Xu, R., Zhou, L., He, Y., & Shen, Z. (2021c). Deep stable learning for out-of-distribution generalization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 5372\u20135382.","DOI":"10.1109\/CVPR46437.2021.00533"},{"key":"2637_CR152","doi-asserted-by":"crossref","unstructured":"Zhang, X., Xu, R., Yu, H., Zou, H., & Cui, P. (2023b). Gradient norm aware minimization seeks first-order flatness and improves generalization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 20247\u201320257.","DOI":"10.1109\/CVPR52729.2023.01939"},{"key":"2637_CR153","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Zhou, D., Chen, S., Gao, S., & Ma, Y. (2016). Single-image crowd counting via multi-column convolutional neural network. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 589\u2013597.","DOI":"10.1109\/CVPR.2016.70"},{"key":"2637_CR154","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Li, M., Li, R., Jia, K., & Zhang, L. (2022b). Exact feature distribution matching for arbitrary style transfer and domain generalization. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 8035\u20138045.","DOI":"10.1109\/CVPR52688.2022.00787"},{"key":"2637_CR155","doi-asserted-by":"publisher","first-page":"13025","DOI":"10.1609\/aaai.v34i07.7003","volume":"34","author":"K Zhou","year":"2020","unstructured":"Zhou, K., Yang, Y., Hospedales, T., & Xiang, T. (2020). Deep domain-adversarial image generation for domain generalisation. Proceedings of the AAAI Conference on Artificial Intelligence, 34, 13025\u201313032.","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"2637_CR156","doi-asserted-by":"publisher","first-page":"8008","DOI":"10.1109\/TIP.2021.3112012","volume":"30","author":"K Zhou","year":"2021","unstructured":"Zhou, K., Yang, Y., Qiao, Y., & Xiang, T. (2021). Domain adaptive ensemble learning. IEEE Transactions on Image Processing, 30, 8008\u20138018.","journal-title":"IEEE Transactions on Image Processing"},{"key":"2637_CR157","unstructured":"Zhou, K., Yang, Y., Qiao, Y., & Xiang, T. (2021b). Domain generalization with mixstyle. arXiv preprint arXiv:2104.02008"},{"issue":"4","key":"2637_CR158","first-page":"4396","volume":"45","author":"K Zhou","year":"2022","unstructured":"Zhou, K., Liu, Z., Qiao, Y., Xiang, T., & Loy, C. C. (2022). Domain generalization: A survey. IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(4), 4396\u20134415.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"3","key":"2637_CR159","doi-asserted-by":"publisher","first-page":"822","DOI":"10.1007\/s11263-023-01913-8","volume":"132","author":"K Zhou","year":"2024","unstructured":"Zhou, K., Yang, Y., Qiao, Y., & Xiang, T. (2024). Mixstyle neural networks for domain generalization and adaptation. International Journal of Computer Vision, 132(3), 822\u2013836.","journal-title":"International Journal of Computer Vision"},{"key":"2637_CR160","doi-asserted-by":"crossref","unstructured":"Zhu, H., Yuan, J., Zhong, X., Yang, Z., Wang, Z. & He, S. (2023). Daot: Domain-agnostically aligned optimal transport for domain-adaptive crowd counting. In: Proceedings of the 31st ACM international conference on multimedia, pp. 4319\u20134329.","DOI":"10.1145\/3581783.3611793"}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-025-02637-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11263-025-02637-7","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-025-02637-7.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,3,27]],"date-time":"2026-03-27T10:04:04Z","timestamp":1774605844000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11263-025-02637-7"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,2,2]]},"references-count":160,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2026,3]]}},"alternative-id":["2637"],"URL":"https:\/\/doi.org\/10.1007\/s11263-025-02637-7","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,2,2]]},"assertion":[{"value":"5 February 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"14 October 2025","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"2 February 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}],"article-number":"97"}}