{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,4]],"date-time":"2026-05-04T05:13:19Z","timestamp":1777871599982,"version":"3.51.4"},"reference-count":55,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62476137"],"award-info":[{"award-number":["62476137"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62371254"],"award-info":[{"award-number":["62371254"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100012154","name":"Graduate Research and Innovation Projects of Jiangsu Province","doi-asserted-by":"publisher","award":["SJCX24_0324"],"award-info":[{"award-number":["SJCX24_0324"]}],"id":[{"id":"10.13039\/501100012154","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100005374","name":"Nanjing University of Posts and Telecommunications","doi-asserted-by":"publisher","award":["NY225157"],"award-info":[{"award-number":["NY225157"]}],"id":[{"id":"10.13039\/501100005374","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Knowledge-Based Systems"],"published-print":{"date-parts":[[2026,6]]},"DOI":"10.1016\/j.knosys.2026.115834","type":"journal-article","created":{"date-parts":[[2026,4,2]],"date-time":"2026-04-02T15:57:45Z","timestamp":1775145465000},"page":"115834","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["Region-aware focused masked contrast for self-supervised representation learning"],"prefix":"10.1016","volume":"342","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-6281-0832","authenticated-orcid":false,"given":"Xianzhong","family":"Long","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jiacheng","family":"He","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2079-9484","authenticated-orcid":false,"given":"Yun","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jian","family":"Xiong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"78","reference":[{"key":"10.1016\/j.knosys.2026.115834_bib0001","unstructured":"O. A. van den, Y. Li, O. Vinyals, Representation learning with contrastive predictive coding, in: arXiv preprint arXiv: 1807.03748, 2018, pp. 1\u201313."},{"key":"10.1016\/j.knosys.2026.115834_bib0002","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"9729","article-title":"Momentum contrast for unsupervised visual representation learning","author":"He","year":"2020"},{"key":"10.1016\/j.knosys.2026.115834_bib0003","series-title":"Advances in Neural Information Processing Systems","first-page":"21271","article-title":"Bootstrap your own latent-a new approach to self-supervised learning","author":"Grill","year":"2020"},{"key":"10.1016\/j.knosys.2026.115834_bib0004","series-title":"European Conference on Computer Vision","first-page":"776","article-title":"Contrastive multiview coding","author":"Tian","year":"2020"},{"key":"10.1016\/j.knosys.2026.115834_bib0005","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"16000","article-title":"Masked autoencoders are scalable vision learners","author":"He","year":"2022"},{"key":"10.1016\/j.knosys.2026.115834_bib0006","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"9653","article-title":"Simmim: a simple framework for masked image modeling","author":"Xie","year":"2022"},{"key":"10.1016\/j.knosys.2026.115834_bib0007","unstructured":"H. Bao, L. Dong, S. Piao, F. Wei, Beit: Bert pre-training of image transformers, in: arXiv preprint arXiv: 2106.08254, 2021, pp. 1\u201318."},{"key":"10.1016\/j.knosys.2026.115834_bib0008","series-title":"International Conference on Machine Learning","first-page":"1096","article-title":"Extracting and composing robust features with denoising autoencoders","author":"Vincent","year":"2008"},{"key":"10.1016\/j.knosys.2026.115834_bib0009","series-title":"Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies","first-page":"4171","article-title":"Bert: pre-training of deep bidirectional transformers for language understanding","author":"Kenton","year":"2019"},{"key":"10.1016\/j.knosys.2026.115834_bib0010","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"9650","article-title":"Emerging properties in self-supervised vision transformers","author":"Caron","year":"2021"},{"key":"10.1016\/j.knosys.2026.115834_bib0011","unstructured":"D. Alexey, An image is worth 16x16 words: Transformers for image recognition at scale, in: arXiv preprint arXiv: 2010.11929, 2020, pp. 1\u201322."},{"key":"10.1016\/j.knosys.2026.115834_bib0012","unstructured":"N. Tomasev, I. Bica, B. McWilliams, L. Buesing, R. Pascanu, C. Blundell, J. Mitrovic, Pushing the limits of self-supervised resnets: Can we outperform supervised learning without labels on imagenet?, in: arXiv preprint arXiv: 2201.05119, 2022, pp. 1\u201334."},{"key":"10.1016\/j.knosys.2026.115834_bib0013","unstructured":"Y. Li, S. Xie, X. Chen, P. Dollar, K. He, R. Girshick, Benchmarking detection transfer learning with vision transformers, in: arXiv preprint arXiv: 2111.11429, 2021, pp. 1\u20139."},{"key":"10.1016\/j.knosys.2026.115834_bib0014","series-title":"International Conference on Computer Vision","first-page":"9640","article-title":"An empirical study of training self-supervised vision transformers","author":"Chen","year":"2021"},{"key":"10.1016\/j.knosys.2026.115834_bib0015","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"886","article-title":"Histograms of oriented gradients for human detection","author":"Dalal","year":"2005"},{"key":"10.1016\/j.knosys.2026.115834_bib0016","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"14668","article-title":"Masked feature prediction for self-supervised visual pre-training","author":"Wei","year":"2022"},{"issue":"5","key":"10.1016\/j.knosys.2026.115834_bib0017","doi-asserted-by":"crossref","first-page":"1141","DOI":"10.1007\/s11263-022-01739-w","article-title":"Vitaev2: vision transformer advanced by exploring inductive bias for image recognition and beyond","volume":"131","author":"Zhang","year":"2023","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.knosys.2026.115834_bib0018","series-title":"International Conference on Learning Representations","first-page":"1","article-title":"Regionvit: regional-to-Local attention for vision transformers","author":"Chen","year":"2022"},{"key":"10.1016\/j.knosys.2026.115834_bib0019","doi-asserted-by":"crossref","first-page":"104030","DOI":"10.1016\/j.cviu.2024.104030","article-title":"Other tokens matter: exploring global and local features of vision transformers for object re-Identification","volume":"244","author":"Wang","year":"2024","journal-title":"Comput. Vision Image Understand."},{"key":"10.1016\/j.knosys.2026.115834_bib0020","series-title":"International Conference on Machine Learning","first-page":"20026","article-title":"Adversarial masking for self-supervised learning","author":"Shi","year":"2022"},{"key":"10.1016\/j.knosys.2026.115834_bib0021","unstructured":"L. Sick, D. Engel, P. Hermosilla, T. Ropinski, Attention-Guided Masked Autoencoders For Learning Image Representations, in: arXiv preprint arXiv: 2402.15172, 2024, pp. 1\u201310."},{"issue":"10","key":"10.1016\/j.knosys.2026.115834_bib0022","doi-asserted-by":"crossref","first-page":"1345","DOI":"10.1109\/TKDE.2009.191","article-title":"A survey on transfer learning","volume":"22","author":"Pan","year":"2009","journal-title":"IEEE Trans. Knowl. Data Eng."},{"key":"10.1016\/j.knosys.2026.115834_bib0023","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"10375","article-title":"Hard patches mining for masked image modeling","author":"Wang","year":"2023"},{"key":"10.1016\/j.knosys.2026.115834_bib0024","series-title":"International Conference on Machine Learning","first-page":"1597","article-title":"A simple framework for contrastive learning of visual representations","author":"Chen","year":"2020"},{"key":"10.1016\/j.knosys.2026.115834_bib0025","unstructured":"U. Ozbulak, H.J. Lee, B. Boga, E.T. Anzaku, H. Park, A. Van Messem, W. De Neve, J. Vankerschaver, Know your self-supervised learning: A survey on image-based generative and discriminative training, in: arXiv preprint arXiv: 2305.13689, 2023, pp. 1\u201345."},{"key":"10.1016\/j.knosys.2026.115834_bib0026","series-title":"International Conference on Machine Learning","first-page":"12310","article-title":"Barlow twins: self-supervised learning via redundancy reduction","author":"Zbontar","year":"2021"},{"key":"10.1016\/j.knosys.2026.115834_bib0027","series-title":"Advances in Neural Information Processing Systems","first-page":"9912","article-title":"Unsupervised learning of visual features by contrasting cluster assignments","author":"Caron","year":"2020"},{"key":"10.1016\/j.knosys.2026.115834_bib0028","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"3733","article-title":"Unsupervised feature learning via non-parametric instance discrimination","author":"Wu","year":"2018"},{"key":"10.1016\/j.knosys.2026.115834_bib0029","unstructured":"X. Chen, H. Fan, R. Girshick, K. He, Improved baselines with momentum contrastive learning, in: arXiv preprint arXiv: 2003.04297, 2020, pp. 1\u20133."},{"key":"10.1016\/j.knosys.2026.115834_bib0030","series-title":"Advances in Neural Information Processing Systems","first-page":"1869","article-title":"Dvae#: discrete variational autoencoders with relaxed boltzmann priors","author":"Vahdat","year":"2018"},{"key":"10.1016\/j.knosys.2026.115834_bib0031","doi-asserted-by":"crossref","first-page":"208","DOI":"10.1007\/s11263-023-01852-4","article-title":"Context autoencoder for self-supervised representation learning","volume":"132","author":"Chen","year":"2024","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.knosys.2026.115834_bib0032","unstructured":"K. Tian, Y. Jiang, Q. Diao, C. Lin, L. Wang, Z. Yuan, Designing bert for convolutional networks: Sparse and hierarchical masked modeling, in: arXiv preprint arXiv: 2301.03580, 2023, pp. 1\u201316."},{"key":"10.1016\/j.knosys.2026.115834_bib0033","series-title":"IEEE International Conference on Image Processing","first-page":"2490","article-title":"Attention-Guided contrastive masked image modeling for transformer-Based self-Supervised learning","author":"Zhan","year":"2023"},{"issue":"4","key":"10.1016\/j.knosys.2026.115834_bib0034","doi-asserted-by":"crossref","first-page":"2506","DOI":"10.1109\/TPAMI.2023.3336525","article-title":"Contrastive masked autoencoders are stronger vision learners","volume":"46","author":"Huang","year":"2023","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.knosys.2026.115834_bib0035","unstructured":"B. Alkin, L. Miklautz, S. Hochreiter, J. Brandstetter, Mim-refiner: A contrastive learning boost from intermediate pre-trained representations, in: arXiv preprint arXiv: 2402.10093, 2024, pp. 1\u201333."},{"issue":"1","key":"10.1016\/j.knosys.2026.115834_bib0036","doi-asserted-by":"crossref","first-page":"21","DOI":"10.1109\/TIT.1967.1053964","article-title":"Nearest neighbor pattern classification","volume":"13","author":"Cover","year":"1967","journal-title":"IEEE Trans. Inf. Theory"},{"key":"10.1016\/j.knosys.2026.115834_bib0037","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"22967","article-title":"Self-Supervised representation learning from arbitrary scenarios","author":"Li","year":"2024"},{"key":"10.1016\/j.knosys.2026.115834_bib0038","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"22742","article-title":"Mixed autoencoder for self-supervised visual representation learning","author":"Chen","year":"2023"},{"key":"10.1016\/j.knosys.2026.115834_bib0039","first-page":"1","article-title":"Encoder-free multiaxis physics-aware fusion network for remote sensing image dehazing","volume":"61","author":"Wen","year":"2023","journal-title":"IEEE Trans. Geosci. Remote Sens."},{"key":"10.1016\/j.knosys.2026.115834_bib0040","first-page":"1","article-title":"Cross-level interaction and intra-level fusion network for remote sensing image dehazing","volume":"63","author":"Wen","year":"2025","journal-title":"IEEE Trans. Geosci. Remote Sens."},{"key":"10.1016\/j.knosys.2026.115834_bib0041","doi-asserted-by":"crossref","first-page":"3343","DOI":"10.1109\/TMM.2025.3535316","article-title":"All-in-One weather-Degraded image restoration via adaptive degradation-Aware self-Prompting model","volume":"27","author":"Wen","year":"2024","journal-title":"IEEE Trans. Multimedia"},{"issue":"4","key":"10.1016\/j.knosys.2026.115834_bib0042","doi-asserted-by":"crossref","first-page":"203","DOI":"10.1080\/00224065.1986.11979014","article-title":"The exponentially weighted moving average","volume":"18","author":"Hunter","year":"1986","journal-title":"J. Qual. Technol."},{"key":"10.1016\/j.knosys.2026.115834_bib0043","unstructured":"H. Huang, X. Ma, S. Erfani, J. Bailey, Distilling cognitive backdoor patterns within an image, in: arXiv preprint arXiv: 2301.10908, 2023, pp. 1\u201331."},{"key":"10.1016\/j.knosys.2026.115834_bib0044","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"770","article-title":"Deep residual learning for image recognition","author":"He","year":"2016"},{"key":"10.1016\/j.knosys.2026.115834_bib0045","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"14431","article-title":"Exploring the equivalence of siamese self-supervised learning via a unified gradient framework","author":"Tao","year":"2022"},{"key":"10.1016\/j.knosys.2026.115834_bib0046","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"15750","article-title":"Exploring simple siamese representation learning","author":"Chen","year":"2021"},{"key":"10.1016\/j.knosys.2026.115834_bib0047","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"248","article-title":"Imagenet: a large-scale hierarchical image database","author":"Deng","year":"2009"},{"issue":"4","key":"10.1016\/j.knosys.2026.115834_bib0048","first-page":"1","article-title":"Learning multiple layers of features from tiny images","volume":"1","author":"Krizhevsky","year":"2009","journal-title":"Handbook System. Autoimmune Diseas."},{"key":"10.1016\/j.knosys.2026.115834_bib0049","series-title":"Cs 231N","article-title":"Tiny imagenet visual recognition challenge","author":"Le","year":"2015"},{"key":"10.1016\/j.knosys.2026.115834_bib0050","series-title":"Sixth Indian Conference on Computer Vision, Graphics & Image Processing","first-page":"722","article-title":"Automated flower classification over a large number of classes","author":"Nilsback","year":"2008"},{"key":"10.1016\/j.knosys.2026.115834_bib0051","series-title":"IEEE Conference on Computer Vision and Pattern Recognition","first-page":"3498","article-title":"Cats and dogs","author":"Parkhi","year":"2012"},{"key":"10.1016\/j.knosys.2026.115834_bib0052","unstructured":"I. Loshchilov, Decoupled weight decay regularization, in: arXiv preprint arXiv: 1711.05101, 2017, pp. 1\u201319."},{"key":"10.1016\/j.knosys.2026.115834_bib0053","series-title":"Winter Conference on Applications of Computer Vision","first-page":"8035","article-title":"Local masked reconstruction for efficient self-Supervised learning on high-Resolution images","author":"Chen","year":"2025"},{"key":"10.1016\/j.knosys.2026.115834_bib0054","unstructured":"T. Darcet, F. Baldassarre, M. Oquab, J. Mairal, P. Bojanowski, Cluster and predict latent patches for improved masked image modeling, in: arXiv preprint arXiv: 2502.08769, 2025, pp. 1\u201326."},{"key":"10.1016\/j.knosys.2026.115834_bib0055","unstructured":"J. Zhou, C. Wei, H. Wang, W. Shen, C. Xie, A. Yuille, T. Kong, ibot: Image bert pre-training with online tokenizer, in: arXiv preprint arXiv: 2111.07832, 2021, pp. 1\u201329."}],"container-title":["Knowledge-Based Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0950705126005605?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0950705126005605?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,4,30]],"date-time":"2026-04-30T17:21:19Z","timestamp":1777569679000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0950705126005605"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,6]]},"references-count":55,"alternative-id":["S0950705126005605"],"URL":"https:\/\/doi.org\/10.1016\/j.knosys.2026.115834","relation":{},"ISSN":["0950-7051"],"issn-type":[{"value":"0950-7051","type":"print"}],"subject":[],"published":{"date-parts":[[2026,6]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Region-aware focused masked contrast for self-supervised representation learning","name":"articletitle","label":"Article Title"},{"value":"Knowledge-Based Systems","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.knosys.2026.115834","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier B.V. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"115834"}}