{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T23:17:54Z","timestamp":1783207074716,"version":"3.54.6"},"reference-count":43,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,4,24]],"date-time":"2026-04-24T00:00:00Z","timestamp":1776988800000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/creativecommons.org\/licenses\/by\/4.0\/"}],"funder":[{"DOI":"10.13039\/501100000780","name":"European Commission","doi-asserted-by":"publisher","award":["CZ.10.03.01\/00\/22_003\/0000048"],"award-info":[{"award-number":["CZ.10.03.01\/00\/22_003\/0000048"]}],"id":[{"id":"10.13039\/501100000780","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Computer Vision and Image Understanding"],"published-print":{"date-parts":[[2026,6]]},"DOI":"10.1016\/j.cviu.2026.104767","type":"journal-article","created":{"date-parts":[[2026,4,30]],"date-time":"2026-04-30T20:25:16Z","timestamp":1777580716000},"page":"104767","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["Resolution-invariant no-box attack"],"prefix":"10.1016","volume":"269","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-5525-7706","authenticated-orcid":false,"given":"Petr","family":"Dvo\u0159\u00e1\u010dek","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4349-9705","authenticated-orcid":false,"given":"Petr","family":"Hurtik","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7879-1397","authenticated-orcid":false,"given":"Petra","family":"\u0160tevuli\u00e1kov\u00e1","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.cviu.2026.104767_b1","series-title":"Adversarial robustness comparison of vision transformer and MLP-mixer to CNNs","author":"Benz","year":"2021"},{"issue":"12","key":"10.1016\/j.cviu.2026.104767_b2","doi-asserted-by":"crossref","first-page":"144","DOI":"10.3390\/sym8120144","article-title":"Using convolutional neural network filters to measure left-right mirror symmetry in images","volume":"8","author":"Brachmann","year":"2016","journal-title":"Symmetry"},{"key":"10.1016\/j.cviu.2026.104767_b3","first-page":"10470","article-title":"Incremental multi-domain learning with network latent tensor factorization","volume":"vol. 34","author":"Bulat","year":"2020"},{"key":"10.1016\/j.cviu.2026.104767_b4","series-title":"2017 IEEE Symposium on Security and Privacy","first-page":"39","article-title":"Towards evaluating the robustness of neural networks","author":"Carlini","year":"2017"},{"key":"10.1016\/j.cviu.2026.104767_b5","doi-asserted-by":"crossref","unstructured":"Chen,\u00a0Pin-Yu, Zhang,\u00a0Huan, Sharma,\u00a0Yash, Yi,\u00a0Jinfeng, Hsieh,\u00a0Cho-Jui, 2017. Zoo: Zeroth order optimization based black-box attacks to deep neural networks without training substitute models. In: Proceedings of the 10th ACM Workshop on Artificial Intelligence and Security. pp. 15\u201326.","DOI":"10.1145\/3128572.3140448"},{"key":"10.1016\/j.cviu.2026.104767_b6","series-title":"2016 IEEE Conference on Computer Vision and Pattern Recognition","first-page":"3213","article-title":"The cityscapes dataset for semantic urban scene understanding","author":"Cordts","year":"2016"},{"key":"10.1016\/j.cviu.2026.104767_b7","series-title":"2009 IEEE Conference on Computer Vision and Pattern Recognition","first-page":"248","article-title":"Imagenet: A large-scale hierarchical image database","author":"Deng","year":"2009"},{"key":"10.1016\/j.cviu.2026.104767_b8","doi-asserted-by":"crossref","unstructured":"Dong,\u00a0Yinpeng, Liao,\u00a0Fangzhou, Pang,\u00a0Tianyu, Su,\u00a0Hang, Zhu,\u00a0Jun, Hu,\u00a0Xiaolin, Li,\u00a0Jianguo, 2018. Boosting adversarial attacks with momentum. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 9185\u20139193.","DOI":"10.1109\/CVPR.2018.00957"},{"key":"10.1016\/j.cviu.2026.104767_b9","series-title":"Transformers for image recognition at scale","author":"Dosovitskiy","year":"2020"},{"key":"10.1016\/j.cviu.2026.104767_b10","series-title":"Effective black box adversarial attack with handcrafted kernels","author":"Dvo\u0159\u00e1\u010dek","year":"2023"},{"key":"10.1016\/j.cviu.2026.104767_b11","series-title":"Explaining and harnessing adversarial examples","author":"Goodfellow","year":"2014"},{"key":"10.1016\/j.cviu.2026.104767_b12","doi-asserted-by":"crossref","unstructured":"He,\u00a0Kaiming, Zhang,\u00a0Xiangyu, Ren,\u00a0Shaoqing, Sun,\u00a0Jian, 2016a. Deep residual learning for image recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 770\u2013778.","DOI":"10.1109\/CVPR.2016.90"},{"key":"10.1016\/j.cviu.2026.104767_b13","series-title":"Computer Vision\u2013ECCV 2016: 14th European Conference, Amsterdam, the Netherlands, October 11\u201314, 2016, Proceedings, Part IV 14","first-page":"630","article-title":"Identity mappings in deep residual networks","author":"He","year":"2016"},{"key":"10.1016\/j.cviu.2026.104767_b14","doi-asserted-by":"crossref","unstructured":"Huang,\u00a0Gao, Liu,\u00a0Zhuang, Van Der\u00a0Maaten,\u00a0Laurens, Weinberger,\u00a0Kilian\u00a0Q., 2017. Densely connected convolutional networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 4700\u20134708.","DOI":"10.1109\/CVPR.2017.243"},{"key":"10.1016\/j.cviu.2026.104767_b15","series-title":"Learning multiple layers of features from tiny images","author":"Krizhevsky","year":"2009"},{"key":"10.1016\/j.cviu.2026.104767_b16","series-title":"Adversarial examples in the physical world","author":"Kurakin","year":"2016"},{"key":"10.1016\/j.cviu.2026.104767_b17","doi-asserted-by":"crossref","unstructured":"Ledig,\u00a0Christian, Theis,\u00a0Lucas, Husz\u00e1r,\u00a0Ferenc, Caballero,\u00a0Jose, Cunningham,\u00a0Andrew, Acosta,\u00a0Alejandro, Aitken,\u00a0Andrew, Tejani,\u00a0Alykhan, Totz,\u00a0Johannes, Wang,\u00a0Zehan, et al., 2017. Photo-realistic single image super-resolution using a generative adversarial network. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 4681\u20134690.","DOI":"10.1109\/CVPR.2017.19"},{"key":"10.1016\/j.cviu.2026.104767_b18","first-page":"12849","article-title":"Practical no-box adversarial attacks against dnns","volume":"33","author":"Li","year":"2020","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.cviu.2026.104767_b19","series-title":"Computer Vision \u2013 ECCV 2014","isbn-type":"print","doi-asserted-by":"crossref","first-page":"740","DOI":"10.1007\/978-3-319-10602-1_48","article-title":"Microsoft COCO: Common objects in context","author":"Lin","year":"2014","ISBN":"https:\/\/id.crossref.org\/isbn\/9783319106021"},{"key":"10.1016\/j.cviu.2026.104767_b20","series-title":"Nesterov accelerated gradient and scale invariance for adversarial attacks","author":"Lin","year":"2019"},{"key":"10.1016\/j.cviu.2026.104767_b21","series-title":"Delving into transferable adversarial examples and black-box attacks","author":"Liu","year":"2016"},{"key":"10.1016\/j.cviu.2026.104767_b22","doi-asserted-by":"crossref","unstructured":"Liu,\u00a0Ze, Lin,\u00a0Yutong, Cao,\u00a0Yue, Hu,\u00a0Han, Wei,\u00a0Yixuan, Zhang,\u00a0Zheng, Lin,\u00a0Stephen, Guo,\u00a0Baining, 2021. Swin transformer: Hierarchical vision transformer using shifted windows. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision. pp. 10012\u201310022.","DOI":"10.1109\/ICCV48922.2021.00986"},{"key":"10.1016\/j.cviu.2026.104767_b23","series-title":"Sgdr: Stochastic gradient descent with warm restarts","author":"Loshchilov","year":"2016"},{"key":"10.1016\/j.cviu.2026.104767_b24","series-title":"Transferability in machine learning: from phenomena to black-box attacks using adversarial samples","author":"Papernot","year":"2016"},{"key":"10.1016\/j.cviu.2026.104767_b25","series-title":"How do vision transformers work?","author":"Park","year":"2022"},{"key":"10.1016\/j.cviu.2026.104767_b26","doi-asserted-by":"crossref","DOI":"10.1016\/j.cviu.2024.104140","article-title":"Targeted adversarial attack on classic vision pipelines","volume":"249","author":"Riaz","year":"2024","journal-title":"Comput. Vis. Image Underst.","ISSN":"https:\/\/id.crossref.org\/issn\/1077-3142","issn-type":"print"},{"key":"10.1016\/j.cviu.2026.104767_b27","series-title":"Medical Image Computing and Computer-Assisted Intervention\u2013MICCAI 2015: 18th International Conference, Munich, Germany, October 5-9, 2015, Proceedings, Part III 18","first-page":"234","article-title":"U-net: Convolutional networks for biomedical image segmentation","author":"Ronneberger","year":"2015"},{"key":"10.1016\/j.cviu.2026.104767_b28","series-title":"Very deep convolutional networks for large-scale image recognition","author":"Simonyan","year":"2014"},{"key":"10.1016\/j.cviu.2026.104767_b29","series-title":"Very deep convolutional networks for large-scale image recognition","author":"Simonyan","year":"2014"},{"issue":"5","key":"10.1016\/j.cviu.2026.104767_b30","doi-asserted-by":"crossref","first-page":"828","DOI":"10.1109\/TEVC.2019.2890858","article-title":"One pixel attack for fooling deep neural networks","volume":"23","author":"Su","year":"2019","journal-title":"IEEE Trans. Evol. Comput."},{"key":"10.1016\/j.cviu.2026.104767_b31","doi-asserted-by":"crossref","unstructured":"Szegedy,\u00a0Christian, Vanhoucke,\u00a0Vincent, Ioffe,\u00a0Sergey, Shlens,\u00a0Jon, Wojna,\u00a0Zbigniew, 2016. Rethinking the inception architecture for computer vision. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 2818\u20132826.","DOI":"10.1109\/CVPR.2016.308"},{"key":"10.1016\/j.cviu.2026.104767_b32","series-title":"Intriguing properties of neural networks","author":"Szegedy","year":"2013"},{"key":"10.1016\/j.cviu.2026.104767_b33","series-title":"International Conference on Machine Learning","first-page":"6105","article-title":"Efficientnet: Rethinking model scaling for convolutional neural networks","author":"Tan","year":"2019"},{"key":"10.1016\/j.cviu.2026.104767_b34","first-page":"10347","article-title":"Training data-efficient image transformers & distillation through attention","volume":"vol. 139","author":"Touvron","year":"2021"},{"key":"10.1016\/j.cviu.2026.104767_b35","series-title":"International Conference on Machine Learning","first-page":"10347","article-title":"Training data-efficient image transformers & distillation through attention","author":"Touvron","year":"2021"},{"key":"10.1016\/j.cviu.2026.104767_b36","first-page":"5553","article-title":"Ags: Affordable and generalizable substitute training for transferable adversarial attack","volume":"vol. 38","author":"Wang","year":"2024"},{"key":"10.1016\/j.cviu.2026.104767_b37","doi-asserted-by":"crossref","unstructured":"Xie,\u00a0Cihang, Zhang,\u00a0Zhishuai, Zhou,\u00a0Yuyin, Bai,\u00a0Song, Wang,\u00a0Jianyu, Ren,\u00a0Zhou, Yuille,\u00a0Alan\u00a0L., 2019. Improving transferability of adversarial examples with input diversity. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 2730\u20132739.","DOI":"10.1109\/CVPR.2019.00284"},{"issue":"8","key":"10.1016\/j.cviu.2026.104767_b38","doi-asserted-by":"crossref","first-page":"5663","DOI":"10.1109\/TPAMI.2024.3367773","article-title":"Adaptive perturbation for adversarial attack","volume":"46","author":"Yuan","year":"2024","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.cviu.2026.104767_b39","series-title":"CVPR","article-title":"Scaling vision transformers","author":"Zhai","year":"2022"},{"key":"10.1016\/j.cviu.2026.104767_b40","unstructured":"Zhang,\u00a0Qilong, Li,\u00a0Xiaodan, Chen,\u00a0YueFeng, Song,\u00a0Jingkuan, Gao,\u00a0Lianli, He,\u00a0Yuan, et al., 2022a. Beyond ImageNet Attack: Towards Crafting Adversarial Examples for Black-box Domains. In: International Conference on Learning Representations."},{"key":"10.1016\/j.cviu.2026.104767_b41","series-title":"2017 IEEE Conference on Computer Vision and Pattern Recognition","first-page":"4352","article-title":"Age progression\/regression by conditional adversarial autoencoder","author":"Zhang","year":"2017"},{"key":"10.1016\/j.cviu.2026.104767_b42","series-title":"Practical no-box adversarial attacks with training-free hybrid image transformation","author":"Zhang","year":"2022"},{"key":"10.1016\/j.cviu.2026.104767_b43","series-title":"Transformers without normalization","author":"Zhu","year":"2025"}],"container-title":["Computer Vision and Image Understanding"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1077314226001347?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1077314226001347?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T22:40:30Z","timestamp":1783204830000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S1077314226001347"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,6]]},"references-count":43,"alternative-id":["S1077314226001347"],"URL":"https:\/\/doi.org\/10.1016\/j.cviu.2026.104767","relation":{},"ISSN":["1077-3142"],"issn-type":[{"value":"1077-3142","type":"print"}],"subject":[],"published":{"date-parts":[[2026,6]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Resolution-invariant no-box attack","name":"articletitle","label":"Article Title"},{"value":"Computer Vision and Image Understanding","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.cviu.2026.104767","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 The Author(s). Published by Elsevier Inc.","name":"copyright","label":"Copyright"}],"article-number":"104767"}}