{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,11]],"date-time":"2026-06-11T17:08:45Z","timestamp":1781197725694,"version":"3.54.1"},"reference-count":39,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2026,2,25]],"date-time":"2026-02-25T00:00:00Z","timestamp":1771977600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"},{"start":{"date-parts":[[2026,5,12]],"date-time":"2026-05-12T00:00:00Z","timestamp":1778544000000},"content-version":"vor","delay-in-days":76,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62402459"],"award-info":[{"award-number":["62402459"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100012226","name":"Fundamental Research Funds for the Central Universities","doi-asserted-by":"publisher","award":["CUC25QT05"],"award-info":[{"award-number":["CUC25QT05"]}],"id":[{"id":"10.13039\/501100012226","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100012226","name":"Fundamental Research Funds for the Central Universities","doi-asserted-by":"publisher","award":["U2436208"],"award-info":[{"award-number":["U2436208"]}],"id":[{"id":"10.13039\/501100012226","id-type":"DOI","asserted-by":"publisher"}]},{"name":"the Foundation of Yunnan Key Laboratory of Smart Education","award":["YNSE2024C001"],"award-info":[{"award-number":["YNSE2024C001"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J. King Saud Univ. Comput. Inf. Sci."],"published-print":{"date-parts":[[2026,5]]},"DOI":"10.1007\/s44443-026-00570-4","type":"journal-article","created":{"date-parts":[[2026,2,25]],"date-time":"2026-02-25T16:05:45Z","timestamp":1772035545000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Beyond single image: modified saliency aggregation for universal attacks on STR models"],"prefix":"10.1007","volume":"38","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-8111-7566","authenticated-orcid":false,"given":"Yikun","family":"Xu","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0000-4545-8988","authenticated-orcid":false,"given":"Peibin","family":"Chen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0004-2369-4268","authenticated-orcid":false,"given":"Junfeng","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7070-5167","authenticated-orcid":false,"given":"Wanshan","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7293-1726","authenticated-orcid":false,"given":"Pengwen","family":"Dai","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,2,25]]},"reference":[{"key":"570_CR1","doi-asserted-by":"crossref","unstructured":"Bautista D, Atienza R (2022) Scene text recognition with permuted autoregressive sequence models. In: European conference on computer vision, Springer, pp 178\u2013196","DOI":"10.1007\/978-3-031-19815-1_11"},{"key":"570_CR2","doi-asserted-by":"crossref","unstructured":"Borisyuk F, Gordo A, Sivakumar V (2018) Rosetta: Large scale system for text detection and recognition in images. In: Proceedings of the 24th ACM SIGKDD international conference on knowledge discovery & data mining, pp 71\u201379","DOI":"10.1145\/3219819.3219861"},{"key":"570_CR3","doi-asserted-by":"crossref","unstructured":"Chen L, Sun J, Xu W (2021) Fawa: Fast adversarial watermark attack on optical character recognition (ocr) systems. In: Machine Learning and Knowledge Discovery in Databases: European Conference, ECML PKDD 2020, Ghent, Belgium, September 14\u201318, 2020, Proceedings, Part III, Springer, pp 547\u2013563","DOI":"10.1007\/978-3-030-67664-3_33"},{"issue":"25","key":"570_CR4","doi-asserted-by":"publisher","first-page":"38589","DOI":"10.1007\/s11042-023-15048-y","volume":"82","author":"S Ge","year":"2023","unstructured":"Ge S, Xia Z, Fei J et al (2023) A robust document image watermarking scheme using deep neural network. Multimedia Tools and Applications 82(25):38589\u201338612","journal-title":"Multimedia Tools and Applications"},{"key":"570_CR5","unstructured":"Goodfellow IJ, Shlens J, Szegedy C (2015) Explaining and harnessing adversarial examples. In: ICLR"},{"key":"570_CR6","doi-asserted-by":"crossref","unstructured":"Gupta A, Vedaldi A, Zisserman A (2016) Synthetic data for text localisation in natural images. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 2315\u20132324","DOI":"10.1109\/CVPR.2016.254"},{"key":"570_CR7","doi-asserted-by":"crossref","unstructured":"He Y, Chen K, Chen G et al (2023) Protego: Protect text content against ocr extraction attack. In: ACM MM, pp 7424\u20137434","DOI":"10.1145\/3581783.3612076"},{"key":"570_CR8","unstructured":"Jaderberg M, Simonyan K, Vedaldi A et al (2014) Synthetic data and artificial neural networks for natural scene text recognition. arXiv preprint arXiv:1406.2227"},{"key":"570_CR9","doi-asserted-by":"crossref","unstructured":"Karatzas D, Shafait F, Uchida S et al (2013) Icdar 2013 robust reading competition. In: 2013 12th international conference on document analysis and recognition, IEEE, pp 1484\u20131493","DOI":"10.1109\/ICDAR.2013.221"},{"key":"570_CR10","doi-asserted-by":"crossref","unstructured":"Karatzas D, Gomez-Bigorda L, Nicolaou A et al (2015) Icdar 2015 competition on robust reading. In: ICDAR, IEEE, pp 1156\u20131160","DOI":"10.1109\/ICDAR.2015.7333942"},{"key":"570_CR11","doi-asserted-by":"crossref","unstructured":"Kurakin A, Goodfellow IJ, Bengio S (2018) Adversarial examples in the physical world. In: Artificial intelligence safety and security. Chapman and Hall\/CRC, p 99\u2013112","DOI":"10.1201\/9781351251389-8"},{"key":"570_CR12","unstructured":"Li Y, Li L, Wang L et al (2019) Nattack: Learning the distributions of adversarial examples for an improved black-box attack on deep neural networks. In: ICML, pp 3866\u20133876"},{"key":"570_CR13","doi-asserted-by":"publisher","first-page":"84","DOI":"10.1007\/s10032-004-0138-z","volume":"7","author":"J Liang","year":"2005","unstructured":"Liang J, Doermann D, Li H (2005) Camera-based analysis of text and documents: a survey. IJDAR 7:84\u2013104","journal-title":"IJDAR"},{"key":"570_CR14","doi-asserted-by":"crossref","unstructured":"Liu H, Ji R, Li J et al (2019) Universal adversarial perturbation via prior driven uncertainty approximation. In: ICCV, pp 2941\u20132949","DOI":"10.1109\/ICCV.2019.00303"},{"key":"570_CR15","doi-asserted-by":"crossref","unstructured":"Liu W, Chen C, Wong KYK et al (2016) Star-net: a spatial attention residue network for scene text recognition. In: BMVC, p 7","DOI":"10.5244\/C.30.43"},{"key":"570_CR16","unstructured":"Madry A, Makelov A, Schmidt L et al (2018) Towards deep learning models resistant to adversarial attacks. In: ICLR"},{"key":"570_CR17","doi-asserted-by":"crossref","unstructured":"Mishra A, Alahari K, Jawahar C (2012) Scene text recognition using higher order language priors. In: BMVC, BMVA","DOI":"10.5244\/C.26.127"},{"key":"570_CR18","doi-asserted-by":"crossref","unstructured":"Moosavi-Dezfooli SM, Fawzi A, Frossard P (2016) Deepfool: a simple and accurate method to fool deep neural networks. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 2574\u20132582","DOI":"10.1109\/CVPR.2016.282"},{"key":"570_CR19","doi-asserted-by":"crossref","unstructured":"Moosavi-Dezfooli SM, Fawzi A, Fawzi O et al (2017) Universal adversarial perturbations. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 1765\u20131773","DOI":"10.1109\/CVPR.2017.17"},{"key":"570_CR20","doi-asserted-by":"crossref","unstructured":"Papernot N, McDaniel P, Jha S et al (2016) The limitations of deep learning in adversarial settings. In: 2016 IEEE European symposium on security and privacy (EuroS&P), IEEE, pp 372\u2013387","DOI":"10.1109\/EuroSP.2016.36"},{"key":"570_CR21","doi-asserted-by":"crossref","unstructured":"Reza MF, Rahmati A, Wu T et al (2023) Cgba: Curvature-aware geometric black-box attack. In: ICCV, pp 124\u2013133","DOI":"10.1109\/ICCV51070.2023.00018"},{"key":"570_CR22","doi-asserted-by":"crossref","unstructured":"Ribeiro MT, Singh S, Guestrin C (2016) \u201cwhy should i trust you?\u201d explaining the predictions of any classifier. In: Proceedings of the 22nd ACM SIGKDD international conference on knowledge discovery and data mining, pp 1135\u20131144","DOI":"10.1145\/2939672.2939778"},{"issue":"18","key":"570_CR23","doi-asserted-by":"publisher","first-page":"8027","DOI":"10.1016\/j.eswa.2014.07.008","volume":"41","author":"A Risnumawan","year":"2014","unstructured":"Risnumawan A, Shivakumara P, Chan CS et al (2014) A robust arbitrary text detection system for natural scene images. Expert Syst Appl 41(18):8027\u20138048","journal-title":"Expert Syst Appl"},{"key":"570_CR24","unstructured":"Selvaraju RR, Das A, Vedantam R et al (2016) Grad-cam: Why did you say that? arXiv preprint arXiv:1611.07450"},{"key":"570_CR25","doi-asserted-by":"crossref","unstructured":"Shi B, Bai X, Yao C (2016a) An end-to-end trainable neural network for image-based sequence recognition and its application to scene text recognition. IEEE Trans Pattern Anal Mach Intell 39(11):2298\u20132304","DOI":"10.1109\/TPAMI.2016.2646371"},{"key":"570_CR26","doi-asserted-by":"crossref","unstructured":"Shi B, Wang X, Lyu P et al (2016b) Robust scene text recognition with automatic rectification. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 4168\u20134176","DOI":"10.1109\/CVPR.2016.452"},{"key":"570_CR27","unstructured":"Song C, Shmatikov V (2018) Fooling ocr systems with adversarial text images. arXiv preprint arXiv:1802.05385"},{"key":"570_CR28","unstructured":"Szegedy C, Zaremba W, Sutskever I et al (2013) Intriguing properties of neural networks. arXiv preprint arXiv:1312.6199"},{"key":"570_CR29","unstructured":"Vo VQ, Abbasnejad E, Ranasinghe DC (2024) Brusleattack: A query-efficient score-based black-box sparse adversarial attack. arXiv preprint arXiv:2404.05311"},{"key":"570_CR30","doi-asserted-by":"crossref","unstructured":"Wang K, Babenko B, Belongie S (2011) End-to-end scene text recognition. In: ICCV, IEEE, pp 1457\u20131464","DOI":"10.1109\/ICCV.2011.6126402"},{"key":"570_CR31","doi-asserted-by":"crossref","unstructured":"Wu H, Yunas S, Rowlands S et al (2023) Adversarial driving: Attacking end-to-end autonomous driving. In: 2023 IEEE Intelligent Vehicles Symposium (IV). IEEE, p 1\u20137","DOI":"10.1109\/IV55152.2023.10186386"},{"key":"570_CR32","doi-asserted-by":"crossref","unstructured":"Xu X, Chen J, Xiao J et al (2020) What machines see is not what they get: Fooling scene text recognition models with adversarial text images. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 12304\u201312314","DOI":"10.1109\/CVPR42600.2020.01232"},{"key":"570_CR33","doi-asserted-by":"crossref","unstructured":"Xu Y, Dai P, Cao X (2021) Less is better: Fooling scene text recognition with minimal perturbations. In: ICONIP, Springer, pp 537\u2013544","DOI":"10.1007\/978-3-030-92310-5_62"},{"key":"570_CR34","doi-asserted-by":"publisher","first-page":"1580","DOI":"10.1109\/TIFS.2023.3245984","volume":"18","author":"Y Xu","year":"2023","unstructured":"Xu Y, Dai P, Li Z et al (2023) The best protection is attack: Fooling scene text recognition with minimal pixels. IEEE Trans Inf Forensics Secur 18:1580\u20131595","journal-title":"IEEE Trans Inf Forensics Secur"},{"key":"570_CR35","doi-asserted-by":"crossref","unstructured":"Yang M, Zheng H, Bai X et al (2021) Cost-effective adversarial attacks against scene text recognition. In: ICPR, IEEE, pp 2368\u20132374","DOI":"10.1109\/ICPR48806.2021.9412914"},{"key":"570_CR36","doi-asserted-by":"crossref","unstructured":"Yuan X, He P, Lit X et al (2020) Adaptive adversarial attack on scene text recognition. In: IEEE INFOCOM 2020-IEEE Conference on Computer Communications Workshops (INFOCOM WKSHPS), IEEE, pp 358\u2013363","DOI":"10.1109\/INFOCOMWKSHPS50562.2020.9162685"},{"key":"570_CR37","doi-asserted-by":"crossref","unstructured":"Zha M, Meng G, Lin C et al (2020) Rolma: a practical adversarial attack against deep learning-based lpr systems. In: Information Security and Cryptology: 15th International Conference, Inscrypt 2019, Nanjing, China, December 6\u20138, 2019, Revised Selected Papers 15, Springer, pp 101\u2013117","DOI":"10.1007\/978-3-030-42921-8_6"},{"key":"570_CR38","doi-asserted-by":"publisher","first-page":"2575","DOI":"10.1109\/TMM.2020.3013376","volume":"23","author":"J Zhang","year":"2020","unstructured":"Zhang J, Sang J, Xu K et al (2020) Robust captchas towards malicious ocr. IEEE Trans Multimedia 23:2575\u20132587","journal-title":"IEEE Trans Multimedia"},{"issue":"1","key":"570_CR39","doi-asserted-by":"publisher","first-page":"209","DOI":"10.1109\/TITS.2017.2768827","volume":"19","author":"Y Zhu","year":"2017","unstructured":"Zhu Y, Liao M, Yang M et al (2017) Cascaded segmentation-detection networks for text-based traffic sign detection. IEEE Trans Intell Transp Syst 19(1):209\u2013219","journal-title":"IEEE Trans Intell Transp Syst"}],"container-title":["Journal of King Saud University Computer and Information Sciences"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s44443-026-00570-4","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s44443-026-00570-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s44443-026-00570-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,11]],"date-time":"2026-06-11T16:44:20Z","timestamp":1781196260000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s44443-026-00570-4"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,2,25]]},"references-count":39,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2026,5]]}},"alternative-id":["570"],"URL":"https:\/\/doi.org\/10.1007\/s44443-026-00570-4","relation":{},"ISSN":["1319-1578","2213-1248"],"issn-type":[{"value":"1319-1578","type":"print"},{"value":"2213-1248","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,2,25]]},"assertion":[{"value":"19 September 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"9 February 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"25 February 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"No potential conflict of interest was reported by the authors.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of Interest"}},{"value":"Not applicable.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethics approval and consent to participate"}}],"article-number":"168"}}