{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,2]],"date-time":"2026-01-02T00:05:24Z","timestamp":1767312324506,"version":"3.48.0"},"publisher-location":"Cham","reference-count":35,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783032093707","type":"print"},{"value":"9783032093714","type":"electronic"}],"license":[{"start":{"date-parts":[[2026,1,1]],"date-time":"2026-01-01T00:00:00Z","timestamp":1767225600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,1,1]],"date-time":"2026-01-01T00:00:00Z","timestamp":1767225600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2026]]},"DOI":"10.1007\/978-3-032-09371-4_20","type":"book-chapter","created":{"date-parts":[[2026,1,2]],"date-time":"2026-01-02T00:01:16Z","timestamp":1767312076000},"page":"329-346","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["ClapperText: A Benchmark for\u00a0Text Recognition in\u00a0Low-Resource Archival Documents"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0009-0008-9825-686X","authenticated-orcid":false,"given":"Tingyu","family":"Lin","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-6843-0830","authenticated-orcid":false,"given":"Marco","family":"Peer","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8351-5066","authenticated-orcid":false,"given":"Florian","family":"Kleber","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4195-1593","authenticated-orcid":false,"given":"Robert","family":"Sablatnig","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2026,1,2]]},"reference":[{"issue":"2","key":"20_CR1","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3440756","volume":"54","author":"X Chen","year":"2021","unstructured":"Chen, X., Jin, L., Zhu, Y., Luo, C., Wang, T.: Text recognition in the wild: a survey. ACM Comput. Surv. (CSUR) 54(2), 1\u201335 (2021)","journal-title":"ACM Comput. Surv. (CSUR)"},{"key":"20_CR2","doi-asserted-by":"crossref","unstructured":"Ch\u2019ng, C.K., Chan, C.S.: Total-text: A comprehensive dataset for scene text detection and recognition. In: 2017 14th IAPR International Conference On Document Analysis And Recognition (ICDAR). vol.\u00a01, pp. 935\u2013942. IEEE (2017)","DOI":"10.1109\/ICDAR.2017.157"},{"key":"20_CR3","doi-asserted-by":"crossref","unstructured":"Cl\u00e9rice, T., et\u00a0al.: Catmus medieval: a multilingual large-scale cross-century dataset in latin script for handwritten text recognition and beyond. In: International Conference on Document Analysis and Recognition, pp. 174\u2013194. Springer (2024)","DOI":"10.1007\/978-3-031-70543-4_11"},{"key":"20_CR4","doi-asserted-by":"publisher","DOI":"10.5281\/zenodo.12771595","author":"C Corporation","year":"2024","unstructured":"Corporation, C.: Computer vision annotation tool (cvat) (2024). https:\/\/doi.org\/10.5281\/zenodo.12771595","journal-title":"Computer vision annotation tool (cvat)"},{"key":"20_CR5","doi-asserted-by":"crossref","unstructured":"Du, Y., et al.: Svtr: scene text recognition with a single visual model. In: Raedt, L.D. (ed.) Proceedings of the Thirty-First International Joint Conference on Artificial Intelligence, IJCAI-22, pp. 884\u2013890. International Joint Conferences on Artificial Intelligence Organization (7 2022)","DOI":"10.24963\/ijcai.2022\/124"},{"key":"20_CR6","doi-asserted-by":"crossref","unstructured":"Gupta, A., Vedaldi, A., Zisserman, A.: Synthetic data for text localisation in natural images. In: IEEE Conference on Computer Vision and Pattern Recognition (2016)","DOI":"10.1109\/CVPR.2016.254"},{"key":"20_CR7","doi-asserted-by":"crossref","unstructured":"He, K., Gkioxari, G., Doll\u00e1r, P., Girshick, R.: Mask r-CNN. In: 2017 IEEE International Conference on Computer Vision (ICCV), pp. 2980\u20132988 (2017)","DOI":"10.1109\/ICCV.2017.322"},{"key":"20_CR8","doi-asserted-by":"crossref","unstructured":"Helm, D., Jogl, F., Kampel, M.: Historian: a large-scale historical film dataset with cinematographic annotation. In: 2022 IEEE International Conference on Image Processing (ICIP), pp. 2087\u20132091 (2022)","DOI":"10.1109\/ICIP46576.2022.9897300"},{"key":"20_CR9","unstructured":"Jaderberg, M., Simonyan, K., Vedaldi, A., Zisserman, A.: Synthetic data and artificial neural networks for natural scene text recognition. In: Workshop on Deep Learning, NIPS (2014)"},{"issue":"1","key":"20_CR10","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s11263-015-0823-z","volume":"116","author":"M Jaderberg","year":"2016","unstructured":"Jaderberg, M., Simonyan, K., Vedaldi, A., Zisserman, A.: Reading text in the wild with convolutional neural networks. Int. J. Comput. Vision 116(1), 1\u201320 (2016)","journal-title":"Int. J. Comput. Vision"},{"key":"20_CR11","doi-asserted-by":"crossref","unstructured":"Karatzas, D., et\u00a0al.: ICDAR 2015 competition on robust reading. In: 2015 13th International Conference on Document Analysis and Recognition (ICDAR), pp. 1156\u20131160. IEEE (2015)","DOI":"10.1109\/ICDAR.2015.7333942"},{"key":"20_CR12","doi-asserted-by":"crossref","unstructured":"Karatzas, D., et al.: ICDAR 2013 robust reading competition. In: 2013 12th International Conference on Document Analysis and Recognition, pp. 1484\u20131493 (2013)","DOI":"10.1109\/ICDAR.2013.221"},{"key":"20_CR13","doi-asserted-by":"crossref","unstructured":"Kleber, F., Fiel, S., Diem, M., Sablatnig, R.: CVL-database: an off-line database for writer retrieval, writer identification and word spotting. In: 2013 12th International Conference on Document Analysis and Recognition, pp. 560\u2013564. IEEE (2013)","DOI":"10.1109\/ICDAR.2013.117"},{"key":"20_CR14","doi-asserted-by":"crossref","unstructured":"Li, H., Wang, P., Shen, C., Zhang, G.: Show, attend and read: a simple and strong baseline for irregular text recognition. In: Proceedings of the AAAI Conference on Artificial Intelligence. vol.\u00a033, pp. 8610\u20138617 (2019)","DOI":"10.1609\/aaai.v33i01.33018610"},{"key":"20_CR15","doi-asserted-by":"crossref","unstructured":"Liao, M., Wan, Z., Yao, C., Chen, K., Bai, X.: Real-time scene text detection with differentiable binarization. In: Proceedings of the AAAI Conference on Artificial Intelligence, pp. 11474\u201311481 (2020)","DOI":"10.1609\/aaai.v34i07.6812"},{"key":"20_CR16","doi-asserted-by":"crossref","unstructured":"Liao, M., Zou, Z., Wan, Z., Yao, C., Bai, X.: Real-time scene text detection with differentiable binarization and adaptive scale fusion. IEEE Trans. Patt. Anal. Mach. Intell. (2022)","DOI":"10.1109\/TPAMI.2022.3155612"},{"issue":"1","key":"20_CR17","doi-asserted-by":"publisher","first-page":"161","DOI":"10.1007\/s11263-020-01369-0","volume":"129","author":"S Long","year":"2021","unstructured":"Long, S., He, X., Yao, C.: Scene text detection and recognition: the deep learning era. Int. J. Comput. Vision 129(1), 161\u2013184 (2021)","journal-title":"Int. J. Comput. Vision"},{"key":"20_CR18","doi-asserted-by":"crossref","unstructured":"Long, S., Qin, S., Panteleev, D., Bissacco, A., Fujii, Y., Raptis, M.: Towards end-to-end unified scene text detection and layout analysis. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 1049\u20131059 (2022)","DOI":"10.1109\/CVPR52688.2022.00112"},{"key":"20_CR19","doi-asserted-by":"crossref","unstructured":"Long, S., Ruan, J., Zhang, W., He, X., Wu, W., Yao, C.: Textsnake: a flexible representation for detecting text of arbitrary shapes, pp. 20\u201336 (2018)","DOI":"10.1007\/978-3-030-01216-8_2"},{"key":"20_CR20","doi-asserted-by":"crossref","unstructured":"Lu, N., Yu, W., Qi, X., Chen, Y., Gong, P., Xiao, R., Bai, X.: Master: multi-aspect non-local network for scene text recognition. Patt. Recogn. (2021)","DOI":"10.1016\/j.patcog.2021.107980"},{"key":"20_CR21","doi-asserted-by":"crossref","unstructured":"Lucas, S., Panaretos, A., Sosa, L., Tang, A., Wong, S., Young, R.: ICDAR 2003 robust reading competitions. In: Seventh International Conference on Document Analysis and Recognition, 2003. Proceedings, pp. 682\u2013687 (2003)","DOI":"10.1109\/ICDAR.2003.1227749"},{"key":"20_CR22","doi-asserted-by":"publisher","first-page":"39","DOI":"10.1007\/s100320200071","volume":"5","author":"UV Marti","year":"2002","unstructured":"Marti, U.V., Bunke, H.: The iam-database: an english sentence database for offline handwriting recognition. Int. J. Doc. Anal. Recogn. 5, 39\u201346 (2002)","journal-title":"Int. J. Doc. Anal. Recogn."},{"key":"20_CR23","doi-asserted-by":"crossref","unstructured":"Mishra, A., Alahari, K., Jawahar, C.V.: Scene text recognition using higher order language priors. In: BMVC (2012)","DOI":"10.5244\/C.26.127"},{"key":"20_CR24","doi-asserted-by":"crossref","unstructured":"Mondal, A., Tulsyan, K., Jawahar, C.: Bridging the gap in resource for offline english handwritten text recognition. In: International Conference on Document Analysis and Recognition, pp. 413\u2013428. Springer (2024)","DOI":"10.1007\/978-3-031-70536-6_25"},{"key":"20_CR25","doi-asserted-by":"crossref","unstructured":"Reddy, S., Mathew, M., Gomez, L., Rusinol, M., Karatzas, D., Jawahar, C.: Roadtext-1k: text detection & recognition dataset for driving videos. In: 2020 IEEE International Conference on Robotics and Automation (ICRA), pp. 11074\u201311080. IEEE (2020)","DOI":"10.1109\/ICRA40945.2020.9196577"},{"key":"20_CR26","doi-asserted-by":"crossref","unstructured":"Sheng, F., Chen, Z., Xu, B.: NRTR: a no-recurrence sequence-to-sequence model for scene text recognition. In: 2019 International Conference on Document Analysis and Recognition (ICDAR), pp. 781\u2013786. IEEE (2019)","DOI":"10.1109\/ICDAR.2019.00130"},{"key":"20_CR27","doi-asserted-by":"crossref","unstructured":"Shi, B., Bai, X., Yao, C.: An end-to-end trainable neural network for image-based sequence recognition and its application to scene text recognition. IEEE Trans. Patt Anal. Mach. Intell. (2016)","DOI":"10.1109\/TPAMI.2016.2646371"},{"issue":"3","key":"20_CR28","doi-asserted-by":"publisher","first-page":"542","DOI":"10.1109\/TPAMI.2017.2692763","volume":"40","author":"S Tian","year":"2017","unstructured":"Tian, S., Yin, X.C., Su, Y., Hao, H.W.: A unified framework for tracking based text detection and recognition from web videos. IEEE Trans. Pattern Anal. Mach. Intell. 40(3), 542\u2013554 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"20_CR29","unstructured":"Veit, A., Matera, T., Neumann, L., Matas, J., Belongie, S.: Coco-text: dataset and benchmark for text detection and recognition in natural images. arXiv preprint arXiv:1601.07140 (2016)"},{"key":"20_CR30","doi-asserted-by":"crossref","unstructured":"Wang, W., Xie, E., Li, X., Hou, W., Lu, T., Yu, G., Shao, S.: Shape robust text detection with progressive scale expansion network. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 9336\u20139345 (2019)","DOI":"10.1109\/CVPR.2019.00956"},{"key":"20_CR31","doi-asserted-by":"crossref","unstructured":"Wang, W., et al.: Efficient and accurate arbitrary-shaped text detection with pixel aggregation network. In: ICCV, pp. 8439\u20138448 (2019)","DOI":"10.1109\/ICCV.2019.00853"},{"key":"20_CR32","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2023.126702","volume":"556","author":"XF Wang","year":"2023","unstructured":"Wang, X.F., He, Z.H., Wang, K., Wang, Y.F., Zou, L., Wu, Z.Z.: A survey of text detection and recognition algorithms based on deep learning technology. Neurocomputing 556, 126702 (2023)","journal-title":"Neurocomputing"},{"key":"20_CR33","doi-asserted-by":"crossref","unstructured":"Wang, Y., Xie, H., Fang, S., Wang, J., Zhu, S., Zhang, Y.: From two to one: a new scene text recognizer with visual language modeling network. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 14194\u201314203 (2021)","DOI":"10.1109\/ICCV48922.2021.01393"},{"key":"20_CR34","doi-asserted-by":"crossref","unstructured":"Yue, X., Kuang, Z., Lin, C., Sun, H., Zhang, W.: Robustscanner: dynamically enhancing positional clues for robust text recognition. In: European Conference on Computer Vision (2020)","DOI":"10.1007\/978-3-030-58529-7_9"},{"key":"20_CR35","doi-asserted-by":"crossref","unstructured":"Zhu, Y., Chen, J., Liang, L., Kuang, Z., Jin, L., Zhang, W.: Fourier contour embedding for arbitrary-shaped text detection. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.00314"}],"container-title":["Lecture Notes in Computer Science","Document Analysis and Recognition \u2013 ICDAR 2025 Workshops"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-032-09371-4_20","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,1,2]],"date-time":"2026-01-02T00:01:20Z","timestamp":1767312080000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-032-09371-4_20"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026]]},"ISBN":["9783032093707","9783032093714"],"references-count":35,"URL":"https:\/\/doi.org\/10.1007\/978-3-032-09371-4_20","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026]]},"assertion":[{"value":"2 January 2026","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ICDAR","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Document Analysis and Recognition","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Wuhan","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"China","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2025","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"16 September 2025","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"21 September 2025","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"18","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"icdar2025","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/iapr.org\/icdar2025","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}