{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,9]],"date-time":"2025-12-09T04:27:14Z","timestamp":1765254434043,"version":"3.40.3"},"publisher-location":"Cham","reference-count":30,"publisher":"Springer Nature Switzerland","isbn-type":[{"type":"print","value":"9783031781186"},{"type":"electronic","value":"9783031781193"}],"license":[{"start":{"date-parts":[[2024,12,5]],"date-time":"2024-12-05T00:00:00Z","timestamp":1733356800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,12,5]],"date-time":"2024-12-05T00:00:00Z","timestamp":1733356800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-78119-3_3","type":"book-chapter","created":{"date-parts":[[2024,12,4]],"date-time":"2024-12-04T02:01:17Z","timestamp":1733277677000},"page":"29-44","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["DocHFormer: Document Image Dewarping via\u00a0Harmonized Modeling of\u00a0Hierarchical Priors"],"prefix":"10.1007","author":[{"given":"Xinyue","family":"Zhou","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Guanting","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Nanfeng","family":"Jiang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Da-Han","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xu-Yao","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"ShunZhi","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,12,5]]},"reference":[{"key":"3_CR1","doi-asserted-by":"crossref","unstructured":"Meng, G., Wang, Y., Qu, S., Xiang, S., Pan, C.: Active flattening of curved document images via two structured beams. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3890\u20133897 (2014)","DOI":"10.1109\/CVPR.2014.497"},{"issue":"2","key":"3_CR2","doi-asserted-by":"publisher","first-page":"505","DOI":"10.1109\/TPAMI.2017.2675980","volume":"40","author":"S You","year":"2017","unstructured":"You, S., Matsushita, Y., Sinha, S., Bou, Y., Ikeuchi, K.: Multiview rectification of folded documents. IEEE Trans. Pattern Anal. Mach. Intell. 40(2), 505\u2013511 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"3_CR3","doi-asserted-by":"crossref","unstructured":"He, Y., Pan, P., Xie, S., Sun, J., Naoi, S.: A book dewarping system by boundary-based 3D surface reconstruction. In: 2013 12Th International Conference on Document Analysis and Recognition, pp. 403\u2013407. IEEE (2013)","DOI":"10.1109\/ICDAR.2013.88"},{"key":"3_CR4","doi-asserted-by":"publisher","first-page":"111","DOI":"10.1007\/s10032-014-0233-8","volume":"18","author":"C Liu","year":"2015","unstructured":"Liu, C., Zhang, Y., Wang, B., Ding, X.: Restoring camera-captured distorted document images. Int. J. Doc. Anal. Recogn. (IJDAR) 18, 111\u2013124 (2015)","journal-title":"Int. J. Doc. Anal. Recogn. (IJDAR)"},{"issue":"4","key":"3_CR5","doi-asserted-by":"publisher","first-page":"728","DOI":"10.1109\/TPAMI.2007.70831","volume":"30","author":"L Zhang","year":"2008","unstructured":"Zhang, L., Zhang, Y., Tan, C.: An improved physically-based method for geometric restoration of distorted document images. IEEE Trans. Pattern Anal. Mach. Intell. 30(4), 728\u2013734 (2008)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"3_CR6","doi-asserted-by":"crossref","unstructured":"Ma, K., Shu, Z., Bai, X., Wang, J., Samaras, D.: DocUNet: document image unwarping via a stacked U-Net. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4700\u20134709 (2018)","DOI":"10.1109\/CVPR.2018.00494"},{"key":"3_CR7","doi-asserted-by":"crossref","unstructured":"Das, S., Ma, K., Shu, Z., Samaras, D., Shilkrot, R.: DewarpNet: single-image document unwarping with stacked 3D and 2D regression networks. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 131\u2013140 (2019)","DOI":"10.1109\/ICCV.2019.00022"},{"key":"3_CR8","doi-asserted-by":"crossref","unstructured":"Xie, G.-W., Yin, F., Zhang, X.-Y., Liu, C.-L.: Dewarping document image by displacement flow estimation with fully convolutional network. In: Document Analysis Systems: 14th IAPR International Workshop, pp. 131\u2013144 (2020)","DOI":"10.1007\/978-3-030-57058-3_10"},{"key":"3_CR9","doi-asserted-by":"publisher","first-page":"475","DOI":"10.1007\/978-3-031-19836-6_27","volume-title":"Computer Vision \u2013 ECCV 2022: 17th European Conference, Tel Aviv, Israel, October 23\u201327, 2022, Proceedings, Part XXXVII","author":"H Feng","year":"2022","unstructured":"Feng, H., Zhou, W., Deng, J., Wang, Y., Li, H.: Geometric representation learning for\u00a0document image rectification. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) Computer Vision \u2013 ECCV 2022: 17th European Conference, Tel Aviv, Israel, October 23\u201327, 2022, Proceedings, Part XXXVII, pp. 475\u2013492. Springer Nature Switzerland, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-19836-6_27"},{"key":"3_CR10","doi-asserted-by":"crossref","unstructured":"Jiang, X., Long, R., Xue, N., Yang, Z., Yao, C., Xia, G.-S.: Revisiting document image dewarping by grid regularization. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 4543\u20134552 (2022)","DOI":"10.1109\/CVPR52688.2022.00450"},{"key":"3_CR11","doi-asserted-by":"crossref","unstructured":"Li, H., Wu, X., Chen, Q., Xiang, Q.: Foreground and text-lines aware document image rectification. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 19574\u201319583 (2023)","DOI":"10.1109\/ICCV51070.2023.01793"},{"key":"3_CR12","doi-asserted-by":"crossref","unstructured":"Feng, H., Wang, Y., Zhou, W., Deng, J., Li, H.: DocTr: document image transformer for geometric unwarping and illumination correction. In: Proceedings of the 29th ACM International Conference on Multimedia, pp. 273\u2013281 (2021)","DOI":"10.1145\/3474085.3475388"},{"key":"3_CR13","doi-asserted-by":"crossref","unstructured":"Tsoi, Y.-C., Brown, M.S.: Multi-view document rectification using boundary. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 1\u20138. IEEE (2007)","DOI":"10.1109\/CVPR.2007.383251"},{"issue":"4","key":"3_CR14","doi-asserted-by":"publisher","first-page":"707","DOI":"10.1109\/TPAMI.2011.151","volume":"34","author":"G Meng","year":"2011","unstructured":"Meng, G., Pan, C., Xiang, S., Duan, J., Zheng, N.: Metric rectification of curved document images. IEEE Trans. Pattern Anal. Mach. Intell. 34(4), 707\u2013722 (2011)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"6","key":"3_CR15","doi-asserted-by":"publisher","first-page":"1544","DOI":"10.1109\/TIP.2006.871082","volume":"15","author":"MS Brown","year":"2006","unstructured":"Brown, M.S., Tsoi, Y.-C.: Geometric and shading correction for images of printed materials using boundary. IEEE Trans. Image Process. 15(6), 1544\u20131554 (2006)","journal-title":"IEEE Trans. Image Process."},{"issue":"7","key":"3_CR16","doi-asserted-by":"publisher","first-page":"1551","DOI":"10.1109\/TIP.2009.2019301","volume":"18","author":"HI Koo","year":"2009","unstructured":"Koo, H.I., Kim, J., Cho, N.I.: Composition of a dewarped and enhanced document image from two view images. IEEE Trans. Image Process. 18(7), 1551\u20131562 (2009)","journal-title":"IEEE Trans. Image Process."},{"issue":"4","key":"3_CR17","doi-asserted-by":"publisher","first-page":"591","DOI":"10.1109\/TPAMI.2007.70724","volume":"30","author":"J Liang","year":"2008","unstructured":"Liang, J., DeMenthon, D., Doermann, D.: Geometric rectification of camera-captured document images. IEEE Trans. Pattern Anal. Mach. Intell. 30(4), 591\u2013605 (2008)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"6","key":"3_CR18","first-page":"1","volume":"38","author":"X Li","year":"2019","unstructured":"Li, X., Zhang, B., Liao, J., Sander, P.V.: Document rectification and illumination correction using a patch-based CNN. ACM Trans. Graph. (TOG) 38(6), 1\u201311 (2019)","journal-title":"ACM Trans. Graph. (TOG)"},{"key":"3_CR19","doi-asserted-by":"publisher","first-page":"208","DOI":"10.1007\/978-3-030-58610-2_13","volume-title":"Computer Vision \u2013 ECCV 2020: 16th European Conference, Glasgow, UK, August 23\u201328, 2020, Proceedings, Part XII","author":"A Markovitz","year":"2020","unstructured":"Markovitz, A., Lavi, I., Perel, O., Mazor, S., Litman, R.: Can you read me now? Content aware rectification using angle supervision. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) Computer Vision \u2013 ECCV 2020: 16th European Conference, Glasgow, UK, August 23\u201328, 2020, Proceedings, Part XII, pp. 208\u2013223. Springer International Publishing, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58610-2_13"},{"key":"3_CR20","unstructured":"Zhang, W., Wang, Q., Huang, K.: Polar-Doc: one-stage document dewarping with multi-scope constraints under polar representation. arXiv preprint arXiv:2312.07925 (2023)"},{"key":"3_CR21","doi-asserted-by":"crossref","unstructured":"Yu, F., et al.: DocReal: robust document dewarping of real-life images via attention-enhanced control point prediction. In: Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision, pp. 665\u2013674 (2024)","DOI":"10.1109\/WACV57701.2024.00072"},{"key":"3_CR22","doi-asserted-by":"crossref","unstructured":"Kumari, P., Das, S.: Am i readable? Transfer learning based document image rectification. Int. J. Doc. Anal. Recogn. (IJDAR), 1\u201314 (2024)","DOI":"10.1007\/s10032-024-00476-9"},{"key":"3_CR23","doi-asserted-by":"crossref","unstructured":"Verhoeven, F., Magne, T., Sorkine-Hornung, O.: UVDoc: neural grid-based document unwarping. In: SIGGRAPH Asia 2023 Conference Papers, pp. 1\u201311 (2023)","DOI":"10.1145\/3610548.3618174"},{"key":"3_CR24","doi-asserted-by":"crossref","unstructured":"Feng, H., Liu, S., Deng, J., Zhou, W., Li, H.: Deep unrestricted document image rectification. IEEE Trans. Multimedia (2023)","DOI":"10.1109\/TMM.2023.3347094"},{"issue":"4","key":"3_CR25","doi-asserted-by":"publisher","first-page":"600","DOI":"10.1109\/TIP.2003.819861","volume":"13","author":"Z Wang","year":"2004","unstructured":"Wang, Z., Bovik, A.C., Sheikh, H.R., Simoncelli, E.P.: Image quality assessment: from error visibility to structural similarity. IEEE Trans. Image Process. 13(4), 600\u2013612 (2004)","journal-title":"IEEE Trans. Image Process."},{"key":"3_CR26","doi-asserted-by":"crossref","unstructured":"Ma, K., Das, S., Shu, Z., Samaras, D.: Learning from documents in the wild to improve document unwarping. In: ACM SIGGRAPH 2022 Conference Proceedings, pp. 1\u20139 (2022)","DOI":"10.1145\/3528233.3530756"},{"key":"3_CR27","doi-asserted-by":"crossref","unstructured":"Morris, A.C., Maier, V., Green, P.D.: From WER and RIL to MER and WIL: improved evaluation measures for connected speech recognition. In: Interspeech, pp. 2765\u20132768 (2004)","DOI":"10.21437\/Interspeech.2004-668"},{"key":"3_CR28","unstructured":"Levenshtein, V.I., et\u00a0al.: Binary codes capable of correcting deletions, insertions, and reversals, in: Soviet physics doklady, vol.\u00a010, Soviet Union, pp. 707\u2013710 (1966)"},{"key":"3_CR29","doi-asserted-by":"crossref","unstructured":"Zhang, J., Peng, D., Liu, C., Zhang, P., Jin, L.: DocRes: a generalist model toward unifying document image restoration tasks. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 15654\u201315664 (2024)","DOI":"10.1109\/CVPR52733.2024.01482"},{"key":"3_CR30","doi-asserted-by":"crossref","unstructured":"Smith, R.: An overview of the tesseract OCR engine. In: Ninth International Conference on Document Analysis and Recognition (ICDAR 2007), vol.\u00a02, pp. 629\u2013633. IEEE (2007)","DOI":"10.1109\/ICDAR.2007.4376991"}],"container-title":["Lecture Notes in Computer Science","Pattern Recognition"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-78119-3_3","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,12,4]],"date-time":"2024-12-04T02:03:16Z","timestamp":1733277796000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-78119-3_3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,12,5]]},"ISBN":["9783031781186","9783031781193"],"references-count":30,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-78119-3_3","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2024,12,5]]},"assertion":[{"value":"5 December 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ICPR","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Pattern Recognition","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Kolkata","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"India","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"1 December 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"5 December 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"27","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"icpr2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/icpr2024.org\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}