{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,16]],"date-time":"2026-05-16T18:22:27Z","timestamp":1778955747560,"version":"3.51.4"},"reference-count":45,"publisher":"Springer Science and Business Media LLC","issue":"5","license":[{"start":{"date-parts":[[2021,3,26]],"date-time":"2021-03-26T00:00:00Z","timestamp":1616716800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2021,3,26]],"date-time":"2021-03-26T00:00:00Z","timestamp":1616716800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Vis Comput"],"published-print":{"date-parts":[[2022,5]]},"DOI":"10.1007\/s00371-021-02094-6","type":"journal-article","created":{"date-parts":[[2021,3,26]],"date-time":"2021-03-26T21:02:36Z","timestamp":1616792556000},"page":"1645-1664","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":27,"title":["Understanding movie poster: transfer-deep learning approach for graphic-rich text recognition"],"prefix":"10.1007","volume":"38","author":[{"given":"Mridul","family":"Ghosh","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Sayan Saha","family":"Roy","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Himadri","family":"Mukherjee","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Sk Md","family":"Obaidullah","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"K. C.","family":"Santosh","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kaushik","family":"Roy","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2021,3,26]]},"reference":[{"issue":"2","key":"2094_CR1","doi-asserted-by":"publisher","first-page":"176","DOI":"10.1109\/34.574802","volume":"19","author":"J Hochberg","year":"1997","unstructured":"Hochberg, J., Kelly, P., Thomas, T., Kerns, L.: Automatic script identification from document images using cluster-based templates. IEEE Trans. Pattern Anal. Mach. Intell. 19(2), 176\u2013181 (1997)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"2094_CR2","doi-asserted-by":"crossref","unstructured":"Pal, U., Sinha, S., Chaudhuri, B.B.: Multi-script line identification from Indian documents. In: Proceedings of Seventh International Conference on Document Analysis and Recognition, pp. 880\u2013884. IEEE (2003)","DOI":"10.1109\/ICDAR.2003.1227786"},{"key":"2094_CR3","unstructured":"Banashree, N.P., Andhre, D., Vasanta, R., Satyanarayana, P.S.: OCR for script identification of Hindi (Devnagari) numerals using error diffusion Halftoning Algorithm with neural classifier. In: Proceedings of World Academy of Science Engineering and Technology, vol. 20, pp. 46\u201350 (2007)"},{"issue":"3","key":"2094_CR4","doi-asserted-by":"publisher","first-page":"193","DOI":"10.1145\/979872.979875","volume":"2","author":"H Ma","year":"2003","unstructured":"Ma, H., Doermann, D.: Adaptive Hindi OCR using generalized Hausdorff image comparison. ACM Trans. Asian Lang. Inf. Process. 2(3), 193\u2013218 (2003)","journal-title":"ACM Trans. Asian Lang. Inf. Process."},{"key":"2094_CR5","doi-asserted-by":"crossref","unstructured":"Santosh, K. C., Wendling, L.: Graphical symbol recognition. In: Wiley Encyclopedia of Electrical and Electronics Engineering, pp. 1\u201322 (1999)","DOI":"10.1002\/047134608X.W8260"},{"issue":"2","key":"2094_CR6","doi-asserted-by":"publisher","first-page":"1643","DOI":"10.1007\/s11042-017-4373-y","volume":"77","author":"SM Obaidullah","year":"2018","unstructured":"Obaidullah, S.M., Halder, C., Santosh, K.C., Das, N., Roy, K.: PHDIndic_11: page-level handwritten document image dataset of 11 official Indic scripts for script identification. Multimed. Tools Appl. 77(2), 1643\u20131678 (2018)","journal-title":"Multimed. Tools Appl."},{"key":"2094_CR7","doi-asserted-by":"crossref","unstructured":"Obaidullah, S. M., Halder, C., Das, N., Roy, K.: An approach for automatic Indic script identification from handwritten document images. In: Advanced Computing and Systems for Security, pp. 37\u201351. Springer, New Delhi, (2016)","DOI":"10.1007\/978-81-322-2653-6_3"},{"issue":"2","key":"2094_CR8","doi-asserted-by":"publisher","first-page":"125","DOI":"10.1007\/s10032-015-0237-z","volume":"18","author":"S Lu","year":"2015","unstructured":"Lu, S., Chen, T., Tian, S., Lim, J.H., Tan, C.L.: Scene text extraction based on edges and support vector regression. Int. J. Doc. Anal. Recognit. 18(2), 125\u2013135 (2015)","journal-title":"Int. J. Doc. Anal. Recognit."},{"key":"2094_CR9","doi-asserted-by":"publisher","first-page":"448","DOI":"10.1016\/j.patcog.2015.11.005","volume":"52","author":"B Shi","year":"2016","unstructured":"Shi, B., Bai, X., Yao, C.: Script identification in the wild via discriminative convolutional neural network. Pattern Recognit. 52, 448\u2013458 (2016)","journal-title":"Pattern Recognit."},{"key":"2094_CR10","doi-asserted-by":"crossref","unstructured":"Gomez, L., Karatzas, D.: A fine-grained approach to scene text script identification. In: 2016 12th IAPR Workshop on Document Analysis Systems (DAS), pp. 192\u2013197. IEEE (2016)","DOI":"10.1109\/DAS.2016.64"},{"key":"2094_CR11","doi-asserted-by":"publisher","first-page":"85","DOI":"10.1016\/j.patcog.2017.01.032","volume":"67","author":"L Gomez","year":"2017","unstructured":"Gomez, L., Nicolaou, A., Karatzas, D.: Improving patch-based scene text script identification with ensembles of conjoined networks. Pattern Recognit. 67, 85\u201396 (2017)","journal-title":"Pattern Recognit."},{"key":"2094_CR12","doi-asserted-by":"publisher","first-page":"172","DOI":"10.1016\/j.patcog.2018.07.034","volume":"85","author":"AK Bhunia","year":"2019","unstructured":"Bhunia, A.K., Konwer, A., Bhunia, A.K., Bhowmick, A., Roy, P.P., Pal, U.: Script identification in natural scene image and video frames using an attention based convolutional-LSTM network. Pattern Recognit. 85, 172\u2013184 (2019)","journal-title":"Pattern Recognit."},{"issue":"9","key":"2094_CR13","doi-asserted-by":"publisher","first-page":"4256","DOI":"10.1109\/TIP.2012.2199327","volume":"21","author":"C Yi","year":"2012","unstructured":"Yi, C., Tian, Y.: Localizing text in scene images by boundary clustering, stroke segmentation, and string fragment classification. IEEE Trans. Image Process. 21(9), 4256\u20134268 (2012)","journal-title":"IEEE Trans. Image Process."},{"key":"2094_CR14","doi-asserted-by":"publisher","first-page":"35","DOI":"10.1016\/j.cviu.2014.09.003","volume":"130","author":"P Shivakumara","year":"2015","unstructured":"Shivakumara, P., Yuan, Z., Zhao, D., Lu, T., Tan, C.L.: New gradient-spatial-structural features for video script identification. Comput. Vis. Image Underst. 130, 35\u201353 (2015)","journal-title":"Comput. Vis. Image Underst."},{"key":"2094_CR15","doi-asserted-by":"crossref","unstructured":"Epshtein, B., Ofek, E., Wexler, Y.: Detecting text in natural scenes with stroke width transform. In: 2010 IEEE Computer Society Conference on Computer Vision and Pattern Recognition, pp. 2963\u20132970. IEEE (2010)","DOI":"10.1109\/CVPR.2010.5540041"},{"key":"2094_CR16","unstructured":"Yao, C., Bai, X., Liu, W., Ma, Y., Tu, Z.: Detecting texts of arbitrary orientations in natural images. In: 2012 IEEE Conference on Computer Vision and Pattern Recognition, pp. 1083\u20131090. IEEE (2012)"},{"key":"2094_CR17","doi-asserted-by":"crossref","unstructured":"Jaderberg, M., Vedaldi, A., Zisserman, A.: Deep features for text spotting. In: European Conference on Computer Vision, pp. 512\u2013528. Springer, Cham (2014)","DOI":"10.1007\/978-3-319-10593-2_34"},{"key":"2094_CR18","doi-asserted-by":"crossref","unstructured":"Huang, L., Wang, Y., Bai, T.: Recognizing art work image from natural type: a deep adaptive depiction fusion method. Vis. Comput. 1\u201312 (2020)","DOI":"10.1007\/s00371-020-01995-2"},{"issue":"3","key":"2094_CR19","doi-asserted-by":"publisher","first-page":"559","DOI":"10.1007\/s00371-019-01641-6","volume":"36","author":"H Yang","year":"2020","unstructured":"Yang, H., Min, K.: Classification of basic artistic media based on a deep convolutional approach. Vis. Comput. 36(3), 559\u2013578 (2020)","journal-title":"Vis. Comput."},{"issue":"11","key":"2094_CR20","doi-asserted-by":"publisher","first-page":"1720","DOI":"10.1109\/TPAMI.2005.227","volume":"27","author":"A Busch","year":"2005","unstructured":"Busch, A., Boles, W.W., Sridharan, S.: Texture for script identification. IEEE Trans. Pattern Anal. Mach. Intell. 27(11), 1720\u20131732 (2005)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"2094_CR21","doi-asserted-by":"crossref","unstructured":"Pal, U., Sinha, S., Chaudhuri, B.B.: Multi-script line identification from Indian documents. In: Proceedings of Seventh International Conference on Document Analysis and Recognition, pp. 880\u2013884. IEEE (2003)","DOI":"10.1109\/ICDAR.2003.1227786"},{"issue":"13","key":"2094_CR22","doi-asserted-by":"publisher","first-page":"800","DOI":"10.1049\/el:20080522","volume":"44","author":"Q Huynh-Thu","year":"2008","unstructured":"Huynh-Thu, Q., Ghanbari, M.: Scope of validity of PSNR in image\/video quality assessment. Electron. Lett. 44(13), 800\u2013801 (2008)","journal-title":"Electron. Lett."},{"issue":"2","key":"2094_CR23","doi-asserted-by":"crossref","first-page":"1716","DOI":"10.1016\/j.amc.2005.09.016","volume":"175","author":"O K\u00f6ksoy","year":"2006","unstructured":"K\u00f6ksoy, O.: Multiresponse robust design: mean square error (MSE) criterion. Appl. Math. Comput. 175(2), 1716\u20131729 (2006)","journal-title":"Appl. Math. Comput."},{"issue":"2","key":"2094_CR24","doi-asserted-by":"publisher","first-page":"107","DOI":"10.1016\/j.patrec.2012.09.019","volume":"34","author":"C Shi","year":"2013","unstructured":"Shi, C., Wang, C., Xiao, B., Zhang, Y., Gao, S.: Scene text detection using graph model built upon maximally stable extremal regions. Pattern Recognit. Lett. 34(2), 107\u2013116 (2013)","journal-title":"Pattern Recognit. Lett."},{"key":"2094_CR25","doi-asserted-by":"crossref","unstructured":"Deguillaume, F., Voloshynovskiy, S. V., Pun, T.: Method for the estimation and recovering from general affine transforms in digital watermarking applications. In: Security and watermarking of multimedia contents IV, vol. 4675, pp. 313\u2013322. International Society for Optics and Photonics (2002)","DOI":"10.1117\/12.465289"},{"issue":"3","key":"2094_CR26","doi-asserted-by":"publisher","first-page":"696","DOI":"10.1109\/TIP.2010.2073477","volume":"20","author":"F Luisier","year":"2010","unstructured":"Luisier, F., Blu, T., Unser, M.: Image denoising in mixed Poisson\u2013Gaussian noise. IEEE Trans. Image Process. 20(3), 696\u2013708 (2010)","journal-title":"IEEE Trans. Image Process."},{"issue":"4","key":"2094_CR27","doi-asserted-by":"publisher","first-page":"575","DOI":"10.1007\/s00371-017-1362-0","volume":"34","author":"A Khmag","year":"2018","unstructured":"Khmag, A., Al-haddad, S.A.R., Kamarudin, N.: Natural image noise level estimation based on local statistics for blind noise reduction. Vis. Comput. 34(4), 575\u2013587 (2018)","journal-title":"Vis. Comput."},{"issue":"5","key":"2094_CR28","doi-asserted-by":"publisher","first-page":"1018","DOI":"10.1109\/TMI.2014.2366792","volume":"34","author":"A Van Opbroek","year":"2014","unstructured":"Van Opbroek, A., Ikram, M.A., Vernooij, M.W., De Bruijne, M.: Transfer learning improves supervised image segmentation across imaging protocols. IEEE Trans. Med. Imaging 34(5), 1018\u20131030 (2014)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"2094_CR29","doi-asserted-by":"crossref","unstructured":"Zhou, X., Yao, C., Wen, H., Wang, Y., Zhou, S., He, W., Liang, J.: East: an efficient and accurate scene text detector. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 5551\u20135560 (2017)","DOI":"10.1109\/CVPR.2017.283"},{"key":"2094_CR30","doi-asserted-by":"crossref","unstructured":"He, W., Zhang, X.Y., Yin, F., Liu, C.L.: Deep direct regression for multi-oriented scene text detection. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 745\u2013753 (2017)","DOI":"10.1109\/ICCV.2017.87"},{"issue":"3","key":"2094_CR31","doi-asserted-by":"publisher","first-page":"362","DOI":"10.17775\/CSEEJPES.2018.00520","volume":"4","author":"D Zhang","year":"2018","unstructured":"Zhang, D., Han, X., Deng, C.: Review on the research and practice of deep learning and reinforcement learning in smart grids. CSEE J. Power Energy Syst. 4(3), 362\u2013370 (2018)","journal-title":"CSEE J. Power Energy Syst."},{"key":"2094_CR32","doi-asserted-by":"crossref","unstructured":"Ghosh, M., Mukherjee, H., Obaidullah, S. M., Santosh, K. C., Das, N., Roy, K.: Identifying the presence of graphical texts in scene images using CNN. In: 2019 International Conference on Document Analysis and Recognition Workshops (ICDARW), vol. 1, pp. 86\u201391. IEEE (2019)","DOI":"10.1109\/ICDARW.2019.00020"},{"issue":"4","key":"2094_CR33","doi-asserted-by":"publisher","first-page":"246","DOI":"10.1504\/IJSISE.2010.038020","volume":"3","author":"M Agarwal","year":"2010","unstructured":"Agarwal, M., Maheshwari, R.P.: HOG feature and vocabulary tree for content-based image retrieval. Int. J. Signal Imaging Syst. Eng. 3(4), 246\u2013254 (2010)","journal-title":"Int. J. Signal Imaging Syst. Eng."},{"key":"2094_CR34","first-page":"199","volume":"38","author":"GD Wang","year":"2012","unstructured":"Wang, G.D., Zhang, P.L., Ren, G.Q., Kou, X.: Texture feature extraction method fused with LBP and GLCM. Comput. Eng. 38, 199\u2013201 (2012)","journal-title":"Comput. Eng."},{"key":"2094_CR35","first-page":"1094","volume-title":"Principal Component Analysis","author":"I Jolliffe","year":"2011","unstructured":"Jolliffe, I.: Principal Component Analysis, pp. 1094\u20131096. Springer, Berlin (2011)"},{"key":"2094_CR36","first-page":"896128","volume":"2014","author":"SM Obaidullah","year":"2014","unstructured":"Obaidullah, S.M., Mondal, A., Das, N., Roy, K.: Script identification from printed Indian document images and performance evaluation using different classifiers. Appl. Comput. Intell. Soft Comput. 2014, 896128 (2014)","journal-title":"Appl. Comput. Intell. Soft Comput."},{"issue":"3","key":"2094_CR37","doi-asserted-by":"publisher","first-page":"581","DOI":"10.1109\/TGRS.2004.839547","volume":"43","author":"S Aksoy","year":"2005","unstructured":"Aksoy, S., Koperski, K., Tusk, C., Marchisio, G., Tilton, J.C.: Learning Bayesian classifiers for scene classification with a visual grammar. IEEE Trans. Geosci. Remote Sens. 43(3), 581\u2013589 (2005)","journal-title":"IEEE Trans. Geosci. Remote Sens."},{"key":"2094_CR38","doi-asserted-by":"crossref","unstructured":"Rimey, R.D., Brown, C.M.: Where to look next using a Bayes net: an overview. In: Proceedings of 1992 DARPA Image Understanding Workshop, pp. 927\u2013932 (1992)","DOI":"10.1007\/3-540-55426-2_59"},{"key":"2094_CR39","unstructured":"Yang, J., Yu, K., Gong, Y., Huang, T.: Linear spatial pyramid matching using sparse coding for image classification. In: 2009 IEEE Conference on computer vision and pattern recognition, pp. 1794\u20131801. IEEE (2009)"},{"key":"2094_CR40","doi-asserted-by":"crossref","unstructured":"Nayef, N., Patel, Y., Busta, M., Chowdhury, P.N., Karatzas, D., Khlif, W., Matas, J., Pal, U., Burie, J.C., Liu, C.L. Ogier, J.M.: ICDAR2019 robust reading challenge on multi-lingual scene text detection and recognition\u2014RRC-MLT-2019. In: 2019 International Conference on Document Analysis and Recognition (ICDAR), pp. 1582\u20131587. IEEE (2019)","DOI":"10.1109\/ICDAR.2019.00254"},{"key":"2094_CR41","unstructured":"Simonyan, K., Zisserman, A.: Very deep convolutional networks for large-scale image recognition. arXiv preprint arXiv:1409.1556 (2014)"},{"key":"2094_CR42","doi-asserted-by":"crossref","unstructured":"Szegedy, C., Vanhoucke, V., Ioffe, S., Shlens, J., Wojna, Z.: Rethinking the inception architecture for computer vision. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 2818\u20132826 (2016)","DOI":"10.1109\/CVPR.2016.308"},{"key":"2094_CR43","unstructured":"Howard, A.G., Zhu, M., Chen, B., Kalenichenko, D., Wang, W., Weyand, T., Andreetto, M. Adam, H.: Mobilenets: efficient convolutional neural networks for mobile vision applications. arXiv preprint arXiv:1704.04861 (2017)"},{"issue":"8","key":"2094_CR44","doi-asserted-by":"publisher","first-page":"1307","DOI":"10.1007\/s13042-017-0645-0","volume":"9","author":"MR Bouguelia","year":"2018","unstructured":"Bouguelia, M.R., Nowaczyk, S., Santosh, K.C., Verikas, A.: Agreeing to disagree: active learning with noisy labels without crowdsourcing. Int. J. Mach. Learn. Cybernet. 9(8), 1307\u20131319 (2018)","journal-title":"Int. J. Mach. Learn. Cybernet."},{"issue":"2","key":"2094_CR45","doi-asserted-by":"publisher","first-page":"163","DOI":"10.1007\/s00371-015-1167-y","volume":"33","author":"L Cai","year":"2017","unstructured":"Cai, L., Nguyen, B.P., Chui, C.K., Ong, S.H.: A two-level clustering approach for multidimensional transfer function specification in volume visualization. Vis. Comput. 33(2), 163\u2013177 (2017)","journal-title":"Vis. Comput."}],"container-title":["The Visual Computer"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-021-02094-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00371-021-02094-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-021-02094-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,8,26]],"date-time":"2024-08-26T22:56:28Z","timestamp":1724712988000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00371-021-02094-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,3,26]]},"references-count":45,"journal-issue":{"issue":"5","published-print":{"date-parts":[[2022,5]]}},"alternative-id":["2094"],"URL":"https:\/\/doi.org\/10.1007\/s00371-021-02094-6","relation":{},"ISSN":["0178-2789","1432-2315"],"issn-type":[{"value":"0178-2789","type":"print"},{"value":"1432-2315","type":"electronic"}],"subject":[],"published":{"date-parts":[[2021,3,26]]},"assertion":[{"value":"11 February 2021","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"26 March 2021","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that there is no conflict of interest. The authors declare that there are no human participants and\/or animals involved in this study. The authors also declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}