{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,11,24]],"date-time":"2025-11-24T21:14:32Z","timestamp":1764018872636,"version":"3.37.3"},"reference-count":43,"publisher":"Springer Science and Business Media LLC","issue":"13","license":[{"start":{"date-parts":[[2019,1,21]],"date-time":"2019-01-21T00:00:00Z","timestamp":1548028800000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"funder":[{"DOI":"10.13039\/501100001809","name":"Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61662082","U1703261"],"award-info":[{"award-number":["61662082","U1703261"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]},{"DOI":"10.13039\/501100001809","name":"Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61632019"],"award-info":[{"award-number":["61632019"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]},{"DOI":"10.13039\/501100001809","name":"Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61836011","61390514"],"award-info":[{"award-number":["61836011","61390514"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2019,7]]},"DOI":"10.1007\/s11042-019-7177-4","type":"journal-article","created":{"date-parts":[[2019,1,21]],"date-time":"2019-01-21T11:02:30Z","timestamp":1548068550000},"page":"18205-18227","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":22,"title":["Scene text detection with fully convolutional neural networks"],"prefix":"10.1007","volume":"78","author":[{"given":"Zhandong","family":"Liu","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wengang","family":"Zhou","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Houqiang","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2019,1,21]]},"reference":[{"key":"7177_CR1","unstructured":"Bai X, Yang M, Lyu P, Xu Y (2017) Integrating scene text and visual appearance for fine-grained image classification with convolutional neural networks. arXiv: 1704.04613"},{"key":"7177_CR2","unstructured":"Busta M, Neumann L, Matas J (2015) Fastext: efficient unconstrained scene text detector. In: IEEE international conference on computer vision, pp 1206\u20131214"},{"key":"7177_CR3","doi-asserted-by":"crossref","unstructured":"Cho H, Sung M, Jun B (2016) Canny text detector: fast and robust scene text localization algorithm. In: IEEE conference on computer vision and pattern recognition, pp 3566\u20133573","DOI":"10.1109\/CVPR.2016.388"},{"key":"7177_CR4","doi-asserted-by":"crossref","unstructured":"Deng D, Liu H, Li X, Cai D (2018) Pixellink: detecting scene text via instance segmentation. arXiv: 1801.01315","DOI":"10.1609\/aaai.v32i1.12269"},{"key":"7177_CR5","doi-asserted-by":"crossref","unstructured":"Eom S, Huh JH (2018) Group signature with restrictive linkability: minimizing privacy exposure in ubiquitous environment. J Ambient Intell Humaniz Comput: 1\u201311","DOI":"10.1007\/s12652-018-0698-2"},{"key":"7177_CR6","doi-asserted-by":"crossref","unstructured":"Epshtein B, Ofek E, Wexler Y (2010) Detecting text in natural scenes with stroke width transform. In: IEEE conference on computer vision and pattern recognition, pp 2963\u20132970","DOI":"10.1109\/CVPR.2010.5540041"},{"key":"7177_CR7","doi-asserted-by":"crossref","unstructured":"He D, Yang X, Liang C, Zhou Z, Ororbia AG, Kifer D, Giles CL (2017) Multi-scale fcn with cascaded instance aware segmentation for arbitrary oriented word spotting in the wild. In: IEEE conference on computer vision and pattern recognition, pp 3519\u20133528","DOI":"10.1109\/CVPR.2017.58"},{"key":"7177_CR8","doi-asserted-by":"crossref","unstructured":"He P, Huang W, He T, Zhu Q, Qiao Y, Li X (2017) Single shot text detector with regional attention. In: IEEE international conference on computer vision, pp 3047\u20133055","DOI":"10.1109\/ICCV.2017.331"},{"key":"7177_CR9","unstructured":"He T, Huang W, Qiao Y, Yao J (2016) Accurate text localization in natural image with cascaded convolutional text network. arXiv: 1603.09423"},{"key":"7177_CR10","unstructured":"Huang L, Yang Y, Deng Y, Yu Y (2015) Densebox: unifying landmark localization with end to end object detection. arXiv: 1509.04874"},{"key":"7177_CR11","doi-asserted-by":"crossref","unstructured":"Huang W, Lin Z, Yang J, Wang J (2013) Text localization in natural images using stroke feature transform and text covariance descriptors. In: IEEE international conference on computer vision, pp 1241\u20131248","DOI":"10.1109\/ICCV.2013.157"},{"key":"7177_CR12","doi-asserted-by":"crossref","unstructured":"Huang W, Qiao Y, Tang X (2014) Robust scene text detection with convolution neural network induced mser trees. In: European conference on computer vision, pp 497\u2013511","DOI":"10.1007\/978-3-319-10593-2_33"},{"issue":"5","key":"7177_CR13","doi-asserted-by":"publisher","first-page":"1862","DOI":"10.1007\/s11227-016-1672-4","volume":"72","author":"JH Huh","year":"2016","unstructured":"Huh JH, Otgonchimeg S, Seo K (2016) Advanced metering infrastructure design and test bed experiment using intelligent agents: focusing on the plc network base technology for smart grid system. J Supercomput 72(5):1862\u20131877","journal-title":"J Supercomput"},{"key":"7177_CR14","doi-asserted-by":"crossref","unstructured":"Jaderberg M, Vedaldi A, Zisserman A (2014) Deep features for text spotting. In: European conference on computer vision, pp 512\u2013528","DOI":"10.1007\/978-3-319-10593-2_34"},{"key":"7177_CR15","doi-asserted-by":"crossref","unstructured":"Jia Y, Shelhamer E, Donahue J, Karayev S, Long J, Girshick R, Guadarrama S, Darrell T (2014) Caffe: convolutional architecture for fast feature embedding. In: ACM international conference on multimedia, pp 675\u2013678","DOI":"10.1145\/2647868.2654889"},{"key":"7177_CR16","unstructured":"Jiang Y, Zhu X, Wang X, Yang S, Li W, Wang H, Fu P, Luo Z (2017) R2cnn: rotational region cnn for orientation robust scene text detection. arXiv: 1706.09579"},{"key":"7177_CR17","doi-asserted-by":"crossref","unstructured":"Kang L, Li Y, Doermann D (2014) Orientation robust text line detection in natural images. In: IEEE conference on computer vision and pattern recognition, pp 4034\u20134041","DOI":"10.1109\/CVPR.2014.514"},{"issue":"5","key":"7177_CR18","doi-asserted-by":"publisher","first-page":"1063","DOI":"10.1109\/TMM.2016.2638622","volume":"19","author":"S Karaoglu","year":"2017","unstructured":"Karaoglu S, Tao R, Gevers T, Smeulders AW (2017) Words matter: scene text for image classification and retrieval. IEEE Trans Multimedia 19(5):1063\u20131076","journal-title":"IEEE Trans Multimedia"},{"issue":"15","key":"7177_CR19","doi-asserted-by":"publisher","first-page":"16625","DOI":"10.1007\/s11042-016-3941-x","volume":"76","author":"V Khare","year":"2017","unstructured":"Khare V, Shivakumara P, Paramesran R, Blumenstein M (2017) Arbitrarily-oriented multi-lingual text detection in video. Multimed Tools Appl 76 (15):16625\u201316655","journal-title":"Multimed Tools Appl"},{"key":"7177_CR20","doi-asserted-by":"crossref","unstructured":"Liao M, Shi B, Bai X, Wang X, Liu W (2017) Textboxes: a fast text detector with a single deep neural network. In: AAAI conference on artificial intelligence, pp 4161\u20134167","DOI":"10.1609\/aaai.v31i1.11196"},{"key":"7177_CR21","doi-asserted-by":"crossref","unstructured":"Lin TY, Goyal P, Girshick R, He K, Doll\u00e1r P (2017) Focal loss for dense object detection. In: IEEE international conference on computer vision, pp 2980\u20132988","DOI":"10.1109\/ICCV.2017.324"},{"key":"7177_CR22","doi-asserted-by":"crossref","unstructured":"Liu W, Anguelov D, Erhan D, Szegedy C, Reed S, Fu CY, Berg AC (2016) Ssd: single shot multibox detector. In: European conference on computer vision, pp 21\u201337","DOI":"10.1007\/978-3-319-46448-0_2"},{"key":"7177_CR23","doi-asserted-by":"crossref","unstructured":"Liu X, Liang D, Yan S, Chen D, Qiao Y, Yan J (2018) Fots: fast oriented text spotting with a unified network. arXiv: 1801.01671","DOI":"10.1109\/CVPR.2018.00595"},{"key":"7177_CR24","doi-asserted-by":"crossref","unstructured":"Liu Y, Jin L (2017) Deep matching prior network: toward tighter multi-oriented text detection. In: IEEE conference on computer vision and pattern recognition, vol 2, p 8","DOI":"10.1109\/CVPR.2017.368"},{"key":"7177_CR25","doi-asserted-by":"crossref","unstructured":"Long J, Shelhamer E, Darrell T (2015) Fully convolutional networks for semantic segmentation. In: IEEE conference on computer vision and pattern recognition, pp 3431\u20133440","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"7177_CR26","first-page":"7","volume":"2012","author":"K Loukhaoukha","year":"2012","unstructured":"Loukhaoukha K, Chouinard JY, Berdai A (2012) A secure image encryption algorithm based on rubik\u2019s cube principle. J Electr Comput Eng 2012:7","journal-title":"J Electr Comput Eng"},{"issue":"10","key":"7177_CR27","doi-asserted-by":"publisher","first-page":"761","DOI":"10.1016\/j.imavis.2004.02.006","volume":"22","author":"J Matas","year":"2004","unstructured":"Matas J, Chum O, Urban M, Pajdla T (2004) Robust wide-baseline stereo from maximally stable extremal regions. Image Vis Comput 22(10):761\u2013767","journal-title":"Image Vis Comput"},{"key":"7177_CR28","doi-asserted-by":"crossref","unstructured":"Nikoloudakis Y, Panagiotakis S, Markakis E, Pallis E, Mastorakis G, Mavromoustakis CX, Dobre C (2016) A fog-based emergency system for smart enhanced living environments. IEEE Cloud Computing 3(6): 54\u201362","DOI":"10.1109\/MCC.2016.118"},{"key":"7177_CR29","unstructured":"Ren S, He K, Girshick R, Sun J (2015) Faster r-cnn: towards real-time object detection with region proposal networks. In: Advances in neural information processing systems, pp 91\u201399"},{"key":"7177_CR30","doi-asserted-by":"crossref","unstructured":"Shi B, Bai X, Belongie S (2017) Detecting oriented text in natural images by linking segments. In: IEEE conference on computer vision and pattern recognition, pp 2550\u20132558","DOI":"10.1109\/CVPR.2017.371"},{"issue":"11","key":"7177_CR31","doi-asserted-by":"publisher","first-page":"2298","DOI":"10.1109\/TPAMI.2016.2646371","volume":"39","author":"B Shi","year":"2017","unstructured":"Shi B, Bai X, Yao C (2017) An end-to-end trainable neural network for image-based sequence recognition and its application to scene text recognition. IEEE Trans Pattern Anal Mach Intell 39(11):2298\u20132304","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"7177_CR32","doi-asserted-by":"crossref","unstructured":"Tian S, Pan Y, Huang C, Lu S, Yu K, Lim Tan C (2015) Text flow: a unified text detection system in natural scene images. In: IEEE international conference on computer vision, pp 4651\u20134659","DOI":"10.1109\/ICCV.2015.528"},{"key":"7177_CR33","unstructured":"Tian S, Pei WY, Zuo ZY, Yin X (2016) Scene text detection in video by learning locally and globally. In: International joint conference on artificial intelligence, pp 2647\u20132653"},{"issue":"4","key":"7177_CR34","doi-asserted-by":"publisher","first-page":"280","DOI":"10.1007\/s10032-006-0014-0","volume":"8","author":"C Wolf","year":"2006","unstructured":"Wolf C, Jolion JM (2006) Object count\/area graphs for the evaluation of object detection and segmentation algorithms. Int J Doc Anal Recognit 8(4):280\u2013296","journal-title":"Int J Doc Anal Recognit"},{"key":"7177_CR35","doi-asserted-by":"crossref","unstructured":"Xie S, Tu Z (2015) Holistically-nested edge detection. In: IEEE international conference on computer vision, pp 1395\u20131403","DOI":"10.1109\/ICCV.2015.164"},{"key":"7177_CR36","unstructured":"Yao C, Bai X, Liu W, Ma Y, Tu Z (2012) Detecting texts of arbitrary orientations in natural images. In: IEEE conference on computer vision and pattern recognition, pp 1083\u20131090"},{"key":"7177_CR37","unstructured":"Yao C, Bai X, Sang N, Zhou X, Zhou S, Cao Z (2016) Scene text detection via holistic, multi-channel prediction. arXiv: 1606.09002"},{"key":"7177_CR38","unstructured":"Yi C, Tian Y (2011) Assistive text reading from complex background for blind persons. In: International workshop on camera-based document analysis and recognition, pp 15\u201328"},{"issue":"9","key":"7177_CR39","doi-asserted-by":"publisher","first-page":"1930","DOI":"10.1109\/TPAMI.2014.2388210","volume":"37","author":"X Yin","year":"2015","unstructured":"Yin X, Pei WY, Zhang J, Hao HW (2015) Multi-orientation scene text detection with adaptive clustering. IEEE Trans Pattern Anal Mach Intell 37 (9):1930\u20131937","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"5","key":"7177_CR40","doi-asserted-by":"publisher","first-page":"970","DOI":"10.1109\/TPAMI.2013.182","volume":"36","author":"X Yin","year":"2014","unstructured":"Yin X, Yin X, Huang K, Hao HW (2014) Robust text detection in natural scene images. IEEE Trans Pattern Anal Mach Intell 36(5):970\u2013983","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"7177_CR41","doi-asserted-by":"crossref","unstructured":"Zhang Z, Shen W, Yao C, Bai X (2015) Symmetry-based text line detection in natural scenes. In: IEEE conference on computer vision and pattern recognition, pp 2558\u20132567","DOI":"10.1109\/CVPR.2015.7298871"},{"key":"7177_CR42","doi-asserted-by":"crossref","unstructured":"Zhang Z, Zhang C, Shen W, Yao C, Liu W, Bai X (2016) Multi-oriented text detection with fully convolutional networks. In: IEEE conference on computer vision and pattern recognition, pp 4159\u20134167","DOI":"10.1109\/CVPR.2016.451"},{"key":"7177_CR43","doi-asserted-by":"crossref","unstructured":"Zhou X, Yao C, Wen H, Wang Y, Zhou S, He W, Liang J (2017) East: an efficient and accurate scene text detector. In: IEEE conference on computer vision and pattern recognition, pp 2642\u20132651","DOI":"10.1109\/CVPR.2017.283"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-019-7177-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11042-019-7177-4\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-019-7177-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,9,13]],"date-time":"2023-09-13T02:27:57Z","timestamp":1694572077000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11042-019-7177-4"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019,1,21]]},"references-count":43,"journal-issue":{"issue":"13","published-print":{"date-parts":[[2019,7]]}},"alternative-id":["7177"],"URL":"https:\/\/doi.org\/10.1007\/s11042-019-7177-4","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"type":"print","value":"1380-7501"},{"type":"electronic","value":"1573-7721"}],"subject":[],"published":{"date-parts":[[2019,1,21]]},"assertion":[{"value":"19 May 2018","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"4 November 2018","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"6 January 2019","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"21 January 2019","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}