{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,7]],"date-time":"2026-05-07T22:06:42Z","timestamp":1778191602667,"version":"3.51.4"},"reference-count":44,"publisher":"Springer Science and Business Media LLC","issue":"6","license":[{"start":{"date-parts":[[2021,1,22]],"date-time":"2021-01-22T00:00:00Z","timestamp":1611273600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2021,1,22]],"date-time":"2021-01-22T00:00:00Z","timestamp":1611273600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"funder":[{"name":"The China Shandong Key R&D Plan","award":["2018GGX106008"],"award-info":[{"award-number":["2018GGX106008"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Real-Time Image Proc"],"published-print":{"date-parts":[[2021,12]]},"DOI":"10.1007\/s11554-021-01074-2","type":"journal-article","created":{"date-parts":[[2021,1,22]],"date-time":"2021-01-22T18:40:40Z","timestamp":1611340840000},"page":"1965-1978","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":24,"title":["An improved one-stage pedestrian detection method based on multi-scale attention feature extraction"],"prefix":"10.1007","volume":"18","author":[{"given":"Jun","family":"Ma","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Honglin","family":"Wan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Junxia","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hao","family":"Xia","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3783-9419","authenticated-orcid":false,"given":"Chengjie","family":"Bai","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2021,1,22]]},"reference":[{"key":"1074_CR1","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G. E.: ImageNet classification with deep convolutional neural networks. In: Neural Information Processing Systems, pp. 1097\u20131105 (2012)"},{"key":"1074_CR2","doi-asserted-by":"crossref","unstructured":"Tian, Y., Luo, P., Wang, X., Tang, X.: Pedestrian detection aided by deep learning semantic tasks. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 5079\u20135087 (2015)","DOI":"10.1109\/CVPR.2015.7299143"},{"key":"1074_CR3","doi-asserted-by":"crossref","unstructured":"Zhang, L., Lin, L., Liang, X., He, K.: Is faster r-cnn doing well for pedestrian detection? In: European Conference on Computer Vision (ECCV), pp. 443\u2013457 (2016)","DOI":"10.1007\/978-3-319-46475-6_28"},{"key":"1074_CR4","doi-asserted-by":"crossref","unstructured":"Liu, W., Liao, S., Ren, W., Hu, W., Yu, Y.: High-level semantic feature detection: a new perspective for pedestrian detection. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 5187\u20135196 (2019)","DOI":"10.1109\/CVPR.2019.00533"},{"key":"1074_CR5","doi-asserted-by":"publisher","DOI":"10.1007\/s11760-020-01742-z","author":"J Ma","year":"2020","unstructured":"Ma, J., Wan, H., Wang, J., Xia, H., Bai, C.: An improved scheme of deep dilated feature extraction on pedestrian detection. SIViP (2020). https:\/\/doi.org\/10.1007\/s11760-020-01742-z","journal-title":"SIViP"},{"key":"1074_CR6","doi-asserted-by":"crossref","unstructured":"Zhang, S., Benenson, R., & Schiele, B.: CityPersonss: a diverse dataset for pedestrian detection. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition, pp. 3213\u20133221 (2017)","DOI":"10.1109\/CVPR.2017.474"},{"issue":"4","key":"1074_CR7","doi-asserted-by":"publisher","first-page":"743","DOI":"10.1109\/TPAMI.2011.155","volume":"34","author":"P Dollar","year":"2012","unstructured":"Dollar, P., Wojek, C., Schiele, B., Perona, P.: Pedestrian detection: An evaluation of the state of the art. IEEE Trans. Pattern Anal. Mach. Intell. 34(4), 743\u2013761 (2012)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1074_CR8","doi-asserted-by":"crossref","unstructured":"Girshick, R., Donahue, J., Darrell, T., Malik, J.: Rich feature hierarchies for accurate object detection and semantic segmentation. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 580\u2013587 (2014)","DOI":"10.1109\/CVPR.2014.81"},{"key":"1074_CR9","doi-asserted-by":"crossref","unstructured":"Girshick R.: Fast R-CNN. In: IEEE International Conference on Computer Vision (ICCV), pp. 1440\u20131448 (2015)","DOI":"10.1109\/ICCV.2015.169"},{"issue":"6","key":"1074_CR10","doi-asserted-by":"publisher","first-page":"1137","DOI":"10.1109\/TPAMI.2016.2577031","volume":"39","author":"S Ren","year":"2017","unstructured":"Ren, S., He, K., Girshick, R., Sun, J.: Faster R-CNN: Towards real-time object detection with region proposal networks. IEEE Trans. Pattern Anal. Mach. Intell. 39(6), 1137\u20131149 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1074_CR11","doi-asserted-by":"crossref","unstructured":"Redmon, J., Divvala, S., Girshick, R., Farhadi, A.: You only look once: unified, real-time object detection. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 779\u2013788(2016)","DOI":"10.1109\/CVPR.2016.91"},{"key":"1074_CR12","doi-asserted-by":"crossref","unstructured":"Liu, W., Anguelov, D., Erhan, D., Szegedy, C., Reed, S., Fu, C. Y., Berg, A. C.: Ssd: single shot multibox detector. In: European Conference on Computer Vision (ECCV), pp. 21\u201337 (2016)","DOI":"10.1007\/978-3-319-46448-0_2"},{"key":"1074_CR13","unstructured":"Fu, C., Liu, W., Ranga, A., Tyagi, A., Berg, A. C.: DSSD: deconvolutional single shot detector. arXiv:1701.06659 (2017)"},{"key":"1074_CR14","doi-asserted-by":"crossref","unstructured":"Zhang, S., Wen, L., Bian, X., Lei, Z., Li, S.Z.: Single-shot refinement neural network for object detection. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 4203\u20134212 (2018)","DOI":"10.1109\/CVPR.2018.00442"},{"key":"1074_CR15","doi-asserted-by":"crossref","unstructured":"Redmon, J., Farhadi, A.: YOLO9000: better, faster, stronger. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 6517\u20136525 (2017)","DOI":"10.1109\/CVPR.2017.690"},{"key":"1074_CR16","unstructured":"Redmon, J., Farhadi, A.: YOLOv3: an incremental improvement. arXiv:1804.02767 (2018)"},{"key":"1074_CR17","doi-asserted-by":"crossref","unstructured":"Han, K., Wang, Y., Tian, Q., Guo, J., Xu, C., Xu, C.: GhostNet: more features from cheap operations. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2020)","DOI":"10.1109\/CVPR42600.2020.00165"},{"key":"1074_CR18","doi-asserted-by":"crossref","unstructured":"Fan, Q., Zhuo, W., Tang, C., Tai, Y.: Few-shot object detection with attention-RPN and multi-relation detector. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2020)","DOI":"10.1109\/CVPR42600.2020.00407"},{"key":"1074_CR19","doi-asserted-by":"crossref","unstructured":"Wang, X., Zhang, S., Yu, Z., Feng, L., Zhang, W.: Scale-equalizing pyramid convolution for object detection. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR). arXiv:2005.03101 (2020)","DOI":"10.1109\/CVPR42600.2020.01337"},{"key":"1074_CR20","unstructured":"Bochkovskiy, A., Wang, C., Liao, H. M.: YOLOv4: optimal speed and accuracy of object detection. arXiv:2004.10934 (2020)."},{"key":"1074_CR21","doi-asserted-by":"crossref","unstructured":"Cai, Z., Fan, Q., Feris, R. S., Vasconcelos, N.: A unified multi-scale deep convolutional neural network for fast object detection. In: European Conference on Computer Vision (ECCV), pp. 354\u2013370 (2016)","DOI":"10.1007\/978-3-319-46493-0_22"},{"key":"1074_CR22","doi-asserted-by":"crossref","unstructured":"Cai, Z., Vasconcelos, N.: Cascade r-cnn: delving into high quality object detection. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 6154\u20136162 (2018)","DOI":"10.1109\/CVPR.2018.00644"},{"key":"1074_CR23","doi-asserted-by":"crossref","unstructured":"Wang, X., Xiao, T., Jiang, Y., Shao, S., Sun, J., Shen, C.: Repulsion loss: detecting pedestrians in a crowd. In: 2018 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 7774\u20137783 (2018)","DOI":"10.1109\/CVPR.2018.00811"},{"key":"1074_CR24","doi-asserted-by":"crossref","unstructured":"Zhang, S., Wen, L., Bian, X., Lei, Z., Li, S. Z.: Occlusion-aware R-CNN: detecting pedestrians in a crowd. In: European Conference on Computer Vision (ECCV), pp. 637\u2013653 (2018)","DOI":"10.1007\/978-3-030-01219-9_39"},{"key":"1074_CR25","unstructured":"Wang, Z., Wang, J., Yang, Y.: Resisting the distracting-factors in pedestrian detection. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR). arXiv:2005.07344 (2020)"},{"key":"1074_CR26","doi-asserted-by":"crossref","unstructured":"Chu, X., Zheng, A., Zhang, X., Sun, J.: Detection in crowded scenes: one proposal, multiple predictions. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR). arXiv:2003.09163 (2020)","DOI":"10.1109\/CVPR42600.2020.01223"},{"key":"1074_CR27","unstructured":"Jaderberg, M., Simonyan, K., Zisserman, A., Kavukcuoglu, K.: Spatial transformer networks. In: NIPS, pp. 2017\u20132025 (2015)"},{"key":"1074_CR28","doi-asserted-by":"crossref","unstructured":"Hu, J., Shen, L., Albanie, S., Sun, G., Wu, E.: Squeeze-and-excitation networks. In: IEEE Trans. Pattern Anal. Mach. Intell., p. 1 (2019)","DOI":"10.1109\/CVPR.2018.00745"},{"key":"1074_CR29","doi-asserted-by":"crossref","unstructured":"Fu, J., Liu, J., Tian, H., Li, Y., Bao, Y., Fang, Z., Lu, H.: Dual attention network for scene segmentation. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 3146\u20133154 (2019)","DOI":"10.1109\/CVPR.2019.00326"},{"key":"1074_CR30","doi-asserted-by":"crossref","unstructured":"Zhu, M., Jiao, L., Liu, F., Yang, S., Wang, J.: Residual spectral-spatial attention network for hyperspectral image classification. In: IEEE Trans. Geosci. Remote Sensing, pp. 1\u201314 (2020)","DOI":"10.1109\/TGRS.2021.3080394"},{"key":"1074_CR31","doi-asserted-by":"crossref","unstructured":"Ji, R., Wen, L., Zhang, L., Du, D., Wu, Y., Zhao, C., Liu, X., Huang, F.: Attention convolutional binary neural tree for fine-grained visual categorization. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR). arXiv:1909.11378 (2020)","DOI":"10.1109\/CVPR42600.2020.01048"},{"key":"1074_CR32","doi-asserted-by":"crossref","unstructured":"Li, A., Qi, J., Lu, H.: Multi-attention guided feature fusion network for salient object detection. Neurocomputing 416\u2013427 (2020)","DOI":"10.1016\/j.neucom.2020.06.021"},{"key":"1074_CR33","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"1074_CR34","doi-asserted-by":"crossref","unstructured":"Szegedy, C., Ioffe, S., Vanhoucke, V., Alemi, A.: Inception-v4, inception-ResNet and the impact of residual connections on learning. In: AAAI (2017)","DOI":"10.1609\/aaai.v31i1.11231"},{"key":"1074_CR35","doi-asserted-by":"crossref","unstructured":"Liu, W., Liao, S., Hu, W., Liang, X., Chen, X.: Learning efficient single-stage pedestrian detectors by asymptotic localization fitting. In: 2018 European Conference on Computer Vision (ECCV), pp. 618\u2013634 (2018)","DOI":"10.1007\/978-3-030-01264-9_38"},{"key":"1074_CR36","doi-asserted-by":"crossref","unstructured":"Lin, T. Y., Goyal, P., Girshick, R., He, K., Doll\u00e1r, P.: Focal loss for dense object detection. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 2980\u20132988 (2017)","DOI":"10.1109\/ICCV.2017.324"},{"key":"1074_CR37","doi-asserted-by":"publisher","first-page":"47687","DOI":"10.1109\/ACCESS.2019.2910201","volume":"7","author":"CY Lin","year":"2019","unstructured":"Lin, C.Y., Xie, H.X., Zheng, H.: PedJointNet: joint head-shoulder and full body deep network for pedestrian detection. IEEE Access 7, 47687\u201347697 (2019)","journal-title":"IEEE Access"},{"key":"1074_CR38","doi-asserted-by":"crossref","unstructured":"Zhang, S., Yang, X., Liu, Y., Xu, C.: Asymmetric multi-stage CNNs for small-scale pedestrian detection. Neurocomputing 12\u201326 (2020)","DOI":"10.1016\/j.neucom.2020.05.019"},{"key":"1074_CR39","doi-asserted-by":"publisher","first-page":"76243","DOI":"10.1109\/ACCESS.2020.2986476","volume":"8","author":"Y Zhang","year":"2020","unstructured":"Zhang, Y., Yi, P., Zhou, D., Yang, X., Zhang, Q., Wei, P.: CSANet: channel and spatial mixed attention CNN for pedestrian detection. IEEE Access 8, 76243\u201376252 (2020)","journal-title":"IEEE Access"},{"key":"1074_CR40","doi-asserted-by":"crossref","unstructured":"Song, T., Sun, L., Xie, D., Sun, H., Pu, S.: Small-scale pedestrian detection based on topological line localization and temporal feature aggregation. In: 2018 European Conference on Computer Vision (ECCV), pp. 536\u2013551 (2018)","DOI":"10.1007\/978-3-030-01234-2_33"},{"key":"1074_CR41","doi-asserted-by":"crossref","unstructured":"Tian, Y., Luo, P., Wang, X., Tang, X.: Deep learning strong parts for pedestrian detection. In: 2015 IEEE international conference on computer vision, pp. 1904\u20131912 (2015)","DOI":"10.1109\/ICCV.2015.221"},{"issue":"4","key":"1074_CR42","doi-asserted-by":"publisher","first-page":"761","DOI":"10.1007\/s11760-018-1406-6","volume":"13","author":"Z Li","year":"2019","unstructured":"Li, Z., Chen, Z., Wu, Q.J., Liu, C.: Real-time pedestrian detection with deep supervision in the wild. SIViP 13(4), 761\u2013769 (2019)","journal-title":"SIViP"},{"key":"1074_CR43","unstructured":"Du, X., EI-Khamy, M., Morariu, V., Lee, J., Davis, L.: Fused deep neural networks for efficient pedestrian detection. arXiv:1805.08688 (2016)"},{"key":"1074_CR44","doi-asserted-by":"publisher","DOI":"10.1007\/s11227-020-03345-4","author":"M Saeidi","year":"2020","unstructured":"Saeidi, M., Ahmadi, A.: High-performance and deep pedestrian detection based on estimation of different parts. J Supercomput (2020). https:\/\/doi.org\/10.1007\/s11227-020-03345-4","journal-title":"J Supercomput"}],"container-title":["Journal of Real-Time Image Processing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11554-021-01074-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11554-021-01074-2\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11554-021-01074-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,12,12]],"date-time":"2022-12-12T22:39:55Z","timestamp":1670884795000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11554-021-01074-2"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,1,22]]},"references-count":44,"journal-issue":{"issue":"6","published-print":{"date-parts":[[2021,12]]}},"alternative-id":["1074"],"URL":"https:\/\/doi.org\/10.1007\/s11554-021-01074-2","relation":{},"ISSN":["1861-8200","1861-8219"],"issn-type":[{"value":"1861-8200","type":"print"},{"value":"1861-8219","type":"electronic"}],"subject":[],"published":{"date-parts":[[2021,1,22]]},"assertion":[{"value":"18 August 2020","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 January 2021","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"22 January 2021","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}