{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,20]],"date-time":"2026-01-20T02:36:20Z","timestamp":1768876580365,"version":"3.49.0"},"reference-count":37,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2019,1,24]],"date-time":"2019-01-24T00:00:00Z","timestamp":1548288000000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61203261"],"award-info":[{"award-number":["61203261"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61876099"],"award-info":[{"award-number":["61876099"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"name":"China Postdoctoral Science Foundation funded project","award":["2012M521335"],"award-info":[{"award-number":["2012M521335"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["SIViP"],"published-print":{"date-parts":[[2019,6]]},"DOI":"10.1007\/s11760-018-1406-6","type":"journal-article","created":{"date-parts":[[2019,1,24]],"date-time":"2019-01-24T22:00:36Z","timestamp":1548367236000},"page":"761-769","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":16,"title":["Real-time pedestrian detection with deep supervision in the wild"],"prefix":"10.1007","volume":"13","author":[{"given":"Zhaoqing","family":"Li","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9637-5170","authenticated-orcid":false,"given":"Zhenxue","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Q. M. Jonathan","family":"Wu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chengyun","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2019,1,24]]},"reference":[{"key":"1406_CR1","first-page":"613","volume":"8926","author":"R Benenson","year":"2014","unstructured":"Benenson, R., Omran, M., Hosang, J., Schiele, B.: Ten years of pedestrian detection, what have we learned? Eur. Conf. Comput. Vis. 8926, 613\u2013627 (2014)","journal-title":"Eur. Conf. Comput. Vis."},{"key":"1406_CR2","doi-asserted-by":"crossref","unstructured":"Cai, Z., Saberian, M., Vasconcelos, N.: Learning complexity aware cascades for deep pedestrian detection. In: 2015 IEEE International Conference on Computer Vision (ICCV), pp. 3361\u20133369 (2015)","DOI":"10.1109\/ICCV.2015.384"},{"key":"1406_CR3","doi-asserted-by":"crossref","unstructured":"Du, X., El-Khamy, M., Lee, J., Davis, L.: Fused dnn: a deep neural network fusion approach to fast and robust pedestrian detection. In: 2017 IEEE Winter Conference on Applications of Computer Vision (WACV), pp. 953\u2013961 (2017)","DOI":"10.1109\/WACV.2017.111"},{"key":"1406_CR4","unstructured":"Dalal, N., Triggs, B.: Histograms of oriented gradients for human detection. In: 2005 IEEE Computer Society Conference on Computer Vision and Pattern Recognition (CVPR\u201905), vol. 1, pp. 886\u2013893 (2005)"},{"key":"1406_CR5","unstructured":"Perona, P., Dollar, P., Schiele B., Wojek, C.: http:\/\/www.vision.caltech.edu\/Image_Datasets\/CaltechPedestrians"},{"key":"1406_CR6","unstructured":"Dollar, P., Tu, Z., Tao, H., Belongie, S.: Feature mining for image classification. In: IEEE Conference on Computer Vision and Pattern Recognition, 2007, CVPR\u201907, pp. 1\u20138 (2007)"},{"issue":"8","key":"1406_CR7","doi-asserted-by":"publisher","first-page":"1532","DOI":"10.1109\/TPAMI.2014.2300479","volume":"36","author":"P Dollr","year":"2014","unstructured":"Dollr, P., Appel, R., Belongie, S., Perona, P.: Fast feature pyramids for object detection. IEEE Trans. Pattern Anal. Mach. Intell. 36(8), 1532\u20131545 (2014)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"4","key":"1406_CR8","doi-asserted-by":"publisher","first-page":"743","DOI":"10.1109\/TPAMI.2011.155","volume":"34","author":"P Dollr","year":"2011","unstructured":"Dollr, P., Wojek, C., Schiele, B., Perona, P.: Pedestrian detection: an evaluation of the state of the art. IEEE Trans. Pattern Anal. Mach. Intell. 34(4), 743\u2013761 (2011)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1406_CR9","doi-asserted-by":"crossref","unstructured":"Ess, A., Leibe, B., Gool, L.V.: Depth and appearance for mobile scene analysis. In: 2007 IEEE 11th International Conference on Computer Vision, pp. 1\u20138 (2007)","DOI":"10.1109\/ICCV.2007.4409092"},{"key":"1406_CR10","doi-asserted-by":"crossref","unstructured":"Felzenszwalb, P., McAllester, D., Ramanan, D.: A discriminatively trained, multiscale, deformable part model. In: 2008 IEEE Conference on Computer Vision and Pattern Recognition, vol. 8, pp. 1\u20138 (2008)","DOI":"10.1109\/CVPR.2008.4587597"},{"key":"1406_CR11","unstructured":"Fu, C.Y., Liu, W., Ranga, A., Tyagi, A., Berg, A.C.: Dssd: deconvolutional single shot detector. In: Computer Vision and Pattern Recognition (2017)"},{"key":"1406_CR12","doi-asserted-by":"crossref","unstructured":"Ghorban, F., Marn, J., Su, Y., Colombo, A., Kummert, A.: Aggregated channels network for real-time pedestrian detection. In: Computer Vision and Pattern Recognition (2018)","DOI":"10.1117\/12.2309864"},{"key":"1406_CR13","doi-asserted-by":"crossref","unstructured":"Girshick, R.: Fast r-cnn. In: 2015 IEEE International Conference on Computer Vision (ICCV), pp. 1440\u20131448 (2015)","DOI":"10.1109\/ICCV.2015.169"},{"key":"1406_CR14","doi-asserted-by":"crossref","unstructured":"Girshick, R., Donahue, J., Darrell, T., Malik, J.: Rich feature hierarchies for accurate object detection and semantic segmentation. In 2014 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 580\u2013587 (2014)","DOI":"10.1109\/CVPR.2014.81"},{"key":"1406_CR15","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"1406_CR16","doi-asserted-by":"crossref","unstructured":"Lan, X., Ye, M., Zhang, S., Yuen, P.C.: Robust collaborative discriminative learning for rgb-infrared tracking. In: AAAI Conference on Artificial Intelligence, pp. 7008\u20137015 (2018)","DOI":"10.1609\/aaai.v32i1.12307"},{"key":"1406_CR17","first-page":"09","volume":"38","author":"C Lee","year":"2014","unstructured":"Lee, C., Xie, S., Gallagher, P., Zhang, Z., Tu, Z.: Deeply-supervised nets. AISTATS 38, 09 (2014)","journal-title":"AISTATS"},{"key":"1406_CR18","doi-asserted-by":"crossref","unstructured":"Lee, A.Y., Kim, H., Park, E., Cui, X., Kim, H.: Wide-residual-inception networks for real-time object detection. In: 2017 IEEE Intelligent Vehicles Symposium (IV), pp. 758\u2013764 (2017)","DOI":"10.1109\/IVS.2017.7995808"},{"key":"1406_CR19","first-page":"423","volume":"5305","author":"Z Lin","year":"2008","unstructured":"Lin, Z., Davis, L.S.: A pose-invariant descriptor for human detection and segmentation. Eur. Conf. Comput. Vis. 5305, 423\u2013436 (2008)","journal-title":"Eur. Conf. Comput. Vis."},{"key":"1406_CR20","doi-asserted-by":"publisher","first-page":"21","DOI":"10.1007\/s11263-015-0844-7","volume":"9905","author":"W Liu","year":"2016","unstructured":"Liu, W., Anguelov, D., Erhan, D., Szegedy, C., Reed, S., Fu, C.Y., Berg, A.C.: Ssd: single shot multibox detector. Eur. Conf. Comput. Vis. 9905, 21\u201337 (2016)","journal-title":"Eur. Conf. Comput. Vis."},{"key":"1406_CR21","unstructured":"Maji, S., Berg, A.C., Malik, J:. Classification using intersection kernel support vector machines is efficient. In: IEEE Conference on Computer Vision and Pattern Recognition, 2008. CVPR 2008, pp. 1\u20138 (2008)"},{"key":"1406_CR22","unstructured":"Nam, W., Dollr, P., Han, J.H.: Local decorrelation for improved pedestrian detection. In: NIPS, vol. 1, pp. 1\u20139 (2014)"},{"key":"1406_CR23","doi-asserted-by":"crossref","unstructured":"Ouyang, W., Wang, X.: Joint deep learning for pedestrian detection. In: 2013 IEEE International Conference on Computer Vision, pp. 2056\u20132063 (2013)","DOI":"10.1109\/ICCV.2013.257"},{"key":"1406_CR24","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-10593-2_36","volume-title":"Strengthening the Effectiveness of Pedestrian Detection with Spatially Pooled Features","author":"S Paisitkriangkrai","year":"2014","unstructured":"Paisitkriangkrai, S., Shen, C., Hengel, A., Van, D.: Strengthening the Effectiveness of Pedestrian Detection with Spatially Pooled Features. Springer, Berlin (2014)"},{"key":"1406_CR25","doi-asserted-by":"crossref","unstructured":"Pedro, P.O., Lin, T.Y., Collobert, R., Dollr, P.: Learning to refine object segments. In: Lecture Notes in Computer Science, vol. 9905, pp. 75\u201391 (2016)","DOI":"10.1007\/978-3-319-46448-0_5"},{"key":"1406_CR26","doi-asserted-by":"crossref","unstructured":"Redmon, J., Divvala, S., Girshick, R., Farhadi, A.: You only look once: unified, real-time object detection. In: 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 779\u2013788 (2016)","DOI":"10.1109\/CVPR.2016.91"},{"key":"1406_CR27","doi-asserted-by":"publisher","first-page":"1137","DOI":"10.1109\/TPAMI.2016.2577031","volume":"39","author":"S Ren","year":"2017","unstructured":"Ren, S., He, K., Girshick, R., Sun, J.: Faster r-cnn: towards real-time object detection with region proposal networks. IEEE Trans. Pattern Anal. Mach. Intell. 39, 1137\u20131149 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"11","key":"1406_CR28","doi-asserted-by":"publisher","first-page":"5298","DOI":"10.1109\/TIP.2017.2735182","volume":"26","author":"W Shen","year":"2017","unstructured":"Shen, W., Zhao, K., Jiang, Y., Wang, Y., Bai, X., Yuille, A.: Deepskeleton: learning multi-task scale-associated deep side outputs for object skeleton extraction in natural images. IEEE Trans. Image Process. 26(11), 5298\u20135311 (2017)","journal-title":"IEEE Trans. Image Process."},{"issue":"C","key":"1406_CR29","doi-asserted-by":"publisher","first-page":"482","DOI":"10.1016\/j.image.2016.05.007","volume":"47","author":"D Tom","year":"2016","unstructured":"Tom, D., Monti, F., Baroffio, L., Bondi, L., Tagliasacchi, M., Tubaro, S.: Deep convolutional neural networks for pedestrian detection. Signal Process. Image Commun. 47(C), 482\u2013489 (2016)","journal-title":"Signal Process. Image Commun."},{"issue":"2","key":"1406_CR30","first-page":"734","volume":"2","author":"P Viola","year":"2003","unstructured":"Viola, P., Jones, M.J., Snow, D.: Detecting pedestrians using patterns of motion appearance. Int. J. Comput. Vis. 2(2), 734\u2013741 (2003)","journal-title":"Int. J. Comput. Vis."},{"issue":"4","key":"1406_CR31","doi-asserted-by":"publisher","first-page":"82","DOI":"10.1007\/978-3-540-69321-5_9","volume":"4","author":"C Wojek","year":"2008","unstructured":"Wojek, C., Schiele, B.: A performance evaluation of single and multi-feature people detection. DAGM Symp. Pattern Recognit. 4(4), 82\u201391 (2008)","journal-title":"DAGM Symp. Pattern Recognit."},{"issue":"1","key":"1406_CR32","doi-asserted-by":"publisher","first-page":"3","DOI":"10.1007\/s11263-017-1004-z","volume":"125","author":"S Xie","year":"2017","unstructured":"Xie, S., Tu, Z.: Holistically-nested edge detection. Int. J. Comput. Vis. 125(1), 3\u201318 (2017)","journal-title":"Int. J. Comput. Vis."},{"key":"1406_CR33","doi-asserted-by":"crossref","unstructured":"Yang, B., Yan, J., Lei, Z., Li, S. Z.: Convolutional channel features. In: 2015 IEEE International Conference on Computer Vision, pp. 82\u201390 (2015)","DOI":"10.1109\/ICCV.2015.18"},{"key":"1406_CR34","first-page":"443","volume":"9906","author":"L Zhang","year":"2016","unstructured":"Zhang, L., Lin, L., Liang, X., He, K.: Is faster r-cnn doing well for pedestrian detection? Eur. Conf. Comput. Vis. 9906, 443\u2013457 (2016)","journal-title":"Eur. Conf. Comput. Vis."},{"issue":"99","key":"1406_CR35","first-page":"1","volume":"PP","author":"S Zhang","year":"2018","unstructured":"Zhang, S., Benenson, R., Omran, M., Hosang, J., Schiele, B.: Towards reaching human performance in pedestrian detection. IEEE Trans. Pattern Anal. Mach. Intell. PP(99), 1 (2018)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"8","key":"1406_CR36","doi-asserted-by":"publisher","first-page":"3703","DOI":"10.1109\/TIP.2018.2818018","volume":"27","author":"X Zhang","year":"2018","unstructured":"Zhang, X., Cheng, L., Li, B., Hu, H.M.: Too far to see? Not really!\u2014pedestrian detection with scale-aware localization policy. IEEE Trans. Image Process. 27(8), 3703\u20133715 (2018)","journal-title":"IEEE Trans. Image Process."},{"key":"1406_CR37","doi-asserted-by":"crossref","unstructured":"Zhang, Z., Qiao, S., Xie, C., Shen, W., Wang, B., Yuille, A.: Single-shot object detection with enriched semantics. In: Computer Vision and Pattern Recognition, vol. 12 (2017)","DOI":"10.1109\/CVPR.2018.00609"}],"container-title":["Signal, Image and Video Processing"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11760-018-1406-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11760-018-1406-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11760-018-1406-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,9,10]],"date-time":"2022-09-10T22:39:43Z","timestamp":1662849583000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11760-018-1406-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019,1,24]]},"references-count":37,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2019,6]]}},"alternative-id":["1406"],"URL":"https:\/\/doi.org\/10.1007\/s11760-018-1406-6","relation":{},"ISSN":["1863-1703","1863-1711"],"issn-type":[{"value":"1863-1703","type":"print"},{"value":"1863-1711","type":"electronic"}],"subject":[],"published":{"date-parts":[[2019,1,24]]},"assertion":[{"value":"12 July 2018","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 November 2018","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"17 December 2018","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"24 January 2019","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}