{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,20]],"date-time":"2026-08-20T14:42:21Z","timestamp":1787236941827,"version":"build-2736575974"},"reference-count":13,"publisher":"Institute of Electronics, Information and Communications Engineers (IEICE)","issue":"2","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEICE Trans. Inf. &amp; Syst."],"published-print":{"date-parts":[[2025,2,1]]},"DOI":"10.1587\/transinf.2024edl8067","type":"journal-article","created":{"date-parts":[[2024,9,17]],"date-time":"2024-09-17T18:10:50Z","timestamp":1726596650000},"page":"165-168","source":"Crossref","is-referenced-by-count":3,"title":["D2PT: Density to Point Transformer with Knowledge Distillation for Crowd Counting and Localization"],"prefix":"10.1587","volume":"E108.D","author":[{"given":"Fan","family":"LI","sequence":"first","affiliation":[{"name":"China Academy of Railway Sciences Corporation Limited"},{"name":"Department of Computer Science and Technology, Tsinghua University"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Enze","family":"YANG","sequence":"additional","affiliation":[{"name":"China Academy of Railway Sciences Corporation Limited"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Chao","family":"LI","sequence":"additional","affiliation":[{"name":"China Academy of Railway Sciences Corporation Limited"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shuoyan","family":"LIU","sequence":"additional","affiliation":[{"name":"China Academy of Railway Sciences Corporation Limited"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Haodong","family":"WANG","sequence":"additional","affiliation":[{"name":"Department of Computer Science and Technology, Tsinghua University"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"532","reference":[{"key":"1","doi-asserted-by":"crossref","unstructured":"[1] Y. Zhang, D. Zhou, S. Chen, S. Gao, and Y. Ma, \u201cSingle-image crowd counting via multi-column convolutional neural network,\u201d 2016 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2016, Las Vegas, NV, USA, June 27-30, 2016, pp.589-597, 2016. 10.1109\/cvpr.2016.70","DOI":"10.1109\/CVPR.2016.70"},{"key":"2","doi-asserted-by":"crossref","unstructured":"[2] Y. Li, X. Zhang, and D. Chen, \u201cCsrnet: Dilated convolutional neural networks for understanding the highly congested scenes,\u201d 2018 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2018, Salt Lake City, UT, USA, June 18-22, 2018, pp.1091-1100, 2018. 10.1109\/cvpr.2018.00120","DOI":"10.1109\/CVPR.2018.00120"},{"key":"3","doi-asserted-by":"crossref","unstructured":"[3] V.A. Sindagi and V.M. Patel, \u201cGenerating high-quality crowd density maps using contextual pyramid cnns,\u201d IEEE International Conference on Computer Vision, ICCV 2017, Venice, Italy, Oct. 22-29, 2017, pp.1879-1888, 2017. 10.1109\/iccv.2017.206","DOI":"10.1109\/ICCV.2017.206"},{"key":"4","doi-asserted-by":"crossref","unstructured":"[4] M. Rodriguez, I. Laptev, J. Sivic, and J.-Y. Audibert, \u201cDensity-aware person detection and tracking in crowds,\u201d IEEE International Conference on Computer Vision, ICCV 2011, Barcelona, Spain, Nov. 6-13, 2011, pp.2423-2430, 2011. 10.1109\/iccv.2011.6126526","DOI":"10.1109\/ICCV.2011.6126526"},{"key":"5","doi-asserted-by":"crossref","unstructured":"[5] Q. Song, C. Wang, Z. Jiang, Y. Wang, Y. Tai, C. Wang, J. Li, F. Huang, and Y. Wu, \u201cRethinking counting and localization in crowds: A purely point-based framework,\u201d 2021 IEEE\/CVF International Conference on Computer Vision, ICCV 2021, Montreal, QC, Canada, Oct. 10-17, 2021, pp.3345-3354, 2021. 10.1109\/iccv48922.2021.00335","DOI":"10.1109\/ICCV48922.2021.00335"},{"key":"6","doi-asserted-by":"publisher","unstructured":"[6] D. Liang, X. Chen, W. Xu, Y. Zhou, and X. Bai, \u201cTranscrowd: weakly-supervised crowd counting with transformers,\u201d Sci. China Inf. Sci., vol.65, no.6, pp.1-14, 2022. 10.1007\/s11432-021-3445-y","DOI":"10.1007\/s11432-021-3445-y"},{"key":"7","unstructured":"[7] T. Furlanello, Z.C. Lipton, M. Tschannen, L. Itti, and A. Anandkumar, \u201cBorn-again neural networks,\u201d Proceedings of Machine Learning Research, vol.80, pp.1602-1611, 2018."},{"key":"8","doi-asserted-by":"crossref","unstructured":"[8] M. Caron, H. Touvron, I. Misra, H. J\u00e9gou, J. Mairal, P. Bojanowski, and A. Joulin, \u201cEmerging properties in self-supervised vision transformers,\u201d 2021 IEEE\/CVF International Conference on Computer Vision, ICCV 2021, Montreal, QC, Canada, Oct. 10-17, 2021, pp.9630-9640, 2021. 10.1109\/iccv48922.2021.00951","DOI":"10.1109\/ICCV48922.2021.00951"},{"key":"9","doi-asserted-by":"crossref","unstructured":"[9] S. Yang, W. Guo, and Y. Ren, \u201cCrowdformer: An overlap patching vision transformer for top-down crowd counting,\u201d Proc. Thirty-First International Joint Conference on Artificial Intelligence, IJCAI 2022, Vienna, Austria, 23-29 July 2022, pp.1545-1551, 2022. 10.24963\/ijcai.2022\/215","DOI":"10.24963\/ijcai.2022\/215"},{"key":"10","doi-asserted-by":"publisher","unstructured":"[10] Q. Wang, J. Gao, W. Lin, and X. Li, \u201cNwpu-crowd: A large-scale benchmark for crowd counting and localization,\u201d IEEE Trans. Pattern Anal. Mach. Intell., vol.43, no.6, pp.2141-2149, 2021. 10.1109\/tpami.2020.3013269","DOI":"10.1109\/TPAMI.2020.3013269"},{"key":"11","doi-asserted-by":"crossref","unstructured":"[11] H. Idrees, M. Tayyab, K. Athrey, D. Zhang, S. Al-M\u00e1adeed, N. Rajpoot, and M. Shah, \u201cComposition loss for counting, density map estimation and localization in dense crowds,\u201d Computer Vision- ECCV 2018 - 15th European Conference, Munich, Germany, Sept. 8-14, 2018, Proceedings, Part II, pp.544-559, 2018. 10.1007\/978-3-030-01216-8_33","DOI":"10.1007\/978-3-030-01216-8_33"},{"key":"12","doi-asserted-by":"crossref","unstructured":"[12] Q. Wang, J. Gao, W. Lin, and Y. Yuan, \u201cLearning from synthetic data for crowd counting in the wild,\u201d IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2019, Long Beach, CA, USA, June 16-20, 2019, pp.8198-8207, Computer Vision Foundation\/IEEE, 2019. 10.1109\/cvpr.2019.00839","DOI":"10.1109\/CVPR.2019.00839"},{"key":"13","doi-asserted-by":"crossref","unstructured":"[13] D. Liang, W. Xu, and X. Bai, \u201cAn end-to-end transformer model for crowd localization,\u201d Computer Vision - ECCV 2022 - 17th European Conference, Tel Aviv, Israel, Oct. 23-27, 2022, Proceedings, Part I, pp.38-54, 2022. 10.1007\/978-3-031-19769-7_3","DOI":"10.1007\/978-3-031-19769-7_3"}],"container-title":["IEICE Transactions on Information and Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/www.jstage.jst.go.jp\/article\/transinf\/E108.D\/2\/E108.D_2024EDL8067\/_pdf","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,1,31]],"date-time":"2025-01-31T22:30:44Z","timestamp":1738362644000},"score":1,"resource":{"primary":{"URL":"https:\/\/www.jstage.jst.go.jp\/article\/transinf\/E108.D\/2\/E108.D_2024EDL8067\/_article"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,2,1]]},"references-count":13,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2025]]}},"URL":"https:\/\/doi.org\/10.1587\/transinf.2024edl8067","relation":{},"ISSN":["0916-8532","1745-1361"],"issn-type":[{"value":"0916-8532","type":"print"},{"value":"1745-1361","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,2,1]]},"article-number":"2024EDL8067"}}