{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,11,17]],"date-time":"2025-11-17T03:05:33Z","timestamp":1763348733130,"version":"3.44.0"},"reference-count":44,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2025,5,2]],"date-time":"2025-05-02T00:00:00Z","timestamp":1746144000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,5,2]],"date-time":"2025-05-02T00:00:00Z","timestamp":1746144000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"the National Nature Science Foundation of China","doi-asserted-by":"crossref","award":["51804250"],"award-info":[{"award-number":["51804250"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimedia Systems"],"published-print":{"date-parts":[[2025,6]]},"DOI":"10.1007\/s00530-025-01807-4","type":"journal-article","created":{"date-parts":[[2025,5,2]],"date-time":"2025-05-02T08:58:14Z","timestamp":1746176294000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["TMU-GAN: a compliance detection algorithm for protective equipment in power operations"],"prefix":"10.1007","volume":"31","author":[{"given":"Xuecun","family":"Yang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jiayu","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Qingyun","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yixiang","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhonghua","family":"Dong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Gaoting","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2025,5,2]]},"reference":[{"key":"1807_CR1","unstructured":"Li, K., Zhao, X., Bian, J., Tan, M.: Automatic Safety Helmet Wearing Detection, arXiv preprint arXiv:1802.00264, (2018)"},{"key":"1807_CR2","unstructured":"Bajracharya, D.: Real time pattern recognition in digital video with applications to safety in construction sites, Ph.D. thesis, (2013)"},{"key":"1807_CR3","doi-asserted-by":"crossref","unstructured":"Li, J., Liu, H., Wang, T., Jiang, M., Wang, S., Li, K., Zhao, X.: Safety helmet wearing detection based on image processing and machine learning, In: Proceedings of the 2017 Ninth International Conference on Advanced Computational Intelligence (ICACI), IEEE, pp. 201-205, (2017)","DOI":"10.1109\/ICACI.2017.7974509"},{"key":"1807_CR4","doi-asserted-by":"crossref","unstructured":"Dahiya, K., Singh, D., Mohan, C. K.: Automatic detection of bike-riders without helmet using surveillance videos in real-time, In: Proceedings of the 2016 International Joint Conference on Neural Networks (IJCNN), IEEE, pp. 3046-3051, (2016)","DOI":"10.1109\/IJCNN.2016.7727586"},{"issue":"22","key":"1807_CR5","doi-asserted-by":"publisher","first-page":"4675","DOI":"10.3390\/electronics12224675","volume":"12","author":"M Riaz","year":"2023","unstructured":"Riaz, M., He, J., Xie, K., Alsagri, H.S., Moqurrab, S.A., Alhakbani, H.A.A., Obidallah, W.J.: Enhancing Workplace Safety: PPE_Swin-A Robust Swin Transformer Approach for Automated Personal Protective Equipment Detection. Electronics 12(22), 4675 (2023).","journal-title":"Electronics"},{"key":"1807_CR6","doi-asserted-by":"crossref","unstructured":"Ronneberger, O., Fischer, P., Brox, T.: U-Net: Convolutional Networks for Biomedical Image Segmentation, In: Medical Image Computing and Computer-Assisted Intervention \u2013 MICCAI 2015, Springer, pp. 234-241, (2015)","DOI":"10.1007\/978-3-319-24574-4_28"},{"key":"1807_CR7","doi-asserted-by":"crossref","unstructured":"Liu, Z., Lin, Y., Cao, Y., Hu, H., Wei, Y., Zhang, Z., Lin, S., Guo, B.: Swin Transformer: Hierarchical Vision Transformer using Shifted Windows, In: Proceedings of the IEEE\/CVF International Conference on Computer Vision (ICCV), IEEE, pp. 10012-10022, (2021)","DOI":"10.1109\/ICCV48922.2021.00986"},{"key":"1807_CR8","doi-asserted-by":"crossref","unstructured":"Truong, T., Bhatt, A., Queiroz, L., Lai, K., Yanushkevich, S.: Instance Segmentation of Personal Protective Equipment using a Multi-stage Transfer Learning Process, In: Proceedings of the 2020 IEEE International Conference on Systems, Man, and Cybernetics (SMC), IEEE, pp. 1181-1186, (2020)","DOI":"10.1109\/SMC42975.2020.9283427"},{"key":"1807_CR9","doi-asserted-by":"crossref","unstructured":"He, K., Gkioxari, G., Dollar, P., Girshick, R.: Mask R-CNN, In: Proceedings of the IEEE International Conference on Computer Vision (ICCV), IEEE, pp. 2961-2969, (2017)","DOI":"10.1109\/ICCV.2017.322"},{"issue":"10","key":"1807_CR10","doi-asserted-by":"publisher","first-page":"3478","DOI":"10.3390\/s21103478","volume":"21","author":"Z Wang","year":"2021","unstructured":"Wang, Z., Wu, Y., Yang, L., Thirunavukarasu, A., Evison, C., Zhao, Y.: Fast Personal Protective Equipment Detection for Real Construction Sites Using Deep Learning Approaches. Sensors 21(10), 3478 (2021). (MDPI)","journal-title":"Sensors"},{"key":"1807_CR11","doi-asserted-by":"publisher","first-page":"e999","DOI":"10.7717\/peerj-cs.999","volume":"8","author":"M Ferdous","year":"2022","unstructured":"Ferdous, M., Ahsan, S.M.M.: PPE detector: a YOLO-based architecture to detect personal protective equipment (PPE) for construction sites. Peer J Comput. Sci. 8, e999 (2022)","journal-title":"Peer J Comput. Sci."},{"key":"1807_CR12","unstructured":"Ge, Z., Liu, S., Wang, F., Li, Z., Sun, J.: YOLOX: Exceeding YOLO Series in 2021, arXiv preprint arXiv:2107.08430, (2021)"},{"key":"1807_CR13","doi-asserted-by":"publisher","first-page":"2445","DOI":"10.1007\/s00521-023-09212-6","volume":"36","author":"H Samma","year":"2024","unstructured":"Samma, H., Al-Azani, S., Luqman, H.: others: Contrastive-based YOLOv7 for personal protective equipment detection. Neural Comput. Appl. 36, 2445\u20132457 (2024)","journal-title":"Neural Comput. Appl."},{"key":"1807_CR14","doi-asserted-by":"crossref","unstructured":"Wang, C.-Y., Bochkovskiy, A., Liao, H.-Y. M.: YOLOv7: Trainable Bag-of-Freebies Sets New State-of-the-Art for Real-Time Object Detectors, In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), IEEE, pp. 7464-7475, (2023)","DOI":"10.1109\/CVPR52729.2023.00721"},{"issue":"18","key":"1807_CR15","doi-asserted-by":"publisher","first-page":"13990","DOI":"10.3390\/su151813990","volume":"15","author":"MIB Ahmed","year":"2023","unstructured":"Ahmed, M.I.B., Saraireh, L., Rahman, A., Al-Qarawi, S., Mhran, A., Al-Jalaoud, J., Al-Mudaifer, D., Al-Haidar, F., AlKhulaifi, D., Youldash, M., Gollapalli, M.: Personal Protective Equipment Detection: A Deep-Learning-Based Sustainable Approach. Sustainability 15(18), 13990 (2023)","journal-title":"Sustainability"},{"issue":"6","key":"1807_CR16","doi-asserted-by":"publisher","first-page":"1137","DOI":"10.1109\/TPAMI.2016.2577031","volume":"39","author":"S Ren","year":"2017","unstructured":"Ren, S., He, K., Girshick, R., Sun, J.: Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks. IEEE Trans. Pattern Anal. Mach. Intell. 39(6), 1137\u20131149 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"11","key":"1807_CR17","doi-asserted-by":"publisher","first-page":"1449","DOI":"10.3390\/sym16111449","volume":"16","author":"Q Zhou","year":"2024","unstructured":"Zhou, Q., Liu, D.: Improving Safety in High-Altitude Work: Semantic Segmentation of Safety Harnesses with CEMFormer. Symmetry 16(11), 1449 (2024)","journal-title":"Symmetry"},{"issue":"6","key":"1807_CR18","doi-asserted-by":"publisher","first-page":"1878","DOI":"10.3390\/buildings14061878","volume":"14","author":"SFA Zaidi","year":"2024","unstructured":"Zaidi, S.F.A., Yang, J., Abbas, M.S., Hussain, R., Lee, D., Park, C.: Vision-Based Construction Safety Monitoring Utilizing Temporal Analysis to Reduce False Alarms. Buildings 14(6), 1878 (2024)","journal-title":"Buildings"},{"issue":"15","key":"1807_CR19","doi-asserted-by":"publisher","first-page":"2990","DOI":"10.3390\/electronics13152990","volume":"13","author":"P Sanjeewani","year":"2024","unstructured":"Sanjeewani, P., Neuber, G., Fitzgerald, J., Chandrasena, N., Potums, S., Alavi, A., Lane, C.: Real-Time Personal Protective Equipment Non-Compliance Recognition on AI Edge Cameras. Electronics 13(15), 2990 (2024)","journal-title":"Electronics"},{"key":"1807_CR20","doi-asserted-by":"publisher","first-page":"104779","DOI":"10.1016\/j.autcon.2023.104779","volume":"149","author":"W-C Chern","year":"2023","unstructured":"Chern, W.-C., Hyeon, J., Nguyen, T.V., Asari, V.K., Kim, H.: Context-aware safety assessment system for far-field monitoring. Autom. Constr. 149, 104779 (2023)","journal-title":"Autom. Constr."},{"issue":"1","key":"1807_CR21","doi-asserted-by":"publisher","first-page":"133","DOI":"10.1108\/IJICC-08-2024-0383","volume":"18","author":"H Song","year":"2025","unstructured":"Song, H., Xia, H., Wang, W., Zhou, Y., Liu, W., Liu, Q., Liu, J.: QAGA-Net: Enhanced vision transformer-based object detection for remote sensing images. Int. J. Intell. Comput. Cybern. 18(1), 133\u2013152 (2025)","journal-title":"Int. J. Intell. Comput. Cybern."},{"issue":"1","key":"1807_CR22","doi-asserted-by":"publisher","first-page":"101929","DOI":"10.1016\/j.jksuci.2024.101929","volume":"36","author":"Z Chen","year":"2024","unstructured":"Chen, Z., Yang, J., Zhou, F.: RailSegVITNet: A lightweight VIT-based real-time track surface segmentation network for improving railroad safety. J. King Saud Univ.-Comput. Inf. Sci. 36(1), 101929 (2024)","journal-title":"J. King Saud Univ.-Comput. Inf. Sci."},{"issue":"189","key":"1807_CR23","doi-asserted-by":"publisher","first-page":"e70004","DOI":"10.1111\/phor.70004","volume":"40","author":"H Song","year":"2025","unstructured":"Song, H., Xie, J., Wang, Y., Fu, L., Zhou, Y., Zhou, X.: Optimized Data Distribution Learning for Enhancing Vision Transformer-Based Object Detection in Remote Sensing Images. Photogramm. Rec. 40(189), e70004 (2025)","journal-title":"Photogramm. Rec."},{"issue":"4","key":"1807_CR24","doi-asserted-by":"publisher","first-page":"56","DOI":"10.33166\/AETiC.2024.04.003","volume":"10","author":"H Song","year":"2024","unstructured":"Song, H., Zhou, Y., Liu, W., Zhao, D., Liu, Q., Liu, J.: Variance consistency learning: enhancing cross-modal knowledge distillation for remote sensing image classification. Ann. Emerg. Technol. Comput. (AETiC) 10(4), 56\u201376 (2024)","journal-title":"Ann. Emerg. Technol. Comput. (AETiC)"},{"issue":"186","key":"1807_CR25","doi-asserted-by":"publisher","first-page":"340","DOI":"10.1111\/phor.12489","volume":"39","author":"H Song","year":"2024","unstructured":"Song, H., Yuan, Y., Ouyang, Z., Yang, Y., Xiang, H.: Quantitative regularization in robust vision transformer for remote sensing image classification. Photogramm. Rec. 39(186), 340\u2013372 (2024)","journal-title":"Photogramm. Rec."},{"issue":"1","key":"1807_CR26","doi-asserted-by":"publisher","first-page":"5507","DOI":"10.1038\/s41598-025-89735-1","volume":"15","author":"H Song","year":"2025","unstructured":"Song, H., Xie, H., Duan, Y., Xie, X., Gan, F., Wang, W., Liu, J.: Pure data correction enhancing remote sensing image classification with a lightweight ensemble model. Sci. Rep. 15(1), 5507 (2025)","journal-title":"Sci. Rep."},{"issue":"6","key":"1807_CR27","doi-asserted-by":"publisher","first-page":"1751","DOI":"10.3390\/s25061751","volume":"25","author":"W Wang","year":"2025","unstructured":"Wang, W., Ding, J., Shu, X., Xu, W., Wu, Y.: FFAE-UNet: An Efficient Pear Leaf Disease Segmentation Network Based on U-Shaped Architecture. Sensors 25(6), 1751 (2025)","journal-title":"Sensors"},{"key":"1807_CR28","doi-asserted-by":"publisher","first-page":"234","DOI":"10.1016\/j.aej.2024.09.108","volume":"110","author":"D Chen","year":"2025","unstructured":"Chen, D., Qin, F., Ge, R., Peng, Y., Wang, C.: ID-UNet: A densely connected UNet architecture for infrared small target segmentation. Alex. Eng. J. 110, 234\u2013244 (2025)","journal-title":"Alex. Eng. J."},{"issue":"16","key":"1807_CR29","doi-asserted-by":"publisher","first-page":"3241","DOI":"10.3390\/electronics13163241","volume":"13","author":"Y Liu","year":"2024","unstructured":"Liu, Y., Qin, Y., Lin, Z., Xia, H., Wang, C.: Detection of Scratch Defects on Metal Surfaces Based on MSDD-UNet. Electronics 13(16), 3241 (2024)","journal-title":"Electronics"},{"issue":"20","key":"1807_CR30","doi-asserted-by":"publisher","first-page":"3829","DOI":"10.3390\/rs16203829","volume":"16","author":"S Wang","year":"2024","unstructured":"Wang, S., Chen, Y., Yuan, Y., Chen, X., Tian, J., Tian, X., Cheng, H.: Tsae-unet: A novel network for multi-scene and multi-temporal water body detection based on spatiotemporal feature extraction. Remote Sens 16(20), 3829 (2024)","journal-title":"Remote Sens"},{"issue":"4","key":"1807_CR31","doi-asserted-by":"publisher","first-page":"637","DOI":"10.3390\/agriculture14040637","volume":"14","author":"X Wu","year":"2024","unstructured":"Wu, X., Fang, P., Liu, X., Liu, M., Huang, P., Duan, X., Huang, D., Liu, Z.: AM-UNet: Field Ridge Segmentation of Paddy Field Images Based on an Improved MultiResUNet Network. Agriculture 14(4), 637 (2024)","journal-title":"Agriculture"},{"issue":"Suppl 1","key":"1807_CR32","doi-asserted-by":"publisher","first-page":"757","DOI":"10.1007\/s11760-024-03190-5","volume":"18","author":"B Wang","year":"2024","unstructured":"Wang, B., Dai, C., Li, J., Jiang, X., Zhang, J., Jia, G.: PMENet: a parallel UNet based on the fusion of multiple attention mechanisms for road crack segmentation. Signal Image Video Process. 18(Suppl 1), 757\u2013769 (2024)","journal-title":"Signal Image Video Process."},{"key":"1807_CR33","volume-title":"Generative adversarial networks, Communications of the ACM, 63(11), 139\u2013144","author":"I Goodfellow","year":"2020","unstructured":"Goodfellow, I., Pouget-Abadie, J., Mirza, M., Xu, B., Warde-Farley, D., Ozair, S., Courville, A., Bengio, Y.: Generative adversarial networks, Communications of the ACM, 63(11), 139\u2013144. ACM New York, NY, USA (2020)"},{"issue":"2","key":"1807_CR34","doi-asserted-by":"publisher","first-page":"101","DOI":"10.1007\/s00530-024-01290-3","volume":"30","author":"C Dong","year":"2024","unstructured":"Dong, C., Liu, H., Wang, X., Bi, X.: Image inpainting method based on AU-GAN. Multimed. Syst. 30(2), 101 (2024)","journal-title":"Multimed. Syst."},{"key":"1807_CR35","doi-asserted-by":"publisher","first-page":"87467","DOI":"10.1109\/ACCESS.2024.3417442","volume":"12","author":"T-P Hong","year":"2024","unstructured":"Hong, T.-P., Wu, J.-H., Su, J.-H., Yin, T.-K.: Conditional-GAN-based face inpainting approaches with symmetry and view-degree utilization. IEEE Access 12, 87467\u201387478 (2024)","journal-title":"IEEE Access"},{"key":"1807_CR36","doi-asserted-by":"publisher","first-page":"127061","DOI":"10.1016\/j.neucom.2023.127061","volume":"566","author":"C Xu","year":"2024","unstructured":"Xu, C., Li, W., Cui, X., Wang, Z., Zheng, F., Zhang, X., Chen, B.: Scarcity-GAN: Scarce data augmentation for defect detection via generative adversarial nets. Neurocomputing 566, 127061 (2024)","journal-title":"Neurocomputing"},{"key":"1807_CR37","doi-asserted-by":"crossref","unstructured":"Zhou, Z., Rahman Siddiquee, M. M., Tajbakhsh, N., Liang, J.: Unet++: A nested u-net architecture for medical image segmentation, In: Deep learning in medical image analysis and multimodal learning for clinical decision support: 4th international workshop, DLMIA 2018, and 8th international workshop, ML-CDS 2018, held in conjunction with MICCAI 2018, Granada, Spain, September 20, 2018, proceedings 4, Springer, pp. 3-11, (2018)","DOI":"10.1007\/978-3-030-00889-5_1"},{"issue":"12","key":"1807_CR38","doi-asserted-by":"publisher","first-page":"2481","DOI":"10.1109\/TPAMI.2016.2644615","volume":"39","author":"V Badrinarayanan","year":"2017","unstructured":"Badrinarayanan, V., Kendall, A., Cipolla, R.: Segnet: A deep convolutional encoder-decoder architecture for image segmentation. IEEE Trans. Pattern Anal. Mach. Intell. 39(12), 2481\u20132495 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1807_CR39","doi-asserted-by":"crossref","unstructured":"Zhao, H., Shi, J., Qi, X., Wang, X., Jia, J.: Pyramid scene parsing network, In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp. 2881-2890, (2017)","DOI":"10.1109\/CVPR.2017.660"},{"key":"1807_CR40","doi-asserted-by":"crossref","unstructured":"Chen, L.-C., Zhu, Y., Papandreou, G., Schroff, F., Adam, H.: Encoder-decoder with atrous separable convolution for semantic image segmentation, In: Proceedings of the European conference on computer vision (ECCV), pp. 801-818, (2018)","DOI":"10.1007\/978-3-030-01234-2_49"},{"key":"1807_CR41","unstructured":"Chen, J., Lu, Y., Yu, Q., Luo, X., Adeli, E., Wang, Y., Lu, L., Yuille, A. L., Zhou, Y.: Transunet: Transformers make strong encoders for medical image segmentation, arXiv preprint arXiv:2102.04306, (2021)"},{"key":"1807_CR42","doi-asserted-by":"crossref","unstructured":"Cao, H., Wang, Y., Chen, J., Jiang, D., Zhang, X., Tian, Q., Wang, M.: Swin-unet: Unet-like pure transformer for medical image segmentation, In: European conference on computer vision, pp. 205-218, Springer, (2022)","DOI":"10.1007\/978-3-031-25066-8_9"},{"issue":"9","key":"1807_CR43","doi-asserted-by":"publisher","first-page":"568","DOI":"10.1007\/s11801-024-3241-z","volume":"20","author":"Z Guo","year":"2024","unstructured":"Guo, Z., Ma, D., Luo, X.: A lightweight semantic segmentation algorithm integrating CA and ECA-Net modules. Optoelectron. Lett. 20(9), 568\u2013576 (2024)","journal-title":"Optoelectron. Lett."},{"issue":"5","key":"1807_CR44","doi-asserted-by":"publisher","first-page":"3427","DOI":"10.1007\/s00371-023-03043-1","volume":"40","author":"Y Huang","year":"2024","unstructured":"Huang, Y., Shi, P., He, H., He, H., Zhao, B.: Senet: spatial information enhancement for semantic segmentation neural networks. Vis. Comput. 40(5), 3427\u20133440 (2024)","journal-title":"Vis. Comput."}],"container-title":["Multimedia Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-025-01807-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00530-025-01807-4\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-025-01807-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,9,4]],"date-time":"2025-09-04T15:02:53Z","timestamp":1756998173000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00530-025-01807-4"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,5,2]]},"references-count":44,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2025,6]]}},"alternative-id":["1807"],"URL":"https:\/\/doi.org\/10.1007\/s00530-025-01807-4","relation":{},"ISSN":["0942-4962","1432-1882"],"issn-type":[{"type":"print","value":"0942-4962"},{"type":"electronic","value":"1432-1882"}],"subject":[],"published":{"date-parts":[[2025,5,2]]},"assertion":[{"value":"6 January 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"15 April 2025","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"2 May 2025","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The code involved in this paper will not be disclosed for the time being due to the need for subsequent research, and will be available for others to use after the overall project is completed.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"222"}}