{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,6]],"date-time":"2025-12-06T16:49:03Z","timestamp":1765039743923,"version":"3.37.3"},"reference-count":54,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2024,11,7]],"date-time":"2024-11-07T00:00:00Z","timestamp":1730937600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,11,7]],"date-time":"2024-11-07T00:00:00Z","timestamp":1730937600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["No. 62271336"],"award-info":[{"award-number":["No. 62271336"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Supercomput"],"published-print":{"date-parts":[[2025,1]]},"DOI":"10.1007\/s11227-024-06654-0","type":"journal-article","created":{"date-parts":[[2024,11,7]],"date-time":"2024-11-07T17:31:19Z","timestamp":1731000679000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":2,"title":["A compressed video quality enhancement algorithm based on CNN and transformer hybrid network"],"prefix":"10.1007","volume":"81","author":[{"given":"Hao","family":"Li","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiaohai","family":"He","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shuhua","family":"Xiong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Haibo","family":"He","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Honggang","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,11,7]]},"reference":[{"issue":"12","key":"6654_CR1","doi-asserted-by":"publisher","first-page":"1649","DOI":"10.1109\/TCSVT.2012.2221191","volume":"22","author":"GJ Sullivan","year":"2012","unstructured":"Sullivan GJ, Ohm JR, Han WJ et al (2012) Overview of the high efficiency video coding (hevc) standard. IEEE Trans Circuits Syst Video Technol 22(12):1649\u20131668","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"10","key":"6654_CR2","doi-asserted-by":"publisher","first-page":"3736","DOI":"10.1109\/TCSVT.2021.3101953","volume":"31","author":"B Bross","year":"2021","unstructured":"Bross B, Wang YK, Ye Y et al (2021) Overview of the versatile video coding (vvc) standard and its applications. IEEE Trans Circuits Syst Video Technol 31(10):3736\u20133764","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"7","key":"6654_CR3","doi-asserted-by":"publisher","first-page":"9475","DOI":"10.1007\/s11227-021-04274-6","volume":"78","author":"G Jin","year":"2022","unstructured":"Jin G (2022) Player target tracking and detection in football game video using edge computing and deep learning. J Supercomput 78(7):9475\u20139491","journal-title":"J Supercomput"},{"issue":"16","key":"6654_CR4","doi-asserted-by":"publisher","first-page":"18947","DOI":"10.1007\/s11227-023-05380-3","volume":"79","author":"H Wang","year":"2023","unstructured":"Wang H, Qian H, Feng S, Yan S (2023) Calyolov4: lightweight yolov4 target detection based on coordinated attention. J Supercomput 79(16):18947\u201318969","journal-title":"J Supercomput"},{"issue":"10","key":"6654_CR5","doi-asserted-by":"publisher","first-page":"12648","DOI":"10.1007\/s11227-022-04391-w","volume":"78","author":"Y Wang","year":"2022","unstructured":"Wang Y, Guo R, Zhao S (2022) Target tracking algorithm based on multiscale analysis and combinatorial matching. J Supercomput 78(10):12648\u201312661","journal-title":"J Supercomput"},{"issue":"2","key":"6654_CR6","doi-asserted-by":"publisher","first-page":"1293","DOI":"10.1007\/s11227-018-2489-0","volume":"76","author":"W Tiancheng","year":"2020","unstructured":"Tiancheng W (2020) Unsupervised video multi-target tracking based on fast resampling particle filter. J Supercomput 76(2):1293\u20131304","journal-title":"J Supercomput"},{"key":"6654_CR7","doi-asserted-by":"crossref","unstructured":"Dong C, Deng Y, Loy CC, et\u00a0al. (2015) Compression artifacts reduction by a deep convolutional network. In: Proceedings of the IEEE international conference on Computer Vision, pp 576\u2013584","DOI":"10.1109\/ICCV.2015.73"},{"key":"6654_CR8","doi-asserted-by":"crossref","unstructured":"Yang R, Xu M, Wang Z (2017) Decoder-side hevc quality enhancement with scalable convolutional neural network. In: 2017 IEEE International Conference on Multimedia and Expo (ICME), IEEE, pp 817\u2013822","DOI":"10.1109\/ICME.2017.8019299"},{"issue":"7","key":"6654_CR9","doi-asserted-by":"publisher","first-page":"2039","DOI":"10.1109\/TCSVT.2018.2867568","volume":"29","author":"R Yang","year":"2018","unstructured":"Yang R, Xu M, Liu T et al (2018) Enhancing quality for hevc compressed videos. IEEE Trans Circuits Syst Video Technol 29(7):2039\u20132054","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"7","key":"6654_CR10","doi-asserted-by":"publisher","first-page":"3142","DOI":"10.1109\/TIP.2017.2662206","volume":"26","author":"K Zhang","year":"2017","unstructured":"Zhang K, Zuo W, Chen Y et al (2017) Beyond a gaussian denoiser: residual learning of deep cnn for image denoising. IEEE Trans Image Process 26(7):3142\u20133155","journal-title":"IEEE Trans Image Process"},{"key":"6654_CR11","doi-asserted-by":"crossref","unstructured":"Guo J, Chao H (2016) Building dual-domain representations for compression artifacts reduction. In: Computer Vision\u2013ECCV 2016: 14th European Conference, Amsterdam, The Netherlands, October 11\u201314, 2016, Proceedings, Part I 14, Springer, pp 628\u2013644","DOI":"10.1007\/978-3-319-46448-0_38"},{"key":"6654_CR12","doi-asserted-by":"crossref","unstructured":"Dai Y, Liu D, Wu F (2017) A convolutional neural network approach for post-processing in hevc intra coding. In: MultiMedia Modeling: 23rd International Conference, MMM 2017, Reykjavik, Iceland, January 4-6, 2017, Proceedings, Part I 23, Springer, pp 28\u201339","DOI":"10.1007\/978-3-319-51811-4_3"},{"key":"6654_CR13","doi-asserted-by":"crossref","unstructured":"Yang R, Xu M, Wang Z, et\u00a0al. (2018) Multi-frame quality enhancement for compressed video. In: Proceedings of the IEEE conference on Computer Vision and Pattern Recognition, pp 6664\u20136673","DOI":"10.1109\/CVPR.2018.00697"},{"key":"6654_CR14","doi-asserted-by":"crossref","unstructured":"Guan Z, Xing Q, Xu M, et\u00a0al. (2019) Mfqe 2.0: A new approach for multi-frame quality enhancement on compressed video. IEEE transactions on pattern analysis and machine intelligence 43(3):949\u2013963","DOI":"10.1109\/TPAMI.2019.2944806"},{"key":"6654_CR15","doi-asserted-by":"crossref","unstructured":"Deng J, Wang L, Pu S, et\u00a0al. (2020) Spatio-temporal deformable convolution for compressed video quality enhancement. In: Proceedings of the AAAI conference on Artificial Intelligence, pp 10696\u201310703","DOI":"10.1609\/aaai.v34i07.6697"},{"key":"6654_CR16","doi-asserted-by":"crossref","unstructured":"Zhao M, Xu Y, Zhou S (2021) Recursive fusion and deformable spatiotemporal attention for video compression artifact reduction. In: Proceedings of the 29th ACM international conference on Multimedia, pp 5646\u20135654","DOI":"10.1145\/3474085.3475710"},{"key":"6654_CR17","doi-asserted-by":"publisher","first-page":"6459","DOI":"10.1109\/TIP.2021.3092949","volume":"30","author":"Q Ding","year":"2021","unstructured":"Ding Q, Shen L, Yu L et al (2021) Patch-wise spatial-temporal quality enhancement for hevc compressed video. IEEE Trans Image Process 30:6459\u20136472","journal-title":"IEEE Trans Image Process"},{"key":"6654_CR18","doi-asserted-by":"publisher","first-page":"543","DOI":"10.1109\/LSP.2022.3147441","volume":"29","author":"D Luo","year":"2022","unstructured":"Luo D, Ye M, Li S et al (2022) Coarse-to-fine spatio-temporal information fusion for compressed video quality enhancement. IEEE Signal Process Lett 29:543\u2013547","journal-title":"IEEE Signal Process Lett"},{"key":"6654_CR19","doi-asserted-by":"crossref","unstructured":"Gao Y, Jia M, Li S et al (2022) A multiscale gradient-backpropagation optimization framework for deformable convolution based compressed video enhancement. ICASSP 2022\u20132022 IEEE International Conference on Acoustics. Speech and Signal Processing (ICASSP), IEEE, pp 2110\u20132114","DOI":"10.1109\/ICASSP43922.2022.9746932"},{"issue":"2","key":"6654_CR20","doi-asserted-by":"publisher","first-page":"109","DOI":"10.1109\/TCI.2016.2532323","volume":"2","author":"A Kappeler","year":"2016","unstructured":"Kappeler A, Yoo S, Dai Q et al (2016) Video super-resolution with convolutional neural networks. IEEE Trans Comput Imaging 2(2):109\u2013122","journal-title":"IEEE Trans Comput Imaging"},{"key":"6654_CR21","doi-asserted-by":"crossref","unstructured":"Caballero J, Ledig C, Aitken A, et\u00a0al. (2017) Real-time video super-resolution with spatio-temporal networks and motion compensation. In: Proceedings of the IEEE conference on Computer Vision and Pattern Recognition, pp 4778\u20134787","DOI":"10.1109\/CVPR.2017.304"},{"key":"6654_CR22","doi-asserted-by":"publisher","first-page":"1106","DOI":"10.1007\/s11263-018-01144-2","volume":"127","author":"T Xue","year":"2019","unstructured":"Xue T, Chen B, Wu J et al (2019) Video enhancement with task-oriented flow. Int J Comput Vision 127:1106\u20131125","journal-title":"Int J Comput Vision"},{"key":"6654_CR23","doi-asserted-by":"crossref","unstructured":"Dai J, Qi H, Xiong Y, et\u00a0al. (2017) Deformable convolutional networks. In: Proceedings of the IEEE international conference on Computer Vision, pp 764\u2013773","DOI":"10.1109\/ICCV.2017.89"},{"key":"6654_CR24","unstructured":"Lin J, Huang Y, Wang L (2021) Fdan: Flow-guided deformable alignment network for video super-resolution. arXiv preprint arXiv:2105.05640"},{"key":"6654_CR25","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1186\/s40537-021-00444-8","volume":"8","author":"L Alzubaidi","year":"2021","unstructured":"Alzubaidi L, Zhang J, Humaidi AJ et al (2021) Review of deep learning: concepts, cnn architectures, challenges, applications, future directions. J big Data 8:1\u201374","journal-title":"J big Data"},{"key":"6654_CR26","unstructured":"Vaswani A, Shazeer N, Parmar N, et\u00a0al. (2017) Attention is all you need. Advances in neural information processing systems 30"},{"key":"6654_CR27","unstructured":"Dosovitskiy A, Beyer L, Kolesnikov A, et\u00a0al. (2020) An image is worth 16x16 words: Transformers for image recognition at scale. arXiv preprint"},{"issue":"8","key":"6654_CR28","doi-asserted-by":"publisher","first-page":"1200","DOI":"10.3390\/electronics11081200","volume":"11","author":"S Li","year":"2022","unstructured":"Li S, Wu C, Xiong N (2022) Hybrid architecture based on cnn and transformer for strip steel surface defect classification. Electronics 11(8):1200","journal-title":"Electronics"},{"key":"6654_CR29","doi-asserted-by":"crossref","unstructured":"Liu Z, Lin Y, Cao Y, et\u00a0al. (2021) Swin transformer: Hierarchical vision transformer using shifted windows. In: Proceedings of the IEEE\/CVF international conference on Computer Vision, pp 10012\u201310022","DOI":"10.1109\/ICCV48922.2021.00986"},{"key":"6654_CR30","doi-asserted-by":"crossref","unstructured":"Liu Z, Hu H, Lin Y, et\u00a0al. (2022) Swin transformer v2: Scaling up capacity and resolution. In: Proceedings of the IEEE\/CVF conference on Computer Vision and Pattern Recognition, pp 12009\u201312019","DOI":"10.1109\/CVPR52688.2022.01170"},{"key":"6654_CR31","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, et\u00a0al. (2016) Deep residual learning for image recognition. In: Proceedings of the IEEE conference on Computer Vision and Pattern Recognition, pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"key":"6654_CR32","unstructured":"Zhang Y, Li K, Li K, et\u00a0al. (2019) Residual non-local attention networks for image restoration. arXiv preprint"},{"key":"6654_CR33","doi-asserted-by":"crossref","unstructured":"Liu D, Wen B, Fan Y, et\u00a0al. (2018) Non-local recurrent network for image restoration. Advances in neural information processing systems 31","DOI":"10.1007\/978-3-030-04212-7_1"},{"key":"6654_CR34","doi-asserted-by":"crossref","unstructured":"Tai Y, Yang J, Liu X, et\u00a0al. (2017) Memnet: A persistent memory network for image restoration. In: Proceedings of the IEEE international conference on Computer Vision, pp 4539\u20134547","DOI":"10.1109\/ICCV.2017.486"},{"key":"6654_CR35","doi-asserted-by":"crossref","unstructured":"Wang Z, Liu D, Chang S, et\u00a0al. (2016) D3: Deep dual-domain based fast restoration of jpeg-compressed images. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp 2764\u20132772","DOI":"10.1109\/CVPR.2016.302"},{"key":"6654_CR36","doi-asserted-by":"crossref","unstructured":"Chen H, He X, Qing L, et\u00a0al. (2018) Dpw-sdnet: Dual pixel-wavelet domain deep cnns for soft decoding of jpeg-compressed images. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition Workshops, pp 711\u2013720","DOI":"10.1109\/CVPRW.2018.00114"},{"issue":"4","key":"6654_CR37","doi-asserted-by":"publisher","first-page":"18","DOI":"10.1109\/5254.708428","volume":"13","author":"MA Hearst","year":"1998","unstructured":"Hearst MA, Dumais ST, Osuna E et al (1998) Support vector machines. IEEE Intell Syst Appl 13(4):18\u201328","journal-title":"IEEE Intell Syst Appl"},{"issue":"3","key":"6654_CR38","first-page":"1229","volume":"70","author":"T Zhang","year":"2023","unstructured":"Zhang T, Teng Q, He X et al (2023) Multi-scale inter-communication spatio-temporal network for video compression artifacts reduction. IEEE Trans Circuits Syst II: Express Briefs 70(3):1229\u20131233","journal-title":"IEEE Trans Circuits Syst II: Express Briefs"},{"key":"6654_CR39","doi-asserted-by":"crossref","unstructured":"Wang K, Chen F, Ye Z, et\u00a0al. (2023) A spatio-temporal decomposition network for compressed video quality enhancement. In: ICASSP 2023 - 2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp 1\u20135","DOI":"10.1109\/ICASSP49357.2023.10097006"},{"key":"6654_CR40","doi-asserted-by":"publisher","first-page":"108902","DOI":"10.1016\/j.sigpro.2022.108902","volume":"206","author":"L Yan","year":"2023","unstructured":"Yan L, Zhao M, Liu S et al (2023) Cascaded transformer u-net for image restoration. Signal Processing 206:108902","journal-title":"Signal Processing"},{"key":"6654_CR41","doi-asserted-by":"crossref","unstructured":"Liang J, Cao J, Sun G, et\u00a0al. (2021) Swinir: Image restoration using swin transformer. In: Proceedings of the IEEE\/CVF international conference on Computer Vision, pp 1833\u20131844","DOI":"10.1109\/ICCVW54120.2021.00210"},{"key":"6654_CR42","doi-asserted-by":"crossref","unstructured":"Chen X, Wang X, Zhou J, et\u00a0al. (2023) Activating more pixels in image super-resolution transformer. In: 2023 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp 22367\u201322377","DOI":"10.1109\/CVPR52729.2023.02142"},{"issue":"1","key":"6654_CR43","doi-asserted-by":"publisher","first-page":"160","DOI":"10.1109\/TCSVT.2022.3201045","volume":"33","author":"M Cao","year":"2023","unstructured":"Cao M, Fan Y, Zhang Y et al (2023) Vdtr: Video deblurring with transformer. IEEE Trans Circuits Syst Video Technol 33(1):160\u2013171","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"6654_CR44","doi-asserted-by":"publisher","first-page":"2171","DOI":"10.1109\/TIP.2024.3372454","volume":"33","author":"J Liang","year":"2024","unstructured":"Liang J, Cao J, Fan Y et al (2024) Vrt: A video restoration transformer. IEEE Trans Image Process 33:2171\u20132182","journal-title":"IEEE Trans Image Process"},{"issue":"1","key":"6654_CR45","doi-asserted-by":"publisher","first-page":"197","DOI":"10.1109\/TBC.2023.3332015","volume":"70","author":"L Yu","year":"2024","unstructured":"Yu L, Chang W, Wu S et al (2024) End-to-end transformer for compressed video quality enhancement. IEEE Trans Broadcasting 70(1):197\u2013207","journal-title":"IEEE Trans Broadcasting"},{"key":"6654_CR46","doi-asserted-by":"crossref","unstructured":"Lup V, Giosan I (2023) Vtseg: Video transformer for semantic segmentation. In: 2023 IEEE 19th International Conference on Intelligent Computer Communication and Processing (ICCP), pp 95\u2013102","DOI":"10.1109\/ICCP60212.2023.10398651"},{"key":"6654_CR47","doi-asserted-by":"crossref","unstructured":"Yoo JS, Lee H, Jung SW (2023) Hierarchical spatiotemporal transformers for video object segmentation. In: 2023 IEEE\/CVF International Conference on Computer Vision Workshops (ICCVW), pp 795\u2013805","DOI":"10.1109\/ICCVW60793.2023.00087"},{"issue":"2","key":"6654_CR48","doi-asserted-by":"publisher","first-page":"209","DOI":"10.1109\/JETCAS.2024.3387301","volume":"14","author":"P Du","year":"2024","unstructured":"Du P, Liu Y, Ling N (2024) Cgvc-t: Contextual generative video compression with transformers. IEEE J Emerging Selected Topics in Circuits Syst 14(2):209\u2013223","journal-title":"IEEE J Emerging Selected Topics in Circuits Syst"},{"key":"6654_CR49","doi-asserted-by":"crossref","unstructured":"Ronneberger O, Fischer P, Brox T (2015) U-net: Convolutional networks for biomedical image segmentation. In: Medical Image Computing and Computer-Assisted Intervention\u2013MICCAI 2015: 18th International Conference, Munich, Germany, October 5-9, 2015, Proceedings, Part III 18, Springer, pp 234\u2013241","DOI":"10.1007\/978-3-319-24574-4_28"},{"key":"6654_CR50","doi-asserted-by":"publisher","first-page":"611","DOI":"10.1007\/s13244-018-0639-9","volume":"9","author":"R Yamashita","year":"2018","unstructured":"Yamashita R, Nishio M, Do RKG et al (2018) Convolutional neural networks: an overview and application in radiology. Insights into imaging 9:611\u2013629","journal-title":"Insights into imaging"},{"key":"6654_CR51","doi-asserted-by":"crossref","unstructured":"Zeiler MD, Krishnan D, Taylor GW, et\u00a0al. (2010) Deconvolutional networks. In: 2010 IEEE Computer Society Conference on Computer Vision and Pattern Recognition, IEEE, pp 2528\u20132535","DOI":"10.1109\/CVPR.2010.5539957"},{"key":"6654_CR52","unstructured":"Agarap AF (2018) Deep learning using rectified linear units (relu). arXiv preprint"},{"key":"6654_CR53","doi-asserted-by":"crossref","unstructured":"Conde MV, Choi UJ, Burchi M, et\u00a0al. (2022) Swin2sr: Swinv2 transformer for compressed image super-resolution and restoration. In: European Conference on Computer Vision, Springer, pp 669\u2013687","DOI":"10.1007\/978-3-031-25063-7_42"},{"issue":"7","key":"6654_CR54","first-page":"1","volume":"12","author":"F Bossen","year":"2013","unstructured":"Bossen F et al (2013) Common test conditions and software reference configurations. JCTVC-L1100 12(7):1","journal-title":"JCTVC-L1100"}],"container-title":["The Journal of Supercomputing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-024-06654-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11227-024-06654-0\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-024-06654-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,11,7]],"date-time":"2024-11-07T18:06:28Z","timestamp":1731002788000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11227-024-06654-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,11,7]]},"references-count":54,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2025,1]]}},"alternative-id":["6654"],"URL":"https:\/\/doi.org\/10.1007\/s11227-024-06654-0","relation":{},"ISSN":["0920-8542","1573-0484"],"issn-type":[{"type":"print","value":"0920-8542"},{"type":"electronic","value":"1573-0484"}],"subject":[],"published":{"date-parts":[[2024,11,7]]},"assertion":[{"value":"23 October 2024","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"7 November 2024","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known conflict of interest or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"144"}}