{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,11]],"date-time":"2026-07-11T16:58:14Z","timestamp":1783789094679,"version":"3.55.0"},"reference-count":478,"publisher":"Springer Science and Business Media LLC","issue":"11","license":[{"start":{"date-parts":[[2024,10,17]],"date-time":"2024-10-17T00:00:00Z","timestamp":1729123200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"},{"start":{"date-parts":[[2024,10,17]],"date-time":"2024-10-17T00:00:00Z","timestamp":1729123200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Sci. China Inf. Sci."],"published-print":{"date-parts":[[2024,11]]},"abstract":"<jats:title>Abstract<\/jats:title>\n                  <jats:p>Perceptual video quality assessment plays a vital role in the field of video processing due to the existence of quality degradations introduced in various stages of video signal acquisition, compression, transmission and display. With the advancement of Internet communication and cloud service technology, video content and traffic are growing exponentially, which further emphasizes the requirement for accurate and rapid assessment of video quality. Therefore, numerous subjective and objective video quality assessment studies have been conducted over the past two decades for both generic videos and specific videos such as streaming, user-generated content, 3D, virtual and augmented reality, high dynamic range, high frame rate, audio-visual, etc. This survey provides an up-to-date and comprehensive review of these video quality assessment studies. Specifically, we first review the subjective video quality assessment methodologies and databases, which are necessary for validating the performance of video quality metrics. Second, the objective video quality assessment measures for general purposes are categorized and surveyed according to the methodologies utilized in the quality measures. Third, we overview the objective video quality assessment measures for specific applications and emerging topics. Finally, the performance of the state-of-the-art video quality assessment measures is compared and analyzed. This survey provides a systematic overview of both classical works and recent progress in the realm of video quality assessment, which can help other researchers quickly access the field and conduct relevant research.<\/jats:p>","DOI":"10.1007\/s11432-024-4133-3","type":"journal-article","created":{"date-parts":[[2024,10,21]],"date-time":"2024-10-21T11:03:18Z","timestamp":1729508598000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":175,"title":["Perceptual video quality assessment: a survey"],"prefix":"10.1007","volume":"67","author":[{"given":"Xiongkuo","family":"Min","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Huiyu","family":"Duan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Wei","family":"Sun","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yucheng","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Guangtao","family":"Zhai","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,10,17]]},"reference":[{"key":"4133_CR1","unstructured":"Sandvine\u2019s 2023 global Internet phenomena report shows 24% jump in video traffic, with netflix volume overtaking youtube. https:\/\/www.sandvine.com\/press-releases\/sandvines-2023-global-internet-phenomena-report-shows-24-jump-in-video-traffic-with-netflix-volume-overtaking-youtube, 2023"},{"key":"4133_CR2","doi-asserted-by":"publisher","first-page":"1193523","DOI":"10.3389\/frsip.2023.1193523","volume":"3","author":"A Saha","year":"2023","unstructured":"Saha A, Pentapati S K, Shang Z, et al. Perceptual video quality assessment: The journey continues! Frontiers in Signal Processing, 2023, 3: 1193523","journal-title":"Frontiers in Signal Processing"},{"key":"4133_CR3","doi-asserted-by":"publisher","first-page":"211301","DOI":"10.1007\/s11432-019-2757-1","volume":"63","author":"G Zhai","year":"2020","unstructured":"Zhai G, Min X. Perceptual image quality assessment: a survey. Sci China Inf Sci, 2020, 63: 211301","journal-title":"Sci China Inf Sci"},{"key":"4133_CR4","doi-asserted-by":"publisher","first-page":"98","DOI":"10.1109\/MSP.2008.930649","volume":"26","author":"W Zhou","year":"2009","unstructured":"Zhou Wang, Bovik A C. Mean squared error: love it or leave it? A new look at signal fidelity measures. IEEE Signal Process Mag, 2009, 26: 98\u2013117","journal-title":"IEEE Signal Process Mag"},{"key":"4133_CR5","doi-asserted-by":"publisher","first-page":"29","DOI":"10.1109\/MSP.2011.942471","volume":"28","author":"Z Wang","year":"2011","unstructured":"Wang Z, Bovik A. Reduced- and no-reference image quality assessment. IEEE Signal Process Mag, 2011, 28: 29\u201340","journal-title":"IEEE Signal Process Mag"},{"key":"4133_CR6","doi-asserted-by":"publisher","first-page":"297","DOI":"10.1016\/j.jvcir.2011.01.005","volume":"22","author":"W Lin","year":"2011","unstructured":"Lin W, Jay Kuo C C. Perceptual visual quality metrics: a survey. J Vis Commun Image Represent, 2011, 22: 297\u2013312","journal-title":"J Vis Commun Image Represent"},{"key":"4133_CR7","doi-asserted-by":"publisher","first-page":"675","DOI":"10.1007\/s11042-010-0640-x","volume":"51","author":"A K Moorthy","year":"2011","unstructured":"Moorthy A K, Bovik A C. Visual quality assessment algorithms: what does the future hold? Multimedia Tools and Applications, 2011, 51: 675\u2013696","journal-title":"Multimedia Tools and Applications"},{"key":"4133_CR8","volume-title":"International Scholarly Research Notices","author":"D M Chandler","year":"2013","unstructured":"Chandler D M. Seven challenges in image quality assessment: past, present, and future research. International Scholarly Research Notices, 2013"},{"key":"4133_CR9","doi-asserted-by":"publisher","first-page":"165","DOI":"10.1109\/TBC.2011.2104671","volume":"57","author":"S Chikkerur","year":"2011","unstructured":"Chikkerur S, Sundaram V, Reisslein M, et al. Objective video quality assessment methods: a classification, review, and performance comparison. IEEE Trans Broadcast, 2011, 57: 165\u2013182","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR10","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1186\/1687-5281-2014-40","volume":"2014","author":"M Shahid","year":"2014","unstructured":"Shahid M, Rossholm A, L\u00f6vstr\u00f6m B, et al. No-reference image and video quality assessment: a classification and review of recent approaches. EURASIP J Image Video Process, 2014, 2014: 1\u201332","journal-title":"EURASIP J Image Video Process"},{"key":"4133_CR11","doi-asserted-by":"publisher","first-page":"1126","DOI":"10.1109\/COMST.2014.2363139","volume":"17","author":"Y Chen","year":"2014","unstructured":"Chen Y, Wu K, Zhang Q. From QoS to QoE: a tutorial on video quality assessment. IEEE Commun Surv Tut, 2014, 17: 1126\u20131165","journal-title":"IEEE Commun Surv Tut"},{"key":"4133_CR12","doi-asserted-by":"publisher","first-page":"31019","DOI":"10.1007\/s11042-017-4848-x","volume":"78","author":"Q Fan","year":"2019","unstructured":"Fan Q, Luo W, Xia Y, et al. Metrics and methods of video quality assessment: a brief review. Multimed Tools Appl, 2019, 78: 31019\u201331033","journal-title":"Multimed Tools Appl"},{"key":"4133_CR13","first-page":"3","volume":"17","author":"D Li","year":"2019","unstructured":"Li D, Jiang T, Jiang M. Recent advances and challenges in video quality assessment. ZTE Commun, 2019, 17: 3\u201311","journal-title":"ZTE Commun"},{"key":"4133_CR14","doi-asserted-by":"publisher","first-page":"103526","DOI":"10.1016\/j.jvcir.2022.103526","volume":"86","author":"W Zhou","year":"2022","unstructured":"Zhou W, Min X, Li H, et al. A brief survey on adaptive video streaming quality assessment. J Vis Commun Image Represent, 2022, 86: 103526","journal-title":"J Vis Commun Image Represent"},{"key":"4133_CR15","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3470970","volume":"54","author":"X Min","year":"2021","unstructured":"Min X, Gu K, Zhai G, et al. Screen content quality assessment: overview, benchmark, and beyond. ACM Comput Surv, 2021, 54: 1\u201336","journal-title":"ACM Comput Surv"},{"key":"4133_CR16","first-page":"2958","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"Q Chen","year":"2021","unstructured":"Chen Q, Min X, Duan H, et al. Muiqa: image quality assessment database and algorithm for medical ultrasound images. In: Proceedings of the IEEE International Conference on Image Processing, 2021. 2958\u20132962"},{"key":"4133_CR17","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Visual Communications and Image Processing","author":"Q Chen","year":"2022","unstructured":"Chen Q, Liu F, Duan H, et al. Mriqa: subjective method and objective model for magnetic resonance image quality assessment. In: Proceedings of the IEEE International Conference on Visual Communications and Image Processing, 2022. 1\u20135"},{"key":"4133_CR18","first-page":"604","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"S Wu","year":"2021","unstructured":"Wu S, Duan H, Min X, et al. Accurate compensation makes the world more clear for the visually impaired. In: Proceedings of the IEEE International Conference on Image Processing, 2021. 604\u2013608"},{"key":"4133_CR19","doi-asserted-by":"publisher","first-page":"3295","DOI":"10.1109\/TMI.2023.3282387","volume":"42","author":"Y Guo","year":"2023","unstructured":"Guo Y, Hu M, Min X, et al. Blind image quality assessment for pathological microscopic image under screen and immersion scenarios. IEEE Trans Med Imag, 2023, 42: 3295\u20133306","journal-title":"IEEE Trans Med Imag"},{"key":"4133_CR20","doi-asserted-by":"publisher","first-page":"112107","DOI":"10.1007\/s11432-023-3847-x","volume":"67","author":"Y Tian","year":"2024","unstructured":"Tian Y, Fu H, Wang H, et al. RGB oralscan video-based orthodontic treatment monitoring. Sci China Inf Sci, 2024, 67: 112107","journal-title":"Sci China Inf Sci"},{"key":"4133_CR21","volume-title":"Recommendation ITU-R BT","author":"B Series","year":"2012","unstructured":"Series B. Methodology for the subjective assessment of the quality of television pictures. Recommendation ITU-R BT, 2012"},{"key":"4133_CR22","volume-title":"Recommendation ITU-T","author":"ITU","year":"2018","unstructured":"ITU. Subjective evaluation of media quality using a crowdsourcing approach. Recommendation ITU-T, 2018"},{"key":"4133_CR23","unstructured":"Amazon mechanical turk. https:\/\/www.mturk.com\/, 2023"},{"key":"4133_CR24","unstructured":"Microworkers. https:\/\/microworkers.com, 2023"},{"key":"4133_CR25","unstructured":"Crowdflower. https:\/\/www.crowdflower.com\/, 2023"},{"key":"4133_CR26","unstructured":"Crowdee. https:\/\/crowdee.de\/, 2023"},{"key":"4133_CR27","doi-asserted-by":"publisher","first-page":"1427","DOI":"10.1109\/TIP.2010.2042111","volume":"19","author":"K Seshadrinathan","year":"2010","unstructured":"Seshadrinathan K, Soundararajan R, Bovik A C, et al. Study of subjective and objective quality assessment of video. IEEE Trans Image Process, 2010, 19: 1427\u20131441","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR28","first-page":"2430","volume-title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing","author":"F De Simone","year":"2010","unstructured":"De Simone F, Tagliasacchi M, Naccari M, et al. A h. 264\/avc video database for the evaluation of quality metrics. In: Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing, 2010. 2430\u20132433"},{"key":"4133_CR29","unstructured":"VQEG HDTV phase i database. https:\/\/www.its.bldrdoc.gov\/vqeg\/projects\/hdtv\/hdtv.aspx, 2010"},{"key":"4133_CR30","volume-title":"Ivp subjective quality video database","author":"Z Fan","year":"2011","unstructured":"Fan Z, Songnan L, Lin M, et al. Ivp subjective quality video database. http:\/\/ivp.ee.cuhk.edu.hk\/research\/database\/subjective\/, 2011"},{"key":"4133_CR31","first-page":"97","volume-title":"Proceedings of the International Workshop on Quality of Multimedia Experience","author":"C Keimel","year":"2012","unstructured":"Keimel C, Redl A, Diepold K. The tum high definition video datasets. In: Proceedings of the International Workshop on Quality of Multimedia Experience, 2012. 97\u2013102"},{"key":"4133_CR32","doi-asserted-by":"publisher","first-page":"013016","DOI":"10.1117\/1.JEI.23.1.013016","volume":"23","author":"P V Vu","year":"2014","unstructured":"Vu P V, Chandler D M. ViS3: an algorithm for video quality assessment via analysis of spatial and spatiotemporal slices. J Electron Imag, 2014, 23: 013016","journal-title":"J Electron Imag"},{"key":"4133_CR33","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.jvcir.2015.02.012","volume":"30","author":"J Y Lin","year":"2015","unstructured":"Lin J Y, Song R, Wu C H, et al. MCL-V: a streaming video quality assessment database. J Vis Commun Image Represent, 2015, 30: 1\u20139","journal-title":"J Vis Commun Image Represent"},{"key":"4133_CR34","first-page":"1509","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"H Wang","year":"2016","unstructured":"Wang H, Gan W, Hu S, et al. Mcl-jcv: a jnd-based h. 264\/avc video quality assessment dataset. In: Proceedings of the IEEE International Conference on Image Processing, 2016. 1509\u20131513"},{"key":"4133_CR35","doi-asserted-by":"publisher","first-page":"3073","DOI":"10.1109\/TIP.2016.2562513","volume":"25","author":"M Nuutinen","year":"2016","unstructured":"Nuutinen M, Virtanen T, Vaahteranoksa M, et al. CVD2014-A database for evaluating no-reference video quality assessment algorithms. IEEE Trans Image Process, 2016, 25: 3073\u20133086","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR36","doi-asserted-by":"publisher","first-page":"2061","DOI":"10.1109\/TCSVT.2017.2707479","volume":"28","author":"D Ghadiyaram","year":"2017","unstructured":"Ghadiyaram D, Pan J, Bovik A C, et al. In-capture mobile video distortions: a study of subjective behavior and objective algorithms. IEEE Trans Circuits Syst Video Technol, 2017, 28: 2061\u20132077","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR37","first-page":"1","volume-title":"Proceedings of the International Conference on Quality of Multimedia Experience","author":"V Hosu","year":"2017","unstructured":"Hosu V, Hahn F, Jenadeleh M, et al. The konstanz natural video database (konvid-1k). In: Proceedings of the International Conference on Quality of Multimedia Experience, 2017. 1\u20136"},{"key":"4133_CR38","doi-asserted-by":"publisher","first-page":"612","DOI":"10.1109\/TIP.2018.2869673","volume":"28","author":"Z Sinno","year":"2018","unstructured":"Sinno Z, Bovik A C. Large-scale study of perceptual video quality. IEEE Trans Image Process, 2018, 28: 612\u2013627","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR39","first-page":"1","volume-title":"Proceedings of the International Workshop on Multimedia Signal Processing","author":"Y Wang","year":"2019","unstructured":"Wang Y, Inguva S, Adsumilli B. Youtube UGC dataset for video compression research. In: Proceedings of the International Workshop on Multimedia Signal Processing, 2019. 1\u20135"},{"key":"4133_CR40","first-page":"14019","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"Z Ying","year":"2021","unstructured":"Ying Z, Mandal M, Ghadiyaram D, et al. Patch-vq: \u2018patching up\u2019 the video quality problem. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2021. 14019\u201314029"},{"key":"4133_CR41","first-page":"35","volume-title":"Proceedings of the IEEE Conference on Multimedia Information Processing and Retrieval","author":"Y Li","year":"2020","unstructured":"Li Y, Meng S, Zhang X, et al. Ugc-video: perceptual quality assessment of user-generated videos. In: Proceedings of the IEEE Conference on Multimedia Information Processing and Retrieval, 2020. 35\u201338"},{"key":"4133_CR42","doi-asserted-by":"publisher","first-page":"7511","DOI":"10.1109\/TIP.2021.3107213","volume":"30","author":"X Yu","year":"2021","unstructured":"Yu X, Birkbeck N, Wang Y, et al. Predicting the quality of compressed videos with pre-existing distortions. IEEE Trans Image Process, 2021, 30: 7511\u20137526","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR43","first-page":"13435","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"Y Wang","year":"2021","unstructured":"Wang Y, Ke J, Talebi H, et al. Rich features for perceptual quality assessment of ugc videos. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2021. 13435\u201313444"},{"key":"4133_CR44","volume-title":"Icme 2021 UGC-VQA challenge","author":"W Haiqiang","year":"2021","unstructured":"Haiqiang W, Gary L, Shan L, et al. Icme 2021 UGC-VQA challenge. http:\/\/ugcvqa.com\/, 2021"},{"key":"4133_CR45","first-page":"1746","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"Z Zhang","year":"2023","unstructured":"Zhang Z, Wu W, Sun W, et al. Md-vqa: multi-dimensional quality assessment for ugc live videos. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2023. 1746\u20131755"},{"key":"4133_CR46","doi-asserted-by":"publisher","first-page":"652","DOI":"10.1109\/JSTSP.2012.2212417","volume":"6","author":"A K Moorthy","year":"2012","unstructured":"Moorthy A K, Choi L K, Bovik A C, et al. Video quality assessment on mobile devices: Subjective, behavioral and objective studies. IEEE J Sel Top Signal Process, 2012, 6: 652\u2013671","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR47","doi-asserted-by":"publisher","first-page":"2206","DOI":"10.1109\/TIP.2014.2312613","volume":"23","author":"C Chao","year":"2014","unstructured":"Chao Chen, Lark Kwon Choi, de Veciana G, et al. Modeling the time-varying subjective quality of HTTP video streams with rate adaptations. IEEE Trans Image Process, 2014, 23: 2206\u20132221","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR48","first-page":"989","volume-title":"Proceedings of the IEEE Global Conference on Signal and Information Processing","author":"D Ghadiyaram","year":"2014","unstructured":"Ghadiyaram D, Bovik A C, Yeganeh H, et al. Study of the effects of stalling events on the quality of experience of mobile streaming videos. In: Proceedings of the IEEE Global Conference on Signal and Information Processing, 2014. 989\u2013993"},{"key":"4133_CR49","doi-asserted-by":"publisher","first-page":"5217","DOI":"10.1109\/TIP.2017.2729891","volume":"26","author":"C G Bampis","year":"2017","unstructured":"Bampis C G, Li Z, Moorthy A K, et al. Study of temporal effects on subjective video quality of experience. IEEE Trans Image Process, 2017, 26: 5217\u20135231","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR50","doi-asserted-by":"publisher","first-page":"5182","DOI":"10.1109\/TIP.2021.3073294","volume":"30","author":"C G Bampis","year":"2021","unstructured":"Bampis C G, Li Z, Katsavounidis I, et al. Towards perceptually optimized adaptive video streaming-a realistic quality of experience database. IEEE Trans Image Process, 2021, 30: 5182\u20135197","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR51","doi-asserted-by":"publisher","first-page":"154","DOI":"10.1109\/JSTSP.2016.2608329","volume":"11","author":"Z Duanmu","year":"2016","unstructured":"Duanmu Z, Zeng K, Ma K, et al. A quality-of-experience index for streaming video. IEEE J Sel Top Signal Process, 2016, 11: 154\u2013166","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR52","doi-asserted-by":"publisher","first-page":"1752","DOI":"10.1145\/3123266.3123418","volume-title":"Proceedings of the ACM international conference on Multimedia","author":"Z Duanmu","year":"2017","unstructured":"Duanmu Z, Ma K, Wang Z. Quality-of-experience of adaptive video streaming: exploring the space of adaptations. In: Proceedings of the ACM international conference on Multimedia, 2017. 1752\u20131760"},{"key":"4133_CR53","doi-asserted-by":"publisher","first-page":"474","DOI":"10.1109\/TBC.2018.2822870","volume":"64","author":"Z Duanmu","year":"2018","unstructured":"Duanmu Z, Rehman A, Wang Z. A quality-of-experience database for adaptive video streaming. IEEE Trans Broadcast, 2018, 64: 474\u2013487","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR54","volume-title":"The Waterloo streaming quality-of-experience database IV","author":"Z Duanmu","year":"2019","unstructured":"Duanmu Z, Liu W, Li Z, et al. The Waterloo streaming quality-of-experience database IV. https:\/\/ieee-dataport:org\/open-access\/waterloo-streaming-quality-experience-database-iv, 2019"},{"key":"4133_CR55","first-page":"173","volume-title":"Proceedings of the IEEE Southwest Symposium on Image Analysis and Interpretation","author":"M J Chen","year":"2012","unstructured":"Chen M J, Kwon D K, Bovik A C. Study of subject agreement on stereoscopic video quality. In: Proceedings of the IEEE Southwest Symposium on Image Analysis and Interpretation, 2012. 173\u2013176"},{"key":"4133_CR56","doi-asserted-by":"publisher","first-page":"3392","DOI":"10.1109\/TIP.2013.2268422","volume":"22","author":"V De Silva","year":"2013","unstructured":"De Silva V, Arachchi H K, Ekmekcioglu E, et al. Toward an impairment metric for stereoscopic video: a full-reference video quality metric to assess compressed stereoscopic video. IEEE Trans Image Process, 2013, 22: 3392\u20133404","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR57","first-page":"126","volume-title":"Proceedings of the SPIE","author":"S Jumisko-Pyykk\u00f6","year":"2011","unstructured":"Jumisko-Pyykk\u00f6 S, Haustola T, Boev A, et al. Subjective evaluation of mobile 3D video content: depth range versus compression artifacts. In: Proceedings of the SPIE. SPIE, 2011. 126\u2013137"},{"key":"4133_CR58","first-page":"242","volume-title":"Proceedings of the Three-Dimensional Image Processing (3DIP) and Applications","author":"L Goldmann","year":"2010","unstructured":"Goldmann L, De Simone F, Ebrahimi T. A comprehensive database and subjective evaluation methodology for quality of experience in stereoscopic video. In: Proceedings of the Three-Dimensional Image Processing (3DIP) and Applications. SPIE, 2010. 242\u2013252"},{"key":"4133_CR59","first-page":"109","volume-title":"Proceedings of the International Workshop on Quality of Multimedia Experience","author":"M Urvoy","year":"2012","unstructured":"Urvoy M, Barkowsky M, Cousseau R, et al. NAMA3DS1-COSPAD1: subjective video quality assessment database on coding conditions introducing freely available high quality 3d stereoscopic sequences. In: Proceedings of the International Workshop on Quality of Multimedia Experience, 2012. 109\u2013114"},{"key":"4133_CR60","first-page":"416","volume-title":"Proceedings of the IEEE International Conference on Consumer Electronics","author":"A Banitalebi-Dehkordi","year":"2014","unstructured":"Banitalebi-Dehkordi A, Pourazad M T, Nasiopoulos P. Effect of high frame rates on 3d video quality of experience. In: Proceedings of the IEEE International Conference on Consumer Electronics, 2014. 416\u2013417"},{"key":"4133_CR61","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s13319-014-0034-3","volume":"6","author":"A Banitalebi-Dehkordi","year":"2015","unstructured":"Banitalebi-Dehkordi A, Pourazad M T, Nasiopoulos P. The effect of frame rate on 3D video quality and bitrate. 3D Res, 2015, 6: 1\u20133","journal-title":"3D Res"},{"key":"4133_CR62","doi-asserted-by":"publisher","first-page":"2087","DOI":"10.1007\/s11042-015-3172-6","volume":"76","author":"E Dumi\u0107","year":"2017","unstructured":"Dumi\u0107 E, Grgi\u0107 S, \u0160aki\u0107 K, et al. 3D video subjective quality: a new database and grade comparison study. Multimed Tools Appl, 2017, 76: 2087\u20132109","journal-title":"Multimed Tools Appl"},{"key":"4133_CR63","doi-asserted-by":"publisher","first-page":"1330","DOI":"10.1109\/TIP.2017.2651387","volume":"26","author":"J Wang","year":"2017","unstructured":"Wang J, Wang S, Wang Z. Asymmetrically compressed stereoscopic 3D videos: quality assessment and rate-distortion performance evaluation. IEEE Trans Image Process, 2017, 26: 1330\u20131343","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR64","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Systems, Signals and Image Processing","author":"H Duan","year":"2017","unstructured":"Duan H, Zhai G, Yang X, et al. Ivqad 2017: an immersive video quality assessment database. In: Proceedings of the IEEE International Conference on Systems, Signals and Image Processing, 2017. 1\u20135"},{"key":"4133_CR65","doi-asserted-by":"publisher","first-page":"461","DOI":"10.1109\/TBC.2018.2811627","volume":"64","author":"Y Zhang","year":"2018","unstructured":"Zhang Y, Wang Y, Liu F, et al. Subjective panoramic video quality assessment database for coding applications. IEEE Trans Broadcast, 2018, 64: 461\u2013473","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR66","first-page":"163","volume-title":"Proceedings of the IEEE International Conference on Multimedia & Expo Workshops","author":"B Zhang","year":"2017","unstructured":"Zhang B, Zhao J, Yang S, et al. Subjective and objective quality assessment of panoramic videos in virtual reality environments. In: Proceedings of the IEEE International Conference on Multimedia & Expo Workshops, 2017. 163\u2013168"},{"key":"4133_CR67","first-page":"249","volume-title":"Proceedings of Applications of Digital Image Processing XLI","author":"F Lopes","year":"2018","unstructured":"Lopes F, Ascenso J, Rodrigues A, et al. Subjective and objective quality assessment of omnidirectional video. In: Proceedings of Applications of Digital Image Processing XLI. SPIE, 2018. 249\u2013265"},{"key":"4133_CR68","doi-asserted-by":"publisher","first-page":"511","DOI":"10.1145\/3126686.3126768","volume-title":"Proceedings of the Thematic Workshops of ACM Multimedia","author":"A Singla","year":"2017","unstructured":"Singla A, Fremerey S, Robitza W, et al. Comparison of subjective quality evaluation for hevc encoded omnidirectional videos at different bit-rates for uhd and fhd resolution. In: Proceedings of the Thematic Workshops of ACM Multimedia, 2017. 511\u2013519"},{"key":"4133_CR69","doi-asserted-by":"publisher","first-page":"3516","DOI":"10.1109\/TCSVT.2018.2886277","volume":"29","author":"M Xu","year":"2018","unstructured":"Xu M, Li C, Chen Z, et al. Assessing visual quality of omnidirectional videos. IEEE Trans Circuits Syst Video Technol, 2018, 29: 3516\u20133530","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR70","doi-asserted-by":"publisher","first-page":"28","DOI":"10.1587\/transinf.2017MUP0011","volume":"E101.D","author":"H T T Tran","year":"2018","unstructured":"Tran H T T, Ngoc N P, Bui C M, et al. A study on quality metrics for 360 video communications. IEICE Trans Inf Syst, 2018, E101.D: 28\u201336","journal-title":"IEICE Trans Inf Syst"},{"key":"4133_CR71","doi-asserted-by":"publisher","first-page":"932","DOI":"10.1145\/3240508.3240581","volume-title":"Proceedings of the ACM International conference on Multimedia","author":"C Li","year":"2018","unstructured":"Li C, Xu M, Du X, et al. Bridge the gap between vqa and human behavior on omnidirectional video: a large-scale dataset and a deep learning model. In: Proceedings of the ACM International conference on Multimedia, 2018. 932\u2013940"},{"key":"4133_CR72","doi-asserted-by":"publisher","first-page":"5905","DOI":"10.1109\/TIP.2021.3087322","volume":"30","author":"Y Jin","year":"2021","unstructured":"Jin Y, Chen M, Goodall T, et al. Subjective and objective quality assessment of 2D and 3D foveated video compression in virtual reality. IEEE Trans Image Process, 2021, 30: 5905\u20135919","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR73","unstructured":"Zhu X, Duan H, Cao Y, et al. Perceptual quality assessment of omnidirectional audio-visual signals. arXiv preprint. ArXiv:2307.10813, 2023"},{"key":"4133_CR74","first-page":"1","volume-title":"Proceedings of the IEEE International Workshop on Multimedia Signal Processing","author":"R M Nasiri","year":"2015","unstructured":"Nasiri R M, Wang J, Rehman A, et al. Perceptual quality assessment of high frame rate video. In: Proceedings of the IEEE International Workshop on Multimedia Signal Processing, 2015. 1\u20136"},{"key":"4133_CR75","doi-asserted-by":"publisher","first-page":"1499","DOI":"10.1109\/TMM.2018.2880603","volume":"21","author":"A Mackin","year":"2018","unstructured":"Mackin A, Zhang F, Bull D R. A study of high frame rate video formats. IEEE Trans Multimedia, 2018, 21: 1499\u20131512","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR76","doi-asserted-by":"publisher","first-page":"108069","DOI":"10.1109\/ACCESS.2021.3100462","volume":"9","author":"P C Madhusudana","year":"2021","unstructured":"Madhusudana P C, Yu X, Birkbeck N, et al. Subjective and objective quality assessment of high frame rate videos. IEEE Access, 2021, 9: 108069","journal-title":"IEEE Access"},{"key":"4133_CR77","doi-asserted-by":"publisher","first-page":"934","DOI":"10.1109\/TIP.2021.3137658","volume":"31","author":"D Y Lee","year":"2021","unstructured":"Lee D Y, Paul S, Bampis C G, et al. A subjective and objective study of space-time subsampled video quality. IEEE Trans Image Process, 2021, 31: 934\u2013948","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR78","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Quality of Multimedia Experience","author":"H Men","year":"2020","unstructured":"Men H, Hosu V, Lin H, et al. Visual quality assessment for interpolated slow-motion videos based on a novel database. In: Proceedings of the IEEE International Conference on Quality of Multimedia Experience, 2020. 1\u20136"},{"key":"4133_CR79","doi-asserted-by":"crossref","unstructured":"Danier D, Zhang F, Bull D. Bvi-vfi: a video quality database for video frame interpolation. arXiv preprint. ArXiv:2210.00823, 2022","DOI":"10.1109\/ICIP46576.2022.9897364"},{"key":"4133_CR80","doi-asserted-by":"publisher","first-page":"973","DOI":"10.1109\/TMM.2006.879871","volume":"8","author":"S Winkler","year":"2006","unstructured":"Winkler S, Faller C. Perceived audiovisual quality of low-bitrate multimedia content. IEEE Trans Multimedia, 2006, 8: 973\u2013980","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR81","doi-asserted-by":"publisher","first-page":"640","DOI":"10.1109\/JSTSP.2012.2215306","volume":"6","author":"M H Pinson","year":"2012","unstructured":"Pinson M H, Janowski L, Pepion R, et al. The influence of subjects and environment on audiovisual subjective tests: an international study. IEEE J Sel Top Signal Process, 2012, 6: 640\u2013651","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR82","first-page":"30","volume-title":"Proceedings of the International Workshop on Quality of Multimedia Experience","author":"M H Pinson","year":"2013","unstructured":"Pinson M H, Schmidmer C, Janowski L, et al. Subjective and objective evaluation of an audiovisual subjective dataset for research and development. In: Proceedings of the International Workshop on Quality of Multimedia Experience, 2013. 30\u201331"},{"key":"4133_CR83","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Communications","author":"E Demirbilek","year":"2016","unstructured":"Demirbilek E, Gr\u00e9goire J C. Towards reduced reference parametric models for estimating audiovisual quality in multimedia services. In: Proceedings of the IEEE International Conference on Communications, 2016. 1\u20136"},{"key":"4133_CR84","doi-asserted-by":"publisher","first-page":"061108","DOI":"10.1117\/1.JEI.23.6.061108","volume":"23","author":"H B Martinez","year":"2014","unstructured":"Martinez H B, Farias M C Q. Full-reference audio-visual video quality metric. J Electron Imag, 2014, 23: 061108","journal-title":"J Electron Imag"},{"key":"4133_CR85","doi-asserted-by":"publisher","first-page":"23993","DOI":"10.1007\/s11042-018-5656-7","volume":"77","author":"H A B Martinez","year":"2018","unstructured":"Martinez H A B, Farias M C Q. Combining audio and video metrics to assess audio-visual quality. Multimed Tools Appl, 2018, 77: 23993\u201324012","journal-title":"Multimed Tools Appl"},{"key":"4133_CR86","doi-asserted-by":"publisher","first-page":"6054","DOI":"10.1109\/TIP.2020.2988148","volume":"29","author":"X Min","year":"2020","unstructured":"Min X, Zhai G, Zhou J, et al. Study of subjective and objective quality Assessment of audio-visual signals. IEEE Trans Image Process, 2020, 29: 6054\u20136068","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR87","doi-asserted-by":"publisher","first-page":"3847","DOI":"10.1109\/TIP.2023.3290528","volume":"32","author":"Y Cao","year":"2023","unstructured":"Cao Y, Min X, Sun W, et al. Subjective and objective audio-visual quality assessment for user generated content. IEEE Trans Image Process, 2023, 32: 3847\u20133861","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR88","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Multimedia and Expo Workshops","author":"R F Fela","year":"2022","unstructured":"Fela R F, Pastor A, Le Callet P, et al. Perceptual evaluation on audio-visual dataset of 360 content. In: Proceedings of the IEEE International Conference on Multimedia and Expo Workshops, 2022. 1\u20136"},{"key":"4133_CR89","first-page":"8","volume-title":"Proceedings of the IEEE International Conference on Heterogeneous Networking for Quality, Reliability, Security and Robustness","author":"A Banitalebi-Dehkordi","year":"2014","unstructured":"Banitalebi-Dehkordi A, Azimi M, Pourazad M T, et al. Compression of high dynamic range video using the hevc and h. 264\/avc standards. In: Proceedings of the IEEE International Conference on Heterogeneous Networking for Quality, Reliability, Security and Robustness, 2014. 8\u201312"},{"key":"4133_CR90","first-page":"289","volume-title":"Proceedings of the Applications of Digital Image Processing","author":"M Narwaria","year":"2015","unstructured":"Narwaria M, Da Silva M P, Le Callet P. Study of high dynamic range video quality assessment. In: Proceedings of the Applications of Digital Image Processing. SPIE, 2015. 289\u2013301"},{"key":"4133_CR91","doi-asserted-by":"publisher","first-page":"426","DOI":"10.1016\/j.image.2016.08.001","volume":"47","author":"R Mukherjee","year":"2016","unstructured":"Mukherjee R, Debattista K, Bashford-Rogers T, et al. Objective and subjective evaluation of high dynamic range video compression. Signal Processing-Image Communication, 2016, 47: 426\u2013437","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR92","first-page":"899","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"H Yeganeh","year":"2016","unstructured":"Yeganeh H, Wang S, Zeng K, et al. Objective quality assessment of tone-mapped videos. In: Proceedings of the IEEE International Conference on Image Processing, 2016. 899\u2013903"},{"key":"4133_CR93","unstructured":"Azimi M, Banitalebi-Dehkordi A, Dong Y, et al. Evaluating the performance of existing full-reference quality metrics on high dynamic range (hdr) video content. arXiv preprint. ArXiv:1803.04815, 2018"},{"key":"4133_CR94","first-page":"1740","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"S Athar","year":"2019","unstructured":"Athar S, Costa T, Zeng K, et al. Perceptual quality assessment of uhd-hdr-wcg videos. In: Proceedings of the IEEE International Conference on Image Processing, 2019. 1740\u20131744"},{"key":"4133_CR95","first-page":"786","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"Z Shang","year":"2022","unstructured":"Shang Z, Ebenezer J P, Bovik A C, et al. Subjective assessment of high dynamic range videos under different ambient conditions. In: Proceedings of the IEEE International Conference on Image Processing, 2022. 786\u2013790"},{"key":"4133_CR96","doi-asserted-by":"publisher","first-page":"8636","DOI":"10.1109\/TIP.2020.3018256","volume":"29","author":"S Cheng","year":"2020","unstructured":"Cheng S, Zeng H, Chen J, et al. Screen content video quality assessment: subjective and objective study. IEEE Trans Image Process, 2020, 29: 8636\u20138651","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR97","doi-asserted-by":"publisher","first-page":"438","DOI":"10.1109\/TBC.2020.3028335","volume":"67","author":"T Li","year":"2020","unstructured":"Li T, Min X, Zhao H, et al. Subjective and objective quality assessment of compressed screen content videos. IEEE Trans Broadcast, 2020, 67: 438\u2013449","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR98","first-page":"1","volume-title":"Proceedings of the Annual Workshop on Network and Systems Support for Games (NetGames)","author":"N Barman","year":"2018","unstructured":"Barman N, Zadtootaghaj S, Schmidt S, et al. Gamingvideoset: a dataset for gaming video streaming applications. In: Proceedings of the Annual Workshop on Network and Systems Support for Games (NetGames), 2018. 1\u20136"},{"key":"4133_CR99","doi-asserted-by":"publisher","first-page":"74511","DOI":"10.1109\/ACCESS.2019.2920477","volume":"7","author":"N Barman","year":"2019","unstructured":"Barman N, Jammeh E, Ghorashi S A, et al. No-reference video quality estimation based on machine learning for passive gaming video streaming applications. IEEE Access, 2019, 7: 74511\u201374527","journal-title":"IEEE Access"},{"key":"4133_CR100","first-page":"213","volume-title":"Proceedings of the ACM Multimedia Systems Conference","author":"S Zadtootaghaj","year":"2020","unstructured":"Zadtootaghaj S, Schmidt S, Sabet S S, et al. Quality estimation models for gaming video streaming services using perceptual video quality dimensions. In: Proceedings of the ACM Multimedia Systems Conference, 2020. 213\u2013224"},{"key":"4133_CR101","first-page":"1810","volume-title":"Proceedings of ICASSP 2022-2022 IEEE International Conference on Acoustics, Speech and Signal Processing","author":"S Wen","year":"2022","unstructured":"Wen S, Ling S, Wang J, et al. Subjective and objective quality assessment of mobile gaming video. In: Proceedings of ICASSP 2022-2022 IEEE International Conference on Acoustics, Speech and Signal Processing, 2022. 1810\u20131814"},{"key":"4133_CR102","doi-asserted-by":"publisher","first-page":"445","DOI":"10.1109\/TG.2023.3293093","volume":"16","author":"X Yu","year":"2023","unstructured":"Yu X, Ying Z, Birkbeck N, et al. Subjective and objective analysis of streamed gaming videos. IEEE Trans Games, 2023, 16: 445\u2013458","journal-title":"IEEE Trans Games"},{"key":"4133_CR103","first-page":"41","volume":"1","author":"H Duan","year":"2024","unstructured":"Duan H, Zhu X, Zhu Y, et al. A quick review of human perception in immersive media. IEEE Open J Immersive Displays, 2024, 1: 41\u201350","journal-title":"IEEE Open J Immersive Displays"},{"key":"4133_CR104","first-page":"4463","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"Z Liu","year":"2017","unstructured":"Liu Z, Yeh R A, Tang X, et al. Video frame synthesis using deep voxel flow. In: Proceedings of the IEEE International Conference on Computer Vision, 2017. 4463\u20134471"},{"key":"4133_CR105","first-page":"32","volume-title":"Proceedings of the Advances in Neural Information Processing Systems","author":"X Xu","year":"2019","unstructured":"Xu X, Siyao L, Sun W, et al. Quadratic video interpolation. In: Proceedings of the Advances in Neural Information Processing Systems, 2019, 32"},{"key":"4133_CR106","first-page":"3521","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"D Danier","year":"2022","unstructured":"Danier D, Zhang F, Bull D. St-mfnet: a spatio-temporal multi-flow network for frame interpolation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2022. 3521\u20133531"},{"key":"4133_CR107","doi-asserted-by":"publisher","first-page":"600","DOI":"10.1109\/TIP.2003.819861","volume":"13","author":"Z Wang","year":"2004","unstructured":"Wang Z, Bovik A C, Sheikh H R, et al. Image quality assessment: from error visibility to structural similarity. IEEE Trans Image Process, 2004, 13: 600\u2013612","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR108","first-page":"1398","volume-title":"Proceedings of the Asilomar Conference on Signals, Systems & Computers","author":"Z Wang","year":"2003","unstructured":"Wang Z, Simoncelli E P, Bovik A C. Multiscale structural similarity for image quality assessment. In: Proceedings of the Asilomar Conference on Signals, Systems & Computers, 2003. 1398\u20131402"},{"key":"4133_CR109","doi-asserted-by":"publisher","first-page":"430","DOI":"10.1109\/TIP.2005.859378","volume":"15","author":"H R Sheikh","year":"2006","unstructured":"Sheikh H R, Bovik A C. Image information and visual quality. IEEE Trans Image Process, 2006, 15: 430\u2013444","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR110","first-page":"586","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"R Zhang","year":"2018","unstructured":"Zhang R, Isola P, Efros A A, et al. The unreasonable effectiveness of deep features as a perceptual metric. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2018. 586\u2013595"},{"key":"4133_CR111","doi-asserted-by":"publisher","first-page":"121","DOI":"10.1016\/S0923-5965(03)00076-6","volume":"19","author":"Z Wang","year":"2004","unstructured":"Wang Z, Lu L, Bovik A C. Video quality assessment based on structural distortion measurement. Signal Processing-Image Communication, 2004, 19: 121\u2013132","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR112","doi-asserted-by":"publisher","first-page":"B61","DOI":"10.1364\/JOSAA.24.000B61","volume":"24","author":"Z Wang","year":"2007","unstructured":"Wang Z, Li Q. Video quality assessment using a statistical model of human visual speed perception. J Opt Soc Am A, 2007, 24: B61","journal-title":"J Opt Soc Am A"},{"key":"4133_CR113","doi-asserted-by":"publisher","first-page":"1653","DOI":"10.1109\/TCSVT.2010.2087470","volume":"20","author":"A K Moorthy","year":"2010","unstructured":"Moorthy A K, Bovik A C. Efficient video quality assessment along temporal trajectories. IEEE Trans Circuits Syst Video Technol, 2010, 20: 1653\u20131658","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR114","first-page":"872","volume-title":"Proceedings of the Conference Record of the Forty-Third Asilomar Conference on Signals, Systems and Computers","author":"A K Moorthy","year":"2009","unstructured":"Moorthy A K, Bovik A C. A motion compensated approach to video quality assessment. In: Proceedings of the Conference Record of the Forty-Third Asilomar Conference on Signals, Systems and Computers, 2009. 872\u2013875"},{"key":"4133_CR115","first-page":"1153","volume-title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing","author":"K Seshadrinathan","year":"2011","unstructured":"Seshadrinathan K, Bovik A C. Temporal hysteresis model of time varying subjective video quality. In: Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing, 2011. 1153\u20131156"},{"key":"4133_CR116","doi-asserted-by":"publisher","first-page":"610","DOI":"10.1109\/TIP.2012.2219551","volume":"22","author":"J Park","year":"2012","unstructured":"Park J, Seshadrinathan K, Lee S, et al. Video quality pooling adaptive to perceptual distortion severity. IEEE Trans Image Process, 2012, 22: 610\u2013620","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR117","doi-asserted-by":"publisher","first-page":"2480","DOI":"10.1109\/TIP.2016.2548247","volume":"25","author":"K Manasa","year":"2016","unstructured":"Manasa K, Channappayya S S. An optical flow-based full reference video quality assessment algorithm. IEEE Trans Image Process, 2016, 25: 2480\u20132492","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR118","first-page":"621","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"K Zeng","year":"2012","unstructured":"Zeng K, Wang Z. 3D-SSIM for video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2012. 621\u2013624"},{"key":"4133_CR119","doi-asserted-by":"publisher","first-page":"335","DOI":"10.1109\/TIP.2009.2034992","volume":"19","author":"K Seshadrinathan","year":"2009","unstructured":"Seshadrinathan K, Bovik A C. Motion tuned spatio-temporal quality assessment of natural videos. IEEE Trans Image Process, 2009, 19: 335\u2013350","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR120","first-page":"283","volume-title":"Proceedings of Human Vision and Electronic Imaging XIV","author":"K Seshadrinathan","year":"2009","unstructured":"Seshadrinathan K, Bovik A C. Motion-based perceptual quality assessment of video. In: Proceedings of Human Vision and Electronic Imaging XIV. SPIE, 2009. 283\u2013294"},{"key":"4133_CR121","doi-asserted-by":"publisher","first-page":"182","DOI":"10.1016\/j.image.2018.06.009","volume":"67","author":"L K Choi","year":"2018","unstructured":"Choi L K, Bovik A C. Video quality assessment accounting for temporal visual masking of local flicker. Signal Processing-Image Communication, 2018, 67: 182\u2013198","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR122","first-page":"29","volume-title":"Proceedings of the IEEE Southwest Symposium on Image Analysis and Interpretation","author":"L K Choi","year":"2016","unstructured":"Choi L K, Bovik A C. Flicker sensitive motion tuned video quality assessment. In: Proceedings of the IEEE Southwest Symposium on Image Analysis and Interpretation, 2016. 29\u201332"},{"key":"4133_CR123","doi-asserted-by":"publisher","first-page":"989","DOI":"10.1109\/TCSVT.2012.2186745","volume":"22","author":"Y Wang","year":"2012","unstructured":"Wang Y, Jiang T, Ma S, et al. Novel spatio-temporal structural information based video quality metric. IEEE Trans Circuits Syst Video Technol, 2012, 22: 989\u2013998","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR124","first-page":"2505","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"P V Vu","year":"2011","unstructured":"Vu P V, Vu C T, Chandler D M. A spatiotemporal most-apparent-distortion model for video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2011. 2505\u20132508"},{"key":"4133_CR125","doi-asserted-by":"publisher","first-page":"033019","DOI":"10.1117\/1.JEI.27.3.033019","volume":"27","author":"P Yan","year":"2018","unstructured":"Yan P, Mou X. Video quality assessment based on motion structure partition similarity of spatiotemporal slice images. J Electronic Imag, 2018, 27: 033019","journal-title":"J Electronic Imag"},{"key":"4133_CR126","doi-asserted-by":"publisher","first-page":"1017","DOI":"10.1109\/TCSVT.2015.2428551","volume":"26","author":"F Zhang","year":"2015","unstructured":"Zhang F, Bull D R. A perception-based hybrid model for video quality assessment. IEEE Trans Circuit System Video Technol, 2015, 26: 1017\u20131028","journal-title":"IEEE Trans Circuit System Video Technol"},{"key":"4133_CR127","doi-asserted-by":"publisher","first-page":"2738","DOI":"10.1109\/TMM.2019.2908377","volume":"21","author":"J Wu","year":"2019","unstructured":"Wu J, Liu Y, Dong W, et al. Quality assessment for video with degradation along salient trajectories. IEEE Trans Multimedia, 2019, 21: 2738\u20132749","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR128","first-page":"200","volume":"23","author":"J You","year":"2013","unstructured":"You J, Ebrahimi T, Perkis A. Attention driven foveated video quality assessment. IEEE Trans Image Process, 2013, 23: 200\u2013213","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR129","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.patcog.2017.04.031","volume":"70","author":"P Peng","year":"2017","unstructured":"Peng P, Liao D, Li Z N. An efficient temporal distortion measure of videos based on spacetime texture. Pattern Recognition, 2017, 70: 1\u201311","journal-title":"Pattern Recognition"},{"key":"4133_CR130","doi-asserted-by":"publisher","first-page":"1275","DOI":"10.1109\/TIP.2017.2651410","volume":"26","author":"W Zhang","year":"2017","unstructured":"Zhang W, Liu H. Study of saliency in objective video quality assessment. IEEE Trans Image Process, 2017, 26: 1275\u20131288","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR131","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.image.2018.02.010","volume":"64","author":"P G Freitas","year":"2018","unstructured":"Freitas P G, Akamine W Y L, Farias M C Q. Using multiple spatio-temporal features to estimate video quality. Signal Processing-Image Communication, 2018, 64: 1\u201310","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR132","first-page":"2","volume":"6","author":"Z Li","year":"2016","unstructured":"Li Z, Aaron A, Katsavounidis I, et al. Toward a practical perceptual video quality metric. The Netflix Tech Blog, 2016, 6: 2","journal-title":"The Netflix Tech Blog"},{"key":"4133_CR133","doi-asserted-by":"publisher","first-page":"2256","DOI":"10.1109\/TCSVT.2018.2868262","volume":"29","author":"C G Bampis","year":"2018","unstructured":"Bampis C G, Li Z, Bovik A C. Spatiotemporal feature integration and model fusion for full reference video quality assessment. IEEE Trans Circuits Syst Video Technol, 2018, 29: 2256\u20132270","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR134","first-page":"298","volume-title":"Proceedings of the Picture Coding Symposium","author":"C G Bampis","year":"2018","unstructured":"Bampis C G, Bovik A C, Li Z. A simple prediction fusion improves data-driven full-reference video quality assessment models. In: Proceedings of the Picture Coding Symposium, 2018. 298\u2013302"},{"key":"4133_CR135","first-page":"2147","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"A K Venkataramanan","year":"2022","unstructured":"Venkataramanan A K, Stejerean C, Bovik A C. Funque: fusion of unified quality evaluators. In: Proceedings of the IEEE International Conference on Image Processing, 2022. 2147\u20132151"},{"key":"4133_CR136","doi-asserted-by":"publisher","first-page":"3754","DOI":"10.1109\/TMM.2021.3107148","volume":"24","author":"Y Liu","year":"2021","unstructured":"Liu Y, Wu J, Li A, et al. Video quality assessment with serial dependence modeling. IEEE Trans Multimedia, 2021, 24: 3754\u20133768","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR137","first-page":"219","volume-title":"Proceedings of the European Conference on Computer Vision","author":"W Kim","year":"2018","unstructured":"Kim W, Kim J, Ahn S, et al. Deep video quality assessor: from spatio-temporal visual sensitivity to a convolutional neural aggregation network. In: Proceedings of the European Conference on Computer Vision, 2018. 219\u2013234"},{"key":"4133_CR138","first-page":"4447","volume-title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing","author":"M Xu","year":"2020","unstructured":"Xu M, Chen J, Wang H, et al. C3DVQA: full-reference video quality assessment with 3d convolutional neural network. In: Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing, 2020. 4447\u20134451"},{"key":"4133_CR139","doi-asserted-by":"publisher","first-page":"2716","DOI":"10.1109\/TNNLS.2018.2890310","volume":"31","author":"Y Zhang","year":"2019","unstructured":"Zhang Y, Gao X, He L, et al. Objective video quality assessment combining transfer learning with CNN. IEEE Trans Neural Netw Learn Syst, 2019, 31: 2716\u20132730","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"key":"4133_CR140","doi-asserted-by":"publisher","first-page":"242","DOI":"10.1016\/j.neucom.2021.06.026","volume":"457","author":"Y Zhang","year":"2021","unstructured":"Zhang Y, He L, Lu W, et al. Video quality assessment with dense features and ranking pooling. Neurocomputing, 2021, 457: 242\u2013253","journal-title":"Neurocomputing"},{"key":"4133_CR141","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Visual Communications and Image Processing","author":"W Wo","year":"2022","unstructured":"Wo W, Zhang Y, Hu Y, et al. Video quality assessment based on quality aggregation networks. In: Proceedings of the IEEE International Conference on Visual Communications and Image Processing, 2022. 1\u20135"},{"key":"4133_CR142","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Multimedia & Expo Workshops","author":"Y Li","year":"2021","unstructured":"Li Y, Feng L, Xu J, et al. Full-reference and no-reference quality assessment for compressed user-generated content videos. In: Proceedings of the IEEE International Conference on Multimedia & Expo Workshops, 2021. 1\u20136"},{"key":"4133_CR143","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Multimedia & Expo Workshops","author":"W Sun","year":"2021","unstructured":"Sun W, Wang T, Min X, et al. Deep learning based full-reference and no-reference quality assessment models for compressed ugc videos. In: Proceedings of the IEEE International Conference on Multimedia & Expo Workshops, 2021. 1\u20136"},{"key":"4133_CR144","doi-asserted-by":"publisher","first-page":"154","DOI":"10.1109\/TMM.2021.3122347","volume":"25","author":"Y Li","year":"2021","unstructured":"Li Y, Meng S, Zhang X, et al. User-generated video quality assessment: a subjective and objective study. IEEE Trans Multimedia, 2021, 25: 154\u2013166","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR145","doi-asserted-by":"publisher","first-page":"312","DOI":"10.1109\/TBC.2004.834028","volume":"50","author":"M H Pinson","year":"2004","unstructured":"Pinson M H, Wolf S. A new standardized method for objectively measuring video quality. IEEE Trans Broadcast, 2004, 50: 312\u2013322","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR146","doi-asserted-by":"publisher","first-page":"260","DOI":"10.1109\/TCSVT.2005.861946","volume":"16","author":"M Masry","year":"2006","unstructured":"Masry M, Hemami S S, Sermadevi Y. A scalable wavelet-based video distortion metric and applications. IEEE Trans Circuits Syst Video Technol, 2006, 16: 260\u2013273","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR147","doi-asserted-by":"publisher","first-page":"1316","DOI":"10.1109\/TNN.2006.879766","volume":"17","author":"P Le Callet","year":"2006","unstructured":"Le Callet P, Viard-Gaudin C, Barba D. A convolutional neural network approach for objective video quality assessment. IEEE Trans Neural Netw, 2006, 17: 1316\u20131327","journal-title":"IEEE Trans Neural Netw"},{"key":"4133_CR148","doi-asserted-by":"publisher","first-page":"71","DOI":"10.1109\/TCSVT.2007.913755","volume":"18","author":"I P Gunawan","year":"2008","unstructured":"Gunawan I P, Ghanbari M. Reduced-reference video quality assessment using discriminative local harmonic strength with motion consideration. IEEE Trans Circuits Syst Video Technol, 2008, 18: 71\u201383","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR149","first-page":"1010","volume-title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing","author":"K Zeng","year":"2010","unstructured":"Zeng K, Wang Z. Temporal motion smoothness measurement for reduced-reference video quality assessment. In: Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing, 2010. 1010\u20131013"},{"key":"4133_CR150","doi-asserted-by":"publisher","first-page":"1441","DOI":"10.1109\/TCSVT.2012.2202049","volume":"22","author":"L Ma","year":"2012","unstructured":"Ma L, Li S, Ngan K N. Reduced-reference video quality assessment of compressed video sequences. IEEE Trans Circuits Syst Video Technol, 2012, 22: 1441\u20131456","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR151","first-page":"541","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"K Zhu","year":"2014","unstructured":"Zhu K, Barkowsky M, Shen M, et al. Optimizing feature pooling and prediction models of vqa algorithms. In: Proceedings of the IEEE International Conference on Image Processing, 2014. 541\u2013545"},{"key":"4133_CR152","doi-asserted-by":"publisher","first-page":"684","DOI":"10.1109\/TCSVT.2012.2214933","volume":"23","author":"R Soundararajan","year":"2012","unstructured":"Soundararajan R, Bovik A C. Video quality assessment by reduced reference spatio-temporal entropic differencing. IEEE Trans Circuit Syst Video Technol, 2012, 23: 684\u2013694","journal-title":"IEEE Trans Circuit Syst Video Technol"},{"key":"4133_CR153","doi-asserted-by":"publisher","first-page":"1333","DOI":"10.1109\/LSP.2017.2726542","volume":"24","author":"C G Bampis","year":"2017","unstructured":"Bampis C G, Gupta P, Soundararajan R, et al. SpEED-QA: spatial efficient entropic differencing for image and video quality. IEEE Signal Process Lett, 2017, 24: 1333\u20131337","journal-title":"IEEE Signal Process Lett"},{"key":"4133_CR154","first-page":"571","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"M Wang","year":"2015","unstructured":"Wang M, Zhang F, Agrafiotis D. A very low complexity reduced reference video quality metric based on spatio-temporal information selection. In: Proceedings of the IEEE International Conference on Image Processing, 2015. 571\u2013575"},{"key":"4133_CR155","doi-asserted-by":"publisher","first-page":"011006","DOI":"10.1117\/1.3267105","volume":"19","author":"D M Chandler","year":"2010","unstructured":"Chandler D M. Most apparent distortion: full-reference image quality assessment and the role of strategy. J Electron Imag, 2010, 19: 011006","journal-title":"J Electron Imag"},{"key":"4133_CR156","doi-asserted-by":"publisher","first-page":"684","DOI":"10.1109\/TIP.2013.2293423","volume":"23","author":"W Xue","year":"2013","unstructured":"Xue W, Zhang L, Mou X, et al. Gradient magnitude similarity deviation: a highly efficient perceptual image quality index. IEEE Trans Image Process, 2013, 23: 684\u2013695","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR157","doi-asserted-by":"publisher","first-page":"3805","DOI":"10.1109\/TIP.2020.2966082","volume":"29","author":"X Min","year":"2020","unstructured":"Min X, Zhai G, Zhou J, et al. A multimodal saliency model for videos with high audio-visual correspondence. IEEE Trans Image Process, 2020, 29: 3805\u20133819","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR158","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/2996463","volume":"13","author":"X Min","year":"2016","unstructured":"Min X, Zhai G, Gu K, et al. Fixation prediction through multimodal analysis. ACM Trans Multimedia Comput Communication Application, 2016, 13: 1\u201323","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR159","first-page":"704","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"H Duan","year":"2018","unstructured":"Duan H, Zhai G, Min X, et al. Learning to predict where the children with asd look. In: Proceedings of the IEEE International Conference on Image Processing, 2018. 704\u2013708"},{"key":"4133_CR160","first-page":"423","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"Y Fang","year":"2020","unstructured":"Fang Y, Duan H, Shi F, et al. Identifying children with autism spectrum disorder based on gaze-following. In: Proceedings of the IEEE International Conference on Image Processing, 2020. 423\u2013427"},{"key":"4133_CR161","doi-asserted-by":"publisher","first-page":"2287","DOI":"10.1109\/TIP.2019.2945857","volume":"29","author":"Z Che","year":"2019","unstructured":"Che Z, Borji A, Zhai G, et al. How is gaze influenced by image transformations? Dataset and model. IEEE Trans Image Process, 2019, 29: 2287\u20132300","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR162","doi-asserted-by":"publisher","first-page":"935","DOI":"10.1109\/TMM.2011.2152382","volume":"13","author":"S Li","year":"2011","unstructured":"Li S, Zhang F, Ma L, et al. Image quality assessment by separately evaluating detail losses and additive impairments. IEEE Trans Multimedia, 2011, 13: 935\u2013949","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR163","first-page":"95","volume":"5","author":"D Melcher","year":"1995","unstructured":"Melcher D, Wolf S. Objective measures for detecting digital tiling. T1A1, 1995, 5: 95\u2013104","journal-title":"T1A1"},{"key":"4133_CR164","doi-asserted-by":"publisher","first-page":"15","DOI":"10.1117\/12.152700","volume-title":"Proceedings of Human vision, visual processing, and digital display IV","author":"A A Webster","year":"1993","unstructured":"Webster A A, Jones C T, Pinson M H, et al. Objective video quality assessment system based on human perception. In: Proceedings of Human vision, visual processing, and digital display IV, 1993. 15\u201326"},{"key":"4133_CR165","first-page":"801","volume-title":"Proceedings of the Visual Communications and Image Processing","author":"Y Tetsuji","year":"2000","unstructured":"Tetsuji Y, Kameda M, Miyahara M M. Objective picture quality scale for video images (pqsvideo): definition of distortion factors. In: Proceedings of the Visual Communications and Image Processing, 2000. 801\u2013809"},{"key":"4133_CR166","first-page":"981","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"Z Wang","year":"2000","unstructured":"Wang Z, Bovik A C, Evan B L. Blind measurement of blocking artifacts in images. In: Proceedings of the IEEE International Conference on Image Processing, 2000. 981\u2013984"},{"key":"4133_CR167","first-page":"49","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"K Zhu","year":"2013","unstructured":"Zhu K, Hirakawa K, Asari V, et al. A no-reference video quality assessment based on laplacian pyramids. In: Proceedings of the IEEE International Conference on Image Processing, 2013. 49\u201353"},{"key":"4133_CR168","doi-asserted-by":"publisher","first-page":"517","DOI":"10.1109\/TIP.2011.2166082","volume":"21","author":"R Soundararajan","year":"2011","unstructured":"Soundararajan R, Bovik A C. Rred indices: reduced reference entropic differencing for image quality assessment. IEEE Trans Image Process, 2011, 21: 517\u2013526","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR169","doi-asserted-by":"publisher","first-page":"209","DOI":"10.1109\/LSP.2012.2227726","volume":"20","author":"A Mittal","year":"2012","unstructured":"Mittal A, Soundararajan R, Bovik A C. Making a \u201ccompletely blind\u201d image quality analyzer. IEEE Signal Process Lett, 2012, 20: 209\u2013212","journal-title":"IEEE Signal Process Lett"},{"key":"4133_CR170","doi-asserted-by":"publisher","first-page":"2579","DOI":"10.1109\/TIP.2015.2426416","volume":"24","author":"L Zhang","year":"2015","unstructured":"Zhang L, Zhang L, Bovik A C. A feature-enriched completely blind image quality evaluator. IEEE Trans Image Process, 2015, 24: 2579\u20132591","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR171","first-page":"491","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"J Xu","year":"2014","unstructured":"Xu J, Ye P, Liu Y, et al. No-reference video quality assessment via feature learning. In: Proceedings of the IEEE International Conference on Image Processing, 2014. 491\u2013495"},{"key":"4133_CR172","doi-asserted-by":"publisher","first-page":"289","DOI":"10.1109\/TIP.2015.2502725","volume":"25","author":"A Mittal","year":"2015","unstructured":"Mittal A, Saad M A, Bovik A C. A completely blind video integrity oracle. IEEE Trans Image Process, 2015, 25: 289\u2013300","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR173","doi-asserted-by":"publisher","first-page":"263","DOI":"10.1109\/TIP.2021.3130541","volume":"31","author":"P Kancharla","year":"2021","unstructured":"Kancharla P, Channappayya S S. Completely blind quality assessment of user generated video content. IEEE Trans Image Process, 2021, 31: 263\u2013274","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR174","doi-asserted-by":"publisher","first-page":"2228","DOI":"10.1109\/LSP.2022.3215311","volume":"29","author":"Q Zheng","year":"2022","unstructured":"Zheng Q, Tu Z, Zeng X, et al. A completely blind video quality evaluator. IEEE Signal Process Lett, 2022, 29: 2228\u20132232","journal-title":"IEEE Signal Process Lett"},{"key":"4133_CR175","doi-asserted-by":"publisher","first-page":"1352","DOI":"10.1109\/TIP.2014.2299154","volume":"23","author":"M A Saad","year":"2014","unstructured":"Saad M A, Bovik A C, Charrier C. Blind prediction of natural video quality. IEEE Trans Image Process, 2014, 23: 1352\u20131365","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR176","doi-asserted-by":"publisher","first-page":"5923","DOI":"10.1109\/TIP.2019.2923051","volume":"28","author":"J Korhonen","year":"2019","unstructured":"Korhonen J. Two-level approach for no-reference consumer video quality assessment. IEEE Trans Image Process, 2019, 28: 5923\u20135938","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR177","doi-asserted-by":"publisher","first-page":"4449","DOI":"10.1109\/TIP.2021.3072221","volume":"30","author":"Z Tu","year":"2021","unstructured":"Tu Z, Wang Y, Birkbeck N, et al. UGC-VQA: benchmarking blind video quality assessment for user generated content. IEEE Trans Image Process, 2021, 30: 4449\u20134464","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR178","doi-asserted-by":"publisher","first-page":"8059","DOI":"10.1109\/TIP.2021.3112055","volume":"30","author":"J P Ebenezer","year":"2021","unstructured":"Ebenezer J P, Shang Z, Wu Y, et al. ChipQA: no-reference video quality prediction via space-time chips. IEEE Trans Image Process, 2021, 30: 8059\u20138074","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR179","first-page":"2351","volume-title":"Proceedings of the ACM Multimedia Conference","author":"D Li","year":"2019","unstructured":"Li D, Jiang T, Jiang M. Quality assessment of in-the-wild videos. In: Proceedings of the ACM Multimedia Conference, 2019. 2351\u20132359"},{"key":"4133_CR180","doi-asserted-by":"publisher","first-page":"1238","DOI":"10.1007\/s11263-020-01408-w","volume":"129","author":"D Li","year":"2021","unstructured":"Li D, Jiang T, Jiang M. Unified quality assessment of in-the-wild videos with mixed datasets training. Int J Comput Vis, 2021, 129: 1238\u20131257","journal-title":"Int J Comput Vis"},{"key":"4133_CR181","first-page":"156","volume-title":"Proceedings of the IEEE International Conference on Visual Communications and Image Processing","author":"J Tang","year":"2020","unstructured":"Tang J, Dong Y, Xie R, et al. Deep blind video quality assessment for user generated videos. In: Proceedings of the IEEE International Conference on Visual Communications and Image Processing, 2020. 156\u2013159"},{"key":"4133_CR182","first-page":"834","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"P Chen","year":"2020","unstructured":"Chen P, Li L, Ma L, et al. Rirnet: recurrent-in-recurrent network for video quality assessment. In: Proceedings of the ACM International Conference on Multimedia, 2020. 834\u2013842"},{"key":"4133_CR183","doi-asserted-by":"publisher","first-page":"1903","DOI":"10.1109\/TCSVT.2021.3088505","volume":"32","author":"B Chen","year":"2021","unstructured":"Chen B, Zhu L, Li G, et al. Learning generalized spatial-temporal deep feature representation for no-reference video quality assessment. IEEE Trans Circuits Syst Video Technol, 2021, 32: 1903\u20131916","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR184","first-page":"2112","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"J You","year":"2021","unstructured":"You J. Long short-term convolutional transformer for no-reference video quality assessment. In: Proceedings of the ACM International Conference on Multimedia, 2021. 2112\u20132120"},{"key":"4133_CR185","first-page":"356","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"J You","year":"2022","unstructured":"You J, Lin Y. Efficient transformer with locally shared attention for video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2022. 356\u2013360"},{"key":"4133_CR186","doi-asserted-by":"publisher","first-page":"4840","DOI":"10.1109\/TCSVT.2023.3249741","volume":"33","author":"H Wu","year":"2023","unstructured":"Wu H, Chen C, Liao L, et al. Discovqa: temporal distortion-content transformers for video quality assessment. IEEE Trans Circuit Syst Video Technol, 2023, 33: 4840\u20134854","journal-title":"IEEE Trans Circuit Syst Video Technol"},{"key":"4133_CR187","first-page":"1248","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"J Xu","year":"2021","unstructured":"Xu J, Li J, Zhou X, et al. Perceptual quality assessment of Internet videos. In: Proceedings of the ACM International Conference on Multimedia, 2021. 1248\u20131257"},{"key":"4133_CR188","first-page":"327","volume-title":"Proceedings of the European Conference on Computer Vision","author":"Z Ying","year":"2022","unstructured":"Ying Z, Ghadiyaram D, Bovik A. Telepresence video quality assessment. In: Proceedings of the European Conference on Computer Vision. Springer, 2022. 327\u2013347"},{"key":"4133_CR189","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Multimedia and Expo","author":"B Li","year":"2022","unstructured":"Li B, Zhang W, Tian M, et al. Learning a blind quality evaluator for ugc videos in perceptually relevant domains. In: Proceedings of the IEEE International Conference on Multimedia and Expo, 2022. 1\u20136"},{"key":"4133_CR190","doi-asserted-by":"publisher","first-page":"5944","DOI":"10.1109\/TCSVT.2022.3164467","volume":"32","author":"B Li","year":"2022","unstructured":"Li B, Zhang W, Tian M, et al. Blindly assess quality of in-the-wild videos via quality-aware pre-training and motion perception. IEEE Trans Circuits Syst Video Technol, 2022, 32: 5944\u20135958","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR191","doi-asserted-by":"publisher","first-page":"1043","DOI":"10.1109\/TCSVT.2022.3209007","volume":"33","author":"Y Liu","year":"2022","unstructured":"Liu Y, Wu J, Li L, et al. Quality assessment of UGC videos based on decomposition and recomposition. IEEE Trans Circuits Syst Video Technol, 2022, 33: 1043\u20131054","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR192","first-page":"3016","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"Y Wang","year":"2022","unstructured":"Wang Y, Yim J G, Birkbeck N, et al. Revisiting the efficiency of ugc video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2022. 3016\u20133020"},{"key":"4133_CR193","doi-asserted-by":"crossref","unstructured":"Telili A, Fezza S A, Hamidouche W, et al. 2BiVQA: double bi-lstm based video quality assessment of ugc videos. arXiv preprint. ArXiv:2208.14774, 2022","DOI":"10.1145\/3632178"},{"key":"4133_CR194","first-page":"2501","volume-title":"Proceedings of the IEEE International Conference on Multimedia and Expo","author":"W Lu","year":"2023","unstructured":"Lu W, Sun W, Zhang Z, et al. BH-VQA: blind high frame rate video quality assessment. In: Proceedings of the IEEE International Conference on Multimedia and Expo, 2023. 2501\u20132506"},{"key":"4133_CR195","doi-asserted-by":"publisher","first-page":"1031","DOI":"10.1109\/TCSVT.2022.3207148","volume":"33","author":"H Zhu","year":"2022","unstructured":"Zhu H, Chen B, Zhu L, et al. Learning spatiotemporal interactions for user-generated video quality assessment. IEEE Trans Circuits Syst Video Technol, 2022, 33: 1031\u20131042","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR196","unstructured":"Zhang A X, Wang Y G, Tang W, et al. HVS revisited: a comprehensive video quality assessment framework. arXiv preprint. ArXiv:2210.04158, 2022"},{"key":"4133_CR197","doi-asserted-by":"publisher","first-page":"2577","DOI":"10.1109\/TCSVT.2022.3225552","volume":"33","author":"P Chen","year":"2022","unstructured":"Chen P, Li L, Li H, et al. Dynamic expert-knowledge ensemble for generalizable video quality assessment. IEEE Trans Circuit System Video Technol, 2022, 33: 2577\u20132589","journal-title":"IEEE Trans Circuit System Video Technol"},{"key":"4133_CR198","doi-asserted-by":"publisher","first-page":"28060","DOI":"10.1109\/ACCESS.2023.3259101","volume":"11","author":"N W Kwong","year":"2023","unstructured":"Kwong N W, Chan Y L, Tsang S H, et al. Quality feature learning via multi-channel CNN and GRU for no-reference video quality assessment. IEEE Access, 2023, 11: 28060\u201328075","journal-title":"IEEE Access"},{"key":"4133_CR199","unstructured":"Wu H, Liao L, Wang A, et al. Towards robust text-prompted semantic criterion for in-the-wild video quality assessment. arXiv preprint. ArXiv:2304.14672, 2023"},{"key":"4133_CR200","doi-asserted-by":"crossref","unstructured":"Wu H, Liao L, Hou J, et al. Exploring opinion-unaware video quality assessment with semantic affinity criterion. arXiv preprint. ArXiv:2302.13269, 2023","DOI":"10.1109\/ICME55011.2023.00070"},{"key":"4133_CR201","doi-asserted-by":"crossref","unstructured":"Liu H, Wu M, Yuan K, et al. Ada-DQA: adaptive diverse quality-aware feature acquisition for video quality assessment. arXiv preprint. ArXiv:2308.00729, 2023","DOI":"10.1145\/3581783.3611795"},{"key":"4133_CR202","doi-asserted-by":"publisher","first-page":"546","DOI":"10.1145\/3240508.3240643","volume-title":"Proceedings of the ACM Multimedia Conference","author":"W Liu","year":"2018","unstructured":"Liu W, Duanmu Z, Wang Z. End-to-end blind quality assessment of compressed videos using deep neural networks. In: Proceedings of the ACM Multimedia Conference, 2018. 546\u2013554"},{"key":"4133_CR203","first-page":"2349","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"J You","year":"2019","unstructured":"You J, Korhonen J. Deep neural networks for no-reference video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2019. 2349\u20132353"},{"key":"4133_CR204","first-page":"1414","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"F Yi","year":"2021","unstructured":"Yi F, Chen M, Sun W, et al. Attention based network for no-reference ugc video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2021. 1414\u20131418"},{"key":"4133_CR205","unstructured":"Wen S, Wang J. A strong baseline for image and video quality assessment. arXiv preprint. ArXiv:2111.07104, 2021"},{"key":"4133_CR206","doi-asserted-by":"publisher","first-page":"856","DOI":"10.1145\/3503161.3548329","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"W Sun","year":"2022","unstructured":"Sun W, Min X, Lu W, et al. A deep learning based no-reference quality assessment model for ugc videos. In: Proceedings of the ACM International Conference on Multimedia, 2022. 856\u2013865"},{"key":"4133_CR207","unstructured":"Sun W, Wen W, Min X, et al. Analysis of video quality datasets via design of minimalistic video quality models. arXiv preprint. ArXiv:2307.13981, 2023"},{"key":"4133_CR208","first-page":"2326","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"F Xing","year":"2022","unstructured":"Xing F, Wang Y G, Wang H, et al. Starvqa: Space-time attention for video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2022. 2326\u20132330"},{"key":"4133_CR209","doi-asserted-by":"publisher","first-page":"2616","DOI":"10.1109\/TCSVT.2022.3227039","volume":"33","author":"L Lin","year":"2022","unstructured":"Lin L, Wang Z, He J, et al. Deep quality assessment of compressed videos: a subjective and objective study. IEEE Trans Circuit Syst Video Technol, 2022, 33: 2616\u20132626","journal-title":"IEEE Trans Circuit Syst Video Technol"},{"key":"4133_CR210","doi-asserted-by":"publisher","first-page":"651","DOI":"10.1109\/TBC.2022.3164332","volume":"68","author":"W Shen","year":"2022","unstructured":"Shen W, Zhou M, Liao X, et al. An end-to-end no-reference video quality assessment method with hierarchical spatiotemporal feature representation. IEEE Trans Broadcast, 2022, 68: 651\u2013660","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR211","doi-asserted-by":"publisher","first-page":"130","DOI":"10.1109\/TBC.2022.3192997","volume":"69","author":"W Xian","year":"2022","unstructured":"Xian W, Zhou M, Fang B, et al. Spatiotemporal feature hierarchy-based blind prediction of natural video quality via transfer learning. IEEE Trans Broadcast, 2022, 69: 130\u2013143","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR212","doi-asserted-by":"publisher","first-page":"5206","DOI":"10.1109\/TMM.2022.3189251","volume":"25","author":"X Guan","year":"2022","unstructured":"Guan X, Li F, Zhang Y, et al. End-to-end blind video quality assessment based on visual and memory attention modeling. IEEE Trans Multimedia, 2022, 25: 5206\u20135221","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR213","unstructured":"Lu W, Sun W, Min X, et al. Deep neural network for blind visual quality assessment of 4k content. arXiv preprint. ArXiv:2206.04363, 2022"},{"key":"4133_CR214","first-page":"538","volume-title":"Proceedings of the European Conference on Computer Vision","author":"H Wu","year":"2022","unstructured":"Wu H, Chen C, Hou J, et al. Fast-vqa: efficient end-to-end video quality assessment with fragment sampling. In: Proceedings of the European Conference on Computer Vision, 2022. 538\u2013554"},{"key":"4133_CR215","unstructured":"Wu H, Liao L, Chen C, et al. Disentangling aesthetic and technical effects for video quality assessment of user generated content. arXiv preprint. ArXiv:2211.04894, 2022"},{"key":"4133_CR216","doi-asserted-by":"crossref","unstructured":"Kou T, Liu X, Sun W, et al. Stablevqa: a deep no-reference quality assessment model for video stability. arXiv preprint. ArXiv:2308.04904, 2023","DOI":"10.1145\/3581783.3611860"},{"key":"4133_CR217","doi-asserted-by":"crossref","unstructured":"Yuan K, Kong Z, Zheng C, et al. Capturing co-existing distortions in user-generated content for no-reference video quality assessment. arXiv preprint. ArXiv:2307.16813, 2023","DOI":"10.1145\/3581783.3612023"},{"key":"4133_CR218","doi-asserted-by":"publisher","first-page":"1137006","DOI":"10.3389\/frsip.2023.1137006","volume":"3","author":"J Ke","year":"2023","unstructured":"Ke J, Zhang T, Wang Y, et al. MRET: multi-resolution transformer for video quality assessment. Front Signal Process, 2023, 3: 1137006","journal-title":"Front Signal Process"},{"key":"4133_CR219","first-page":"4174","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"J Wu","year":"2021","unstructured":"Wu J, Liu Y, Li L, et al. No-reference video quality assessment with heterogeneous knowledge ensemble. In: Proceedings of the ACM International Conference on Multimedia, 2021. 4174\u20134182"},{"key":"4133_CR220","doi-asserted-by":"publisher","first-page":"3500","DOI":"10.1109\/TCSVT.2021.3114509","volume":"32","author":"Y Liu","year":"2021","unstructured":"Liu Y, Wu J, Li L, et al. Spatiotemporal representation learning for blind video quality assessment. IEEE Trans Circuits Syst Video Technol, 2021, 32: 3500\u20133513","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR221","first-page":"5178","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"P Chen","year":"2021","unstructured":"Chen P, Li L, Wu J, et al. Unsupervised curriculum domain adaptation for no-reference video quality assessment. In: Proceedings of the IEEE International Conference on Computer Vision, 2021. 5178\u20135187"},{"key":"4133_CR222","doi-asserted-by":"publisher","first-page":"458","DOI":"10.1109\/TIP.2021.3130536","volume":"31","author":"P Chen","year":"2021","unstructured":"Chen P, Li L, Wu J, et al. Contrastive self-supervised pre-training for video quality assessment. IEEE Trans Image Process, 2021, 31: 458\u2013471","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR223","unstructured":"Madhusudana P C, Birkbeck N, Wang Y, et al. Conviqt: Contrastive video quality estimator. arXiv preprint. ArXiv:2206.14713, 2022"},{"key":"4133_CR224","doi-asserted-by":"publisher","first-page":"1914","DOI":"10.1145\/3503161.3548064","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"S Mitra","year":"2022","unstructured":"Mitra S, Soundararajan R. Multiview contrastive learning for completely blind video quality assessment of user generated content. In: Proceedings of the ACM International Conference on Multimedia, 2022. 1914\u20131924"},{"key":"4133_CR225","doi-asserted-by":"publisher","first-page":"118","DOI":"10.1109\/TBC.2022.3197904","volume":"69","author":"S Jiang","year":"2022","unstructured":"Jiang S, Sang Q, Hu Z, et al. Self-supervised representation learning for video quality assessment. IEEE Trans Broadcast, 2022, 69: 118\u2013129","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR226","doi-asserted-by":"publisher","first-page":"4695","DOI":"10.1109\/TIP.2012.2214050","volume":"21","author":"A Mittal","year":"2012","unstructured":"Mittal A, Moorthy A K, Bovik A C. No-reference image quality assessment in the spatial domain. IEEE Trans Image Process, 2012, 21: 4695\u20134708","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR227","doi-asserted-by":"publisher","first-page":"2049","DOI":"10.1109\/TMM.2017.2788206","volume":"20","author":"X Min","year":"2018","unstructured":"Min X, Gu K, Zhai G, et al. Blind quality assessment based on pseudo-reference image. IEEE Trans Multimedia, 2018, 20: 2049\u20132062","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR228","doi-asserted-by":"publisher","first-page":"508","DOI":"10.1109\/TBC.2018.2816783","volume":"64","author":"X Min","year":"2018","unstructured":"Min X, Zhai G, Gu K, et al. Blind image quality estimation via distortion aggravation. IEEE Trans Broadcast, 2018, 64: 508\u2013517","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR229","doi-asserted-by":"publisher","first-page":"7607","DOI":"10.1109\/TMM.2022.3224319","volume":"25","author":"Y Zhu","year":"2022","unstructured":"Zhu Y, Li Y, Sun W, et al. Blind image quality assessment via cross-view consistency. IEEE Trans Multimedia, 2022, 25: 7607\u20137620","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR230","doi-asserted-by":"publisher","first-page":"1178","DOI":"10.1109\/JSTSP.2023.3270621","volume":"17","author":"W Sun","year":"2023","unstructured":"Sun W, Min X, Tu D, et al. Blind quality assessment for in-the-wild images via hierarchical feature fusion and iterative mixed database training. IEEE J Sel Top Signal Process, 2023, 17: 1178\u20131192","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR231","first-page":"141","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"Z Tu","year":"2020","unstructured":"Tu Z, Chen C J, Chen L H, et al. A comparative evaluation of temporal pooling methods for blind video quality assessment. In: Proceedings of the IEEE International Conference on Image Processing, 2020. 141\u2013145"},{"key":"4133_CR232","unstructured":"Simonyan K, Zisserman A. Very deep convolutional networks for large-scale image recognition. arXiv preprint. ArXiv:1409.1556, 2014"},{"key":"4133_CR233","first-page":"3202","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"Z Liu","year":"2022","unstructured":"Liu Z, Ning J, Cao Y, et al. Video swin transformer. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2022. 3202\u20133211"},{"key":"4133_CR234","doi-asserted-by":"publisher","first-page":"4041","DOI":"10.1109\/TIP.2020.2967829","volume":"29","author":"V Hosu","year":"2020","unstructured":"Hosu V, Lin H, Sziranyi T, et al. KonIQ-10k: an ecologically valid database for deep learning of blind image quality assessment. IEEE Trans Image Process, 2020, 29: 4041\u20134056","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR235","first-page":"3575","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"Z Ying","year":"2020","unstructured":"Ying Z, Niu H, Gupta P, et al. From patches to pictures (paq-2-piq): mapping the perceptual space of picture quality. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2020. 3575\u20133585"},{"key":"4133_CR236","first-page":"3154","volume-title":"Proceedings of the IEEE International Conference on Computer Vision Workshops","author":"K Hara","year":"2017","unstructured":"Hara K, Kataoka H, Satoh Y. Learning spatio-temporal features with 3d residual networks for action recognition. In: Proceedings of the IEEE International Conference on Computer Vision Workshops, 2017. 3154\u20133160"},{"key":"4133_CR237","first-page":"6299","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"J Carreira","year":"2017","unstructured":"Carreira J, Zisserman A. Quo vadis, action recognition? A new model and the kinetics dataset. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2017. 6299\u20136308"},{"key":"4133_CR238","first-page":"1314","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"A Howard","year":"2019","unstructured":"Howard A, Sandler M, Chu G, et al. Searching for mobilenetv3. In: Proceedings of the IEEE International Conference on Computer Vision, 2019. 1314\u20131324"},{"key":"4133_CR239","first-page":"6450","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"D Tran","year":"2018","unstructured":"Tran D, Wang H, Torresani L, et al. A closer look at spatiotemporal convolutions for action recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2018. 6450\u20136459"},{"key":"4133_CR240","first-page":"776","volume-title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing","author":"J F Gemmeke","year":"2017","unstructured":"Gemmeke J F, Ellis D P, Freedman D, et al. Audio set: an ontology and human-labeled dataset for audio events. In: Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing, 2017. 776\u2013780"},{"key":"4133_CR241","doi-asserted-by":"publisher","first-page":"3474","DOI":"10.1109\/TIP.2021.3061932","volume":"30","author":"W Zhang","year":"2021","unstructured":"Zhang W, Ma K, Zhai G, et al. Uncertainty-aware blind image quality assessment in the laboratory and wild. IEEE Trans Image Process, 2021, 30: 3474\u20133486","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR242","doi-asserted-by":"publisher","first-page":"64","DOI":"10.1109\/TIP.2010.2053549","volume":"20","author":"A Ciancio","year":"2010","unstructured":"Ciancio A, da Costa A L N T, da Silva E A B, et al. No-reference blur assessment of digital pictures based on multifeature classifiers. IEEE Trans Image Process, 2010, 20: 64\u201375","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR243","doi-asserted-by":"publisher","first-page":"372","DOI":"10.1109\/TIP.2015.2500021","volume":"25","author":"D Ghadiyaram","year":"2015","unstructured":"Ghadiyaram D, Bovik A C. Massive online crowdsourced study of subjective and objective picture quality. IEEE Trans Image Process, 2015, 25: 372\u2013387","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR244","first-page":"3677","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"Y Fang","year":"2020","unstructured":"Fang Y, Zhu H, Zeng Y, et al. Perceptual quality assessment of smartphone photography. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2020. 3677\u20133686"},{"key":"4133_CR245","first-page":"6202","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"C Feichtenhofer","year":"2019","unstructured":"Feichtenhofer C, Fan H, Malik J, et al. Slowfast networks for video recognition. In: Proceedings of the IEEE International Conference on Computer Vision, 2019. 6202\u20136211"},{"key":"4133_CR246","first-page":"1492","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"S Xie","year":"2017","unstructured":"Xie S, Girshick R, Doll\u00e1r P, et al. Aggregated residual transformations for deep neural networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2017. 1492\u20131500"},{"key":"4133_CR247","first-page":"6105","volume-title":"Proceedings of the International Conference on Machine Learning","author":"M Tan","year":"2019","unstructured":"Tan M, Le Q. Efficientnet: rethinking model scaling for convolutional neural networks. In: Proceedings of the International Conference on Machine Learning, 2019. 6105\u20136114"},{"key":"4133_CR248","first-page":"625","volume-title":"Proceedings of the IEEE Winter Conference on Applications of Computer Vision","author":"J Stroud","year":"2020","unstructured":"Stroud J, Ross D, Sun C, et al. D3D: distilled 3D networks for video action recognition. In: Proceedings of the IEEE Winter Conference on Applications of Computer Vision, 2020. 625\u2013634"},{"key":"4133_CR249","first-page":"3022","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"G Chu","year":"2021","unstructured":"Chu G, Arikan O, Bender G, et al. Discovering multi-hardware mobile models via architecture search. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2021. 3022\u20133031"},{"key":"4133_CR250","first-page":"16020","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"D Kondratyuk","year":"2021","unstructured":"Kondratyuk D, Yuan L, Li Y, et al. Movinets: mobile video networks for efficient video recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2021. 16020\u201316030"},{"key":"4133_CR251","first-page":"10096","volume-title":"Proceedings of the International Conference on Machine Learning","author":"M Tan","year":"2021","unstructured":"Tan M, Le Q. Efficientnetv2: smaller models and faster training. In: Proceedings of the International Conference on Machine Learning, 2021. 10096\u201310106"},{"key":"4133_CR252","doi-asserted-by":"publisher","first-page":"1796","DOI":"10.1109\/TMM.2017.2780770","volume":"20","author":"Y Zhan","year":"2017","unstructured":"Zhan Y, Zhang R. No-reference image sharpness assessment based on maximum gradient and variability of gradients. IEEE Trans Multimedia, 2017, 20: 1796\u20131808","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR253","first-page":"477","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"G Chen","year":"2015","unstructured":"Chen G, Zhu F, Ann Heng P. An efficient statistical method for image noise level estimation. In: Proceedings of the IEEE International Conference on Computer Vision, 2015. 477\u2013485"},{"key":"4133_CR254","first-page":"I","volume-title":"Proceedings of the International Conference on Image Processing","author":"Z Wang","year":"2002","unstructured":"Wang Z, Sheikh H R, Bovik A C. No-reference perceptual quality assessment of jpeg compressed images. In: Proceedings of the International Conference on Image Processing, 2002. I\u2013I"},{"key":"4133_CR255","doi-asserted-by":"publisher","first-page":"643","DOI":"10.1109\/TCE.2013.6626251","volume":"59","author":"K Panetta","year":"2013","unstructured":"Panetta K, Gao C, Agaian S. No reference color image contrast and quality measures. IEEE Trans Consumer Electron, 2013, 59: 643\u2013651","journal-title":"IEEE Trans Consumer Electron"},{"key":"4133_CR256","first-page":"6546","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"K Hara","year":"2018","unstructured":"Hara K, Kataoka H, Satoh Y. Can spatiotemporal 3d cnns retrace the history of 2d cnns and imagenet? In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2018. 6546\u20136555"},{"key":"4133_CR257","first-page":"11976","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"Z Liu","year":"2022","unstructured":"Liu Z, Mao H, Wu C Y, et al. A convnet for the 2020s. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2022. 11976\u201311986"},{"key":"4133_CR258","doi-asserted-by":"publisher","first-page":"3804","DOI":"10.1109\/TIP.2021.3065239","volume":"30","author":"Y Liu","year":"2021","unstructured":"Liu Y, Zhang X Y, Bian J W, et al. SAMNet: stereoscopically attentive multi-scale network for lightweight salient object detection. IEEE Trans Image Process, 2021, 30: 3804\u20133814","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR259","first-page":"770","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"K He","year":"2016","unstructured":"He K, Zhang X, Ren S, et al. Deep residual learning for image recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2016. 770\u2013778"},{"key":"4133_CR260","first-page":"4489","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"D Tran","year":"2015","unstructured":"Tran D, Bourdev L, Fergus R, et al. Learning spatiotemporal features with 3d convolutional networks. In: Proceedings of the IEEE International Conference on Computer Vision, 2015. 4489\u20134497"},{"key":"4133_CR261","doi-asserted-by":"publisher","first-page":"837","DOI":"10.1145\/3503161.3547849","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"L Liao","year":"2022","unstructured":"Liao L, Xu K, Wu H, et al. Exploring the effectiveness of video perceptual representation in blind video quality assessment. In: Proceedings of the ACM International Conference on Multimedia, 2022. 837\u2013846"},{"key":"4133_CR262","first-page":"8748","volume-title":"Proceedings of the International Conference on Machine Learning","author":"A Radford","year":"2021","unstructured":"Radford A, Kim J W, Hallacy C, et al. Learning transferable visual models from natural language supervision. In: Proceedings of the International Conference on Machine Learning, 2021. 8748\u20138763"},{"key":"4133_CR263","unstructured":"Xing F, Wang Y G, Tang W, et al. Starvqa+: co-training space-time attention for video quality assessment. arXiv preprint. ArXiv:2306.12298, 2023"},{"key":"4133_CR264","first-page":"1395","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"S Xie","year":"2015","unstructured":"Xie S, Tu Z. Holistically-nested edge detection. In: Proceedings of the IEEE International Conference on Computer Vision, 2015. 1395\u20131403"},{"key":"4133_CR265","first-page":"146","volume-title":"Proceedings of the European Conference on Computer Vision","author":"F J Tsai","year":"2022","unstructured":"Tsai F J, Peng Y T, Lin Y Y, et al. Stripformer: strip transformer for fast image deblurring. In: Proceedings of the European Conference on Computer Vision. Springer, 2022. 146\u2013162"},{"key":"4133_CR266","doi-asserted-by":"publisher","first-page":"590","DOI":"10.1109\/TMM.2016.2525004","volume":"18","author":"L Xu","year":"2016","unstructured":"Xu L, Lin W, Ma L, et al. Free-energy principle inspired video quality metric and its use in video coding. IEEE Trans Multimedia, 2016, 18: 590\u2013602","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR267","doi-asserted-by":"publisher","first-page":"533","DOI":"10.1109\/TCSVT.2014.2363737","volume":"25","author":"K Zhu","year":"2014","unstructured":"Zhu K, Li C, Asari V, et al. No-reference video quality assessment based on artifact measurement and statistical analysis. IEEE Trans Circuits Syst Video Technol, 2014, 25: 533\u2013546","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR268","doi-asserted-by":"publisher","first-page":"5462","DOI":"10.1109\/TIP.2017.2735192","volume":"26","author":"X Min","year":"2017","unstructured":"Min X, Ma K, Gu K, et al. Unified blind quality assessment of compressed natural, graphic, and screen content images. IEEE Trans Image Process, 2017, 26: 5462\u20135474","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR269","volume-title":"IEEE Signal Processing Letters","author":"L Lin","year":"2023","unstructured":"Lin L, Zheng Y, Chen W, et al. Saliency-aware spatio-temporal artifact detection for compressed video quality assessment. IEEE Signal Processing Letters, 2023"},{"key":"4133_CR270","first-page":"359","volume-title":"Proceedings of the ACM SIGCOMM conference on Applications, technologies, architectures, and protocols for computer communication","author":"X Liu","year":"2012","unstructured":"Liu X, Dobrian F, Milner H, et al. A case for a coordinated Internet video control plane. In: Proceedings of the ACM SIGCOMM conference on Applications, technologies, architectures, and protocols for computer communication, 2012. 359\u2013370"},{"key":"4133_CR271","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1186\/1687-1499-2014-216","volume":"2014","author":"D Z Rodr\u00edguez","year":"2014","unstructured":"Rodr\u00edguez D Z, Wang Z, Rosa R L, et al. The impact of video-quality-level switching on user quality of experience in dynamic adaptive streaming over http. EURASIP J Wireless Commun Network, 2014, 2014: 1\u201315","journal-title":"EURASIP J Wireless Commun Network"},{"key":"4133_CR272","first-page":"1296","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"A Bentaleb","year":"2016","unstructured":"Bentaleb A, Begen A C, Zimmermann R. Sdndash: improving qoe of http adaptive streaming using software defined networking. In: Proceedings of the ACM International Conference on Multimedia, 2016. 1296\u20131305"},{"key":"4133_CR273","unstructured":"Bampis C G Bovik A C. Learning to predict streaming video qoe: Distortions, rebuffering and memory. arXiv preprint. ArXiv:1703.00633, 2017"},{"key":"4133_CR274","doi-asserted-by":"publisher","first-page":"2257","DOI":"10.1109\/TIP.2018.2790347","volume":"27","author":"D Ghadiyaram","year":"2018","unstructured":"Ghadiyaram D, Pan J, Bovik A C. Learning a continuous-time streaming video QoE model. IEEE Trans Image Process, 2018, 27: 2257\u20132271","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR275","doi-asserted-by":"publisher","first-page":"661","DOI":"10.1109\/TCSVT.2019.2895223","volume":"30","author":"N Eswara","year":"2019","unstructured":"Eswara N, Ashique S, Panchbhai A, et al. Streaming video QoE modeling and prediction: a long short-term memory approach. IEEE Trans Circuits Syst Video Technol, 2019, 30: 661\u2013673","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR276","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3491432","volume":"18","author":"Z Duanmu","year":"2023","unstructured":"Duanmu Z, Liu W, Chen D, et al. A bayesian quality-of-experience model for adaptive streaming videos. ACM Trans Multimedia Comput Communication Application, 2023, 18: 1\u201324","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR277","first-page":"127","volume-title":"Proceedings of the IEEE Consumer Communications and Networking Conference","author":"K D Singh","year":"2012","unstructured":"Singh K D, Hadjadj-Aoul Y, Rubino G. Quality of experience estimation for adaptive http\/tcp video streaming using h. 264\/avc. In: Proceedings of the IEEE Consumer Communications and Networking Conference, 2012. 127\u2013131"},{"key":"4133_CR278","doi-asserted-by":"publisher","first-page":"4937","DOI":"10.1109\/TIP.2022.3190711","volume":"31","author":"L Li","year":"2022","unstructured":"Li L, Chen P, Lin W, et al. From whole video to frames: weakly-supervised domain adaptive continuous-time QoE evaluation. IEEE Trans Image Process, 2022, 31: 4937\u20134951","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR279","volume-title":"IEEE Tran Circuit Syst Video Technol","author":"Z Jia","year":"2024","unstructured":"Jia Z, Min X, Sun W, et al. Continuous and overall quality of experience evaluation for streaming video based on rich features exploration and dual-stage attention. IEEE Tran Circuit Syst Video Technol, 2024"},{"key":"4133_CR280","doi-asserted-by":"publisher","first-page":"1969","DOI":"10.1109\/TCE.2008.4711260","volume":"54","author":"S Yasakethu","year":"2008","unstructured":"Yasakethu S, Hewage C, Fernando W, et al. Quality analysis for 3D video using 2D video quality models. IEEE Trans Consumer Electron, 2008, 54: 1969\u20131976","journal-title":"IEEE Trans Consumer Electron"},{"key":"4133_CR281","doi-asserted-by":"publisher","first-page":"102","DOI":"10.1109\/JSTSP.2016.2632045","volume":"11","author":"C Galkandage","year":"2016","unstructured":"Galkandage C, Calic J, Dogan S, et al. Stereoscopic video quality assessment using binocular energy. IEEE J Sel Top Signal Process, 2016, 11: 102\u2013112","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR282","doi-asserted-by":"publisher","first-page":"823","DOI":"10.1109\/LSP.2018.2829107","volume":"25","author":"B Appina","year":"2018","unstructured":"Appina B, Channappayya S S. Full-reference 3D video quality assessment using scene component statistical dependencies. IEEE Signal Process Lett, 2018, 25: 823\u2013827","journal-title":"IEEE Signal Process Lett"},{"key":"4133_CR283","doi-asserted-by":"publisher","first-page":"509","DOI":"10.1109\/TIP.2019.2929433","volume":"29","author":"Y Zhang","year":"2019","unstructured":"Zhang Y, Zhang H, Yu M, et al. Sparse representation-based video quality assessment for synthesized 3D videos. IEEE Trans Image Process, 2019, 29: 509\u2013524","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR284","doi-asserted-by":"publisher","first-page":"452","DOI":"10.1109\/TCSVT.2020.2981248","volume":"31","author":"C Galkandage","year":"2020","unstructured":"Galkandage C, Calic J, Dogan S, et al. Full-reference stereoscopic video quality assessment using a motion sensitive HVS model. IEEE Trans Circuits Syst Video Technol, 2020, 31: 452\u2013466","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR285","doi-asserted-by":"publisher","first-page":"1185","DOI":"10.1109\/TCE.2011.6018873","volume":"57","author":"C Hewage","year":"2011","unstructured":"Hewage C, Martini M. Reduced-reference quality assessment for 3D video compression and transmission. IEEE Trans Consumer Electron, 2011, 57: 1185\u20131193","journal-title":"IEEE Trans Consumer Electron"},{"key":"4133_CR286","doi-asserted-by":"publisher","first-page":"246","DOI":"10.1016\/j.jvcir.2016.03.010","volume":"38","author":"M Yu","year":"2016","unstructured":"Yu M, Zheng K, Jiang G, et al. Binocular perception based reduced-reference stereo video quality assessment method. J Vis Commun Image Represent, 2016, 38: 246\u2013255","journal-title":"J Vis Commun Image Represent"},{"key":"4133_CR287","doi-asserted-by":"publisher","first-page":"721","DOI":"10.1109\/TIP.2017.2766780","volume":"27","author":"Z Chen","year":"2017","unstructured":"Chen Z, Zhou W, Li W. Blind stereoscopic video quality assessment: from depth perception to overall experience. IEEE Trans Image Process, 2017, 27: 721\u2013734","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR288","doi-asserted-by":"publisher","first-page":"2635","DOI":"10.1109\/TMM.2019.2961209","volume":"22","author":"J Yang","year":"2019","unstructured":"Yang J, Zhao Y, Jiang B, et al. No-reference quality evaluation of stereoscopic video based on spatio-temporal texture. IEEE Trans Multimedia, 2019, 22: 2635\u20132644","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR289","doi-asserted-by":"publisher","first-page":"116820","DOI":"10.1016\/j.image.2022.116820","volume":"108","author":"S Biswas","year":"2022","unstructured":"Biswas S, Appina B, Kara P A, et al. Jomodevi: a joint motion and depth visibility prediction algorithm for perceived stereoscopic 3D quality. Signal Processing-Image Communication, 2022, 108: 116820","journal-title":"Signal Processing-Image Communication"},{"issue":"9","key":"4133_CR290","first-page":"1408","volume":"24","author":"Y Sun","year":"2017","unstructured":"Sun Y, Lu A, Yu L. Weighted-to-spherically-uniform quality evaluation for omnidirectional video. IEEE Signal Processing Letters, 2017, 24(9):1408\u20131412","journal-title":"IEEE Signal Processing Letters"},{"key":"4133_CR291","first-page":"57","volume-title":"Proceedings of Optics and Photonics for Information Processing X","author":"V Zakharchenko","year":"2016","unstructured":"Zakharchenko V, Choi K P, Park J H. Quality metric for spherical panoramic video. In: Proceedings of Optics and Photonics for Information Processing X. SPIE, 2016. 57\u201365"},{"key":"4133_CR292","doi-asserted-by":"publisher","first-page":"217","DOI":"10.1109\/JETCAS.2019.2895096","volume":"9","author":"C Ozcinar","year":"2019","unstructured":"Ozcinar C, Cabrera J, Smolic A. Visual attention-aware omnidirectional video streaming using optimal tiles for virtual reality. IEEE J Emerg Sel Top Circuits Syst, 2019, 9: 217\u2013230","journal-title":"IEEE J Emerg Sel Top Circuits Syst"},{"key":"4133_CR293","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1109\/TMM.2020.3044458","volume":"24","author":"P Gao","year":"2020","unstructured":"Gao P, Zhang P, Smolic A. Quality assessment for omnidirectional video: a spatio-temporal distortion modeling approach. IEEE Trans Multimedia, 2020, 24: 1\u201316","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR294","first-page":"2198","volume":"44","author":"M Xu","year":"2020","unstructured":"Xu M, Jiang L, Li C, et al. Viewport-based cnn: a multi-task approach for assessing 360\u00b0 video quality. IEEE Trans Pattern Analys Machine Intellig, 2020, 44: 2198\u20132215","journal-title":"IEEE Trans Pattern Analys Machine Intellig"},{"key":"4133_CR295","volume-title":"IEEE J Selected Topics Signal Process","author":"H Duan","year":"2023","unstructured":"Duan H, Min X, Sun W, et al. Attentive deep image quality assessment for omnidirectional stitching. IEEE J Selected Topics Signal Process, 2023"},{"key":"4133_CR296","doi-asserted-by":"publisher","first-page":"120","DOI":"10.1109\/TCSVT.2021.3057368","volume":"32","author":"Y Meng","year":"2021","unstructured":"Meng Y, Ma Z. Viewport-based omnidirectional video quality assessment: database, modeling and inference. IEEE Trans Circuit Syst Video Technol, 2021, 32: 120\u2013134","journal-title":"IEEE Trans Circuit Syst Video Technol"},{"key":"4133_CR297","doi-asserted-by":"publisher","first-page":"1778","DOI":"10.1109\/TCSVT.2021.3081182","volume":"32","author":"W Zhou","year":"2021","unstructured":"Zhou W, Xu J, Jiang Q, et al. No-reference quality assessment for 360-degree images by analysis of multifrequency information and local-global naturalness. IEEE Trans Circuits Syst Video Technol, 2021, 32: 1778\u20131791","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR298","doi-asserted-by":"publisher","first-page":"78","DOI":"10.1109\/JSTSP.2019.2956631","volume":"14","author":"Z Fei","year":"2019","unstructured":"Fei Z, Wang F, Wang J, et al. QoE evaluation methods for 360-degree VR video transmission. IEEE J Sel Top Signal Process, 2019, 14: 78\u201388","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR299","doi-asserted-by":"publisher","first-page":"797","DOI":"10.1109\/TMM.2020.2990075","volume":"23","author":"J Yang","year":"2020","unstructured":"Yang J, Liu T, Jiang B, et al. Panoramic video quality assessment based on non-local spherical CNN. IEEE Trans Multimedia, 2020, 23: 797\u2013809","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR300","doi-asserted-by":"publisher","first-page":"1724","DOI":"10.1109\/TCSVT.2020.3015186","volume":"31","author":"J Xu","year":"2020","unstructured":"Xu J, Zhou W, Chen Z. Blind omnidirectional image quality assessment with viewport oriented graph convolutional networks. IEEE Trans Circuits Syst Video Technol, 2020, 31: 1724\u20131737","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR301","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3517240","volume":"6","author":"H Zhu","year":"2022","unstructured":"Zhu H, Li T, Wang C, et al. Eyeqoe: a novel qoe assessment model for 360-degree videos using ocular behaviors. In: Proceedings of the ACM on Interactive, Mobile, Wearable and Ubiquitous Technologies, 2022, 6: 1\u201326","journal-title":"Proceedings of the ACM on Interactive, Mobile, Wearable and Ubiquitous Technologies"},{"key":"4133_CR302","doi-asserted-by":"publisher","first-page":"2473","DOI":"10.1109\/TIP.2014.2303636","volume":"23","author":"Y F Ou","year":"2014","unstructured":"Ou Y F, Xue Y, Wang Y. Q-STAR: a perceptual video quality model considering impact of spatial, temporal, and amplitude resolutions. IEEE Trans Image Process, 2014, 23: 2473\u20132486","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR303","first-page":"300","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"F Zhang","year":"2017","unstructured":"Zhang F, Mackin A, Bull D R. A frame rate dependent video quality metric based on temporal wavelet decomposition and spatiotemporal pooling. In: Proceedings of the IEEE International Conference on Image Processing, 2017. 300\u2013304"},{"key":"4133_CR304","doi-asserted-by":"publisher","first-page":"7446","DOI":"10.1109\/TIP.2021.3106801","volume":"30","author":"P C Madhusudana","year":"2021","unstructured":"Madhusudana P C, Birkbeck N, Wang Y, et al. ST-GREED: space-time generalized entropic differences for frame rate dependent video quality prediction. IEEE Trans Image Process, 2021, 30: 7446\u20137457","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR305","doi-asserted-by":"publisher","first-page":"3644","DOI":"10.1109\/TIP.2022.3173810","volume":"31","author":"D Y Lee","year":"2022","unstructured":"Lee D Y, Kim J, Ko H, et al. Video quality model of compression, resolution and frame rate adaptation based on space-time regularities. IEEE Trans Image Process, 2022, 31: 3644\u20133656","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR306","first-page":"1795","volume-title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing","author":"Q Zheng","year":"2022","unstructured":"Zheng Q, Tu Z, Fan Y, et al. No-reference quality assessment of variable frame-rate videos using temporal bandpass statistics. In: Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing, 2022. 1795\u20131799"},{"key":"4133_CR307","doi-asserted-by":"publisher","first-page":"117101","DOI":"10.1016\/j.image.2024.117101","volume":"122","author":"Q Zheng","year":"2024","unstructured":"Zheng Q, Tu Z, Madhusudana P C, et al. FAVER: blind quality prediction of variable frame rate videos. Signal Processing-Image Communication, 2024, 122: 117101","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR308","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Visual Communications and Image Processing","author":"J Han","year":"2023","unstructured":"Han J, Min X, Gao Y, et al. Perceptual quality assessment for video frame interpolation. In: Proceedings of the IEEE International Conference on Visual Communications and Image Processing, 2023. 1\u20135"},{"key":"4133_CR309","doi-asserted-by":"publisher","first-page":"1882","DOI":"10.1109\/TIP.2023.3251695","volume":"32","author":"Y Cao","year":"2023","unstructured":"Cao Y, Min X, Sun W, et al. Attention-guided neural networks for full-reference and no-reference audio-visual quality assessment. IEEE Trans Image Process, 2023, 32: 1882\u20131896","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR310","doi-asserted-by":"publisher","first-page":"46","DOI":"10.1016\/j.image.2015.04.009","volume":"35","author":"M Narwaria","year":"2015","unstructured":"Narwaria M, Perreira Da Silva M, Le Callet P. HDR-VQM: an objective quality measure for high dynamic range video. Signal Processing-Image Communication, 2015, 35: 46\u201360","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR311","volume-title":"IEEE Signal Processing Letters","author":"J P Ebenezer","year":"2023","unstructured":"Ebenezer J P, Shang Z, Wu Y, et al. Making video quality assessment models robust to bit depth. IEEE Signal Processing Letters, 2023"},{"key":"4133_CR312","doi-asserted-by":"crossref","unstructured":"Ebenezer J P, Shang Z, Wu Y, et al. HDR-ChipQA: no-reference quality assessment on high dynamic range videos. arXiv preprint. ArXiv:2304.13156, 2023","DOI":"10.1016\/j.image.2024.117191"},{"key":"4133_CR313","doi-asserted-by":"publisher","first-page":"6175","DOI":"10.1109\/TIP.2022.3206621","volume":"31","author":"H Zeng","year":"2022","unstructured":"Zeng H, Huang H, Hou J, et al. Screen content video quality assessment model using hybrid spatiotemporal features. IEEE Trans Image Process, 2022, 31: 6175\u20136187","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR314","doi-asserted-by":"publisher","first-page":"3295","DOI":"10.1109\/TIP.2023.3281170","volume":"32","author":"A Saha","year":"2023","unstructured":"Saha A, Chen Y C, Davis C, et al. Study of subjective and objective quality assessment of mobile cloud gaming videos. IEEE Trans Image Process, 2023, 32: 3295\u20133310","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR315","unstructured":"Yu X, Tu Z, Birkbeck N, et al. Perceptual quality assessment of ugc gaming videos. arXiv preprint. ArXiv:2204.00128, 2022"},{"key":"4133_CR316","doi-asserted-by":"publisher","first-page":"505","DOI":"10.1109\/TCE.2012.6227454","volume":"58","author":"X Lin","year":"2012","unstructured":"Lin X, Ma H, Luo L, et al. No-reference video quality assessment in the compressed domain. IEEE Trans Consumer Electron, 2012, 58: 505\u2013512","journal-title":"IEEE Trans Consumer Electron"},{"key":"4133_CR317","doi-asserted-by":"publisher","first-page":"192101","DOI":"10.1007\/s11432-021-3461-9","volume":"65","author":"S Ma","year":"2022","unstructured":"Ma S, Zhang L, Wang S, et al. Evolution of AVS video coding standards: twenty years of innovation and development. Sci China Inf Sci, 2022, 65: 192101","journal-title":"Sci China Inf Sci"},{"key":"4133_CR318","first-page":"1","volume-title":"Proceedings of the IEEE International Symposium on Broadband Multimedia Systems and Broadcasting","author":"R Rassool","year":"2017","unstructured":"Rassool R. Vmaf reproducibility: validating a perceptual practical video quality metric. In: Proceedings of the IEEE International Symposium on Broadband Multimedia Systems and Broadcasting, 2017. 1\u20132"},{"key":"4133_CR319","doi-asserted-by":"publisher","first-page":"067403","DOI":"10.1117\/1.OE.51.6.067403","volume":"51","author":"S O Lee","year":"2012","unstructured":"Lee S O. Hybrid bitstream-based video quality assessment method for scalable video coding. Opt Eng, 2012, 51: 067403","journal-title":"Opt Eng"},{"key":"4133_CR320","doi-asserted-by":"publisher","first-page":"173","DOI":"10.1016\/j.jvcir.2017.01.002","volume":"43","author":"X Huang","year":"2017","unstructured":"Huang X, S\u00f8gaard J, Forchhammer S. No-reference pixel based video quality assessment for HEVC decoded video. J Vis Commun Image Represent, 2017, 43: 173\u2013184","journal-title":"J Vis Commun Image Represent"},{"key":"4133_CR321","doi-asserted-by":"publisher","first-page":"242","DOI":"10.1109\/TCE.2014.6852000","volume":"60","author":"J Nightingale","year":"2014","unstructured":"Nightingale J, Wang Q, Grecos C, et al. The impact of network impairment on quality of experience (QoE) in H.265\/HEVC video streaming. IEEE Trans Consumer Electron, 2014, 60: 242\u2013250","journal-title":"IEEE Trans Consumer Electron"},{"key":"4133_CR322","doi-asserted-by":"publisher","first-page":"1083","DOI":"10.1109\/LSP.2017.2705423","volume":"24","author":"C G Bampis","year":"2017","unstructured":"Bampis C G, Li Z, Bovik A C. Continuous prediction of streaming video qoe using dynamic networks. IEEE Signal Process Lett, 2017, 24: 1083\u20131087","journal-title":"IEEE Signal Process Lett"},{"key":"4133_CR323","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s11432-019-2734-y","volume":"63","author":"M S Anwar","year":"2020","unstructured":"Anwar M S, Wang J, Ullah A, et al. Measuring quality of experience for 360-degree videos in virtual reality. Sci China Inf Sci, 2020, 63: 1\u201315","journal-title":"Sci China Inf Sci"},{"key":"4133_CR324","doi-asserted-by":"publisher","first-page":"148084","DOI":"10.1109\/ACCESS.2020.3015556","volume":"8","author":"M S Anwar","year":"2020","unstructured":"Anwar M S, Wang J, Khan W, et al. Subjective QoE of 360-degree virtual reality videos and machine learning predictions. IEEE Access, 2020, 8: 148084","journal-title":"IEEE Access"},{"key":"4133_CR325","doi-asserted-by":"publisher","first-page":"80321","DOI":"10.1109\/ACCESS.2022.3195527","volume":"10","author":"R R R Rao","year":"2022","unstructured":"Rao R R R, Goring S, Raake A. AVQBits-adaptive video quality model based on bitstream information for various video applications. IEEE Access, 2022, 10: 80321\u201380351","journal-title":"IEEE Access"},{"key":"4133_CR326","doi-asserted-by":"publisher","first-page":"1027","DOI":"10.1109\/TIP.2021.3136723","volume":"31","author":"Z Shang","year":"2021","unstructured":"Shang Z, Ebenezer J P, Wu Y, et al. Study of the subjective and objective quality of high motion live streaming videos. IEEE Trans Image Process, 2021, 31: 1027\u20131041","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR327","first-page":"1","volume-title":"Proceedings of the 3DTV Conference: The True Vision-Capture, Transmission and Display of 3D Video","author":"G Nur","year":"2011","unstructured":"Nur G, Arachchi H K, Dogan S, et al. Extended VQM model for predicting 3D video quality considering ambient illumination context. In: Proceedings of the 3DTV Conference: The True Vision-Capture, Transmission and Display of 3D Video. IEEE, 2011. 1\u20134"},{"key":"4133_CR328","doi-asserted-by":"publisher","first-page":"214","DOI":"10.1109\/LSP.2017.2780285","volume":"25","author":"W Hong","year":"2017","unstructured":"Hong W, Yu L. A spatio-temporal perceptual quality index measuring compression distortions of three-dimensional video. IEEE Signal Processing Letters, 2017, 25: 214\u2013218","journal-title":"IEEE Signal Processing Letters"},{"key":"4133_CR329","doi-asserted-by":"publisher","first-page":"341","DOI":"10.1109\/TBC.2018.2789583","volume":"64","author":"J Yang","year":"2018","unstructured":"Yang J, Ji C, Jiang B, et al. No reference quality assessment of stereo video based on saliency and sparsity. IEEE Trans Broadcast, 2018, 64: 341\u2013353","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR330","doi-asserted-by":"publisher","first-page":"83","DOI":"10.1016\/j.neucom.2018.04.072","volume":"309","author":"J Yang","year":"2018","unstructured":"Yang J, Zhu Y, Ma C, et al. Stereoscopic video quality assessment based on 3D convolutional neural networks. Neurocomputing, 2018, 309: 83\u201393","journal-title":"Neurocomputing"},{"key":"4133_CR331","doi-asserted-by":"publisher","first-page":"5027","DOI":"10.1109\/TIP.2019.2914950","volume":"28","author":"B Appina","year":"2019","unstructured":"Appina B, Dendi S V R, Manasa K, et al. Study of subjective quality and objective blind quality prediction of stereoscopic videos. IEEE Trans Image Process, 2019, 28: 5027\u20135040","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR332","doi-asserted-by":"publisher","first-page":"18","DOI":"10.1109\/TWC.2021.3093305","volume":"21","author":"L Teng","year":"2021","unstructured":"Teng L, Zhai G, Wu Y, et al. QoE driven VR 360\u00b0 video massive MIMO transmission. IEEE Trans Wireless Commun, 2021, 21: 18\u201333","journal-title":"IEEE Trans Wireless Commun"},{"key":"4133_CR333","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.dsp.2018.09.011","volume":"84","author":"W Huang","year":"2019","unstructured":"Huang W, Ding L, Zhai G, et al. Utility-oriented resource allocation for 360-degree video transmission over heterogeneous networks. Digital Signal Processing, 2019, 84: 1\u201314","journal-title":"Digital Signal Processing"},{"key":"4133_CR334","doi-asserted-by":"publisher","first-page":"112106","DOI":"10.1007\/s11432-021-3323-2","volume":"66","author":"Z Zhou","year":"2023","unstructured":"Zhou Z, Meng M, Zhou Y, et al. Model-guided 3D stitching for augmented virtual environment. Sci China Inf Sci, 2023, 66: 112106","journal-title":"Sci China Inf Sci"},{"key":"4133_CR335","first-page":"31","volume-title":"Proceedings of the IEEE International Symposium on Mixed and Augmented Reality","author":"M Yu","year":"2015","unstructured":"Yu M, Lakshman H, Girod B. A framework to evaluate omnidirectional video coding schemes. In: Proceedings of the IEEE International Symposium on Mixed and Augmented Reality, 2015. 31\u201336"},{"key":"4133_CR336","first-page":"54","volume-title":"Proceedings of the IEEE International Conference on Signal Processing","author":"Y Zhou","year":"2018","unstructured":"Zhou Y, Yu M, Ma H, et al. Weighted-to-spherically-uniform ssim objective quality evaluation for panoramic video. In: Proceedings of the IEEE International Conference on Signal Processing, 2018. 54\u201357"},{"key":"4133_CR337","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Multimedia and Expo","author":"S Chen","year":"2018","unstructured":"Chen S, Zhang Y, Li Y, et al. Spherical structural similarity index for objective omnidirectional video quality assessment. In: Proceedings of the IEEE International Conference on Multimedia and Expo, 2018. 1\u20136"},{"key":"4133_CR338","doi-asserted-by":"publisher","first-page":"338","DOI":"10.1109\/OJCAS.2021.3073891","volume":"2","author":"R G A Azevedo","year":"2021","unstructured":"Azevedo R G A, Birkbeck N, Janatra I, et al. Multi-feature 360 video quality estimation. IEEE Open J Circuits Syst, 2021, 2: 338\u2013349","journal-title":"IEEE Open J Circuits Syst"},{"key":"4133_CR339","first-page":"10169","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"C Li","year":"2019","unstructured":"Li C, Xu M, Jiang L, et al. Viewport proposal cnn for 360\u00b0 video quality assessment. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2019. 10169\u201310178"},{"key":"4133_CR340","doi-asserted-by":"publisher","first-page":"4188","DOI":"10.1109\/TCSVT.2021.3126590","volume":"32","author":"Y Zhu","year":"2021","unstructured":"Zhu Y, Zhai G, Yang Y, et al. Viewing behavior supported visual saliency predictor for 360 degree videos. IEEE Trans Circuits Syst Video Technol, 2021, 32: 4188\u20134201","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR341","first-page":"1","volume":"16","author":"Y Zhu","year":"2020","unstructured":"Zhu Y, Zhai G, Min X, et al. Learning a deep agent to predict head movement in 360-degree images. ACM Trans Multimedia Comput Communication Application, 2020, 16: 1\u201323","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR342","doi-asserted-by":"publisher","first-page":"2331","DOI":"10.1109\/TMM.2019.2957986","volume":"22","author":"Y Zhu","year":"2019","unstructured":"Zhu Y, Zhai G, Min X, et al. The prediction of saliency map for head and eye movements in 360 degree images. IEEE Trans Multimedia, 2019, 22: 2331\u20132344","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR343","doi-asserted-by":"publisher","first-page":"15","DOI":"10.1016\/j.image.2018.05.010","volume":"69","author":"Y Zhu","year":"2018","unstructured":"Zhu Y, Zhai G, Min X. The prediction of head and eye movement for 360 degree images. Signal Processing-Image Communication, 2018, 69: 15\u201325","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR344","first-page":"588","volume-title":"Proceedings of the CAAI International Conference on Artificial Intelligence","author":"X Ren","year":"2023","unstructured":"Ren X, Duan H, Min X, et al. Where are the children with autism looking in reality? In: Proceedings of the CAAI International Conference on Artificial Intelligence. Springer, 2023. 588\u2013600"},{"key":"4133_CR345","doi-asserted-by":"publisher","first-page":"38669","DOI":"10.1109\/ACCESS.2018.2854922","volume":"6","author":"J Yang","year":"2018","unstructured":"Yang J, Liu T, Jiang B, et al. 3D panoramic virtual reality video quality assessment based on 3d convolutional neural networks. IEEE Access, 2018, 6: 38669\u201338682","journal-title":"IEEE Access"},{"key":"4133_CR346","doi-asserted-by":"publisher","first-page":"27531","DOI":"10.1007\/s11042-021-10862-8","volume":"80","author":"J Guo","year":"2021","unstructured":"Guo J, Luo Y. No-reference omnidirectional video quality assessment based on generative adversarial networks. Multimed Tools Appl, 2021, 80: 27531\u201327552","journal-title":"Multimed Tools Appl"},{"key":"4133_CR347","doi-asserted-by":"publisher","first-page":"128","DOI":"10.1109\/TIP.2022.3226417","volume":"32","author":"L Yang","year":"2022","unstructured":"Yang L, Xu M, Li S, et al. Blind VQA on 360\u00b0 video via progressively learning from pixels, frames, and video. IEEE Trans Image Process, 2022, 32: 128\u2013143","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR348","first-page":"1348","volume-title":"Proceedings of the International Conference on Signal and Information Processing, Networking and Computers","author":"T An","year":"2022","unstructured":"An T, Sun S, Liu R. Panoramic video quality assessment based on spatial-temporal convolutional neural networks. In: Proceedings of the International Conference on Signal and Information Processing, Networking and Computers. Springer, 2022. 1348\u20131356"},{"key":"4133_CR349","doi-asserted-by":"publisher","first-page":"7206","DOI":"10.1109\/TIP.2022.3220404","volume":"31","author":"H Duan","year":"2022","unstructured":"Duan H, Min X, Zhu Y, et al. Confusing image quality assessment: toward better augmented reality experience. IEEE Trans Image Process, 2022, 31: 7206\u20137221","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR350","doi-asserted-by":"publisher","first-page":"6549","DOI":"10.1145\/3503161.3547955","volume-title":"Proceedings of the ACM International Conference on Multimedia","author":"H Duan","year":"2022","unstructured":"Duan H, Shen W, Min X, et al. Saliency in augmented reality. In: Proceedings of the ACM International Conference on Multimedia, 2022. 6549\u20136558"},{"key":"4133_CR351","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3596445","volume":"19","author":"Y Zhu","year":"2023","unstructured":"Zhu Y, Min X, Zhu D, et al. Toward visual behavior and attention understanding for augmented 360 degree videos. ACM Trans Multimedia Comput Communication Application, 2023, 19: 1\u201324","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR352","doi-asserted-by":"publisher","first-page":"286","DOI":"10.1109\/TCSVT.2010.2087833","volume":"21","author":"Y F Ou","year":"2010","unstructured":"Ou Y F, Ma Z, Liu T, et al. Perceptual quality assessment of video considering both frame rate and quantization artifacts. IEEE Trans Circuit System Video Technol, 2010, 21: 286\u2013298","journal-title":"IEEE Trans Circuit System Video Technol"},{"key":"4133_CR353","doi-asserted-by":"publisher","first-page":"671","DOI":"10.1109\/TCSVT.2011.2177143","volume":"22","author":"Z Ma","year":"2011","unstructured":"Ma Z, Xu M, Ou Y F, et al. Modeling of rate and perceptual quality of compressed video as functions of frame rate and quantization stepsize and its applications. IEEE Trans Circuits Syst Video Technol, 2011, 22: 671\u2013682","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR354","first-page":"1","volume-title":"Proceedings of the Picture Coding Symposium","author":"P C Madhusudana","year":"2021","unstructured":"Madhusudana P C, Birkbeck N, Wang Y, et al. High frame rate video quality assessment using vmaf and entropic differences. In: Proceedings of the Picture Coding Symposium, 2021. 1\u20135"},{"key":"4133_CR355","doi-asserted-by":"publisher","first-page":"680","DOI":"10.1109\/TBC.2008.2001243","volume":"54","author":"K C Yang","year":"2008","unstructured":"Yang K C, Huang A M, Nguyen T Q, et al. A new objective quality metric for frame interpolation used in video compression. IEEE Trans Broadcast, 2008, 54: 680\u201311","journal-title":"IEEE Trans Broadcast"},{"key":"4133_CR356","first-page":"283","volume-title":"Proceedings of the Picture Coding Symposium","author":"D Danier","year":"2022","unstructured":"Danier D, Zhang F, Bull D. Flolpips: a bespoke video quality metric for frame interpolation. In: Proceedings of the Picture Coding Symposium, 2022. 283\u2013287"},{"key":"4133_CR357","first-page":"234","volume-title":"Proceedings of the European Conference on Computer Vision","author":"Q Hou","year":"2022","unstructured":"Hou Q, Ghildyal A, Liu F. A perceptual quality metric for video frame interpolation. In: Proceedings of the European Conference on Computer Vision, 2022. 234\u2013253"},{"key":"4133_CR358","first-page":"1","volume-title":"Proceedings of the IEEE International Symposium on Circuits and Systems","author":"Y Sun","year":"2023","unstructured":"Sun Y, Min X, Duan H, et al. The influence of text-guidance on visual attention. In: Proceedings of the IEEE International Symposium on Circuits and Systems, 2023. 1\u20135"},{"key":"4133_CR359","doi-asserted-by":"crossref","unstructured":"Sun Y, Min X, Duan H, et al. How is visual attention influenced by text guidance? database and model. arXiv preprint. ArXiv:2404.07537, 2024","DOI":"10.1109\/TIP.2024.3461956"},{"key":"4133_CR360","first-page":"153","volume-title":"Proceedings of the IEEE International Workshop on Quality of Multimedia Experience","author":"X Min","year":"2014","unstructured":"Min X, Zhai G, Gao Z, et al. Sound influences visual attention discriminately in videos. In: Proceedings of the IEEE International Workshop on Quality of Multimedia Experience, 2014. 153\u2013158"},{"key":"4133_CR361","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3596445","volume":"19","author":"D Zhu","year":"2023","unstructured":"Zhu D, Shao X, Zhou Q, et al. A novel lightweight audio-visual saliency model for videos. ACM Trans Multimedia Comput Communication Application, 2023, 19: 1\u201322","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR362","volume-title":"IEEE Trans Emerg Topics Computation Intelligence","author":"D Zhu","year":"2024","unstructured":"Zhu D, Zhu K, Ding W, et al. MTCAM: a novel weakly-supervised audio-visual saliency prediction model with multi-modal transformer. IEEE Trans Emerg Topics Computation Intelligence, 2024"},{"key":"4133_CR363","first-page":"355","volume":"47","author":"J G Beerends","year":"1999","unstructured":"Beerends J G, De Caluwe F E. The influence of video quality on perceived audio quality and vice versa. J Audio Engineering Society, 1999, 47: 355\u2013362","journal-title":"J Audio Engineering Society"},{"key":"4133_CR364","doi-asserted-by":"publisher","first-page":"806","DOI":"10.1109\/TMM.2004.837233","volume":"6","author":"D S Hands","year":"2004","unstructured":"Hands D S. A basic multimedia quality model. IEEE Trans Multimedia, 2004, 6: 806\u2013816","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR365","first-page":"2125","volume-title":"Proceedings of the European Signal Processing Conference","author":"H B Martinez","year":"2014","unstructured":"Martinez H B, Farias M C. A no-reference audio-visual video quality metric. In: Proceedings of the European Signal Processing Conference. IEEE, 2014. 2125\u20132129"},{"key":"4133_CR366","doi-asserted-by":"publisher","first-page":"365","DOI":"10.1007\/978-3-031-46317-4_29","volume-title":"Proceedings of the International Conference on Image and Graphics","author":"Y Zhu","year":"2023","unstructured":"Zhu Y, Zhu X, Duan H, et al. Audio-visual saliency for omnidirectional videos. In: Proceedings of the International Conference on Image and Graphics. Springer, 2023. 365\u2013378"},{"key":"4133_CR367","doi-asserted-by":"publisher","first-page":"764","DOI":"10.1109\/TMM.2023.3271022","volume":"26","author":"D Zhu","year":"2023","unstructured":"Zhu D, Zhang K, Zhang N, et al. Unified audio-visual saliency model for omnidirectional videos with spatial audio. IEEE Trans Multimedia, 2023, 26: 764\u2013775","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR368","first-page":"556","volume-title":"Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision","author":"Z Shang","year":"2023","unstructured":"Shang Z, Chen Y, Wu Y, et al. Subjective and objective video quality assessment of high dynamic range sports content. In: Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision, 2023. 556\u2013564"},{"key":"4133_CR369","unstructured":"Ebenezer J P, Shang Z, Chen Y, et al. HDR or SDR? A subjective and objective study of scaled and compressed videos. arXiv preprint. ArXiv:2304.13162, 2023"},{"key":"4133_CR370","doi-asserted-by":"publisher","first-page":"247","DOI":"10.1016\/j.image.2013.09.010","volume":"29","author":"M Melo","year":"2014","unstructured":"Melo M, Bessa M, Debattista K, et al. Evaluation of HDR video tone mapping for mobile devices. Signal Processing-Image Communication, 2014, 29: 247\u2013256","journal-title":"Signal Processing-Image Communication"},{"key":"4133_CR371","first-page":"185","volume-title":"Proceedings of High dynamic range video","author":"G Eilertsen","year":"2016","unstructured":"Eilertsen G, Unger J, Mantiuk R K. Evaluation of tone mapping operators for hdr video. In: Proceedings of High dynamic range video, 2016. 185\u2013207"},{"key":"4133_CR372","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/2010324.1964935","volume":"30","author":"R Mantiuk","year":"2011","unstructured":"Mantiuk R, Kim K J, Rempel A G, et al. HDR-VDP-2. ACM Trans Graph, 2011, 30: 1\u201314","journal-title":"ACM Trans Graph"},{"key":"4133_CR373","doi-asserted-by":"publisher","first-page":"102030","DOI":"10.1016\/j.displa.2021.102030","volume":"69","author":"T Li","year":"2021","unstructured":"Li T, Min X, Zhu W, et al. No-reference screen content video quality assessment. Displays, 2021, 69: 102030","journal-title":"Displays"},{"key":"4133_CR374","first-page":"1","volume-title":"Proceedings of the International Conference on Pattern Recognition and Image Analysis","author":"H Motamednia","year":"2023","unstructured":"Motamednia H, Cheraaqee P, Mansouri A, et al. Quality assessment of screen content videos. In: Proceedings of the International Conference on Pattern Recognition and Image Analysis, 2023. 1\u20137"},{"key":"4133_CR375","doi-asserted-by":"publisher","first-page":"1731","DOI":"10.1016\/j.ins.2022.07.053","volume":"608","author":"W Xian","year":"2022","unstructured":"Xian W, Zhou M, Fang B, et al. A content-oriented no-reference perceptual video quality assessment method for computer graphics animation videos. Inf Sci, 2022, 608: 1731\u20131746","journal-title":"Inf Sci"},{"key":"4133_CR376","first-page":"7","volume-title":"Proceedings of the 23rd Packet Video Workshop","author":"N Barman","year":"2018","unstructured":"Barman N, Schmidt S, Zadtootaghaj S, et al. An evaluation of video quality assessment metrics for passive gaming video streaming. In: Proceedings of the 23rd Packet Video Workshop, 2018. 7\u201312"},{"key":"4133_CR377","doi-asserted-by":"publisher","first-page":"324","DOI":"10.1109\/LSP.2023.3255011","volume":"30","author":"Y C Chen","year":"2023","unstructured":"Chen Y C, Saha A, Davis C, et al. GAMIVAL: video quality prediction on mobile cloud gaming content. IEEE Signal Process Lett, 2023, 30: 324\u2013328","journal-title":"IEEE Signal Process Lett"},{"key":"4133_CR378","doi-asserted-by":"publisher","first-page":"102719","DOI":"10.1016\/j.displa.2024.102719","volume":"83","author":"Y Zhang","year":"2024","unstructured":"Zhang Y, Wang J, Zhu Y, et al. Subjective and objective quality evaluation of UGC video after encoding and decoding. Displays, 2024, 83: 102719","journal-title":"Displays"},{"key":"4133_CR379","doi-asserted-by":"publisher","first-page":"127","DOI":"10.1016\/j.sigpro.2017.10.025","volume":"145","author":"X Min","year":"2018","unstructured":"Min X, Gu K, Zhai G, et al. Saliency-induced reduced-reference quality index for natural scene and screen content images. Signal Processing, 2018, 145: 127\u2013136","journal-title":"Signal Processing"},{"key":"4133_CR380","unstructured":"Final report from the video quality experts group on the validation of objective models of video quality assessment. http:\/\/www.vqeg.org\/, 2000"},{"key":"4133_CR381","doi-asserted-by":"publisher","first-page":"1044","DOI":"10.1109\/TCSVT.2015.2430711","volume":"26","author":"Y Li","year":"2015","unstructured":"Li Y, Po L M, Cheung C H, et al. No-reference video quality assessment with 3D shearlet transform and convolutional neural networks. IEEE Trans Circuits Syst Video Technol, 2015, 26: 1044\u20131057","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR382","first-page":"1676","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"J Kim","year":"2017","unstructured":"Kim J, Lee S. Deep learning of human visual sensitivity in image quality assessment framework. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2017. 1676\u20131684"},{"key":"4133_CR383","doi-asserted-by":"publisher","first-page":"4850","DOI":"10.1109\/TIP.2014.2355716","volume":"23","author":"W Xue","year":"2014","unstructured":"Xue W, Mou X, Zhang L, et al. Blind image quality assessment using joint statistics of gradient magnitude and laplacian features. IEEE Trans Image Process, 2014, 23: 4850\u20134862","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR384","doi-asserted-by":"publisher","first-page":"2957","DOI":"10.1109\/TIP.2017.2685941","volume":"26","author":"D Kundu","year":"2017","unstructured":"Kundu D, Ghadiyaram D, Bovik A C, et al. No-reference quality assessment of tone-mapped hdr pictures. IEEE Trans Image Process, 2017, 26: 2957\u20132971","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR385","doi-asserted-by":"publisher","first-page":"32","DOI":"10.1167\/17.1.32","volume":"17","author":"D Ghadiyaram","year":"2017","unstructured":"Ghadiyaram D, Bovik A C. Perceptual quality prediction on authentically distorted images using a bag of features approach. J Vision, 2017, 17: 32\u201332","journal-title":"J Vision"},{"key":"4133_CR386","first-page":"1098","volume-title":"Proceedings of the IEEE Conference Computer Vision Pattern Recognition","author":"P Ye","year":"2012","unstructured":"Ye P, Kumar J, Kang L, et al. Unsupervised feature learning framework for no-reference image quality assessment. In: Proceedings of the IEEE Conference Computer Vision Pattern Recognition, 2012. 1098\u20131105"},{"key":"4133_CR387","doi-asserted-by":"publisher","first-page":"4444","DOI":"10.1109\/TIP.2016.2585880","volume":"25","author":"J Xu","year":"2016","unstructured":"Xu J, Ye P, Li Q, et al. Blind image quality assessment based on high order statistics aggregation. IEEE Trans Image Process, 2016, 25: 4444\u20134457","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR388","first-page":"3575","volume-title":"Proceedings of the IEEE Conference Computer Vision Pattern Recognition","author":"Z Ying","year":"2020","unstructured":"Ying Z, Niu H, Gupta P, et al. From patches to pictures (PaQ-2-PiQ): mapping the perceptual space of picture quality. In: Proceedings of the IEEE Conference Computer Vision Pattern Recognition, 2020. 3575\u20133585"},{"key":"4133_CR389","doi-asserted-by":"crossref","unstructured":"Li D, Jiang T, Jiang M. Unified quality assessment of in-the-wild videos with mixed datasets training. Int J Comput Vis, 2021","DOI":"10.1007\/s11263-020-01408-w"},{"key":"4133_CR390","doi-asserted-by":"publisher","first-page":"425","DOI":"10.1109\/OJSP.2021.3090333","volume":"2","author":"Z Tu","year":"2021","unstructured":"Tu Z, Yu X, Wang Y, et al. RAPIQUE: rapid and accurate video quality prediction of user generated content. IEEE Open J Signal Process, 2021, 2: 425\u2013440","journal-title":"IEEE Open J Signal Process"},{"key":"4133_CR391","doi-asserted-by":"publisher","first-page":"502","DOI":"10.1016\/j.tics.2006.09.003","volume":"10","author":"F Tong","year":"2006","unstructured":"Tong F, Meng M, Blake R. Neural bases of binocular rivalry. Trends Cogn Sci, 2006, 10: 502\u2013511","journal-title":"Trends Cogn Sci"},{"key":"4133_CR392","doi-asserted-by":"publisher","first-page":"13","DOI":"10.1038\/nrn701","volume":"3","author":"R Blake","year":"2002","unstructured":"Blake R, Logothetis N K. Visual competition. Nat Rev Neurosci, 2002, 3: 13\u201321","journal-title":"Nat Rev Neurosci"},{"key":"4133_CR393","doi-asserted-by":"publisher","first-page":"255","DOI":"10.1145\/3304109.3325818","volume-title":"Proceedings of the ACM Multimedia Systems Conference","author":"H Duan","year":"2019","unstructured":"Duan H, Zhai G, Min X, et al. A dataset of eye movements for the children with autism spectrum disorder. In: Proceedings of the ACM Multimedia Systems Conference, 2019. 255\u2013260"},{"key":"4133_CR394","first-page":"1","volume":"15","author":"H Duan","year":"2019","unstructured":"Duan H, Min X, Fang Y, et al. Visual attention analysis and prediction on human faces for children with autism spectrum disorder. ACM Trans Multimedia Comput Communication Application, 2019, 15: 1\u201323","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR395","doi-asserted-by":"publisher","first-page":"3700","DOI":"10.1109\/TMM.2020.3029891","volume":"23","author":"G Zhai","year":"2020","unstructured":"Zhai G, Zhu Y, Min X. Comparative perceptual assessment of visual signals using free energy features. IEEE Trans Multimedia, 2020, 23: 3700\u20133713","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR396","first-page":"2192","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"D Tu","year":"2022","unstructured":"Tu D, Min X, Duan H, et al. End-to-end human-gaze-target detection with transformers. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2022. 2192\u20132200"},{"key":"4133_CR397","first-page":"87","volume-title":"Proceedings of the European Conference on Computer Vision","author":"D Tu","year":"2022","unstructured":"Tu D, Min X, Duan H, et al. Iwin: Human-object interaction detection via transformer with irregular windows. In: Proceedings of the European Conference on Computer Vision, 2022. 87\u2013103"},{"key":"4133_CR398","doi-asserted-by":"publisher","first-page":"44","DOI":"10.1109\/MCOM.001.2001239","volume":"59","author":"G Shi","year":"2021","unstructured":"Shi G, Xiao Y, Li Y, et al. From semantic communication to semantic-aware networking: model, architecture, and open problems. IEEE Commun Mag, 2021, 59: 44\u201350","journal-title":"IEEE Commun Mag"},{"key":"4133_CR399","first-page":"4267","volume":"65","author":"H Duan","year":"2022","unstructured":"Duan H, Shen W, Min X, et al. Develop then rival: a human vision-inspired framework for superimposed image decomposition. IEEE Trans Multimedia, 2022, 65: 4267\u20134281","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR400","first-page":"2065","volume-title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing","author":"H Duan","year":"2022","unstructured":"Duan H, Min X, Shen W, et al. A unified two-stage model for separating superimposed images. In: Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing, 2022. 2065\u20132069"},{"key":"4133_CR401","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3450626.3459831","volume":"40","author":"R K Mantiuk","year":"2021","unstructured":"Mantiuk R K, Denes G, Chapiro A, et al. FovVideoVDP: a visible difference predictor for wide field-of-view video. ACM Trans Graph, 2021, 40: 1\u201319","journal-title":"ACM Trans Graph"},{"key":"4133_CR402","doi-asserted-by":"publisher","first-page":"202","DOI":"10.1109\/JSAC.2022.3221948","volume":"41","author":"C Dong","year":"2022","unstructured":"Dong C, Liang H, Xu X, et al. Semantic communication system based on semantic slice models propagation. IEEE J Sel Areas Commun, 2022, 41: 202\u2013213","journal-title":"IEEE J Sel Areas Commun"},{"key":"4133_CR403","doi-asserted-by":"publisher","first-page":"64","DOI":"10.1109\/JSTSP.2019.2955024","volume":"14","author":"W Sun","year":"2019","unstructured":"Sun W, Min X, Zhai G, et al. MC360IQA: a multi-channel cnn for blind 360-degree image quality assessment. IEEE J Sel Top Signal Process, 2019, 14: 64\u201377","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR404","first-page":"3450","volume-title":"Proceedings of the IEEE International Conference on Image Processing","author":"W Sun","year":"2017","unstructured":"Sun W, Gu K, Zhai G, et al. CVIQD: subjective quality evaluation of compressed virtual reality images. In: Proceedings of the IEEE International Conference on Image Processing, 2017. 3450\u20133454"},{"key":"4133_CR405","first-page":"1","volume-title":"Proceedings of the International Workshop on Multimedia Signal Processing","author":"W Sun","year":"2018","unstructured":"Sun W, Gu K, Ma S, et al. A large-scale compressed 360-degree spherical image database: from subjective quality evaluation to objective model comparison. In: Proceedings of the International Workshop on Multimedia Signal Processing, 2018. 1\u20136"},{"key":"4133_CR406","first-page":"1","volume-title":"Proceedings of the IEEE International Symposium on Circuits and Systems","author":"H Duan","year":"2018","unstructured":"Duan H, Zhai G, Min X, et al. Perceptual quality assessment of omnidirectional images. In: Proceedings of the IEEE International Symposium on Circuits and Systems, 2018. 1\u20135"},{"key":"4133_CR407","first-page":"38","volume":"17","author":"H Duan","year":"2019","unstructured":"Duan H, Zhai G, Min X, et al. Perceptual quality assessment of omnidirectional images: subjective experiment and objective model evaluation. ZTE Commun, 2019, 17: 38\u201347","journal-title":"ZTE Commun"},{"key":"4133_CR408","first-page":"662","volume-title":"Proceedings of Pacific Rim Conference on Multimedia","author":"H Duan","year":"2017","unstructured":"Duan H, Zhai G, Min X, et al. Assessment of visually induced motion sickness in immersive videos. In: Proceedings of Pacific Rim Conference on Multimedia, 2017. 662\u2013672"},{"key":"4133_CR409","doi-asserted-by":"publisher","first-page":"926","DOI":"10.1109\/JSTSP.2017.2747126","volume":"11","author":"G Wu","year":"2017","unstructured":"Wu G, Masia B, Jarabo A, et al. Light field image processing: an overview. IEEE J Sel Top Signal Process, 2017, 11: 926\u2013954","journal-title":"IEEE J Sel Top Signal Process"},{"key":"4133_CR410","doi-asserted-by":"publisher","first-page":"3790","DOI":"10.1109\/TIP.2020.2966081","volume":"29","author":"X Min","year":"2020","unstructured":"Min X, Zhou J, Zhai G, et al. A metric for light field reconstruction, compression, and display quality evaluation. IEEE Trans Image Process, 2020, 29: 3790\u20133804","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR411","doi-asserted-by":"publisher","first-page":"517","DOI":"10.1109\/TIP.2020.3037504","volume":"30","author":"S Ling","year":"2020","unstructured":"Ling S, Li J, Che Z, et al. Quality assessment of free-viewpoint videos by quantifying the elastic changes of multi-scale motion trajectories. IEEE Trans Image Process, 2020, 30: 517\u2013531","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR412","doi-asserted-by":"publisher","first-page":"67","DOI":"10.1109\/MSP.2010.939077","volume":"28","author":"M Tanimoto","year":"2010","unstructured":"Tanimoto M, Tehrani M, Fujii T, et al. Free-viewpoint TV. IEEE Signal Process Mag, 2010, 28: 67\u201376","journal-title":"IEEE Signal Process Mag"},{"key":"4133_CR413","doi-asserted-by":"publisher","first-page":"7618","DOI":"10.1109\/TCSVT.2022.3186894","volume":"32","author":"Z Zhang","year":"2022","unstructured":"Zhang Z, Sun W, Min X, et al. No-reference quality assessment for 3D colored point cloud and mesh models. IEEE Trans Circuits Syst Video Technol, 2022, 32: 7618\u20137631","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"4133_CR414","unstructured":"Zhang Z, Sun W, Zhu Y, et al. Treating point cloud as moving camera videos: a no-reference quality assessment metric. arXiv preprint. arXiv:2208.14085, 2022"},{"key":"4133_CR415","doi-asserted-by":"crossref","unstructured":"Zhang Z, Sun W, Min X, et al. MM-PCQA: multi-modal learning for no-reference point cloud quality assessment. arXiv preprint. ArXiv:2209.00244, 2022","DOI":"10.24963\/ijcai.2023\/195"},{"key":"4133_CR416","unstructured":"Zhang Z, Sun W, Zhou Y, et al. Advancing zero-shot digital human quality assessment through text-prompted evaluation. arXiv preprint. ArXiv:2307.02808, 2023"},{"key":"4133_CR417","first-page":"36","volume-title":"Proceedings of 2023 IEEE International Conference on Image Processing","author":"Y Zhou","year":"2023","unstructured":"Zhou Y, Zhang Z, Sun W, et al. A no-reference quality assessment method for digital human head. In: Proceedings of 2023 IEEE International Conference on Image Processing, 2023. 36\u201340"},{"key":"4133_CR418","first-page":"1","volume-title":"IEEE Trans Multimedia","author":"Z Zhang","year":"2023","unstructured":"Zhang Z, Sun W, Zhu Y, et al. Evaluating point cloud from moving camera videos: a no-reference metric. IEEE Trans Multimedia, 2023. 1\u201313"},{"key":"4133_CR419","first-page":"1","volume-title":"Proceedings of the International Conference on Quality of Multimedia Experience","author":"E Zerman","year":"2020","unstructured":"Zerman E, Ozcinar C, Gao P, et al. Textured mesh vs coloured point cloud: a subjective study for volumetric video compression. In: Proceedings of the International Conference on Quality of Multimedia Experience, 2020. 1\u20136"},{"key":"4133_CR420","first-page":"2519","volume-title":"Proceedings of the IEEE International Conference on Multimedia and Expo","author":"Z Zhang","year":"2023","unstructured":"Zhang Z, Zhou Y, Sun W, et al. DDH-QA: a dynamic digital humans quality assessment database. In: Proceedings of the IEEE International Conference on Multimedia and Expo, 2023. 2519\u20132524"},{"key":"4133_CR421","first-page":"1365","volume-title":"Proceedings of 2023 IEEE International Conference on Image Processing","author":"Z Zhang","year":"2023","unstructured":"Zhang Z, Zhou Y, Sun W, et al. Geometry-aware video quality assessment for dynamic digital human. In: Proceedings of 2023 IEEE International Conference on Image Processing, 2023. 1365\u20131369"},{"key":"4133_CR422","first-page":"670","volume-title":"Proceedings of the European Signal Processing Conference","author":"Y Fan","year":"2023","unstructured":"Fan Y, Zhang Z, Sun W, et al. Mv-vvqa: Multi-view learning for no-reference volumetric video quality assessment. In: Proceedings of the European Signal Processing Conference, 2023. 670\u2013674"},{"key":"4133_CR423","doi-asserted-by":"publisher","first-page":"133","DOI":"10.1109\/JETCAS.2018.2885981","volume":"9","author":"S Schwarz","year":"2018","unstructured":"Schwarz S, Preda M, Baroncini V, et al. Emerging MPEG standards for point cloud compression. IEEE J Emerg Sel Top Circuits Syst, 2018, 9: 133\u2013148","journal-title":"IEEE J Emerg Sel Top Circuits Syst"},{"key":"4133_CR424","doi-asserted-by":"publisher","first-page":"104","DOI":"10.1109\/TMM.2014.2371240","volume":"17","author":"Y Zhenhui","year":"2014","unstructured":"Zhenhui Yuan, Ghinea G, Muntean G M. Beyond multimedia adaptation: quality of experience-aware multi-sensorial media delivery. IEEE Trans Multimedia, 2014, 17: 104\u2013117","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR425","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3233774","volume":"51","author":"A Covaci","year":"2018","unstructured":"Covaci A, Zou L, Tal I, et al. Is multimedia multisensorial? - A review of mulsemedia systems. ACM Comput Surv, 2018, 51: 1\u201335","journal-title":"ACM Comput Surv"},{"key":"4133_CR426","doi-asserted-by":"publisher","first-page":"3034","DOI":"10.1109\/COMST.2018.2851452","volume":"20","author":"K Antonakoglou","year":"2018","unstructured":"Antonakoglou K, Xu X, Steinbach E, et al. Toward haptic communications over the 5G tactile internet. IEEE Commun Surv Tut, 2018, 20: 3034\u20133059","journal-title":"IEEE Commun Surv Tut"},{"key":"4133_CR427","volume-title":"OpenAI","author":"A Radford","year":"2018","unstructured":"Radford A, Narasimhan K, Salimans T, et al. Improving language understanding by generative pre-training. OpenAI, 2018"},{"key":"4133_CR428","first-page":"10684","volume-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","author":"R Rombach","year":"2022","unstructured":"Rombach R, Blattmann A, Lorenz D, et al. High-resolution image synthesis with latent diffusion models. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2022. 10684\u201310695"},{"key":"4133_CR429","unstructured":"Zheng L, Chiang W L, Sheng Y, et al. Judging llm-as-a-judge with mt-bench and chatbot arena. arXiv preprint. ArXiv:2306.05685, 2023"},{"key":"4133_CR430","doi-asserted-by":"publisher","first-page":"160109","DOI":"10.1007\/s11432-021-3435-8","volume":"65","author":"K Zhang","year":"2022","unstructured":"Zhang K, Zhang R, Wu Y, et al. Few-shot font style transfer with multiple style encoders. Sci China Inf Sci, 2022, 65: 160109","journal-title":"Sci China Inf Sci"},{"key":"4133_CR431","doi-asserted-by":"publisher","first-page":"212102","DOI":"10.1007\/s11432-020-3322-x","volume":"65","author":"X Nie","year":"2022","unstructured":"Nie X, Hu Y, Shen X, et al. Reconstructing and editing fluids using the adaptive multilayer external force guiding model. Sci China Inf Sci, 2022, 65: 212102","journal-title":"Sci China Inf Sci"},{"key":"4133_CR432","unstructured":"Ramesh A, Dhariwal P, Nichol A, et al. Hierarchical text-conditional image generation with clip latents. arXiv preprint. ArXiv:2204.06125, 2022"},{"key":"4133_CR433","unstructured":"Singer U, Polyak A, Hayes T, et al. Make-a-video: text-to-video generation without text-video data. arXiv preprint. ArXiv:2209.14792, 2022"},{"key":"4133_CR434","first-page":"7623","volume-title":"Proceedings of the IEEE International Conference on Computer Vision","author":"J Z Wu","year":"2023","unstructured":"Wu J Z, Ge Y, Wang X, et al. Tune-a-video: one-shot tuning of image diffusion models for text-to-video generation. In: Proceedings of the IEEE International Conference on Computer Vision, 2023. 7623\u20137633"},{"key":"4133_CR435","doi-asserted-by":"crossref","unstructured":"Wang J, Duan H, Liu J, et al. Aigciqa2023: a large-scale image quality assessment database for ai generated images: from the perspectives of quality, authenticity and correspondence. arXiv preprint. ArXiv:2307.00211, 2023","DOI":"10.1007\/978-981-99-9119-8_5"},{"key":"4133_CR436","unstructured":"Wang J, Duan H, Zhai G, et al. Understanding and evaluating human preferences for ai generated images with instruction tuning. arXiv preprint. ArXiv:2405.07346, 2024"},{"key":"4133_CR437","doi-asserted-by":"publisher","first-page":"6833","DOI":"10.1109\/TCSVT.2023.3319020","volume":"34","author":"C Li","year":"2023","unstructured":"Li C, Zhang Z, Wu H, et al. AGIQA-3K: an open database for ai-generated image quality assessment. IEEE Tran Circuit Syst Video Technol, 2023, 34: 6833\u20136846","journal-title":"IEEE Tran Circuit Syst Video Technol"},{"key":"4133_CR438","doi-asserted-by":"publisher","first-page":"103696","DOI":"10.1016\/j.jvcir.2022.103696","volume":"90","author":"Z Zhang","year":"2023","unstructured":"Zhang Z, Sun W, Wu W, et al. Perceptual quality assessment for fine-grained compressed images. J Vis Commun Image Represent, 2023, 90: 103696","journal-title":"J Vis Commun Image Represent"},{"key":"4133_CR439","unstructured":"Xu J, Liu X, Wu Y, et al. Imagereward: learning and evaluating human preferences for text-to-image generation. arXiv preprint. ArXiv:2304.05977, 2023"},{"key":"4133_CR440","doi-asserted-by":"crossref","unstructured":"Yang L, Duan H, Teng L, et al. Aigcoiqa2024: perceptual quality assessment of ai generated omnidirectional images. arXiv preprint. ArXiv:2404.01024, 2024","DOI":"10.1109\/ICIP51287.2024.10647885"},{"key":"4133_CR441","unstructured":"Chivileva I, Lynch P, Ward T E, et al. Measuring the quality of text-to-video model outputs: Metrics and dataset. arXiv preprint. ArXiv:2309.08009, 2023"},{"key":"4133_CR442","first-page":"36","volume-title":"Advances in Neural Information Processing Systems","author":"Y Liu","year":"2024","unstructured":"Liu Y, Li L, Ren S, et al. FETV: a benchmark for fine-grained evaluation of open-domain text-to-video generation. Advances in Neural Information Processing Systems, 2024, 36"},{"key":"4133_CR443","unstructured":"Kou T, Liu X, Zhang Z, et al. Subjective-aligned dateset and metric for text-to-video quality assessment. arXiv preprint. ArXiv:2403.11956, 2024"},{"key":"4133_CR444","doi-asserted-by":"crossref","unstructured":"Chen Z, Sun W, Tian Y, et al. Gaia: rethinking action quality assessment for ai-generated videos. arXiv preprint. ArXiv:2406.06087, 2024","DOI":"10.52202\/079017-1267"},{"key":"4133_CR445","first-page":"22139","volume-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","author":"Y Liu","year":"2024","unstructured":"Liu Y, Cun X, Liu X, et al. EvalCrafter: benchmarking and evaluating large video generation models. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2024. 22139\u201322149"},{"key":"4133_CR446","first-page":"21807","volume-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","author":"Z Huang","year":"2024","unstructured":"Huang Z, He Y, Yu J, et al. VBench: comprehensive benchmark suite for video generative models. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2024. 21807\u201321818"},{"key":"4133_CR447","unstructured":"Liu H, Li C, Li Y, et al. Improved baselines with visual instruction tuning. arXiv preprint. ArXiv:2310.03744, 2023"},{"key":"4133_CR448","unstructured":"Ye Q, Xu H, Xu G, et al. mPLUG-Owl: modularization empowers large language models with multimodality. arXiv preprint. ArXiv:2304.14178, 2023"},{"key":"4133_CR449","unstructured":"Wu H, Zhang Z, Zhang W, et al. Q-align: teaching lmms for visual scoring via discrete text-defined levels. arXiv preprint. ArXiv:2312.17090, 2023"},{"key":"4133_CR450","unstructured":"Zhang Z, Wu H, Ji Z, et al. Q-boost: on visual quality assessment ability of low-level multi-modality foundation models. arXiv preprint. ArXiv:2312.15300, 2023"},{"key":"4133_CR451","unstructured":"Wu H, Zhang Z, Zhang E, et al. Q-instruct: improving low-level visual abilities for multi-modality foundation models. arXiv preprint. ArXiv:2311.06783, 2023"},{"key":"4133_CR452","unstructured":"Wu H, Zhang Z, Zhang E, et al. Q-bench: a benchmark for general-purpose foundation models on low-level vision. arXiv preprint. ArXiv:2309.14181, 2023"},{"key":"4133_CR453","doi-asserted-by":"publisher","first-page":"103685","DOI":"10.1016\/j.jvcir.2022.103685","volume":"90","author":"C C J Kuo","year":"2023","unstructured":"Kuo C C J, Madni A M. Green learning: introduction, examples and outlook. J Vis Commun Image Represent, 2023, 90: 103685","journal-title":"J Vis Commun Image Represent"},{"key":"4133_CR454","unstructured":"Mei Z, Wang Y C, Kuo C C J. Blind video quality assessment at the edge. arXiv preprint. ArXiv:2306.10386, 2023"},{"key":"4133_CR455","first-page":"1","volume-title":"Proceedings of IEEE International Conference on Visual Communications and Image Processing","author":"Y Zhang","year":"2023","unstructured":"Zhang Y, Min X, Zhai G. Split-conv: a resource-efficient compression method for image quality assessment models. In: Proceedings of IEEE International Conference on Visual Communications and Image Processing, 2023. 1\u20135"},{"key":"4133_CR456","doi-asserted-by":"publisher","first-page":"111655","DOI":"10.1016\/j.knosys.2024.111655","volume":"293","author":"Z Hu","year":"2024","unstructured":"Hu Z, Liu L, Sang Q, et al. Adversarial attacks on video quality assessment models. Knowledge-Based Syst, 2024, 293: 111655","journal-title":"Knowledge-Based Syst"},{"key":"4133_CR457","unstructured":"Shumitskaya E, Antsiferova A, Vatolin D. IOI: invisible one-iteration adversarial attack on no-reference image-and video-quality metrics. arXiv preprint. ArXiv:2403.05955, 2024"},{"key":"4133_CR458","first-page":"2916","volume":"35","author":"W Zhang","year":"2022","unstructured":"Zhang W, Li D, Min X, et al. Perceptual attacks of no-reference image quality models with human-in-the-loop. Advances in Neural Information Processing Systems, 2022, 35:2916\u20132929","journal-title":"Advances in Neural Information Processing Systems"},{"key":"4133_CR459","doi-asserted-by":"publisher","first-page":"2879","DOI":"10.1109\/TITS.2018.2868771","volume":"20","author":"X Min","year":"2018","unstructured":"Min X, Zhai G, Gu K, et al. Objective quality evaluation of dehazed images. IEEE Trans Intell Transp Syst, 2018, 20: 2879\u20132892","journal-title":"IEEE Trans Intell Transp Syst"},{"key":"4133_CR460","doi-asserted-by":"publisher","first-page":"2319","DOI":"10.1109\/TMM.2019.2902097","volume":"21","author":"X Min","year":"2019","unstructured":"Min X, Zhai G, Gu K, et al. Quality evaluation of image dehazing methods using synthetic hazy images. IEEE Trans Multimedia, 2019, 21: 2319\u20132333","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR461","doi-asserted-by":"publisher","first-page":"466","DOI":"10.1109\/TIP.2023.3343029","volume":"33","author":"T Guan","year":"2023","unstructured":"Guan T, Li C, Zheng Y, et al. Dual-stream complex-valued convolutional network for authentic dehazed image quality assessment. IEEE Trans Image Process, 2023, 33: 466\u2013478","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR462","doi-asserted-by":"publisher","first-page":"3934","DOI":"10.1109\/TMM.2022.3168438","volume":"25","author":"T Guan","year":"2022","unstructured":"Guan T, Li C, Gu K, et al. Visibility and distortion measurement for no-reference dehazed image quality assessment via complex contourlet transform. IEEE Trans Multimedia, 2022, 25: 3934\u20133949","journal-title":"IEEE Trans Multimedia"},{"key":"4133_CR463","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3457905","volume":"17","author":"G Zhai","year":"2021","unstructured":"Zhai G, Sun W, Min X, et al. Perceptual quality assessment of low-light image enhancement. ACM Trans Multimedia Comput Communication Application, 2021, 17: 1\u201324","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR464","first-page":"1","volume-title":"Proceedings of the IEEE International Conference on Multimedia and Expo","author":"Z Zhang","year":"2021","unstructured":"Zhang Z, Sun W, Min X, et al. A no-reference evaluation metric for low-light image enhancement. In: Proceedings of the IEEE International Conference on Multimedia and Expo, 2021. 1\u20136"},{"key":"4133_CR465","first-page":"1","volume":"19","author":"J Dong","year":"2023","unstructured":"Dong J, Ota K, Dong M. Video frame interpolation: a comprehensive survey. ACM Trans Multimedia Comput Communication Application, 2023, 19: 1\u201331","journal-title":"ACM Trans Multimedia Comput Communication Application"},{"key":"4133_CR466","doi-asserted-by":"publisher","first-page":"5317","DOI":"10.1007\/s10462-022-10302-5","volume":"56","author":"C Rota","year":"2023","unstructured":"Rota C, Buzzelli M, Bianco S, et al. Video restoration based on deep learning: a comprehensive survey. Artif Intell Rev, 2023, 56: 5317\u20135364","journal-title":"Artif Intell Rev"},{"key":"4133_CR467","first-page":"5114","volume-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","author":"W Shen","year":"2020","unstructured":"Shen W, Bao W, Zhai G, et al. Blurry video frame interpolation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2020. 5114\u20135123"},{"key":"4133_CR468","doi-asserted-by":"publisher","first-page":"277","DOI":"10.1109\/TIP.2020.3033617","volume":"30","author":"W Shen","year":"2020","unstructured":"Shen W, Bao W, Zhai G, et al. Video frame interpolation and enhancement via pyramid recurrent framework. IEEE Trans Image Process, 2020, 30: 277\u2013292","journal-title":"IEEE Trans Image Process"},{"key":"4133_CR469","first-page":"4490","volume-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision","author":"Y Tian","year":"2021","unstructured":"Tian Y, Lu G, Min X, et al. Self-conditioned probabilistic learning of video rescaling. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, 2021. 4490\u20134499"},{"key":"4133_CR470","doi-asserted-by":"publisher","first-page":"111101","DOI":"10.1007\/s11432-020-3225-9","volume":"65","author":"H Wang","year":"2022","unstructured":"Wang H, Wu Y, Li M, et al. Survey on rain removal from videos or a single image. Sci China Inf Sci, 2022, 65: 111101","journal-title":"Sci China Inf Sci"},{"key":"4133_CR471","doi-asserted-by":"crossref","unstructured":"Duan H, Min X, Wu S, et al. Uniprocessor: a text-induced unified low-level image processor. arXiv preprint. ArXiv:2407.20928, 2024","DOI":"10.1007\/978-3-031-72855-6_11"},{"key":"4133_CR472","unstructured":"Gao S, Duan H, Li X, et al. Quality-guided skin tone enhancement for portrait photography. arXiv preprint. ArXiv:2406.15848, 2024"},{"key":"4133_CR473","first-page":"5769","volume-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","author":"Z Tu","year":"2022","unstructured":"Tu Z, Talebi H, Zhang H, et al. MAXIM: multi-axis mlp for image processing. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2022. 5769\u20135780"},{"key":"4133_CR474","first-page":"2543","volume-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision","author":"Y Li","year":"2021","unstructured":"Li Y, Jin P, Yang F, et al. COMISR: compression-informed video super-resolution. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, 2021. 2543\u20132552"},{"key":"4133_CR475","first-page":"1724","volume-title":"Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision","author":"R Xu","year":"2023","unstructured":"Xu R, Tu Z, Du Y, et al. Pik-Fix: restoring and colorizing old photos. In: Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision, 2023. 1724\u20131734"},{"key":"4133_CR476","unstructured":"Duan H, Shen W, Min X, et al. Masked autoencoders as image processors. arXiv preprint. ArXiv:2303.17316, 2023"},{"key":"4133_CR477","doi-asserted-by":"publisher","first-page":"119104","DOI":"10.1007\/s11432-020-3031-9","volume":"65","author":"X Hu","year":"2022","unstructured":"Hu X, Shi W, Zhou Y, et al. Quantized and adaptive memristor based CNN (QA-mCNN) for image processing. Sci China Inf Sci, 2022, 65: 119104","journal-title":"Sci China Inf Sci"},{"key":"4133_CR478","doi-asserted-by":"publisher","first-page":"151101","DOI":"10.1007\/s11432-022-3679-0","volume":"66","author":"M Liu","year":"2023","unstructured":"Liu M, Wei Y, Wu X, et al. Survey on leveraging pre-trained generative adversarial networks for image editing and restoration. Sci China Inf Sci, 2023, 66: 151101","journal-title":"Sci China Inf Sci"}],"container-title":["Science China Information Sciences"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11432-024-4133-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11432-024-4133-3","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11432-024-4133-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,12,20]],"date-time":"2025-12-20T22:02:50Z","timestamp":1766268170000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11432-024-4133-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,10,17]]},"references-count":478,"journal-issue":{"issue":"11","published-print":{"date-parts":[[2024,11]]}},"alternative-id":["4133"],"URL":"https:\/\/doi.org\/10.1007\/s11432-024-4133-3","relation":{},"ISSN":["1674-733X","1869-1919"],"issn-type":[{"value":"1674-733X","type":"print"},{"value":"1869-1919","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,10,17]]},"assertion":[{"value":"5 February 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"2 July 2024","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"16 August 2024","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"17 October 2024","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}],"article-number":"211301"}}