{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,10,12]],"date-time":"2025-10-12T03:04:20Z","timestamp":1760238260287,"version":"build-2065373602"},"reference-count":46,"publisher":"MDPI AG","issue":"8","license":[{"start":{"date-parts":[[2020,7,30]],"date-time":"2020-07-30T00:00:00Z","timestamp":1596067200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["J. Imaging"],"abstract":"<jats:p>We introduce a no-reference method for the assessment of the quality of videos affected by in-capture distortions due to camera hardware and processing software. The proposed method encodes both quality attributes and semantic content of each video frame by using two Convolutional Neural Networks (CNNs) and then estimates the quality score of the whole video by using a Recurrent Neural Network (RNN), which models the temporal information. The extensive experiments conducted on four benchmark databases (CVD2014, KoNViD-1k, LIVE-Qualcomm, and LIVE-VQC) containing in-capture distortions demonstrate the effectiveness of the proposed method and its ability to generalize in cross-database setup.<\/jats:p>","DOI":"10.3390\/jimaging6080074","type":"journal-article","created":{"date-parts":[[2020,7,30]],"date-time":"2020-07-30T12:15:38Z","timestamp":1596111338000},"page":"74","update-policy":"https:\/\/doi.org\/10.3390\/mdpi_crossmark_policy","source":"Crossref","is-referenced-by-count":15,"title":["No-Reference Quality Assessment of In-Capture Distorted Videos"],"prefix":"10.3390","volume":"6","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-0009-8007","authenticated-orcid":false,"given":"Mirko","family":"Agarla","sequence":"first","affiliation":[{"name":"Department of Informatics, Systems and Communication, University of Milano-Bicocca, viale Sarca, 336, 20126 Milano, Italy"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-5925-2646","authenticated-orcid":false,"given":"Luigi","family":"Celona","sequence":"additional","affiliation":[{"name":"Department of Informatics, Systems and Communication, University of Milano-Bicocca, viale Sarca, 336, 20126 Milano, Italy"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7461-1451","authenticated-orcid":false,"given":"Raimondo","family":"Schettini","sequence":"additional","affiliation":[{"name":"Department of Informatics, Systems and Communication, University of Milano-Bicocca, viale Sarca, 336, 20126 Milano, Italy"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"1968","published-online":{"date-parts":[[2020,7,30]]},"reference":[{"key":"ref_1","first-page":"444","article-title":"Video Transmission Over Wireless Networks Review and Recent Advances","volume":"4","author":"Ahmed","year":"2015","journal-title":"Int. J. Comput. Appl. Technol. Res."},{"key":"ref_2","doi-asserted-by":"crossref","first-page":"131019","DOI":"10.1109\/ACCESS.2019.2940595","article-title":"Video Transmission using Device-to-Device Communications: A Survey","volume":"7","author":"Ahmed","year":"2019","journal-title":"IEEE Access"},{"key":"ref_3","doi-asserted-by":"crossref","first-page":"121","DOI":"10.1016\/S0923-5965(03)00076-6","article-title":"Video Quality Assessment Based on Structural Distortion Measurement","volume":"19","author":"Wang","year":"2004","journal-title":"Signal Process. Image Commun."},{"key":"ref_4","doi-asserted-by":"crossref","first-page":"2256","DOI":"10.1109\/TCSVT.2018.2868262","article-title":"Spatiotemporal Feature Integration and Model Fusion for Full Reference Video Quality Assessment","volume":"29","author":"Bampis","year":"2018","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"ref_5","doi-asserted-by":"crossref","first-page":"3316","DOI":"10.1109\/TIP.2018.2815842","article-title":"Recurrent and Dynamic Models for Predicting Streaming Video Quality of Experience","volume":"27","author":"Bampis","year":"2018","journal-title":"IEEE Trans. Image Process."},{"key":"ref_6","doi-asserted-by":"crossref","first-page":"2480","DOI":"10.1109\/TIP.2016.2548247","article-title":"An Optical Flow-Based Full Reference Video Quality Assessment Algorithm","volume":"25","author":"Manasa","year":"2016","journal-title":"IEEE Trans. Image Process."},{"key":"ref_7","doi-asserted-by":"crossref","first-page":"684","DOI":"10.1109\/TCSVT.2012.2214933","article-title":"Video Quality Assessment by Reduced Reference Spatio-Temporal Entropic Differencing","volume":"23","author":"Soundararajan","year":"2013","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"ref_8","doi-asserted-by":"crossref","unstructured":"Zeng, K., and Wang, Z. (2010, January 14\u201319). Temporal motion smoothness measurement for reduced-reference video quality assessment. Proceedings of the International Conference on Acoustics, Speech and Signal Processing (ICASSP), Dallas, TX, USA.","DOI":"10.1109\/ICASSP.2010.5495316"},{"key":"ref_9","doi-asserted-by":"crossref","first-page":"209","DOI":"10.1109\/LSP.2012.2227726","article-title":"Making a \u201cCompletely Blind\u201d Image Quality Analyzer","volume":"20","author":"Mittal","year":"2013","journal-title":"IEEE Signal Process. Lett."},{"key":"ref_10","doi-asserted-by":"crossref","first-page":"289","DOI":"10.1109\/TIP.2015.2502725","article-title":"A \u2018Completely Blind\u2019 Video Integrity Oracle","volume":"25","author":"Mittal","year":"2015","journal-title":"IEEE Trans. Image Process."},{"key":"ref_11","doi-asserted-by":"crossref","unstructured":"Li, D., Jiang, T., and Jiang, M. (2019, January 21\u201325). Quality Assessment of In-the-Wild Videos. Proceedings of the International Conference on Multimedia, Nice, France.","DOI":"10.1145\/3343031.3351028"},{"key":"ref_12","doi-asserted-by":"crossref","unstructured":"Saad, M., and Bovik, A. (2012, January 4\u20137). Blind quality assessment of videos using a model of natural scene statistics and motion coherency. Proceedings of the Asilomar Conference on Signals, Systems and Computers (ASILOMAR), Pacific Grove, CA, USA.","DOI":"10.1109\/ACSSC.2012.6489018"},{"key":"ref_13","doi-asserted-by":"crossref","first-page":"4695","DOI":"10.1109\/TIP.2012.2214050","article-title":"No-Reference Image Quality Assessment in the Spatial Domain","volume":"21","author":"Mittal","year":"2012","journal-title":"IEEE Trans. Image Process."},{"key":"ref_14","doi-asserted-by":"crossref","unstructured":"Xu, J., Ye, P., Liu, Y., and Doermann, D. (2014, January 27\u201330). No-reference video quality assessment via feature learning. Proceedings of the International Conference on Image Processing (ICIP), Paris, France.","DOI":"10.1109\/ICIP.2014.7025098"},{"key":"ref_15","doi-asserted-by":"crossref","first-page":"2957","DOI":"10.1109\/TIP.2017.2685941","article-title":"No-Reference Quality Assessment of Tone-Mapped HDR Pictures","volume":"26","author":"Kundu","year":"2017","journal-title":"IEEE Trans. Image Process."},{"key":"ref_16","doi-asserted-by":"crossref","first-page":"1044","DOI":"10.1109\/TCSVT.2015.2430711","article-title":"No-Reference Video Quality Assessment With 3D Shearlet Transform and Convolutional Neural Networks","volume":"26","author":"Li","year":"2016","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"ref_17","doi-asserted-by":"crossref","unstructured":"Wang, C., Su, L., and Zhang, W. (2018, January 10\u201312). COME for No-Reference Video Quality Assessment. Proceedings of the Conference on Multimedia Information Processing and Retrieval (MIPR), Miami, FL, USA.","DOI":"10.1109\/MIPR.2018.00056"},{"key":"ref_18","doi-asserted-by":"crossref","first-page":"011006","DOI":"10.1117\/1.3267105","article-title":"Most apparent distortion: Full-reference image quality assessment and the role of strategy","volume":"19","author":"Larson","year":"2010","journal-title":"J. Electron. Imaging"},{"key":"ref_19","doi-asserted-by":"crossref","unstructured":"Deng, J., Dong, W., Socher, R., Li, L.J., Li, K., and Fei-Fei, L. (2009, January 20\u201325). Imagenet: A large-scale hierarchical image database. Proceedings of the Conference on Computer Vision and Pattern Recognition (CVPR), Miami, FL, USA.","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"ref_20","doi-asserted-by":"crossref","unstructured":"Cho, K., van Merri\u00ebnboer, B., Gulcehre, C., Bahdanau, D., Bougares, F., Schwenk, H., and Bengio, Y. (2014, January 25\u201329). Learning Phrase Representations using RNN Encoder\u2013Decoder for Statistical Machine Translation. Proceedings of the Conference on Empirical Methods in Natural Language Processing (EMNLP), Doha, Qatar.","DOI":"10.3115\/v1\/D14-1179"},{"key":"ref_21","unstructured":"Hosu, V., Hahn, F., Jenadeleh, M., Lin, H., Men, H., Szir\u00e1nyi, T., Li, S., and Saupe, D. (June, January 31). The Konstanz natural video database (KoNViD-1k). Proceedings of the International Conference on Quality of Multimedia Experience (QoMEX), Erfurt, Germany."},{"key":"ref_22","doi-asserted-by":"crossref","first-page":"3073","DOI":"10.1109\/TIP.2016.2562513","article-title":"CVD2014\u2014A database for evaluating no-reference video quality assessment algorithms","volume":"25","author":"Nuutinen","year":"2016","journal-title":"IEEE Trans. Image Process."},{"key":"ref_23","doi-asserted-by":"crossref","first-page":"2061","DOI":"10.1109\/TCSVT.2017.2707479","article-title":"In-capture mobile video distortions: A study of subjective behavior and objective algorithms","volume":"28","author":"Ghadiyaram","year":"2017","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"ref_24","doi-asserted-by":"crossref","first-page":"5923","DOI":"10.1109\/TIP.2019.2923051","article-title":"Two-Level Approach for No-Reference Consumer Video Quality Assessment","volume":"28","author":"Korhonen","year":"2019","journal-title":"IEEE Trans. Image Process."},{"key":"ref_25","doi-asserted-by":"crossref","first-page":"237","DOI":"10.1016\/j.image.2017.10.009","article-title":"Semantic-aware blind image quality assessment","volume":"60","author":"Siahaan","year":"2018","journal-title":"Signal Process. Image Commun."},{"key":"ref_26","doi-asserted-by":"crossref","first-page":"195","DOI":"10.1016\/j.jvcir.2018.11.038","article-title":"Blind image quality assessment with semantic information","volume":"58","author":"Ji","year":"2019","journal-title":"J. Vis. Commun. Image Represent."},{"key":"ref_27","doi-asserted-by":"crossref","first-page":"77440Z","DOI":"10.1117\/12.862431","article-title":"Image quality assessment and human visual system","volume":"Volume 7744","author":"Gao","year":"2010","journal-title":"Proceedings of the Visual Communications and Image Processing 2010"},{"key":"ref_28","unstructured":"Michelson, A.A. (1995). Studies in Optics, Courier Corporation."},{"key":"ref_29","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1163\/156856893X00018","article-title":"Contrast sensitivity to patch stimuli: Effects of spatial bandwidth and temporal presentation","volume":"7","author":"Young","year":"1993","journal-title":"Spat. Vis."},{"key":"ref_30","doi-asserted-by":"crossref","unstructured":"Seshadrinathan, K., and Bovik, A.C. (2011, January 22\u201327). Temporal hysteresis model of time varying subjective video quality. Proceedings of the International Conference on Acoustics, Speech and Signal Processing (ICASSP), Prague, Czech Republic.","DOI":"10.1109\/ICASSP.2011.5946613"},{"key":"ref_31","doi-asserted-by":"crossref","first-page":"270","DOI":"10.1162\/neco.1989.1.2.270","article-title":"A learning algorithm for continually running fully recurrent neural networks","volume":"1","author":"Williams","year":"1989","journal-title":"Neural Comput."},{"key":"ref_32","doi-asserted-by":"crossref","first-page":"179","DOI":"10.1207\/s15516709cog1402_1","article-title":"Finding structure in time","volume":"14","author":"Elman","year":"1990","journal-title":"Cogn. Sci."},{"key":"ref_33","doi-asserted-by":"crossref","unstructured":"Dodge, S., and Karam, L. (2016, January 6\u20138). Understanding how image quality affects deep neural networks. Proceedings of the 2016 eighth international conference on quality of multimedia experience (QoMEX), Lisbon, Portugal.","DOI":"10.1109\/QoMEX.2016.7498955"},{"key":"ref_34","doi-asserted-by":"crossref","first-page":"355","DOI":"10.1007\/s11760-017-1166-8","article-title":"On the use of deep learning for blind image quality assessment","volume":"12","author":"Bianco","year":"2017","journal-title":"Signal Image Video Process."},{"key":"ref_35","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., and Sun, J. (2016, January 27\u201330). Deep residual learning for image recognition. Proceedings of the Conference on Computer Vision and Pattern Recognition (CVPR), Las Vegas, NV, USA.","DOI":"10.1109\/CVPR.2016.90"},{"key":"ref_36","doi-asserted-by":"crossref","first-page":"64270","DOI":"10.1109\/ACCESS.2018.2877890","article-title":"Benchmark Analysis of Representative Deep Neural Network Architectures","volume":"6","author":"Bianco","year":"2018","journal-title":"IEEE Access"},{"key":"ref_37","doi-asserted-by":"crossref","first-page":"390","DOI":"10.1109\/TIP.2014.2378061","article-title":"CID2013: A Database for Evaluating No-Reference Image Quality Assessment Algorithms","volume":"24","author":"Virtanen","year":"2014","journal-title":"IEEE Trans. Image Process."},{"key":"ref_38","doi-asserted-by":"crossref","unstructured":"Snyder, D., Garcia-Romero, D., Povey, D., and Khudanpur, S. (2017, January 20\u201324). Deep Neural Network Embeddings for Text-Independent Speaker Verification. Proceedings of the Interspeech 2017, Stockholm, Sweden.","DOI":"10.21437\/Interspeech.2017-620"},{"key":"ref_39","unstructured":"Paszke, A., Gross, S., Chintala, S., Chanan, G., Yang, E., DeVito, Z., Lin, Z., Desmaison, A., Antiga, L., and Lerer, A. (2017, January 4\u20139). Automatic Differentiation in Pytorch. Proceedings of the 31st Conference on Neural Information Processing Systems (NIPS 2017), Long Beach, CA, USA."},{"key":"ref_40","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., and Sun, J. (2015, January 7\u201313). Delving deep into rectifiers: Surpassing human-level performance on imagenet classification. Proceedings of the International Conference on Computer Vision (ICCV), Santiago, Chile.","DOI":"10.1109\/ICCV.2015.123"},{"key":"ref_41","doi-asserted-by":"crossref","first-page":"612","DOI":"10.1109\/TIP.2018.2869673","article-title":"Large-scale study of perceptual video quality","volume":"28","author":"Sinno","year":"2018","journal-title":"IEEE Trans. Image Process."},{"key":"ref_42","doi-asserted-by":"crossref","first-page":"64","DOI":"10.1145\/2812802","article-title":"YFCC100M: The new data in multimedia research","volume":"59","author":"Thomee","year":"2016","journal-title":"Commun. Acm"},{"key":"ref_43","unstructured":"Ye, P., Kumar, J., Kang, L., and Doermann, D. (2012, January 16\u201321). Unsupervised feature learning framework for no-reference image quality assessment. Proceedings of the Conference on Computer Vision and Pattern Recognition, Providence, RI, USA."},{"key":"ref_44","doi-asserted-by":"crossref","first-page":"4041","DOI":"10.1109\/TIP.2020.2967829","article-title":"KonIQ-10k: An Ecologically Valid Database for Deep Learning of Blind Image Quality Assessment","volume":"29","author":"Hosu","year":"2020","journal-title":"IEEE Trans. Image Process."},{"key":"ref_45","doi-asserted-by":"crossref","first-page":"372","DOI":"10.1109\/TIP.2015.2500021","article-title":"Massive Online Crowdsourced Study of Subjective and Objective Picture Quality","volume":"25","author":"Ghadiyaram","year":"2016","journal-title":"IEEE Trans. Image Process."},{"key":"ref_46","doi-asserted-by":"crossref","unstructured":"Szegedy, C., Ioffe, S., Vanhoucke, V., and Alemi, A.A. (2016, January 2\u20134). Inception-v4, Inception-ResNet and the Impact of Residual Connections on Learning. Proceedings of the International Conference Learning Representations (ICLR) Workshop, San Juan, Puerto Rico.","DOI":"10.1609\/aaai.v31i1.11231"}],"container-title":["Journal of Imaging"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/www.mdpi.com\/2313-433X\/6\/8\/74\/pdf","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,10,11]],"date-time":"2025-10-11T09:52:55Z","timestamp":1760176375000},"score":1,"resource":{"primary":{"URL":"https:\/\/www.mdpi.com\/2313-433X\/6\/8\/74"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,7,30]]},"references-count":46,"journal-issue":{"issue":"8","published-online":{"date-parts":[[2020,8]]}},"alternative-id":["jimaging6080074"],"URL":"https:\/\/doi.org\/10.3390\/jimaging6080074","relation":{},"ISSN":["2313-433X"],"issn-type":[{"type":"electronic","value":"2313-433X"}],"subject":[],"published":{"date-parts":[[2020,7,30]]}}}