{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,15]],"date-time":"2026-06-15T11:54:48Z","timestamp":1781524488012,"version":"3.54.1"},"reference-count":94,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Displays"],"published-print":{"date-parts":[[2026,12]]},"DOI":"10.1016\/j.displa.2026.103543","type":"journal-article","created":{"date-parts":[[2026,6,4]],"date-time":"2026-06-04T23:44:51Z","timestamp":1780616691000},"page":"103543","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["Continuous score regression with multimodal large language models for egocentric spatial image and video quality assessment"],"prefix":"10.1016","volume":"95","author":[{"given":"Qihang","family":"Ge","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yunhao","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Sijing","family":"Wu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiongkuo","family":"Min","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.displa.2026.103543_b1","series-title":"Proceedings of the 33rd ACM International Conference on Multimedia","first-page":"6928","article-title":"FVQ: A large-scale dataset and an LMM-based method for face video quality assessment","author":"Wu","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b2","doi-asserted-by":"crossref","DOI":"10.1109\/TCSVT.2026.3662100","article-title":"Surveillance facial image quality assessment: A multi-dimensional dataset and lightweight model","author":"Jiang","year":"2026","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.displa.2026.103543_b3","doi-asserted-by":"crossref","unstructured":"J. Jin, J. Ying, H. Duan, L. Yang, S. Wu, Y. Li, Y. Zheng, X. Min, G. Zhai, RGC-VQA: An Exploration Database for Robotic-Generated Video Quality Assessment, in: Proceedings of the 33rd ACM International Conference on Multimedia, 2025, pp. 13413\u201313420.","DOI":"10.1145\/3746027.3758304"},{"key":"10.1016\/j.displa.2026.103543_b4","series-title":"VTONQA: A multi-dimensional quality assessment dataset for virtual try-on","author":"Wei","year":"2026"},{"key":"10.1016\/j.displa.2026.103543_b5","series-title":"Ges-qa: A multidimensional quality assessment dataset for audio-to-3d gesture generation","author":"Gao","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b6","series-title":"SFQA: A comprehensive perceptual quality assessment dataset for singing face generation","author":"Gao","year":"2026"},{"key":"10.1016\/j.displa.2026.103543_b7","article-title":"AGHI-QA: A subjective-aligned dataset and metric for AI-generated human images","author":"Li","year":"2025","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.displa.2026.103543_b8","series-title":"DHQA-4D: Perceptual quality assessment of dynamic 4D digital human","author":"Li","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b9","series-title":"2025 IEEE International Symposium on Circuits and Systems","first-page":"1","article-title":"Perceptual quality assessment of AI generated content videos: a dataset and benchmark","author":"Zhang","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b10","doi-asserted-by":"crossref","unstructured":"Y. Li, W. Shen, Z. Gao, Y. Zhu, G. Zhai, G. Guo, Looking here or there? gaze following in 360-degree images, in: Proceedings of the IEEE\/CVF International Conference on Computer Vision, 2021, pp. 3742\u20133751.","DOI":"10.1109\/ICCV48922.2021.00372"},{"key":"10.1016\/j.displa.2026.103543_b11","article-title":"Scanpath prediction in panoramic videos through multimodal fusion","author":"Zhu","year":"2025","journal-title":"Displays"},{"key":"10.1016\/j.displa.2026.103543_b12","article-title":"Future fixation sequence prediction for audio-visual 360deg videos","author":"Zhu","year":"2025","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.displa.2026.103543_b13","first-page":"222","article-title":"Head and eye movement prediction in omnidirectional videos via multimodal fusion and knowledge distillation","volume":"2","author":"Zhu","year":"2025","journal-title":"IEEE Open J. Immersive Displays"},{"key":"10.1016\/j.displa.2026.103543_b14","article-title":"Esiqa: Perceptual quality assessment of vision-pro-based egocentric spatial images","author":"Zhu","year":"2025","journal-title":"IEEE Trans. Vis. Comput. Graphics"},{"key":"10.1016\/j.displa.2026.103543_b15","series-title":"2025 IEEE International Conference on Multimedia and Expo","first-page":"1","article-title":"Esvqa: Perceptual quality assessment of egocentric spatial videos","author":"Zhu","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b16","series-title":"International Conference on Machine Learning","first-page":"19730","article-title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","author":"Li","year":"2023"},{"key":"10.1016\/j.displa.2026.103543_b17","first-page":"34892","article-title":"Visual instruction tuning","volume":"36","author":"Liu","year":"2023","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.displa.2026.103543_b18","series-title":"Qwen2-vl: Enhancing vision-language model\u2019s perception of the world at any resolution","author":"Wang","year":"2024"},{"key":"10.1016\/j.displa.2026.103543_b19","series-title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models","author":"Zhu","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b20","series-title":"2014 IEEE Conference on Computer Vision and Pattern Recognition","first-page":"1733","article-title":"Convolutional neural networks for no-reference image quality assessment","author":"Kang","year":"2014"},{"issue":"1","key":"10.1016\/j.displa.2026.103543_b21","doi-asserted-by":"crossref","first-page":"36","DOI":"10.1109\/TCSVT.2018.2886771","article-title":"Blind image quality assessment using a deep bilinear convolutional neural network","volume":"30","author":"Zhang","year":"2018","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.displa.2026.103543_b22","doi-asserted-by":"crossref","unstructured":"S. Su, Q. Yan, Y. Zhu, C. Zhang, X. Ge, J. Sun, Y. Zhang, Blindly assess image quality in the wild guided by a self-adaptive hyper network, in: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2020, pp. 3667\u20133676.","DOI":"10.1109\/CVPR42600.2020.00372"},{"key":"10.1016\/j.displa.2026.103543_b23","doi-asserted-by":"crossref","unstructured":"J. Ke, Q. Wang, Y. Wang, P. Milanfar, F. Yang, Musiq: Multi-scale image quality transformer, in: Proceedings of the IEEE\/CVF International Conference on Computer Vision, 2021, pp. 5148\u20135157.","DOI":"10.1109\/ICCV48922.2021.00510"},{"key":"10.1016\/j.displa.2026.103543_b24","series-title":"European Conference on Computer Vision","first-page":"247","article-title":"Promptiqa: Boosting the performance and generalization for no-reference image quality assessment via prompts","author":"Chen","year":"2024"},{"key":"10.1016\/j.displa.2026.103543_b25","doi-asserted-by":"crossref","unstructured":"L. Agnolucci, L. Galteri, M. Bertini, A. Del Bimbo, Arniqa: Learning distortion manifold for image quality assessment, in: Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision, 2024, pp. 189\u2013198.","DOI":"10.1109\/WACV57701.2024.00026"},{"key":"10.1016\/j.displa.2026.103543_b26","doi-asserted-by":"crossref","first-page":"7607","DOI":"10.1109\/TMM.2022.3224319","article-title":"Blind image quality assessment via cross-view consistency","volume":"25","author":"Zhu","year":"2022","journal-title":"IEEE Trans. Multimed."},{"key":"10.1016\/j.displa.2026.103543_b27","doi-asserted-by":"crossref","unstructured":"D. Li, T. Jiang, M. Jiang, Quality assessment of in-the-wild videos, in: Proceedings of the 27th ACM International Conference on Multimedia, 2019, pp. 2351\u20132359.","DOI":"10.1145\/3343031.3351028"},{"issue":"4","key":"10.1016\/j.displa.2026.103543_b28","doi-asserted-by":"crossref","first-page":"1238","DOI":"10.1007\/s11263-020-01408-w","article-title":"Unified quality assessment of in-the-wild videos with mixed datasets training","volume":"129","author":"Li","year":"2021","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.displa.2026.103543_b29","doi-asserted-by":"crossref","unstructured":"W. Sun, X. Min, W. Lu, G. Zhai, A deep learning based no-reference quality assessment model for UGC videos, in: Proceedings of the 30th ACM International Conference on Multimedia, 2022, pp. 856\u2013865.","DOI":"10.1145\/3503161.3548329"},{"issue":"11","key":"10.1016\/j.displa.2026.103543_b30","doi-asserted-by":"crossref","first-page":"7056","DOI":"10.1109\/TPAMI.2024.3385364","article-title":"Analysis of video quality datasets via design of minimalistic video quality models","volume":"46","author":"Sun","year":"2024","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.displa.2026.103543_b31","series-title":"2023 IEEE\/CVF International Conference on Computer Vision","first-page":"20144","article-title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","author":"Wu","year":"2023"},{"key":"10.1016\/j.displa.2026.103543_b32","doi-asserted-by":"crossref","first-page":"400","DOI":"10.1016\/j.jvcir.2018.12.006","article-title":"Stereoscopic image quality assessment by deep convolutional neural network","volume":"58","author":"Fang","year":"2019","journal-title":"J. Vis. Commun. Image Represent."},{"key":"10.1016\/j.displa.2026.103543_b33","series-title":"2018 IEEE International Symposium on Circuits and Systems","first-page":"1","article-title":"Perceptual quality assessment of omnidirectional images","author":"Duan","year":"2018"},{"key":"10.1016\/j.displa.2026.103543_b34","series-title":"2017 IEEE International Conference on Image Processing","first-page":"3450","article-title":"CVIQD: Subjective quality evaluation of compressed virtual reality images","author":"Sun","year":"2017"},{"issue":"1","key":"10.1016\/j.displa.2026.103543_b35","first-page":"580","article-title":"Perceptual quality assessment of omnidirectional images","volume":"36","author":"Fang","year":"2022","journal-title":"Proc. AAAI Conf. Artif. Intell."},{"issue":"6","key":"10.1016\/j.displa.2026.103543_b36","doi-asserted-by":"crossref","first-page":"1150","DOI":"10.1109\/JSTSP.2023.3250956","article-title":"Attentive deep image quality assessment for omnidirectional stitching","volume":"17","author":"Duan","year":"2023","journal-title":"IEEE J. Sel. Top. Signal Process."},{"key":"10.1016\/j.displa.2026.103543_b37","doi-asserted-by":"crossref","unstructured":"S. Wu, Y. Yan, Y. Li, Y. Cheng, W. Zhu, K. Gao, X. Li, G. Zhai, Ganhead: Towards generative animatable neural head avatars, in: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2023, pp. 437\u2013447.","DOI":"10.1109\/CVPR52729.2023.00050"},{"key":"10.1016\/j.displa.2026.103543_b38","doi-asserted-by":"crossref","unstructured":"S. Wu, Y. Li, Y. Yan, H. Duan, Z. Liu, G. Zhai, Mmhead: Towards fine-grained multi-modal 3d facial animation, in: Proceedings of the 32nd ACM International Conference on Multimedia, 2024, pp. 7966\u20137975.","DOI":"10.1145\/3664647.3681366"},{"key":"10.1016\/j.displa.2026.103543_b39","article-title":"SingingHead: A large-scale 4D dataset for singing head animation","author":"Wu","year":"2025","journal-title":"IEEE Trans. Multimed."},{"key":"10.1016\/j.displa.2026.103543_b40","doi-asserted-by":"crossref","unstructured":"Y. Li, Z. Yu, Y. Zhu, B. Ni, G. Zhai, W. Shen, Skeleton2humanoid: Animating simulated characters for physically-plausible motion in-betweening, in: Proceedings of the 30th ACM International Conference on Multimedia, 2022, pp. 1493\u20131502.","DOI":"10.1145\/3503161.3548093"},{"key":"10.1016\/j.displa.2026.103543_b41","doi-asserted-by":"crossref","DOI":"10.1016\/j.displa.2025.102987","article-title":"SAMR: Symmetric masked multimodal modeling for general multi-modal 3D motion retrieval","volume":"87","author":"Li","year":"2025","journal-title":"Displays"},{"issue":"1","key":"10.1016\/j.displa.2026.103543_b42","doi-asserted-by":"crossref","DOI":"10.1016\/j.ipm.2025.104321","article-title":"MI3S: A multimodal large language model assisted quality assessment framework for AI-generated talking heads","volume":"63","author":"Zhou","year":"2026","journal-title":"Inf. Process. Manage."},{"key":"10.1016\/j.displa.2026.103543_b43","doi-asserted-by":"crossref","unstructured":"W.Y. Yang, J. Wang, S. Wu, H. Duan, Y. Zhu, L. Yang, K. Fu, G. Zhai, X. Min, Lmme3dhf: Benchmarking and evaluating multimodal 3d human face generation with lmms, in: Proceedings of the 33rd ACM International Conference on Multimedia, 2025, pp. 8825\u20138834.","DOI":"10.1145\/3746027.3755700"},{"key":"10.1016\/j.displa.2026.103543_b44","doi-asserted-by":"crossref","unstructured":"Z. Zhang, W. Sun, X. Li, Y. Li, Q. Ge, J. Jia, Z. Zhang, Z. Ji, F. Sun, S. Jui, et al., Human-activity agv quality assessment: A benchmark dataset and an objective evaluation metric, in: Proceedings of the 33rd ACM International Conference on Multimedia, 2025, pp. 6771\u20136780.","DOI":"10.1145\/3746027.3754731"},{"key":"10.1016\/j.displa.2026.103543_b45","doi-asserted-by":"crossref","unstructured":"C. Chen, S. Yang, H. Wu, L. Liao, Z. Zhang, A. Wang, W. Sun, Q. Yan, W. Lin, Q-ground: Image quality grounding with large multi-modality models, in: Proceedings of the 32nd ACM International Conference on Multimedia, 2024, pp. 486\u2013495.","DOI":"10.1145\/3664647.3680575"},{"key":"10.1016\/j.displa.2026.103543_b46","doi-asserted-by":"crossref","unstructured":"Z. You, X. Cai, J. Gu, T. Xue, C. Dong, Teaching large language models to regress accurate image quality scores using score distribution, in: Proceedings of the Computer Vision and Pattern Recognition Conference, 2025, pp. 14483\u201314494.","DOI":"10.1109\/CVPR52734.2025.01350"},{"key":"10.1016\/j.displa.2026.103543_b47","doi-asserted-by":"crossref","unstructured":"X. He, D. Jiang, G. Zhang, M. Ku, A. Soni, S. Siu, H. Chen, A. Chandra, Z. Jiang, A. Arulraj, et al., Videoscore: Building automatic metrics to simulate fine-grained human feedback for video generation, in: Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, 2024, pp. 2105\u20132123.","DOI":"10.18653\/v1\/2024.emnlp-main.127"},{"key":"10.1016\/j.displa.2026.103543_b48","doi-asserted-by":"crossref","DOI":"10.1109\/TCSVT.2025.3571788","article-title":"Lmm-vqa: Advancing video quality assessment with large multimodal models","author":"Ge","year":"2025","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.displa.2026.103543_b49","doi-asserted-by":"crossref","DOI":"10.1002\/aisy.202500504","article-title":"BMPCQA: Bioinspired metaverse point cloud quality assessment based on large multimodal models","author":"Duan","year":"2025","journal-title":"Adv. Intell. Syst."},{"key":"10.1016\/j.displa.2026.103543_b50","series-title":"ODI-bench: Can MLLMs understand immersive omnidirectional environments?","author":"Yang","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b51","series-title":"Q-bench-portrait: Benchmarking multimodal large language models on portrait image quality perception","author":"Wu","year":"2026"},{"key":"10.1016\/j.displa.2026.103543_b52","series-title":"VideoAesBench: Benchmarking the video aesthetics perception capabilities of large multimodal models","author":"Li","year":"2026"},{"key":"10.1016\/j.displa.2026.103543_b53","series-title":"ELIQ: A label-free framework for quality assessment of evolving AI-generated images","author":"Li","year":"2026"},{"key":"10.1016\/j.displa.2026.103543_b54","series-title":"Exploring instruction data quality for explainable image quality assessment","author":"Li","year":"2025"},{"key":"10.1016\/j.displa.2026.103543_b55","doi-asserted-by":"crossref","unstructured":"S. Wu, Y. Li, H. Duan, Y. Jiang, Y. Zhu, G. Zhai, Hveval: Towards unified evaluation of human-centric video generation and understanding, in: Proceedings of the 33rd ACM International Conference on Multimedia, 2025, pp. 13376\u201313383.","DOI":"10.1145\/3746027.3758299"},{"key":"10.1016\/j.displa.2026.103543_b56","series-title":"2018 IEEE International Symposium on Broadband Multimedia Systems and Broadcasting","first-page":"1","article-title":"Blind image quality estimation via distortion aggravation","author":"Min","year":"2018"},{"issue":"8","key":"10.1016\/j.displa.2026.103543_b57","doi-asserted-by":"crossref","first-page":"2049","DOI":"10.1109\/TMM.2017.2788206","article-title":"Blind quality assessment based on pseudo-reference image","volume":"20","author":"Min","year":"2018","journal-title":"IEEE Trans. Multimed."},{"issue":"12","key":"10.1016\/j.displa.2026.103543_b58","doi-asserted-by":"crossref","first-page":"4695","DOI":"10.1109\/TIP.2012.2214050","article-title":"No-reference image quality assessment in the spatial domain","volume":"21","author":"Mittal","year":"2012","journal-title":"IEEE Trans. Image Process."},{"issue":"9","key":"10.1016\/j.displa.2026.103543_b59","doi-asserted-by":"crossref","first-page":"4444","DOI":"10.1109\/TIP.2016.2585880","article-title":"Blind image quality assessment based on high order statistics aggregation","volume":"25","author":"Xu","year":"2016","journal-title":"IEEE Trans. Image Process."},{"issue":"3","key":"10.1016\/j.displa.2026.103543_b60","doi-asserted-by":"crossref","first-page":"209","DOI":"10.1109\/LSP.2012.2227726","article-title":"Making a \u201ccompletely blind\u201d image quality analyzer","volume":"20","author":"Mittal","year":"2013","journal-title":"IEEE Signal Process. Lett."},{"key":"10.1016\/j.displa.2026.103543_b61","series-title":"2013 IEEE Conference on Computer Vision and Pattern Recognition","first-page":"995","article-title":"Learning without human scores for blind image quality assessment","author":"Xue","year":"2013"},{"issue":"12","key":"10.1016\/j.displa.2026.103543_b62","doi-asserted-by":"crossref","first-page":"5923","DOI":"10.1109\/TIP.2019.2923051","article-title":"Two-level approach for no-reference consumer video quality assessment","volume":"28","author":"Korhonen","year":"2019","journal-title":"IEEE Trans. Image Process."},{"key":"10.1016\/j.displa.2026.103543_b63","doi-asserted-by":"crossref","first-page":"4449","DOI":"10.1109\/TIP.2021.3072221","article-title":"UGC-VQA: Benchmarking blind video quality assessment for user generated content","volume":"30","author":"Tu","year":"2021","journal-title":"IEEE Trans. Image Process."},{"key":"10.1016\/j.displa.2026.103543_b64","series-title":"European Conference on Computer Vision","first-page":"538","article-title":"FAST-VQA: Efficient end-to-end video quality assessment with fragment sampling","author":"Wu","year":"2022"},{"issue":"12","key":"10.1016\/j.displa.2026.103543_b65","doi-asserted-by":"crossref","first-page":"15185","DOI":"10.1109\/TPAMI.2023.3319332","article-title":"Neighbourhood representative sampling for efficient end-to-end video quality assessment","volume":"45","author":"Wu","year":"2023","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"9","key":"10.1016\/j.displa.2026.103543_b66","doi-asserted-by":"crossref","first-page":"5944","DOI":"10.1109\/TCSVT.2022.3164467","article-title":"Blindly assess quality of in-the-wild videos via quality-aware pre-training and motion perception","volume":"32","author":"Li","year":"2022","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.displa.2026.103543_b67","series-title":"2024 IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"2763","article-title":"Modular blind video quality assessment","author":"Wen","year":"2024"},{"key":"10.1016\/j.displa.2026.103543_b68","series-title":"2012 IEEE Conference on Computer Vision and Pattern Recognition","first-page":"1098","article-title":"Unsupervised feature learning framework for no-reference image quality assessment","author":"Ye","year":"2012"},{"key":"10.1016\/j.displa.2026.103543_b69","series-title":"2013 IEEE Workshop on Signal Processing Systems","first-page":"241","article-title":"FISBLIM: A five-step blind metric for quality assessment of multiply distorted images","author":"Gu","year":"2013"},{"issue":"8","key":"10.1016\/j.displa.2026.103543_b70","doi-asserted-by":"crossref","first-page":"2579","DOI":"10.1109\/TIP.2015.2426416","article-title":"A feature-enriched completely blind image quality evaluator","volume":"24","author":"Zhang","year":"2015","journal-title":"IEEE Trans. Image Process."},{"key":"10.1016\/j.displa.2026.103543_b71","series-title":"2015 IEEE International Conference on Image Processing","first-page":"339","article-title":"A highly efficient method for blind image quality assessment","author":"Wu","year":"2015"},{"key":"10.1016\/j.displa.2026.103543_b72","series-title":"Very deep convolutional networks for large-scale image recognition","author":"Simonyan","year":"2014"},{"key":"10.1016\/j.displa.2026.103543_b73","series-title":"2016 IEEE Conference on Computer Vision and Pattern Recognition","first-page":"770","article-title":"Deep residual learning for image recognition","author":"He","year":"2016"},{"issue":"1","key":"10.1016\/j.displa.2026.103543_b74","doi-asserted-by":"crossref","first-page":"206","DOI":"10.1109\/TIP.2017.2760518","article-title":"Deep neural networks for no-reference and full-reference image quality assessment","volume":"27","author":"Bosse","year":"2018","journal-title":"IEEE Trans. Image Process."},{"key":"10.1016\/j.displa.2026.103543_b75","series-title":"2022 IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"1191","article-title":"MANIQA: Multi-dimension attention network for no-reference image quality assessment","author":"Yang","year":"2022"},{"key":"10.1016\/j.displa.2026.103543_b76","series-title":"2022 IEEE\/CVF Winter Conference on Applications of Computer Vision","first-page":"1220","article-title":"No-reference image quality assessment via transformers, relative ranking, and self-consistency","author":"Golestaneh","year":"2022"},{"issue":"4","key":"10.1016\/j.displa.2026.103543_b77","doi-asserted-by":"crossref","first-page":"600","DOI":"10.1109\/TIP.2003.819861","article-title":"Image quality assessment: from error visibility to structural similarity","volume":"13","author":"Wang","year":"2004","journal-title":"IEEE Trans. Image Process."},{"issue":"10","key":"10.1016\/j.displa.2026.103543_b78","doi-asserted-by":"crossref","first-page":"4270","DOI":"10.1109\/TIP.2014.2346028","article-title":"VSI: A visual saliency-induced index for perceptual image quality assessment","volume":"23","author":"Zhang","year":"2014","journal-title":"IEEE Trans. Image Process."},{"issue":"9","key":"10.1016\/j.displa.2026.103543_b79","first-page":"1408","article-title":"Weighted-to-spherically-uniform quality evaluation for omnidirectional video","volume":"24","author":"Sun","year":"2017","journal-title":"IEEE Signal Process. Lett."},{"key":"10.1016\/j.displa.2026.103543_b80","doi-asserted-by":"crossref","unstructured":"R. Zhang, P. Isola, A.A. Efros, E. Shechtman, O. Wang, The Unreasonable Effectiveness of Deep Features as a Perceptual Metric, in: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, CVPR, 2018, pp. 586\u2013595.","DOI":"10.1109\/CVPR.2018.00068"},{"key":"10.1016\/j.displa.2026.103543_b81","first-page":"249","article-title":"Subjective and objective quality assessment of omnidirectional video","volume":"vol. 10752","author":"Lopes","year":"2018"},{"issue":"5","key":"10.1016\/j.displa.2026.103543_b82","first-page":"2567","article-title":"Image quality assessment: Unifying structure and texture similarity","volume":"44","author":"Ding","year":"2022","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"1","key":"10.1016\/j.displa.2026.103543_b83","doi-asserted-by":"crossref","first-page":"64","DOI":"10.1109\/JSTSP.2019.2955024","article-title":"MC360IQA: A multi-channel CNN for blind 360-degree image quality assessment","volume":"14","author":"Sun","year":"2019","journal-title":"IEEE J. Sel. Top. Signal Process."},{"issue":"5","key":"10.1016\/j.displa.2026.103543_b84","doi-asserted-by":"crossref","first-page":"1724","DOI":"10.1109\/TCSVT.2020.3015186","article-title":"Blind omnidirectional image quality assessment with viewport oriented graph convolutional networks","volume":"31","author":"Xu","year":"2020","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"issue":"4","key":"10.1016\/j.displa.2026.103543_b85","doi-asserted-by":"crossref","first-page":"1778","DOI":"10.1109\/TCSVT.2021.3081182","article-title":"No-reference quality assessment for 360-degree images by analysis of multifrequency information and local-global naturalness","volume":"32","author":"Zhou","year":"2021","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"issue":"7","key":"10.1016\/j.displa.2026.103543_b86","doi-asserted-by":"crossref","first-page":"4211","DOI":"10.1109\/TCSVT.2021.3128014","article-title":"Multi-angle projection based blind omnidirectional image quality assessment","volume":"32","author":"Jiang","year":"2021","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.displa.2026.103543_b87","doi-asserted-by":"crossref","unstructured":"J. Fu, C. Hou, W. Zhou, J. Xu, Z. Chen, Adaptive hypergraph convolutional network for no-reference 360-degree image quality assessment, in: Proceedings of the 30th ACM International Conference on Multimedia, 2022, pp. 961\u2013969.","DOI":"10.1145\/3503161.3548337"},{"issue":"2","key":"10.1016\/j.displa.2026.103543_b88","first-page":"2555","article-title":"Exploring CLIP for assessing the look and feel of images","volume":"37","author":"Wang","year":"2023","journal-title":"Proc. AAAI Conf. Artif. Intell."},{"key":"10.1016\/j.displa.2026.103543_b89","doi-asserted-by":"crossref","unstructured":"W. Zhang, G. Zhai, Y. Wei, X. Yang, K. Ma, Blind image quality assessment via vision-language correspondence: A multitask learning perspective, in: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2023, pp. 14071\u201314081.","DOI":"10.1109\/CVPR52729.2023.01352"},{"key":"10.1016\/j.displa.2026.103543_b90","first-page":"64957","article-title":"Assessor360: Multi-sequence network for blind omnidirectional image quality assessment","volume":"36","author":"Wu","year":"2023","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.displa.2026.103543_b91","doi-asserted-by":"crossref","unstructured":"K. Fan, W. Wen, M. Li, Y. Peng, K. Ma, Learned scanpaths aid blind panoramic video quality assessment, in: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2024, pp. 2599\u20132608.","DOI":"10.1109\/CVPR52733.2024.00251"},{"key":"10.1016\/j.displa.2026.103543_b92","series-title":"Perceptual quality assessment of 360-degree images based on generative scanpath representation","author":"Sui","year":"2023"},{"issue":"5","key":"10.1016\/j.displa.2026.103543_b93","first-page":"1","article-title":"Viewport-unaware blind omnidirectional image quality assessment: A flexible and effective paradigm","volume":"21","author":"Yan","year":"2025","journal-title":"ACM Trans. Multimed. Comput. Commun. Appl."},{"key":"10.1016\/j.displa.2026.103543_b94","first-page":"36802","article-title":"Q-insight: Understanding image quality via visual reinforcement learning","volume":"38","author":"Li","year":"2026","journal-title":"Adv. Neural Inf. Process. Syst."}],"container-title":["Displays"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0141938226002064?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0141938226002064?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,6,15]],"date-time":"2026-06-15T11:24:30Z","timestamp":1781522670000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0141938226002064"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,12]]},"references-count":94,"alternative-id":["S0141938226002064"],"URL":"https:\/\/doi.org\/10.1016\/j.displa.2026.103543","relation":{},"ISSN":["0141-9382"],"issn-type":[{"value":"0141-9382","type":"print"}],"subject":[],"published":{"date-parts":[[2026,12]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Continuous score regression with multimodal large language models for egocentric spatial image and video quality assessment","name":"articletitle","label":"Article Title"},{"value":"Displays","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.displa.2026.103543","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier B.V. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"103543"}}