{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,28]],"date-time":"2026-05-28T08:03:10Z","timestamp":1779955390032,"version":"3.53.1"},"reference-count":58,"publisher":"Springer Science and Business Media LLC","issue":"7","license":[{"start":{"date-parts":[[2026,5,28]],"date-time":"2026-05-28T00:00:00Z","timestamp":1779926400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,5,28]],"date-time":"2026-05-28T00:00:00Z","timestamp":1779926400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"name":"the Scientific Research Fund of the Department of Education of Liaoning Province","award":["No. JYTMS20230012"],"award-info":[{"award-number":["No. JYTMS20230012"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int. J. Mach. Learn. &amp; Cyber."],"published-print":{"date-parts":[[2026,7]]},"DOI":"10.1007\/s13042-026-03161-x","type":"journal-article","created":{"date-parts":[[2026,5,28]],"date-time":"2026-05-28T07:15:22Z","timestamp":1779952522000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Cmcl-kmse: adaptive multimodal aspect-based sentiment analysis leveraging cross-modal multi-anchor contrastive learning and knowledge-guided multi-view semantic enhancement"],"prefix":"10.1007","volume":"17","author":[{"given":"Wei","family":"Zheng","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Caifeng","family":"Cui","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhenlin","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hongfei","family":"Lin","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,5,28]]},"reference":[{"key":"3161_CR1","doi-asserted-by":"publisher","first-page":"47","DOI":"10.1016\/j.neucom.2021.05.040","volume":"455","author":"J Zhou","year":"2021","unstructured":"Zhou J et al (2021) MASAD: a large-scale dataset for multimodal aspect-based sentiment analysis. Neurocomputing 455:47\u201358","journal-title":"Neurocomputing"},{"key":"3161_CR2","doi-asserted-by":"publisher","unstructured":"Xu N, Mao WJ (2017) MultiSentiNet: a deep semantic network for multimodal sentiment analysis. In: Proceedings of the 2017 ACM CIKM, pp 2399\u20132402. https:\/\/doi.org\/10.1145\/3132847.3133142","DOI":"10.1145\/3132847.3133142"},{"key":"3161_CR3","unstructured":"Yu JF, Jiang J (2019) Adapting BERT for target-oriented multimodal sentiment classification. In: Proceedings of 28th IJCAI, Macao, 10\u201316 August 2019. 10.24963\/ijcai.2019\/751"},{"key":"3161_CR4","doi-asserted-by":"crossref","unstructured":"Khan Z, Fu Y (2021) Exploiting BERT for multimodal target sentiment classification through input space translation. In: Proceedings of 29th ACM MM, pp 3034\u20133042","DOI":"10.1145\/3474085.3475692"},{"key":"3161_CR5","doi-asserted-by":"crossref","unstructured":"Ye JJ et al (2022) Sentiment-aware multimodal pre-training for multimodal sentiment analysis. Knowl-based Syst 258, 110021","DOI":"10.1016\/j.knosys.2022.110021"},{"issue":"2","key":"3161_CR6","doi-asserted-by":"publisher","first-page":"1389","DOI":"10.1007\/s13042-024-02342-w","volume":"16","author":"Y Chen","year":"2025","unstructured":"Chen Y et al (2025) Relevance-aware visual entity filter network for multimodal aspect-based sentiment analysis. Int J Mach Learn Cybern 16(2):1389\u20131402","journal-title":"Int J Mach Learn Cybern"},{"key":"3161_CR7","unstructured":"Radford A et al (2021) Learning transferable visual models from natural language supervision. In: Proceedings of 38th ICML. pp 8748\u20138763"},{"key":"3161_CR8","doi-asserted-by":"crossref","unstructured":"Kiritchenko S et al (2014) NRC-Canada-2014: detecting aspects and sentiment in customer reviews. In: Proceedings of 8th SemEval, Dublin, Ireland, pp 437\u2013442","DOI":"10.3115\/v1\/S14-2076"},{"key":"3161_CR9","doi-asserted-by":"crossref","unstructured":"Pontiki M et al (2016) SemEval-2016 task 5: aspect based sentiment analysis. In: Proceedings of 10th SemEval, Association for Computational Linguistics, San Diego, California, pp 19\u201330","DOI":"10.18653\/v1\/S16-1002"},{"issue":"3","key":"3161_CR10","doi-asserted-by":"publisher","first-page":"463","DOI":"10.1016\/j.ipm.2018.12.004","volume":"56","author":"C Yang","year":"2019","unstructured":"Yang C et al (2019) Aspect-based sentiment analysis with alternating coattention networks. Inf Process Manag 56(3):463\u2013478","journal-title":"Inf Process Manag"},{"issue":"1","key":"3161_CR11","first-page":"377","volume":"35","author":"K Zhang","year":"2021","unstructured":"Zhang K et al (2021) EATN: an efficient adaptive transfer network for aspect-level sentiment analysis. IEEE Trans Knowl Data Eng 35(1):377\u2013389","journal-title":"IEEE Trans Knowl Data Eng"},{"issue":"3","key":"3161_CR12","doi-asserted-by":"publisher","DOI":"10.1016\/j.ipm.2023.103630","volume":"61","author":"XS Huang","year":"2024","unstructured":"Huang XS et al (2024) Flexibly utilizing syntactic knowledge in aspect-based sentiment analysis. Inf Process Manag 61(3):103630","journal-title":"Inf Process Manag"},{"key":"3161_CR13","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2025.127300","volume":"278","author":"G Dubey","year":"2025","unstructured":"Dubey G et al (2025) Adaptive contextual memory graph transformer with domain-adaptive knowledge graph for aspect-based sentiment analysis. Expert Syst Appl 278:127300","journal-title":"Expert Syst Appl"},{"key":"3161_CR14","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2024.123412","volume":"248","author":"JH Ouyang","year":"2024","unstructured":"Ouyang JH et al (2024) Aspect-based sentiment classification with aspect-specific hypergraph attention networks. Expert Syst Appl 248:123412","journal-title":"Expert Syst Appl"},{"key":"3161_CR15","unstructured":"Devlin J et al (2019) BERT: pre-training of deep bidirectional transformers for language understanding. In: Proceedings of 2019 NAACL. pp 4171\u20134186"},{"key":"3161_CR16","unstructured":"Liu YH et al (2019) RoBERTa: a robustly optimized BERT pretraining approach. In: arXiv preprint http:\/\/arxiv.org\/abs\/1907.11692arXiv:1907.11692"},{"key":"3161_CR17","doi-asserted-by":"crossref","unstructured":"Zhai ZP et al (2023) USSA: a unified table filling scheme for structured sentiment analysis. In: Proceedings of 61st ACL, vol 1, Long Papers, pp 14340\u201314353","DOI":"10.18653\/v1\/2023.acl-long.802"},{"key":"3161_CR18","doi-asserted-by":"crossref","unstructured":"Zhang M et al (2023) Span-level aspect-based sentiment analysis via table filling. In: Proceedings of 61st ACL, vol 1, Long Papers, pp 9273\u20139284","DOI":"10.18653\/v1\/2023.acl-long.515"},{"key":"3161_CR19","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2023.122728","volume":"242","author":"Y Zheng","year":"2024","unstructured":"Zheng Y et al (2024) DJMF: a discriminative joint multi-task framework for multimodal sentiment analysis based on intra- and inter-task dynamics. Expert Syst Appl 242:122728","journal-title":"Expert Syst Appl"},{"issue":"4","key":"3161_CR20","doi-asserted-by":"publisher","first-page":"1554","DOI":"10.1007\/s12559-024-10247-7","volume":"16","author":"W Zou","year":"2024","unstructured":"Zou W et al (2024) A multi-task shared cascade learning for aspect sentiment triplet extraction using BERT-MRC. Cogn Comput 16(4):1554\u20131571","journal-title":"Cogn Comput"},{"key":"3161_CR21","doi-asserted-by":"publisher","unstructured":"Xu N., Mao WJ, Chen GD (2019) Multi-interactive memory network for aspect based multimodal sentiment analysis. In: Proceedings of 33rd AAAI, pp 371\u2013378. https:\/\/doi.org\/10.1609\/aaai.v33i01.3301371","DOI":"10.1609\/aaai.v33i01.3301371"},{"issue":"7","key":"3161_CR22","doi-asserted-by":"publisher","first-page":"2289","DOI":"10.1007\/s13042-022-01757-7","volume":"14","author":"ZX Song","year":"2023","unstructured":"Song ZX et al (2023) Target-oriented multimodal sentiment classification by using topic model and gating mechanism. Int J Mach Learn Cybern 14(7):2289\u20132299","journal-title":"Int J Mach Learn Cybern"},{"key":"3161_CR23","doi-asserted-by":"crossref","unstructured":"Xiao LW et al (2022) Adaptive multi-feature extraction graph convolutional networks for multimodal target sentiment analysis. In: Proceedings of 2022 IEEE ICME, IEEE, Taipei, Taiwan, pp 1\u20136","DOI":"10.1109\/ICME52920.2022.9860020"},{"key":"3161_CR24","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2023.127222","volume":"573","author":"J Yang","year":"2024","unstructured":"Yang J et al (2024) AMIFN: aspect-guided multi-view interactions and fusion network for multimodal aspect-based sentiment analysis. Neurocomputing 573:127222","journal-title":"Neurocomputing"},{"key":"3161_CR25","doi-asserted-by":"crossref","unstructured":"Ling Y, Yu J, Xia R (2022) Vision-language pre-training for multimodal aspect-based sentiment analysis. In: arXiv preprint arXiv:2204.07955","DOI":"10.18653\/v1\/2022.acl-long.152"},{"issue":"34","key":"3161_CR26","doi-asserted-by":"publisher","first-page":"81279","DOI":"10.1007\/s11042-024-18796-7","volume":"83","author":"H Yang","year":"2024","unstructured":"Yang H et al (2024) MACSA: a multimodal aspect-category sentiment analysis dataset with multimodal fine-grained aligned annotations. Multim Tools Appl 83(34):81279\u201381297","journal-title":"Multim Tools Appl"},{"key":"3161_CR27","doi-asserted-by":"crossref","unstructured":"Yang H, Zhao Y, Qin B (2022) \u201cFace-sensitive image-to-emotional-text cross-modal translation for multimodal aspect-based sentiment analysis. In: Proceedings of the 2022 conference on empirical methods in natural language processing, Association for Computational Linguistics (ACL), pp 3324\u20133335","DOI":"10.18653\/v1\/2022.emnlp-main.219"},{"issue":"3","key":"3161_CR28","doi-asserted-by":"publisher","first-page":"1966","DOI":"10.1109\/TAFFC.2022.3171091","volume":"14","author":"JF Yu","year":"2022","unstructured":"Yu JF, Chen K, Xia R (2022) Hierarchical interactive multimodal transformer for aspect-based multimodal sentiment analysis. IEEE Trans Affect Comput 14(3):1966\u20131978","journal-title":"IEEE Trans Affect Comput"},{"issue":"1","key":"3161_CR29","doi-asserted-by":"publisher","first-page":"46","DOI":"10.1007\/s11227-024-06567-y","volume":"81","author":"YZ Chen","year":"2025","unstructured":"Chen YZ et al (2025) Multi-granularity visual-textual jointly modeling for aspect-level multimodal sentiment analysis. J Supercomput 81(1):46","journal-title":"J Supercomput"},{"issue":"3","key":"3161_CR30","first-page":"1803","volume":"14","author":"T Geng","year":"2022","unstructured":"Geng T et al (2022) Sentiment-emotion-and context-guided knowledge selection framework for emotion recognition in conversations. IEEE Trans Affect Comput 14(3):1803\u20131816","journal-title":"IEEE Trans Affect Comput"},{"key":"3161_CR31","doi-asserted-by":"crossref","unstructured":"Tu G et al (2025) Generalizing to unseen speakers: multimodal emotion recognition in conversations with speaker generalization. In: IEEE Transactions on Affective Computing, vol 16, IEEE, pp 3043 - 3054. 10.1109\/TAFFC.2025.3566059","DOI":"10.1109\/TAFFC.2025.3566059"},{"key":"3161_CR32","doi-asserted-by":"publisher","unstructured":"Tu G et al (2024) A persona-infused cross-task graph network for multimodal emotion recognition with emotion shift detection in conversations. In: Proceedings of the 47th International ACM SIGIR Conference on Research and Development in Information Retrieval, pp 2266\u20132270. https:\/\/doi.org\/10.1145\/3626772.3657944","DOI":"10.1145\/3626772.3657944"},{"issue":"4","key":"3161_CR33","doi-asserted-by":"publisher","first-page":"1874","DOI":"10.1109\/TAFFC.2024.3380375","volume":"15","author":"B Liang","year":"2024","unstructured":"Liang B et al (2024) Fusion and discrimination: a multimodal graph contrastive learning framework for multimodal sarcasm detection. IEEE Trans Affect Comput 15(4):1874\u20131888","journal-title":"IEEE Trans Affect Comput"},{"key":"3161_CR34","doi-asserted-by":"publisher","DOI":"10.1016\/j.knosys.2024.111778","volume":"294","author":"B Wang","year":"2024","unstructured":"Wang B et al (2024) What do they meme? A metaphor-aware multi-modal multi-task framework for fine-grained meme understanding. Knowl-Based Syst 294:111778","journal-title":"Knowl-Based Syst"},{"issue":"10","key":"3161_CR35","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s11432-024-4593-8","volume":"68","author":"H Yang","year":"2025","unstructured":"Yang H et al (2025) Large language models meet text-centric multimodal sentiment analysis: a survey. Sci China Inf Sci 68(10):1\u201329","journal-title":"Sci China Inf Sci"},{"key":"3161_CR36","doi-asserted-by":"publisher","unstructured":"Song S, Zhao S (2024) Whether current large language models is suitable for multimodal aspect-based sentiment analysis? In: Proceedings of the 2024 2nd International Conference on Advances in Artificial Intelligence and Applications, pp 125\u2013130. https:\/\/doi.org\/10.1145\/3712623.3712644","DOI":"10.1145\/3712623.3712644"},{"key":"3161_CR37","doi-asserted-by":"crossref","unstructured":"Feng J et al (2024) Autonomous aspect-image instruction a2ii: Q-former guided multimodal sentiment classification. In: Proceedings of the 2024 joint international conference on computational linguistics, language resources and evaluation (LREC-COLING 2024), ELRA and ICCL, Torino, Italia, pp 1996\u20132005","DOI":"10.63317\/2f3apkqkqukh"},{"key":"3161_CR38","unstructured":"Huang X et al (2024) Utilizing large language models for event deconstruction to enhance multimodal aspect-based sentiment analysis. In: arXiv preprint arXiv:2410.14150"},{"key":"3161_CR39","doi-asserted-by":"crossref","unstructured":"Anderson P et al (2018) Bottom-up and top-down attention for image captioning and visual question answering. In: Proceedings of 2018 IEEE CVPR, pp 6077\u20136086. 10.1109\/CVPR.2018.00636","DOI":"10.1109\/CVPR.2018.00636"},{"key":"3161_CR40","doi-asserted-by":"publisher","unstructured":"Ma YK, Peng HY, Cambria E (2018) Targeted aspect-based sentiment analysis via embedding commonsense knowledge into an attentive LSTM. In: Proceedings of 32nd AAAI, vol 32(1). https:\/\/doi.org\/10.1609\/aaai.v32i1.12048","DOI":"10.1609\/aaai.v32i1.12048"},{"key":"3161_CR41","doi-asserted-by":"crossref","unstructured":"Borth D et al (2013) Large-scale visual sentiment ontology and detectors using adjective noun pairs. In: Proceedings of 21st ACM MM, ACM, pp 223\u2013232","DOI":"10.1145\/2502081.2502282"},{"key":"3161_CR42","doi-asserted-by":"crossref","unstructured":"Borth D et al (2013) SentiBank: large-scale ontology and classifiers for detecting sentiment and emotions in visual content. In: Proceedings of 21st ACM MM, pp 459\u2013460","DOI":"10.1145\/2502081.2502268"},{"key":"3161_CR43","doi-asserted-by":"crossref","unstructured":"Tsai Y-HH et al (2019) Multimodal transformer for unaligned multimodal language sequences. In: Proceedings of 2019 ACL, Association for Computational Linguistics, Florence, Italy. pp 6558\u20136569","DOI":"10.18653\/v1\/P19-1656"},{"key":"3161_CR44","doi-asserted-by":"crossref","unstructured":"Chen YF et al (2024) D2R: dual-branch dynamic routing network for multimodal sentiment detection. In: Proc. 2024 EMNLP, Association for Computational Linguistics, Miami, Florida, USA, pp 3536\u20133547","DOI":"10.18653\/v1\/2024.emnlp-main.207"},{"key":"3161_CR45","unstructured":"Zhao F et al (2022) Learning from adjective-noun pairs: a knowledge-enhanced framework for target-oriented multimodal sentiment classification. In: Proceedings of 29th ICCL, International Committee on Computational Linguistics, Gyeongju, Republic of Korea. pp 6784\u20136794"},{"key":"3161_CR46","doi-asserted-by":"crossref","unstructured":"He KM et al (2016) Deep residual learning for image recognition. In: Proceedings of 2016 IEEE CVPR, pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"key":"3161_CR47","doi-asserted-by":"crossref","unstructured":"Fan FF, Feng YS, Zhao DY (2018) Multi-grained attention network for aspect-level sentiment classification. In: Proceedings of 2018 EMNLP, pp 3433\u20133442","DOI":"10.18653\/v1\/D18-1380"},{"key":"3161_CR48","doi-asserted-by":"publisher","first-page":"429","DOI":"10.1109\/TASLP.2019.2957872","volume":"28","author":"JF Yu","year":"2019","unstructured":"Yu JF, Jiang J, Xia R (2019) Entity-sensitive attention and fusion network for entity-level multimodal sentiment classification. IEEE\/ACM Trans Audio Speech Lang Process 28:429\u2013439","journal-title":"IEEE\/ACM Trans Audio Speech Lang Process"},{"key":"3161_CR49","doi-asserted-by":"crossref","unstructured":"Wang SJ, Cai GY, Lv GR (2024) Aspect-level multimodal sentiment analysis based on co-attention fusion. Int J Data Sci Anal 20(2):903\u2013916","DOI":"10.1007\/s41060-023-00497-3"},{"key":"3161_CR50","doi-asserted-by":"crossref","unstructured":"Wang JH, Gao Y, Li HK (2023) An interactive attention mechanism fusion network for aspect-based multimodal sentiment analysis. In: Proceedings of 2023 IEEE ICMLC, IEEE, Adelaide, Australia, pp 268\u2013275","DOI":"10.1109\/ICMLC58545.2023.10327929"},{"issue":"6","key":"3161_CR51","doi-asserted-by":"publisher","DOI":"10.1016\/j.ipm.2023.103508","volume":"60","author":"LW Xiao","year":"2023","unstructured":"Xiao LW et al (2023) Cross-modal fine-grained alignment and fusion network for multimodal aspect-based sentiment analysis. Inf Process Manag 60(6):103508","journal-title":"Inf Process Manag"},{"key":"3161_CR52","doi-asserted-by":"crossref","unstructured":"Zhu A et al (2025) DaNet: dual-aware enhanced alignment network for multimodal aspect-based sentiment analysis. Findings of the Association for Computational Linguistics: ACL 2025, pp 14369\u201314381","DOI":"10.18653\/v1\/2025.findings-acl.741"},{"issue":"3","key":"3161_CR53","doi-asserted-by":"publisher","first-page":"1264","DOI":"10.1109\/TAFFC.2023.3333200","volume":"15","author":"Q Wang","year":"2023","unstructured":"Wang Q et al (2023) Image-to-text conversion and aspect-oriented filtration for multimodal aspect-based sentiment analysis. IEEE Trans Affect Comput 15(3):1264\u20131278","journal-title":"IEEE Trans Affect Comput"},{"key":"3161_CR54","doi-asserted-by":"crossref","unstructured":"Xiao L et al (2025) Exploring cognitive and aesthetic causality for multimodal aspect-based sentiment analysis. IEEE Trans Affect Comput http: arXiv:2504.15848v1 [cs.CL]","DOI":"10.1109\/TAFFC.2025.3565506"},{"key":"3161_CR55","unstructured":"Touvron H et al (2023) Llama 2: open foundation and fine-tuned chat models. In: arXiv preprint arXiv:2307.09288"},{"key":"3161_CR56","first-page":"34892","volume":"36","author":"H Liu","year":"2023","unstructured":"Liu H et al (2023) Visual instruction tuning. Adv Neural Inf Process Syst 36:34892\u201334916","journal-title":"Adv Neural Inf Process Syst"},{"key":"3161_CR57","unstructured":"Achiam J et al (2023) Gpt-4 technical report. In: arXiv preprint arXiv:2303.08774"},{"key":"3161_CR58","unstructured":"Van der Maaten L, Hinton G (2008) Visualizing data using t-SNE. J Mach Learn Res 9:2579\u20132605"}],"container-title":["International Journal of Machine Learning and Cybernetics"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s13042-026-03161-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s13042-026-03161-x","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s13042-026-03161-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,5,28]],"date-time":"2026-05-28T07:15:49Z","timestamp":1779952549000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s13042-026-03161-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,5,28]]},"references-count":58,"journal-issue":{"issue":"7","published-print":{"date-parts":[[2026,7]]}},"alternative-id":["3161"],"URL":"https:\/\/doi.org\/10.1007\/s13042-026-03161-x","relation":{},"ISSN":["1868-8071","1868-808X"],"issn-type":[{"value":"1868-8071","type":"print"},{"value":"1868-808X","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,5,28]]},"assertion":[{"value":"17 September 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"4 May 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"28 May 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"The authors state that this research complies with ethical standards. This research does not involve either human participants or animals.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethical approval"}}],"article-number":"317"}}