{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,8]],"date-time":"2026-07-08T18:33:20Z","timestamp":1783535600740,"version":"3.55.0"},"reference-count":60,"publisher":"Springer Science and Business Media LLC","issue":"13","license":[{"start":{"date-parts":[[2025,8,1]],"date-time":"2025-08-01T00:00:00Z","timestamp":1754006400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,8,1]],"date-time":"2025-08-01T00:00:00Z","timestamp":1754006400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62373037"],"award-info":[{"award-number":["62373037"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100012226","name":"Fundamental Research Funds for the Central Universities","doi-asserted-by":"publisher","award":["2024YJS185"],"award-info":[{"award-number":["2024YJS185"]}],"id":[{"id":"10.13039\/501100012226","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Distinguished Scientist Fellowship Program (DSFP) of Princess Nourah bint Abdulrahman University"},{"name":"Princess Nourah bint Abdulrahman University Researchers Supporting Project","award":["HCPNU2025R54"],"award-info":[{"award-number":["HCPNU2025R54"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Appl Intell"],"published-print":{"date-parts":[[2025,8]]},"DOI":"10.1007\/s10489-025-06764-z","type":"journal-article","created":{"date-parts":[[2025,8,1]],"date-time":"2025-08-01T12:13:15Z","timestamp":1754050395000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["A hierarchical interaction multimodal model for feature fusion based on RoBERTa-Keyword-ViT"],"prefix":"10.1007","volume":"55","author":[{"given":"Yuanhang","family":"Wang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-2658-0982","authenticated-orcid":false,"given":"Yonghua","family":"Zhou","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Min","family":"Zhong","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yiduo","family":"Mei","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hamido","family":"Fujita","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hanan","family":"Aljuaid","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,8,1]]},"reference":[{"issue":"1","key":"6764_CR1","doi-asserted-by":"crossref","first-page":"216","DOI":"10.1109\/TCSS.2022.3226862","volume":"11","author":"K Liu","year":"2022","unstructured":"Liu K, Xue F, Li S, Sang S, Hong R (2022) Multimodal hierarchical graph collaborative filtering for multimedia-based recommendation. IEEE Trans Comput Soc Syst 11(1):216\u2013227","journal-title":"IEEE Trans Comput Soc Syst"},{"issue":"23","key":"6764_CR2","doi-asserted-by":"crossref","first-page":"29433","DOI":"10.1007\/s10489-023-05080-8","volume":"53","author":"F Han","year":"2023","unstructured":"Han F, Zhang X, He L, Kong L, Chen Y (2023) Multimodal fuzzy granular representation and classification. Appl Intell 53(23):29433\u201329447","journal-title":"Appl Intell"},{"key":"6764_CR3","doi-asserted-by":"crossref","first-page":"103482","DOI":"10.1016\/j.bulsci.2024.103482","volume":"195","author":"T Radhika","year":"2024","unstructured":"Radhika T, Chandrasekar A, Vijayakumar V (2024) Finite-time H\u221e synchronization of semi-Markov jump neural networks with two delay components with stochastic sampled-data control. Bullet des Sci Math\u00e9matiques 195:103482","journal-title":"Bullet des Sci Math\u00e9matiques"},{"issue":"1","key":"6764_CR4","doi-asserted-by":"crossref","first-page":"613","DOI":"10.1007\/s11063-021-10649-w","volume":"54","author":"A Chandrasekar","year":"2022","unstructured":"Chandrasekar A, Radhika T, Zhu Q (2022) Further results on input-to-state stability of stochastic Cohen-Grossberg BAM neural networks with probabilistic time-varying delays. Neural Process Lett 54(1):613\u2013635","journal-title":"Neural Process Lett"},{"key":"6764_CR5","doi-asserted-by":"crossref","first-page":"1516","DOI":"10.1109\/TMM.2023.3282874","volume":"26","author":"S Wei","year":"2023","unstructured":"Wei S, Luo C, Luo Y, Xu J (2023) Privileged modality learning via multimodal hallucination. IEEE Trans Multimed 26:1516\u20131527","journal-title":"IEEE Trans Multimed"},{"issue":"2","key":"6764_CR6","first-page":"1","volume":"55","author":"Y Chen","year":"2025","unstructured":"Chen Y, Ma Y, Zou H et al (2025) Multifactorial modality fusion network for multimodal recommendation. Appl Intell 55(2):1\u201317","journal-title":"Appl Intell"},{"key":"6764_CR7","doi-asserted-by":"crossref","first-page":"121692","DOI":"10.1016\/j.eswa.2023.121692","volume":"237","author":"S Zhang","year":"2023","unstructured":"Zhang S, Yang Y, Chen C, Zhang X, Leng Q, Zhao X (2023) Deep learning-based multimodal emotion recognition from audio, visual, and... text modalities: a systematic review of recent advancements and future prospects. Expert Syst Appl 237:121692","journal-title":"Expert Syst Appl"},{"issue":"3","key":"6764_CR8","doi-asserted-by":"crossref","first-page":"1469","DOI":"10.1109\/TCSVT.2023.3296196","volume":"34","author":"P Tang","year":"2023","unstructured":"Tang P, Hu K, Zhang L, Luo J, Wang Z (2023) Tldw: extreme multimodal summarisation of news videos. IEEE Trans Circ Syst Video Technol 34(3):1469\u20131480","journal-title":"IEEE Trans Circ Syst Video Technol"},{"key":"6764_CR9","doi-asserted-by":"crossref","first-page":"5753","DOI":"10.1109\/TMM.2023.3338769","volume":"26","author":"R Huan","year":"2023","unstructured":"Huan R, Zhong G, Chen P, Liang R (2023) Unimf: a unified multimodal framework for multimodal sentiment analysis in missing modalities and unaligned multimodal sequences. IEEE Trans Multimed 26:5753\u20135768","journal-title":"IEEE Trans Multimed"},{"issue":"2s","key":"6764_CR10","first-page":"1","volume":"19","author":"J Wu","year":"2023","unstructured":"Wu J, Zhu T, Zhu J, Li T, Wang C (2023) An optimized BERT for multimodal sentiment analysis. ACM Trans Multimed Comput Commun Appl 19(2s):1\u201312","journal-title":"ACM Trans Multimed Comput Commun Appl"},{"issue":"7","key":"6764_CR11","doi-asserted-by":"crossref","first-page":"2289","DOI":"10.1007\/s13042-022-01757-7","volume":"14","author":"Z Song","year":"2023","unstructured":"Song Z, Xue Y, Gu D, Zhang H, Ding W (2023) Target-oriented multimodal sentiment classification by using topic model and gating mechanism. Int J Mach Learn Cybern 14(7):2289\u20132299","journal-title":"Int J Mach Learn Cybern"},{"issue":"1","key":"6764_CR12","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1007\/s00530-023-01202-x","volume":"30","author":"Y Luo","year":"2024","unstructured":"Luo Y, Wu R, Liu J, Tang X (2024) Balanced sentimental information via multimodal interaction model. Multimedia Syst 30(1):1\u20139","journal-title":"Multimedia Syst"},{"issue":"3","key":"6764_CR13","doi-asserted-by":"crossref","first-page":"142","DOI":"10.1007\/s00530-024-01345-5","volume":"30","author":"L Zhao","year":"2024","unstructured":"Zhao L, Yang Y, Ning T (2024) A three-stage multimodal emotion recognition network based on text low-rank fusion. Multimedia Syst 30(3):142","journal-title":"Multimedia Syst"},{"key":"6764_CR14","doi-asserted-by":"crossref","first-page":"101958","DOI":"10.1016\/j.inffus.2023.101958","volume":"100","author":"C Zhu","year":"2023","unstructured":"Zhu C, Chen M, Zhang S, Sun C, Liang H, Liu Y, Chen J (2023) Skeafn: sentiment knowledge enhanced attention fusion network for multimodal sentiment analysis. Inf Fusion 100:101958","journal-title":"Inf Fusion"},{"key":"6764_CR15","doi-asserted-by":"crossref","first-page":"203","DOI":"10.1016\/j.inffus.2021.12.003","volume":"81","author":"A Rahate","year":"2022","unstructured":"Rahate A, Walambe R, Ramanna S, Kotecha K (2022) Multimodal co-learning: challenges, applications with datasets, recent advances and future directions. Inf Fusion 81:203\u2013239","journal-title":"Inf Fusion"},{"issue":"1","key":"6764_CR16","doi-asserted-by":"crossref","first-page":"185","DOI":"10.28991\/HIJ-2024-05-01-014","volume":"5","author":"H Abbassi","year":"2024","unstructured":"Abbassi H, El Mendili S, Gahi Y (2024) Real-time online banking fraud detection model by unsupervised learning fusion. HighTech Innov J 5(1):185\u2013199","journal-title":"HighTech Innov J"},{"key":"6764_CR17","doi-asserted-by":"crossref","first-page":"119760","DOI":"10.1016\/j.ins.2023.119760","volume":"653","author":"S Kim","year":"2024","unstructured":"Kim S, Yun S, Lee J, Chang G, Roh W, Sohn D-N, Lee J-T, Park H, Kim S (2024) Self-supervised multimodal graph convolutional network for collaborative filtering. Inf Sci 653:119760","journal-title":"Inf Sci"},{"key":"6764_CR18","doi-asserted-by":"crossref","first-page":"234","DOI":"10.1016\/j.comcom.2023.12.003","volume":"214","author":"S Yu","year":"2024","unstructured":"Yu S, Wang J, Hussein W, Hung PC (2024) Robust multimodal federated learning for incomplete modalities. Comput Commun 214:234\u2013243","journal-title":"Comput Commun"},{"key":"6764_CR19","doi-asserted-by":"crossref","first-page":"110404","DOI":"10.1016\/j.asoc.2023.110404","volume":"143","author":"S Aslan","year":"2023","unstructured":"Aslan S (2023) A deep learning-based sentiment analysis approach (mf-cnn-bilstm) and topic modeling of tweets related to the ukraine\u2013russia conflict. Appl Soft Comput 143:110404","journal-title":"Appl Soft Comput"},{"key":"6764_CR20","doi-asserted-by":"crossref","first-page":"106960","DOI":"10.1016\/j.engappai.2023.106960","volume":"126","author":"Y Yang","year":"2023","unstructured":"Yang Y, Fei L, Alshehri AH, Zhao S, Sun W, Teng S (2023) Joint multi-type feature learning for multi-modality fkp recognition. Eng Appl Artif Intell 126:106960","journal-title":"Eng Appl Artif Intell"},{"key":"6764_CR21","doi-asserted-by":"crossref","first-page":"109631","DOI":"10.1016\/j.asoc.2022.109631","volume":"129","author":"P Razzaghi","year":"2022","unstructured":"Razzaghi P, Abbasi K, Shirazi M, Rashidi S (2022) Multimodal brain tumor detection using multimodal deep transfer learning. Appl Soft Comput 129:109631","journal-title":"Appl Soft Comput"},{"key":"6764_CR22","doi-asserted-by":"crossref","first-page":"2027","DOI":"10.1109\/TMM.2023.3291503","volume":"26","author":"D Chen","year":"2023","unstructured":"Chen D, Zhang R (2023) Building multimodal knowledge bases with multimodal computational sequences and generative adversarial networks. IEEE Trans Multimed 26:2027\u20132040","journal-title":"IEEE Trans Multimed"},{"issue":"8","key":"6764_CR23","doi-asserted-by":"crossref","first-page":"6252","DOI":"10.1007\/s10489-024-05490-2","volume":"54","author":"D Wang","year":"2024","unstructured":"Wang D, Feng X, Liu Z, Wang C (2024) 2m-ner: contrastive learning for multilingual and multimodal ner with language and modal fusion. Appl Intell 54(8):6252\u20136268","journal-title":"Appl Intell"},{"issue":"5","key":"6764_CR24","doi-asserted-by":"crossref","first-page":"1875","DOI":"10.28991\/ESJ-2024-08-05-013","volume":"8","author":"A Maseleno","year":"2024","unstructured":"Maseleno A, Huda M, Ratanamahatana CA (2024) An explainable deep learning approach for classifying monkeypox disease by leveraging skin lesion image data. Emerg Sci J 8(5):1875\u20131897","journal-title":"Emerg Sci J"},{"issue":"1","key":"6764_CR25","doi-asserted-by":"crossref","first-page":"170","DOI":"10.28991\/HIJ-2024-05-01-013","volume":"5","author":"Y Zhang","year":"2024","unstructured":"Zhang Y, Liu H, Feng J, Zhang X (2024) Innovative label embedding for food safety comment classification: Fusion of self-semantic and self-knowledge features. HighTech and Innov J 5(1):170\u2013184","journal-title":"HighTech and Innov J"},{"key":"6764_CR26","first-page":"1","volume":"62","author":"Y Chen","year":"2024","unstructured":"Chen Y, Zhao M, Bruzzone L (2024) A novel approach to incomplete multimodal learning for remote sensing data fusion. IEEE Trans Geosci Remote Sens 62:1\u201314","journal-title":"IEEE Trans Geosci Remote Sens"},{"issue":"4","key":"6764_CR27","doi-asserted-by":"crossref","first-page":"103378","DOI":"10.1016\/j.ipm.2023.103378","volume":"60","author":"Z Zeng","year":"2023","unstructured":"Zeng Z, Sun S, Li Q (2023) Multimodal negative sentiment recognition of online public opinion on public health emergencies based on graph convolutional networks and ensemble learning. Inf Process Manage 60(4):103378","journal-title":"Inf Process Manage"},{"key":"6764_CR28","doi-asserted-by":"crossref","first-page":"110834","DOI":"10.1016\/j.knosys.2023.110834","volume":"277","author":"L Ilias","year":"2023","unstructured":"Ilias L, Askounis D (2023) Context-aware attention layers coupled with optimal transport domain adaptation and multimodal fusion methods for recognizing dementia from spontaneous speech. Knowl-Based Syst 277:110834","journal-title":"Knowl-Based Syst"},{"key":"6764_CR29","doi-asserted-by":"crossref","first-page":"37","DOI":"10.1016\/j.inffus.2022.11.022","volume":"92","author":"K Kim","year":"2023","unstructured":"Kim K, Park S (2023) Aobert: All-modalities-in-one bert for multimodal sentiment analysis. Inf Fusion 92:37\u201345","journal-title":"Inf Fusion"},{"issue":"6","key":"6764_CR30","doi-asserted-by":"crossref","first-page":"1407","DOI":"10.1109\/TCSS.2021.3082942","volume":"8","author":"C Suman","year":"2021","unstructured":"Suman C, Naman A, Saha S, Bhattacharyya P (2021) A multimodal author profiling system for tweets. IEEE Trans Comput Soc Syst 8(6):1407\u20131416","journal-title":"IEEE Trans Comput Soc Syst"},{"issue":"1","key":"6764_CR31","doi-asserted-by":"crossref","first-page":"899","DOI":"10.1007\/s10489-023-05235-7","volume":"54","author":"J Li","year":"2024","unstructured":"Li J, Si G, Tian P, An Z, Zhou F (2024) Overview of indoor scene recognition and representation methods based on multimodal knowledge graphs. Appl Intell 54(1):899\u2013923","journal-title":"Appl Intell"},{"issue":"4","key":"6764_CR32","doi-asserted-by":"crossref","first-page":"140301","DOI":"10.1007\/s11432-022-3588-0","volume":"66","author":"X Sun","year":"2023","unstructured":"Sun X, Tian Y, Lu W, Wang P, Niu R, Yu H, Fu K (2023) From single-to multi-modal remote sensing imagery interpretation: A survey and taxonomy. Sci China Inf Sci 66(4):140301","journal-title":"Sci China Inf Sci"},{"key":"6764_CR33","doi-asserted-by":"crossref","first-page":"126373","DOI":"10.1016\/j.neucom.2023.126373","volume":"548","author":"X Huang","year":"2023","unstructured":"Huang X, Ma T, Jia L, Zhang Y, Rong H, Alnabhan N (2023) An effective multimodal representation and fusion method for multimodal intent recognition. Neurocomputing 548:126373","journal-title":"Neurocomputing"},{"key":"6764_CR34","doi-asserted-by":"crossref","first-page":"127181","DOI":"10.1016\/j.neucom.2023.127181","volume":"572","author":"Y Wang","year":"2024","unstructured":"Wang Y, He J, Wang D, Wang Q, Wan B, Luo X (2024) Multimodal transformer with adaptive modality weighting for multimodal sentiment analysis. Neurocomputing 572:127181","journal-title":"Neurocomputing"},{"issue":"4","key":"6764_CR35","doi-asserted-by":"crossref","first-page":"1966","DOI":"10.1109\/TCSVT.2022.3218018","volume":"33","author":"J Tang","year":"2022","unstructured":"Tang J, Liu D, Jin X, Peng Y, Zhao Q, Ding Y, Kong W (2022) Bafn: Bi-direction attention based fusion network for multimodal sentiment analysis. IEEE Trans Circuits Syst Video Technol 33(4):1966\u20131978","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"6764_CR36","doi-asserted-by":"crossref","first-page":"2082","DOI":"10.1109\/TMM.2023.3291819","volume":"26","author":"J Xu","year":"2023","unstructured":"Xu J, Zhang X, Zhao C, Geng Z, Feng Y, Miao K, Li Y (2023) Improving fine-grained image classification with multimodal information. IEEE Trans Multimed 26:2082\u20132095","journal-title":"IEEE Trans Multimed"},{"issue":"6","key":"6764_CR37","doi-asserted-by":"crossref","first-page":"3","DOI":"10.1109\/MIS.2020.3026715","volume":"36","author":"N Xu","year":"2020","unstructured":"Xu N, Mao W, Wei P, Zeng D (2020) Mda: Multimodal data augmentation framework for boosting performance on sentiment\/emotion classification tasks. IEEE Intell Syst 36(6):3\u201312","journal-title":"IEEE Intell Syst"},{"key":"6764_CR38","doi-asserted-by":"crossref","first-page":"7906","DOI":"10.1109\/TMM.2022.3229966","volume":"25","author":"L Wei","year":"2023","unstructured":"Wei L, Hu D, Zhou W, Hu S (2023) Modeling both intra-and inter-modality uncertainty for multimodal fake news detection. IEEE Trans Multimed 25:7906\u20137916","journal-title":"IEEE Trans Multimed"},{"issue":"1","key":"6764_CR39","doi-asserted-by":"crossref","first-page":"309","DOI":"10.1109\/TAFFC.2023.3274829","volume":"15","author":"L Sun","year":"2023","unstructured":"Sun L, Lian Z, Liu B, Tao J (2023) Efficient multimodal transformer with dual-level feature restoration for robust multimodal sentiment analysis. IEEE Trans Affect Comput 15(1):309\u2013325","journal-title":"IEEE Trans Affect Comput"},{"key":"6764_CR40","doi-asserted-by":"crossref","first-page":"3771","DOI":"10.1109\/TASLP.2023.3316458","volume":"31","author":"Z Zhao","year":"2023","unstructured":"Zhao Z, Wang Y, Xu Y, Zhang J et al (2023) Tdfnet: Transformer based deep-scale fusion network for multimodal emotion recognition. IEEE\/ACM Trans Audio, Speech, Lang Process 31:3771\u20133782","journal-title":"IEEE\/ACM Trans Audio, Speech, Lang Process"},{"key":"6764_CR41","doi-asserted-by":"crossref","unstructured":"Carion N, Massa F, Synnaeve G, Usunier N, Kirillov A, Zagoruyko S (2020) End-to-end object detection with transformers. In: European conference on computer vision. Springer, pp 213\u2013229","DOI":"10.1007\/978-3-030-58452-8_13"},{"key":"6764_CR42","doi-asserted-by":"crossref","unstructured":"Cai Y, Cai H, Wan X (2019) Multi-modal sarcasm detection in twitter with hierarchical fusion model. In: Proceedings of the 57th annual meeting of the association for computational linguistics, pp. 2506\u20132515","DOI":"10.18653\/v1\/P19-1239"},{"key":"6764_CR43","doi-asserted-by":"crossref","unstructured":"Maity K, Jha P, Saha S, Bhattacharyya P (2022) A multitask framework for sentiment, emotion and sarcasm aware cyberbullying detection from multi-modal code-mixed memes. In: Proceedings of the 45th international ACM SIGIR conference on research and development in information retrieval, pp 1739\u20131749","DOI":"10.1145\/3477495.3531925"},{"key":"6764_CR44","doi-asserted-by":"crossref","unstructured":"P\u00e9rez JM, Rajngewerc M, Giudici JC, Furman DA, Luque F, Alemany LA and Mart\u00ednez MV (2023) pysentimiento: a Python toolkit for opinion mining and social NLP tasks. arXiv preprint arXiv:2106.09462","DOI":"10.21203\/rs.3.rs-3570648\/v1"},{"key":"6764_CR45","doi-asserted-by":"crossref","unstructured":"Camacho-collados J, Rezaee K, Riahi T, Ushio A, Loureiro D, Antypas D, Boisson J, Espinosa Anke L, Liu F, Mart\u00b4 \u0131nez C\u00b4amara E, et al (2022) TweetNLP: Cutting-edge natural language processing for social media. In: Proceedings of the 2022 conference on empirical methods in natural language processing: system demonstrations. Association for Computational Linguistics, Abu Dhabi, UAE, pp 38\u201349","DOI":"10.18653\/v1\/2022.emnlp-demos.5"},{"key":"6764_CR46","doi-asserted-by":"crossref","unstructured":"Loureiro D, Barbieri F, Neves L, Espinosa Anke L, Camacho-collados J (2022) TimeLMs: Diachronic language models from Twitter. In: Proceedings of the 60th annual meeting of the association for computational linguistics: system demonstrations. Association for Computational Linguistics, Dublin, Ireland, pp 251\u2013260","DOI":"10.18653\/v1\/2022.acl-demo.25"},{"key":"6764_CR47","unstructured":"Dosovitskiy A, Beyer L, Kolesnikov A, Weissenborn D, Zhai X, Unterthiner T, Dehghani M, Minderer M, Heigold G, Gelly S et al (2020) An image is worth 16x16 words: transformers for image recognition at scale. In: International conference on learning representations"},{"issue":"6","key":"6764_CR48","doi-asserted-by":"crossref","first-page":"84","DOI":"10.1145\/3065386","volume":"60","author":"A Krizhevsky","year":"2017","unstructured":"Krizhevsky A, Sutskever I, Hinton GE (2017) Imagenet classification with deep convolutional neural networks. Commun ACM 60(6):84\u201390","journal-title":"Commun ACM"},{"key":"6764_CR49","unstructured":"Tan M, Le Q (2019) Efficientnet: Rethinking model scaling for convolutional neural networks. In: International conference on machine learning. PMLR, pp 6105\u20136114"},{"key":"6764_CR50","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"key":"6764_CR51","unstructured":"Simonyan K, Zisserman A (2015) Very deep convolutional networks for large-scale image recognition. In: International conference on learning representations"},{"key":"6764_CR52","doi-asserted-by":"crossref","first-page":"132306","DOI":"10.1016\/j.physd.2019.132306","volume":"404","author":"A Sherstinsky","year":"2020","unstructured":"Sherstinsky A (2020) Fundamentals of recurrent neural network (RNN) and long short-term memory (LSTM) network. Physica D 404:132306","journal-title":"Physica D"},{"issue":"8","key":"6764_CR53","doi-asserted-by":"crossref","first-page":"1735","DOI":"10.1162\/neco.1997.9.8.1735","volume":"9","author":"S Hochreiter","year":"1997","unstructured":"Hochreiter S, Schmidhuber J (1997) Long short-term memory. Neural Comput 9(8):1735\u20131780","journal-title":"Neural Comput"},{"issue":"5\u20136","key":"6764_CR54","doi-asserted-by":"crossref","first-page":"602","DOI":"10.1016\/j.neunet.2005.06.042","volume":"18","author":"A Graves","year":"2005","unstructured":"Graves A, Schmidhuber J (2005) Framewise phoneme classification with bidirectional LSTM and other neural network architectures. Neural Netw 18(5\u20136):602\u2013610","journal-title":"Neural Netw"},{"key":"6764_CR55","doi-asserted-by":"crossref","unstructured":"Kim Y (2014) Convolutional neural networks for sentence classification. In: Moschitti A, Pang B, Daelemans W (eds) Proceedings of the 2014 conference on empirical methods in natural language processing (EMNLP), association for computational linguistics, Doha, Qatar, pp 1746\u20131751","DOI":"10.3115\/v1\/D14-1181"},{"issue":"1","key":"6764_CR56","doi-asserted-by":"crossref","first-page":"184","DOI":"10.1002\/jmri.29405","volume":"61","author":"J Liu","year":"2024","unstructured":"Liu J, Li X, Wang G, Zeng W, Zeng H, Wen C, Xu W, He Z, Qin G, Chen W (2024) Time-series MR images identifying complete response to neoadjuvant chemotherapy in breast cancer using a deep learning approach. J Magn Reson Imaging 61(1):184\u2013197","journal-title":"J Magn Reson Imaging"},{"key":"6764_CR57","doi-asserted-by":"crossref","first-page":"9437","DOI":"10.1109\/TMM.2023.3252270","volume":"25","author":"X Guo","year":"2023","unstructured":"Guo X, Kot A, Kong AW-K (2023) Pace-adaptive and noise-resistant contrastive learning for multimodal feature fusion. IEEE Trans Multimed 25:9437\u20139448","journal-title":"IEEE Trans Multimed"},{"key":"6764_CR58","doi-asserted-by":"crossref","first-page":"102132","DOI":"10.1016\/j.inffus.2023.102132","volume":"103","author":"J Wang","year":"2024","unstructured":"Wang J, Yang Y, Jiang Y, Ma M, Xie Z, Li T (2024) Cross-modal incongruity aligning and collaborating for multi-modal sarcasm detection. Inf Fusion 103:102132","journal-title":"Inf Fusion"},{"key":"6764_CR59","doi-asserted-by":"crossref","first-page":"101921","DOI":"10.1016\/j.inffus.2023.101921","volume":"100","author":"T Yue","year":"2023","unstructured":"Yue T, Mao R, Wang H, Hu Z, Cambria E (2023) Knowlenet: Knowledge fusion network for multimodal sarcasm detection. Inf Fusion 100:101921","journal-title":"Inf Fusion"},{"key":"6764_CR60","doi-asserted-by":"crossref","first-page":"102203","DOI":"10.1016\/j.inffus.2023.102203","volume":"104","author":"Q Lu","year":"2024","unstructured":"Lu Q, Long Y, Sun X, Feng J, Zhang H (2024) Fact-sentiment incongruity combination network for multimodal sarcasm detection. Inf Fusion 104:102203","journal-title":"Inf Fusion"}],"container-title":["Applied Intelligence"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-025-06764-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s10489-025-06764-z\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-025-06764-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,9,27]],"date-time":"2025-09-27T14:34:37Z","timestamp":1758983677000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s10489-025-06764-z"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,8]]},"references-count":60,"journal-issue":{"issue":"13","published-print":{"date-parts":[[2025,8]]}},"alternative-id":["6764"],"URL":"https:\/\/doi.org\/10.1007\/s10489-025-06764-z","relation":{},"ISSN":["0924-669X","1573-7497"],"issn-type":[{"value":"0924-669X","type":"print"},{"value":"1573-7497","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,8]]},"assertion":[{"value":"30 June 2025","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"1 August 2025","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflicts of interests"}}],"article-number":"900"}}