{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,19]],"date-time":"2026-05-19T16:16:45Z","timestamp":1779207405818,"version":"3.51.4"},"reference-count":69,"publisher":"Springer Science and Business Media LLC","issue":"12","license":[{"start":{"date-parts":[[2024,7,23]],"date-time":"2024-07-23T00:00:00Z","timestamp":1721692800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,7,23]],"date-time":"2024-07-23T00:00:00Z","timestamp":1721692800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61872188"],"award-info":[{"award-number":["61872188"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61972204"],"award-info":[{"award-number":["61972204"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62103110"],"award-info":[{"award-number":["62103110"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62103192"],"award-info":[{"award-number":["62103192"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62102002"],"award-info":[{"award-number":["62102002"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int. J. Mach. Learn. &amp; Cyber."],"published-print":{"date-parts":[[2024,12]]},"DOI":"10.1007\/s13042-024-02287-0","type":"journal-article","created":{"date-parts":[[2024,7,23]],"date-time":"2024-07-23T08:01:50Z","timestamp":1721721710000},"page":"5863-5880","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":8,"title":["A dual stream attention network for facial expression recognition in the wild"],"prefix":"10.1007","volume":"15","author":[{"given":"Hui","family":"Tang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yichang","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4293-0869","authenticated-orcid":false,"given":"Zhong","family":"Jin","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,7,23]]},"reference":[{"key":"2287_CR1","doi-asserted-by":"publisher","DOI":"10.1037\/10001-000","volume-title":"The expression of the emotions in man and animals","author":"C Darwin","year":"1872","unstructured":"Darwin C (1872) The expression of the emotions in man and animals. John Murray, London"},{"issue":"2","key":"2287_CR2","doi-asserted-by":"publisher","first-page":"97","DOI":"10.1109\/34.908962","volume":"23","author":"Y-I Tian","year":"2001","unstructured":"Tian Y-I, Kanade T, Cohn JF (2001) Recognizing action units for facial expression analysis. IEEE Trans Pattern Anal Mach Intell 23(2):97\u2013115","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"3","key":"2287_CR3","doi-asserted-by":"publisher","first-page":"1195","DOI":"10.1109\/TAFFC.2020.2981446","volume":"13","author":"S Li","year":"2020","unstructured":"Li S, Deng W (2020) Deep facial expression recognition: a survey. IEEE Trans Affect Comput 13(3):1195\u20131215","journal-title":"IEEE Trans Affect Comput"},{"issue":"12","key":"2287_CR4","doi-asserted-by":"publisher","first-page":"2835","DOI":"10.1109\/TPAMI.2018.2868952","volume":"41","author":"CF Benitez-Quiroz","year":"2018","unstructured":"Benitez-Quiroz CF, Srinivasan R, Martinez AM (2018) Discriminant functional learning of color features for the recognition of facial action units and their intensities. IEEE Trans Pattern Anal Mach Intell 41(12):2835\u20132845","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"2287_CR5","doi-asserted-by":"crossref","unstructured":"Kanade T, Cohn JF, Tian Y (2000) Comprehensive database for facial expression analysis. In: Proc. 4th IEEE Int. Conf. Autom. Face Gesture Recognit. (FG), pp 46\u201353","DOI":"10.1109\/AFGR.2000.840611"},{"issue":"3","key":"2287_CR6","doi-asserted-by":"publisher","first-page":"445","DOI":"10.1142\/S0218001408006284","volume":"22","author":"FY Shih","year":"2008","unstructured":"Shih FY, Chuang C-F, Wang PS (2008) Performance comparisons of facial expression recognition in Jaffe database. Int J Pattern Recognit Artif Intell 22(3):445\u2013459","journal-title":"Int J Pattern Recognit Artif Intell"},{"key":"2287_CR7","doi-asserted-by":"crossref","unstructured":"Lucey P, Cohn JF, Kanade T, Saragih J, Ambadar Z, Matthews I (2010) The extended Cohn-Kanade dataset (CK+): a complete dataset for action unit and emotion-specified expression. In: Proc. IEEE Int. Conf. Comput. Vis. Pattern Recognit.-Workshops (CVPRW), pp 94\u2013101","DOI":"10.1109\/CVPRW.2010.5543262"},{"issue":"9","key":"2287_CR8","doi-asserted-by":"publisher","first-page":"607","DOI":"10.1016\/j.imavis.2011.07.002","volume":"29","author":"G Zhao","year":"2011","unstructured":"Zhao G, Huang X, Taini M, Li SZ, Pietik\u00e4Inen M (2011) Facial expression recognition from near-infrared videos. Image Vis Comput 29(9):607\u2013619","journal-title":"Image Vis Comput"},{"key":"2287_CR9","unstructured":"Valstar M, Pantic M (2010) Induced disgust, happiness and surprise: an addition to the MMI facial expression database. In: Proc. 3rd Int. Workshop Emotion (satell. of LREC): Corpora Res. Emotion Affect. Paris, France"},{"key":"2287_CR10","unstructured":"Wen Z, Lin W, Wang T, Xu G (2021) Distract your attention: multi-head cross attention network for facial expression recognition. arXiv prepr. arXiv:2109.07270"},{"key":"2287_CR11","doi-asserted-by":"crossref","unstructured":"Li S, Deng W, Du J (2017) Reliable crowdsourcing and deep locality-preserving learning for expression recognition in the wild. In: Proc. IEEE\/CVF Conf. Comput. Vis. Pattern Recognit. (CVPR), pp 2852\u20132861","DOI":"10.1109\/CVPR.2017.277"},{"key":"2287_CR12","doi-asserted-by":"crossref","unstructured":"Barsoum E, Zhang C, Ferrer CC, Zhang Z (2016) Training deep networks for facial expression recognition with crowd-sourced label distribution. In: Proc. 18th ACM Int. Conf. Multimodal Interact., pp 279\u2013283","DOI":"10.1145\/2993148.2993165"},{"issue":"1","key":"2287_CR13","doi-asserted-by":"publisher","first-page":"18","DOI":"10.1109\/TAFFC.2017.2740923","volume":"10","author":"A Mollahosseini","year":"2017","unstructured":"Mollahosseini A, Hasani B, Mahoor MH (2017) Affectnet: a database for facial expression, valence, and arousal computing in the wild. IEEE Trans Affect Comput 10(1):18\u201331","journal-title":"IEEE Trans Affect Comput"},{"issue":"5","key":"2287_CR14","doi-asserted-by":"publisher","first-page":"2439","DOI":"10.1109\/TIP.2018.2886767","volume":"28","author":"Y Li","year":"2018","unstructured":"Li Y, Zeng J, Shan S, Chen X (2018) Occlusion aware facial expression recognition using CNN with attention mechanism. IEEE Trans Image Process 28(5):2439\u20132450","journal-title":"IEEE Trans Image Process"},{"key":"2287_CR15","doi-asserted-by":"publisher","first-page":"4057","DOI":"10.1109\/TIP.2019.2956143","volume":"29","author":"K Wang","year":"2020","unstructured":"Wang K, Peng X, Yang J, Meng D, Qiao Y (2020) Region attention networks for pose and occlusion robust facial expression recognition. IEEE Trans Image Process 29:4057\u20134069","journal-title":"IEEE Trans Image Process"},{"key":"2287_CR16","doi-asserted-by":"publisher","first-page":"781","DOI":"10.1016\/j.ins.2022.11.068","volume":"619","author":"C Liu","year":"2023","unstructured":"Liu C, Hirota K, Dai Y (2023) Patch attention convolutional vision transformer for facial expression recognition with occlusion. Inf Sci 619:781\u2013794","journal-title":"Inf Sci"},{"key":"2287_CR17","doi-asserted-by":"publisher","first-page":"6544","DOI":"10.1109\/TIP.2021.3093397","volume":"30","author":"Z Zhao","year":"2021","unstructured":"Zhao Z, Liu Q, Wang S (2021) Learning deep global multi-scale and local attention features for facial expression recognition in the wild. IEEE Trans Image Process 30:6544\u20136556","journal-title":"IEEE Trans Image Process"},{"key":"2287_CR18","doi-asserted-by":"crossref","unstructured":"Zeiler MD, Fergus R (2014) Visualizing and understanding convolutional networks. In: Proc. Eur. Conf. Comput. Vis. Springer, pp 818\u2013833","DOI":"10.1007\/978-3-319-10590-1_53"},{"key":"2287_CR19","doi-asserted-by":"crossref","unstructured":"Ruan D, Yan Y, Lai S, Chai Z, Shen C, Wang H (2021) Feature decomposition and reconstruction learning for effective facial expression recognition. In: Proc. IEEE Conf. Comput. Vis. Pattern Recognit., pp 7660\u20137669","DOI":"10.1109\/CVPR46437.2021.00757"},{"issue":"2","key":"2287_CR20","doi-asserted-by":"publisher","first-page":"1236","DOI":"10.1109\/TAFFC.2021.3122146","volume":"14","author":"F Ma","year":"2023","unstructured":"Ma F, Sun B, Li S (2023) Facial expression recognition with visual transformers and attentional selective fusion. IEEE Trans Affect Comput 14(2):1236\u20131248","journal-title":"IEEE Trans Affect Comput"},{"key":"2287_CR21","doi-asserted-by":"publisher","first-page":"11823","DOI":"10.1109\/TII.2023.3253188","volume":"19","author":"M Sun","year":"2023","unstructured":"Sun M, Cui W, Zhang Y, Yu S, Liao X, Hu B, Li Y (2023) Attention-rectified and texture-enhanced cross-attention transformer feature fusion network for facial expression recognition. IEEE Trans Ind Inform 19:11823\u201311832","journal-title":"IEEE Trans Ind Inform"},{"key":"2287_CR22","doi-asserted-by":"crossref","unstructured":"Wang K, Peng X, Yang J, Lu S, Qiao Y (2020) Suppressing uncertainties for large-scale facial expression recognition. In: Proc. IEEE\/CVF Conf. Comput. Vis. Pattern Recognit., pp 6897\u20136906","DOI":"10.1109\/CVPR42600.2020.00693"},{"key":"2287_CR23","doi-asserted-by":"publisher","first-page":"2016","DOI":"10.1109\/TIP.2021.3049955","volume":"30","author":"H Li","year":"2021","unstructured":"Li H, Wang N, Ding X, Yang X, Gao X (2021) Adaptively learning facial expression representation via cf labels and distillation. IEEE Trans Image Process 30:2016\u20132028","journal-title":"IEEE Trans Image Process"},{"key":"2287_CR24","doi-asserted-by":"publisher","first-page":"7143","DOI":"10.1109\/TIP.2021.3101820","volume":"30","author":"X Jin","year":"2021","unstructured":"Jin X, Lai Z, Jin Z (2021) Learning dynamic relationships for facial expression recognition based on graph convolutional network. IEEE Trans Image Process 30:7143\u20137155","journal-title":"IEEE Trans Image Process"},{"key":"2287_CR25","doi-asserted-by":"crossref","unstructured":"Ding H, Zhou SK, Chellappa R (2017) FaceNet2ExpNet: regularizing a deep face recognition net for expression recognition. In: Proc. 2017 12th IEEE Int. Conf. Aut. Face Gesture Recognit. (FG 2017), pp 118\u2013126","DOI":"10.1109\/FG.2017.23"},{"key":"2287_CR26","doi-asserted-by":"crossref","unstructured":"Sandler M, Howard A, Zhu M, Zhmoginov A, Chen L-C (2018) MobileNetV2: inverted residuals and linear bottlenecks. In: Proc. IEEE\/CVF Conf. Comput. Vis. Pattern Recognit. (CVPR), pp 4510\u20134520","DOI":"10.1109\/CVPR.2018.00474"},{"key":"2287_CR27","doi-asserted-by":"publisher","first-page":"6535","DOI":"10.1109\/TIP.2020.2991510","volume":"29","author":"Y Fu","year":"2020","unstructured":"Fu Y, Wu X, Li X, Pan Z, Luo D (2020) Semantic neighborhood-aware deep facial expression recognition. IEEE Trans Image Process 29:6535\u20136548","journal-title":"IEEE Trans Image Process"},{"issue":"6","key":"2287_CR28","doi-asserted-by":"publisher","first-page":"4435","DOI":"10.1016\/j.aej.2021.09.066","volume":"61","author":"Y Nan","year":"2022","unstructured":"Nan Y, Ju J, Hua Q, Zhang H, Wang B (2022) A-MobileNet: an approach of facial expression recognition. Alex Eng J 61(6):4435\u20134444","journal-title":"Alex Eng J"},{"key":"2287_CR29","unstructured":"Vaswani A, Shazeer N, Parmar N, Uszkoreit J, Jones L, Gomez AN, Kaiser \u0141, Polosukhin I (2017) Attention is all you need. In: Proc. Neural Inf. Proces. Syst., pp 5999\u20136009"},{"key":"2287_CR30","doi-asserted-by":"crossref","unstructured":"Happy S, George A, Routray A (2012) A real time facial expression classification system using local binary patterns. In: Proc. 2012 4th Int. Conf. Intell. Hum. Comput. Interact. IEEE, pp 1\u20135","DOI":"10.1109\/IHCI.2012.6481802"},{"key":"2287_CR31","doi-asserted-by":"crossref","unstructured":"Kaya H, G\u00fcrpinar, F, Afshar S, Salah AA (2015) Contrasting and combining least squares based learners for emotion recognition in the wild. In: Proc. ACM Int. Conf. Multimodal Interact., pp 459\u2013466","DOI":"10.1145\/2818346.2830588"},{"issue":"4","key":"2287_CR32","doi-asserted-by":"publisher","first-page":"966","DOI":"10.1109\/TSMCB.2012.2200675","volume":"42","author":"MF Valstar","year":"2012","unstructured":"Valstar MF, Mehu M, Jiang B, Pantic M, Scherer K (2012) Meta-analysis of the first facial expression recognition challenge. IEEE Trans Syst Man Cybern Part B (Cybernetics) 42(4):966\u2013979","journal-title":"IEEE Trans Syst Man Cybern Part B (Cybernetics)"},{"issue":"7","key":"2287_CR33","doi-asserted-by":"publisher","first-page":"1052","DOI":"10.1016\/j.imavis.2007.11.004","volume":"26","author":"I Kotsia","year":"2008","unstructured":"Kotsia I, Buciu I, Pitas I (2008) An analysis of facial expression recognition under partial facial image occlusion. Image Vis Comput 26(7):1052\u20131067","journal-title":"Image Vis Comput"},{"key":"2287_CR34","doi-asserted-by":"crossref","unstructured":"Bartlett MS, Littlewort G, Frank M, Lainscsek C, Fasel I, Movellan J (2005) Recognizing facial expression: machine learning and application to spontaneous behavior. In: Proc. IEEE Comput. Society Conf. Comput. Vis. Pattern Recognit., vol 2. IEEE, pp 568\u2013573","DOI":"10.1109\/CVPR.2005.297"},{"key":"2287_CR35","doi-asserted-by":"crossref","unstructured":"Jiang B, Martinez B, Valstar MF, Pantic M (2014) Decision level fusion of domain specific regions for facial action recognition. In: Proc. 22th Int. Conf. Pattern Recognit. IEEE, pp 1776\u20131781","DOI":"10.1109\/ICPR.2014.312"},{"key":"2287_CR36","doi-asserted-by":"crossref","unstructured":"Berretti S, Del\u00a0Bimbo A, Pala P, Amor BB, Daoudi M (2010) A set of selected sift features for 3D facial expression recognition. In: Proc. 20th Int. Conf. Pattern Recognit. IEEE, pp 4125\u20134128","DOI":"10.1109\/ICPR.2010.1002"},{"key":"2287_CR37","doi-asserted-by":"crossref","unstructured":"Gritti T, Shan C, Jeanne V, Braspenning R (2008) Local features based facial expression recognition with face registration errors. In: Proc. 8th IEEE Int. Conf. Automatic Face Gesture Recognit. IEEE, pp 1\u20138","DOI":"10.1109\/AFGR.2008.4813379"},{"issue":"2","key":"2287_CR38","doi-asserted-by":"publisher","first-page":"721","DOI":"10.1007\/s12652-020-02845-8","volume":"13","author":"S Umer","year":"2022","unstructured":"Umer S, Rout RK, Pero C, Nappi M (2022) Facial expression recognition with trade-offs between data augmentation and deep learning features. J Ambient Intell Humaniz Comput 13(2):721\u2013735","journal-title":"J Ambient Intell Humaniz Comput"},{"key":"2287_CR39","doi-asserted-by":"crossref","unstructured":"Zhao X, Liang X, Liu L, Li T, Han Y, Vasconcelos N, Yan S (2016) Peak-piloted deep network for facial expression recognition. In: Proc. Eur. Conf. Comput. Vis.. Springer, pp 425\u2013442","DOI":"10.1007\/978-3-319-46475-6_27"},{"issue":"10","key":"2287_CR40","doi-asserted-by":"publisher","first-page":"3365","DOI":"10.1109\/TPAMI.2020.2982166","volume":"43","author":"Z Wang","year":"2021","unstructured":"Wang Z, Chen J, Hoi SC (2021) Deep learning for image super-resolution: a survey. IEEE Trans Pattern Anal Mach Intell 43(10):3365\u20133387","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"1","key":"2287_CR41","doi-asserted-by":"publisher","first-page":"549","DOI":"10.1007\/s10489-020-01855-5","volume":"51","author":"J Shao","year":"2021","unstructured":"Shao J, Cheng Q (2021) E-FCNN for tiny facial expression recognition. Appl Intell 51(1):549\u2013559","journal-title":"Appl Intell"},{"key":"2287_CR42","doi-asserted-by":"publisher","first-page":"131988","DOI":"10.1109\/ACCESS.2020.3010018","volume":"8","author":"T-H Vo","year":"2020","unstructured":"Vo T-H, Lee G-S, Yang H-J, Kim S-H (2020) Pyramid with super resolution for in-the-wild facial expression recognition. IEEE Access 8:131988\u2013132001","journal-title":"IEEE Access"},{"key":"2287_CR43","doi-asserted-by":"crossref","unstructured":"Lim B, Son S, Kim H, Nah S, Mu\u00a0Lee K (2017) Enhanced deep residual networks for single image super-resolution. In: Proc. IEEE Conf. Comput. Vis. Pattern Recognit-Workshops., pp 136\u2013144","DOI":"10.1109\/CVPRW.2017.151"},{"key":"2287_CR44","doi-asserted-by":"crossref","unstructured":"Zeng J, Shan S, Chen X (2018) Facial expression recognition with inconsistently annotated datasets. In: Proc. Eur. Conf. Comput. Vis., pp 222\u2013237","DOI":"10.1007\/978-3-030-01261-8_14"},{"key":"2287_CR45","doi-asserted-by":"crossref","unstructured":"Wen Y, Zhang K, Li Z, Qiao Y (2016) A discriminative feature learning approach for deep face recognition. In: Proc. Eur. Conf. Comput. Vis. Springer, pp 499\u2013515","DOI":"10.1007\/978-3-319-46478-7_31"},{"key":"2287_CR46","doi-asserted-by":"crossref","unstructured":"Cai J, Meng Z, Khan AS, Li Z, O\u2019Reilly J, Tong Y (2018) Island loss for learning discriminative features in facial expression recognition. In: Proc. 13th IEEE Int. Conf. Automatic Face Gesture Recognit.. IEEE, pp 302\u2013309","DOI":"10.1109\/FG.2018.00051"},{"key":"2287_CR47","doi-asserted-by":"crossref","unstructured":"Farzaneh AH, Qi X (2021) Facial expression recognition in the wild via deep attentive center loss. In: Proc. IEEE Winter Conf. Appl. Comput. Vis., pp 2402\u20132411","DOI":"10.1109\/WACV48630.2021.00245"},{"key":"2287_CR48","unstructured":"Li Y, Lu Y, Li J, Lu G (2019) Separate loss for basic and compound facial expression recognition in the wild. In: Proc. Asian Conf. Mach. Learn.. PMLR, pp 897\u2013911"},{"key":"2287_CR49","unstructured":"Mnih V, Heess N, Graves A (2014) Recurrent models of visual attention. In: Proc. Adv. Neural Inf. Process. Syst., pp 2204\u20132212"},{"key":"2287_CR50","doi-asserted-by":"publisher","first-page":"800","DOI":"10.1109\/TAFFC.2020.3027340","volume":"14","author":"W Chen","year":"2020","unstructured":"Chen W, Zhang D, Li M, Lee D-J (2020) STCAM: spatial-temporal and channel attention module for dynamic facial expression recognition. IEEE Trans Affect Comput 14:800\u2013810","journal-title":"IEEE Trans Affect Comput"},{"key":"2287_CR51","doi-asserted-by":"publisher","unstructured":"Hasani B, Mahoor MH (2017) Facial expression recognition using enhanced deep 3D convolutional neural networks. In: Proc. 2017 IEEE Conf. Comput. Vis. Pattern Recognit. Workshops, pp 2278\u20132288. https:\/\/doi.org\/10.1109\/CVPRW.2017.282","DOI":"10.1109\/CVPRW.2017.282"},{"key":"2287_CR52","doi-asserted-by":"crossref","unstructured":"Wu R, Zhang G, Lu S, Chen T (2020) Cascade EF-GAN: progressive facial expression editing with local focuses. In: Proc. IEEE\/CVF Conf. Comput. Vis. Pattern Recognit., pp 5021\u20135030","DOI":"10.1109\/CVPR42600.2020.00507"},{"key":"2287_CR53","doi-asserted-by":"publisher","first-page":"175","DOI":"10.1109\/TCDS.2022.3150019","volume":"15","author":"R Ni","year":"2022","unstructured":"Ni R, Yang B, Zhou X, Cangelosi A, Liu X (2022) Facial expression recognition through cross-modality attention fusion. IEEE Trans Cogn Dev Syst 15:175\u2013185","journal-title":"IEEE Trans Cogn Dev Syst"},{"key":"2287_CR54","doi-asserted-by":"publisher","first-page":"58","DOI":"10.1016\/j.patrec.2021.01.029","volume":"145","author":"D Gera","year":"2021","unstructured":"Gera D, Balasubramanian S (2021) Landmark guidance independent spatio-channel attention and complementary context information based facial expression recognition. Pattern Recognit Lett 145:58\u201366","journal-title":"Pattern Recognit Lett"},{"key":"2287_CR55","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition. In: Proc. IEEE\/CVF Conf. Comput. Vis. Pattern Recognit., pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"key":"2287_CR56","unstructured":"Zhou S-Y, Su C-Y (2021) A novel lightweight convolutional neural network, exquisitenetv2. arXiv prepr. arXiv:2105.09008"},{"key":"2287_CR57","doi-asserted-by":"crossref","unstructured":"Hu J, Shen L, Sun G (2018) Squeeze-and-excitation networks. In: Proc. IEEE\/CVF Conf. Comput. Vis. Pattern Recognit., pp 7132\u20137141","DOI":"10.1109\/CVPR.2018.00745"},{"key":"2287_CR58","doi-asserted-by":"publisher","first-page":"153","DOI":"10.1016\/j.inffus.2018.02.004","volume":"45","author":"J Ma","year":"2019","unstructured":"Ma J, Ma Y, Li C (2019) Infrared and visible image fusion methods and applications: a survey. Inf Fusion 45:153\u2013178","journal-title":"Inf Fusion"},{"issue":"1","key":"2287_CR59","doi-asserted-by":"publisher","first-page":"39","DOI":"10.1109\/TPAMI.2008.52","volume":"31","author":"Z Zeng","year":"2008","unstructured":"Zeng Z, Pantic M, Roisman GI, Huang TS (2008) A survey of affect recognition methods: audio, visual, and spontaneous expressions. IEEE Trans Pattern Anal Mach Intell 31(1):39\u201358","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"2287_CR60","doi-asserted-by":"publisher","first-page":"100","DOI":"10.1016\/j.inffus.2016.05.004","volume":"33","author":"S Li","year":"2017","unstructured":"Li S, Kang X, Fang L, Hu J, Yin H (2017) Pixel-level image fusion: a survey of the state of the art. Inf Fusion 33:100\u2013112","journal-title":"Inf Fusion"},{"key":"2287_CR61","doi-asserted-by":"crossref","unstructured":"Cai J, Meng Z, Khan AS, Li Z, O\u2019Reilly J, Han S, Liu P, Chen M, Tong Y (2019) Feature-level and model-level audiovisual fusion for emotion recognition in the wild. In: Proc. IEEE Conf. Multimedia Inf. Process. Retr.. IEEE, pp 443\u2013448","DOI":"10.1109\/MIPR.2019.00089"},{"key":"2287_CR62","doi-asserted-by":"crossref","unstructured":"Goodfellow IJ, Erhan D, Carrier PL, Courville A, Mirza M, Hamner B, Cukierski W, Tang Y, Thaler D, Lee D-H (2013) Challenges in representation learning: a report on three machine learning contests. In: Proc. Int. Conf. Neural Inf. Process. Springer, pp 117\u2013124","DOI":"10.1007\/978-3-642-42051-1_16"},{"key":"2287_CR63","doi-asserted-by":"crossref","unstructured":"Guo Y, Zhang L, Hu Y, He X, Gao J (2016) MS-Celeb-1M: a dataset and benchmark for large-scale face recognition. In: Proc. Eur. Conf. Comput. Vis.. Springer, pp 87\u2013102","DOI":"10.1007\/978-3-319-46487-9_6"},{"key":"2287_CR64","doi-asserted-by":"crossref","unstructured":"She J, Hu Y, Shi H, Wang J, Shen Q, Mei T (2021) Dive into ambiguity: latent distribution mining and pairwise uncertainty estimation for facial expression recognition. In: Proc. IEEE Conf. Comput. Vis. Pattern Recognit., pp 6248\u20136257","DOI":"10.1109\/CVPR46437.2021.00618"},{"key":"2287_CR65","doi-asserted-by":"crossref","unstructured":"Albanie S, Nagrani A, Vedaldi A, Zisserman A (2018) Emotion recognition in speech using cross-modal transfer in the wild. In: Proc. 26th ACM Int. Conf. Multimedia, pp 292\u2013301","DOI":"10.1145\/3240508.3240578"},{"key":"2287_CR66","unstructured":"Li H, Sui M, Zhao F, Zha Z, Wu F (2021) MVT: mask vision transformer for facial expression recognition in the wild. arXiv prepr. arXiv:2106.04520"},{"key":"2287_CR67","doi-asserted-by":"crossref","unstructured":"Zhao Z, Liu Q, Zhou F (2021) Robust lightweight facial expression recognition network with label distribution training. In: Proc. AAAI Conf. Artif. Intell., vol. 35, pp 3510\u20133519","DOI":"10.1609\/aaai.v35i4.16465"},{"key":"2287_CR68","doi-asserted-by":"publisher","first-page":"173","DOI":"10.1109\/TAFFC.2023.3263886","volume":"15","author":"H Li","year":"2023","unstructured":"Li H, Wang N, Yang X, Wang X, Gao X (2023) Unconstrained facial expression recognition with no-reference de-elements learning. IEEE Trans Affect Comput 15:173\u2013185","journal-title":"IEEE Trans Affect Comput"},{"issue":"11","key":"2287_CR69","first-page":"2579","volume":"9","author":"L Maaten","year":"2008","unstructured":"Maaten L, Hinton G (2008) Visualizing data using t-SNE. J Mach Learn Res 9(11):2579\u20132605","journal-title":"J Mach Learn Res"}],"container-title":["International Journal of Machine Learning and Cybernetics"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s13042-024-02287-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s13042-024-02287-0\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s13042-024-02287-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,10,29]],"date-time":"2024-10-29T10:26:15Z","timestamp":1730197575000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s13042-024-02287-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,7,23]]},"references-count":69,"journal-issue":{"issue":"12","published-print":{"date-parts":[[2024,12]]}},"alternative-id":["2287"],"URL":"https:\/\/doi.org\/10.1007\/s13042-024-02287-0","relation":{},"ISSN":["1868-8071","1868-808X"],"issn-type":[{"value":"1868-8071","type":"print"},{"value":"1868-808X","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,7,23]]},"assertion":[{"value":"3 September 2023","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"14 July 2024","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"23 July 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors have no conflict of interest to declare that are relevant to the content of this article.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}