{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,4]],"date-time":"2026-06-04T09:05:45Z","timestamp":1780563945960,"version":"3.54.1"},"reference-count":60,"publisher":"Springer Science and Business Media LLC","issue":"2","license":[{"start":{"date-parts":[[2024,1,11]],"date-time":"2024-01-11T00:00:00Z","timestamp":1704931200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"},{"start":{"date-parts":[[2024,1,11]],"date-time":"2024-01-11T00:00:00Z","timestamp":1704931200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Mach. Intell. Res."],"published-print":{"date-parts":[[2024,4]]},"abstract":"<jats:title>Abstract<\/jats:title>\n                  <jats:p>Facial expression recognition (FER) is still challenging due to the small interclass discrepancy in facial expression data. In view of the significance of facial crucial regions for FER, many existing studies utilize the prior information from some annotated crucial points to improve the performance of FER. However, it is complicated and time-consuming to manually annotate facial crucial points, especially for vast wild expression images. Based on this, a local non-local joint network is proposed to adaptively enhance the facial crucial regions in feature learning of FER in this paper. In the proposed method, two parts are constructed based on facial local and non-local information, where an ensemble of multiple local networks is proposed to extract local features corresponding to multiple facial local regions and a non-local attention network is addressed to explore the significance of each local region. In particular, the attention weights obtained by the non-local network are fed into the local part to achieve interactive feedback between the facial global and local information. Interestingly, the non-local weights corresponding to local regions are gradually updated and higher weights are given to more crucial regions. Moreover, U-Net is employed to extract the integrated features of deep semantic information and low hierarchical detail information of expression images. Finally, experimental results illustrate that the proposed method achieves more competitive performance than several state-of-the-art methods on five benchmark datasets.<\/jats:p>","DOI":"10.1007\/s11633-023-1417-9","type":"journal-article","created":{"date-parts":[[2024,1,10]],"date-time":"2024-01-10T23:43:05Z","timestamp":1704930185000},"page":"331-348","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":4,"title":["Adaptively Enhancing Facial Expression Crucial Regions via a Local Non-local Joint Network"],"prefix":"10.1007","volume":"21","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-2230-207X","authenticated-orcid":false,"given":"Guanghui","family":"Shi","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3308-1794","authenticated-orcid":false,"given":"Shasha","family":"Mao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2619-6481","authenticated-orcid":false,"given":"Shuiping","family":"Gou","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9195-2618","authenticated-orcid":false,"given":"Dandan","family":"Yan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3354-9617","authenticated-orcid":false,"given":"Licheng","family":"Jiao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3545-227X","authenticated-orcid":false,"given":"Lin","family":"Xiong","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,1,11]]},"reference":[{"key":"1417_CR1","doi-asserted-by":"crossref","DOI":"10.1093\/oso\/9780195112719.001.0001","volume-title":"The Expression of the Emotions in Man and Animals","author":"C Darwin","year":"1998","unstructured":"C. Darwin, P. Ekman. The Expression of the Emotions in Man and Animals, 3rd ed., Oxford, UK: Oxford University Press, 1998.","edition":"3rd"},{"issue":"4","key":"1417_CR2","doi-asserted-by":"publisher","first-page":"587","DOI":"10.1037\/h0037041","volume":"30","author":"R Buck","year":"1974","unstructured":"R. Buck, R. E. Miller, W. F. Caul. Sex, personality, and physiological variables in the communication of affect via facial expression. Journal of Personality and Social Psychology, vol. 30, no. 4, pp. 587\u2013596, 1974. DOI: https:\/\/doi.org\/10.1037\/h0037041.","journal-title":"Journal of Personality and Social Psychology"},{"issue":"5","key":"1417_CR3","doi-asserted-by":"publisher","first-page":"383","DOI":"10.1017\/S1355617700001454","volume":"2","author":"M C Smith","year":"1996","unstructured":"M. C. Smith, M. K. Smith, H. Ellgring. Spontaneous and posed facial expression in parkinson\u2019s disease. Journal of the International Neuropsychological Society, vol. 2, no. 5, pp. 383\u2013391, 1996. DOI: https:\/\/doi.org\/10.1017\/S1355617700001454.","journal-title":"Journal of the International Neuropsychological Society"},{"issue":"8","key":"1417_CR4","doi-asserted-by":"publisher","first-page":"1548","DOI":"10.1109\/TPAM1.2016.2515606","volume":"38","author":"C A Corneanu","year":"2016","unstructured":"C. A. Corneanu, M. O. Sim\u00f3n, J. F. Cohn, S. E. Guerrero. Survey on RGB, 3D, thermal, and multimodal approaches for facial expression recognition: History, trends, and affect-related applications. IEEE Transactions on Pattern Analysis and Machine Intelligence, vol. 38, no. 8, pp. 1548\u20131568, 2016. DOI: https:\/\/doi.org\/10.1109\/TPAM1.2016.2515606.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"1","key":"1417_CR5","doi-asserted-by":"publisher","first-page":"103","DOI":"10.1109\/TCYB.2016.2625419","volume":"48","author":"A Majumder","year":"2018","unstructured":"A. Majumder, L. Behera, V. K. Subramanian. Automatic facial expression recognition system using deep network-based data fusion. IEEE Transactions on Cybernetics, vol. 48, no. 1, pp. 103\u2013114, 2018. DOI: https:\/\/doi.org\/10.1109\/TCYB.2016.2625419.","journal-title":"IEEE Transactions on Cybernetics"},{"issue":"5","key":"1417_CR6","doi-asserted-by":"publisher","first-page":"2787","DOI":"10.1109\/TCYB.2019.2925095","volume":"51","author":"W C Xie","year":"2021","unstructured":"W. C. Xie, L. L. Shen, J. M. Duan. Adaptive weighting of handcrafted feature losses for facial expression recognition. IEEE Transactions on Cybernetics, vol. 51, no. 5, pp. 2787\u20132800, 2021. DOI: https:\/\/doi.org\/10.1109\/TCYB.2019.2925095.","journal-title":"IEEE Transactions on Cybernetics"},{"key":"1417_CR7","volume-title":"What the Face Reveals: Basic and Applied Studies of Spontaneous Expression using the Facial Action Coding System (FACS)","author":"E L Rosenberg","year":"2020","unstructured":"E. L. Rosenberg, P. Ekman. What the Face Reveals: Basic and Applied Studies of Spontaneous Expression using the Facial Action Coding System (FACS), 3rd ed., Oxford, UK: Oxford University Press, 2020.","edition":"3rd ed."},{"issue":"11","key":"1417_CR8","doi-asserted-by":"publisher","first-page":"3265","DOI":"10.1109\/TCYB.2018.2868194","volume":"48","author":"S F Wang","year":"2018","unstructured":"S. F. Wang, G. Z. Peng, S. Y. Chen, Q. Ji. Weakly supervised facial action unit recognition with domain knowledge. IEEE Transactions on Cybernetics, vol. 48, no. 11, pp. 3265\u20133276, 2018. DOI: https:\/\/doi.org\/10.1109\/TCYB.2018.2868194.","journal-title":"IEEE Transactions on Cybernetics"},{"key":"1417_CR9","doi-asserted-by":"publisher","first-page":"299","DOI":"10.1007\/978-3-642-01793-3_31","volume-title":"Why is facial occlusion a challenging problem?","author":"H K Ekenel","year":"2009","unstructured":"H. K. Ekenel, R. Stiefelhagen. Why is facial occlusion a challenging problem? In Proceedings of the 3rd International Conference on Biometrics, Springer, Alghero, Italy, pp. 299\u2013308, 2009. DOI: https:\/\/doi.org\/10.1007\/978-3-642-01793-3_31."},{"issue":"8","key":"1417_CR10","doi-asserted-by":"publisher","first-page":"1499","DOI":"10.1109\/TCYB.2014.2354351","volume":"45","author":"L Zhong","year":"2015","unstructured":"L. Zhong, Q. S. Liu, P. Yang, J. Z. Huang, D. N. Metaxas. Learning multiscale active facial patches for expression analysis. IEEE Transactions on Cybernetics, vol. 45, no. 8, pp. 1499\u20131510, 2015. DOI: https:\/\/doi.org\/10.1109\/TCYB.2014.2354351.","journal-title":"IEEE Transactions on Cybernetics"},{"key":"1417_CR11","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-01418-6_9","volume-title":"Multi-region ensemble convolutional neural network for facial expression recognition","author":"Y R Fan","year":"2018","unstructured":"Y. R. Fan, J. C. K. Lam, V. O. K. Li. Multi-region ensemble convolutional neural network for facial expression recognition. In Proceedings of the 27th International Conference on Artificial Neural Networks, Springer, Rhodes, Greece, pp.84\u201394, 2018. DOI: https:\/\/doi.org\/10.1007\/978-3-030-01418-6_9."},{"issue":"5","key":"1417_CR12","doi-asserted-by":"publisher","first-page":"2439","DOI":"10.1109\/TIP.2018.2886767","volume":"28","author":"Y Li","year":"2019","unstructured":"Y. Li, J. B. Zeng, S. G. Shan, X. L. Chen. Occlusion aware facial expression recognition using CNN with attention mechanism. IEEE Transactions on Image Processing, vol. 28, no. 5, pp. 2439\u20132450, 2019. DOI: https:\/\/doi.org\/10.1109\/TIP.2018.2886767.","journal-title":"IEEE Transactions on Image Processing"},{"issue":"1","key":"1417_CR13","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1109\/TAFFC.2014.2386334","volume":"6","author":"S L Happy","year":"2015","unstructured":"S. L. Happy A. Routray. Automatic facial expression recognition using features of salient facial patches. IEEE Transactions on Affective Computing, vol. 6, no. 1, pp. 1\u201312, 2015. DOI: https:\/\/doi.org\/10.1109\/TAFFC.2014.2386334.","journal-title":"IEEE Transactions on Affective Computing"},{"key":"1417_CR14","doi-asserted-by":"publisher","first-page":"4057","DOI":"10.1109\/TIP.2019.2956143","volume":"29","author":"K Wang","year":"2020","unstructured":"K. Wang, X. J. Peng, J. F. Yang, D. B. Meng, Y. Qiao. Region attention networks for pose and occlusion robust facial expression recognition. IEEE Transactions on Image Processing, vol. 29, pp. 4057\u20134069, 2020. DOI: https:\/\/doi.org\/10.1109\/TIP.2019.2956143.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1417_CR15","doi-asserted-by":"publisher","unstructured":"M. Y. Liu, S. G. Shan, R. P. Wang, X. L. Chen. Learning expressionlets on spatio-temporal manifold for dynamic facial expression recognition. In Proceedings of IEEE Conference on Computer Vision and Pattern Recognition, Columbus, USA, pp. 1749\u20131756, 2014. DOI: https:\/\/doi.org\/10.1109\/CVPR2014.226","DOI":"10.1109\/CVPR2014.226"},{"issue":"6","key":"1417_CR16","doi-asserted-by":"publisher","first-page":"803","DOI":"10.1016\/j.imavis.2008.08.005","volume":"27","author":"C F Shan","year":"2009","unstructured":"C. F. Shan, S. G. Gong, P. W. McOwan. Facial expression recognition based on local binary patterns: A comprehensive study. Image and Vision Computing, vol. 27, no. 6, pp. 803\u2013816, 2009. DOI: https:\/\/doi.org\/10.1016\/j.imavis.2008.08.005.","journal-title":"Image and Vision Computing"},{"issue":"1","key":"1417_CR17","doi-asserted-by":"publisher","first-page":"172","DOI":"10.1109\/TIP.2006.884954","volume":"16","author":"I Kotsia","year":"2007","unstructured":"I. Kotsia, I. Pitas. Facial expression recognition in image sequences using geometric deformation features and support vector machines. IEEE Transactions on Image Processing, vol. 16, no. 1, pp. 172\u2013187, 2007. DOI: https:\/\/doi.org\/10.1109\/TIP.2006.884954.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1417_CR18","doi-asserted-by":"publisher","unstructured":"P. Lucey, J. F. Cohn, T. Kanade, J. Saragih, Z. Ambadar, I. Matthews. The extended cohn-kanade dataset (CK+): A complete dataset for action unit and emotion-specified expression. In Proceedings of IEEE Computer Society Conference on Computer Vision and Pattern Recognition-Workshops, San Francisco, USA, pp. 94\u2013101, 2010. DOI: https:\/\/doi.org\/10.1109\/CVPRW.2010.5543262.","DOI":"10.1109\/CVPRW.2010.5543262"},{"key":"1417_CR19","doi-asserted-by":"publisher","unstructured":"M. Pantic, M. Valstar, R. Rademaker, L. Maat. Web-based database for facial expression analysis. In Proceedings of IEEE International Conference on Multimedia and Expo, Amsterdam, The Netherlands, pp.317\u2013321, 2005. DOI: https:\/\/doi.org\/10.1109\/ICME.2005.1521424.","DOI":"10.1109\/ICME.2005.1521424"},{"key":"1417_CR20","doi-asserted-by":"publisher","unstructured":"M. Lyons, S. Akamatsu, M. Kamachi, J. Gyoba. Coding facial expressions with gabor wavelets. In Proceedings of the 3rd IEEE International Conference on Automatic Face and Gesture Recognition, Nara, Japan, pp. 200\u2013205, 1998. DOI: https:\/\/doi.org\/10.1109\/AFGR.1998.670949.","DOI":"10.1109\/AFGR.1998.670949"},{"issue":"9","key":"1417_CR21","doi-asserted-by":"publisher","first-page":"607","DOI":"10.1016\/j.imavis.2011.07.002","volume":"29","author":"G Y Zhao","year":"2011","unstructured":"G. Y. Zhao, X. H. Huang, M. Taini, S. Z. Li, M. Pietik\u00e4inen. Facial expression recognition from near-in-frared videos. Image and Vision Computing, vol. 29, no. 9, pp. 607\u2013619, 2011. DOI: https:\/\/doi.org\/10.1016\/j.imavis.2011.07.002.","journal-title":"Image and Vision Computing"},{"issue":"3","key":"1417_CR22","doi-asserted-by":"publisher","first-page":"1195","DOI":"10.1109\/TAFFC.2020.2981446","volume":"13","author":"S Li","year":"2022","unstructured":"S. Li, W. H. Deng. Deep facial expression recognition: A survey. IEEE Transactions on Affective Computing, vol. 13, no. 3, pp. 1195\u20131215, 2022. DOI: https:\/\/doi.org\/10.1109\/TAFFC.2020.2981446.","journal-title":"IEEE Transactions on Affective Computing"},{"key":"1417_CR23","doi-asserted-by":"publisher","unstructured":"S. Li, W. H. Deng, J. P. Du. Reliable crowdsourcing and deep locality-preserving learning for expression recognition in the wild. In Proceedings of IEEE Conference on Computer Vision and Pattern Recognition, Honolulu, USA, pp. 2584\u20132593, 2017. DOI: https:\/\/doi.org\/10.1109\/CVPR.2017.277.","DOI":"10.1109\/CVPR.2017.277"},{"issue":"1","key":"1417_CR24","doi-asserted-by":"publisher","first-page":"18","DOI":"10.1109\/TAFFC.2017.2740923","volume":"10","author":"A Mollahosseini","year":"2019","unstructured":"A. Mollahosseini, B. Hasani, M. H. Mahoor. Affectnet: A database for facial expression, valence, and arousal computing in the wild. IEEE Transactions on Affective Computing, vol. 10, no. 1, pp. 18\u201331, 2019. DOI: https:\/\/doi.org\/10.1109\/TAFFC.2017.2740923.","journal-title":"IEEE Transactions on Affective Computing"},{"key":"1417_CR25","doi-asserted-by":"publisher","unstructured":"C. F. Benitez-Quiroz, R. Srinivasan, A. M. Martinez. EmotioNet: An accurate, real-time algorithm for the automatic annotation of a million facial expressions in the wild. In Proceedings of IEEE Conference on Computer Vision and Pattern Recognition, Las Vegas, USA, pp. 5562\u20135570, 2016. DOI: https:\/\/doi.org\/10.1109\/CVPR.2016.600.","DOI":"10.1109\/CVPR.2016.600"},{"key":"1417_CR26","doi-asserted-by":"publisher","first-page":"529","DOI":"10.1109\/TMM.2021.3128738","volume":"25","author":"L T Mou","year":"2021","unstructured":"L. T. Mou, C. Zhou, P. T. Xie, P. F. Zhao, R. Jain, W. Gao, B. C. Yin. Isotropic self-supervised learning for driver drowsiness detection with attention-based multimodal fusion. IEEE Transactions on Multimedia, vol. 25, pp. 529\u2013542, 2021. DOI: https:\/\/doi.org\/10.1109\/TMM.2021.3128738.","journal-title":"IEEE Transactions on Multimedia"},{"key":"1417_CR27","doi-asserted-by":"publisher","unstructured":"L. T. Mou, C. Zhou, P. F. Zhao, B. Nakisa, M. N. Rastgoo, R. Jain, W. Gao. Driver stress detection via multimodal fusion using attention-based CNN-LSTM. Expert Systems with Applications, vol. 173, Article number 114693, 2021. DOI: https:\/\/doi.org\/10.1016\/j.eswa.2021.114693.","DOI":"10.1016\/j.eswa.2021.114693"},{"issue":"3","key":"1417_CR28","doi-asserted-by":"publisher","first-page":"247","DOI":"10.1007\/s11633-022-1327-2","volume":"19","author":"L Song","year":"2022","unstructured":"L. Song, J. F. Yang, Q. Z. Shang, M. A. Li. Dense face network: A dense face detector based on global context and visual attention mechanism. Machine Intelligence Research, vol. 19, no. 3, pp. 247\u2013256, 2022. DOI: https:\/\/doi.org\/10.1007\/s11633-022-1327-2.","journal-title":"Machine Intelligence Research"},{"key":"1417_CR29","unstructured":"K. Simonyan, A. Zisserman. Very deep convolutional networks for large-scale image recognition. [Online], Available: https:\/\/arxiv.org\/abs\/1409.1556, 2014."},{"key":"1417_CR30","doi-asserted-by":"publisher","unstructured":"C. Szegedy, W. Liu, Y. Q. Jia, P. Sermanet, S. Reed, D. Anguelov, D. Erhan, V. Vanhoucke, A. Rabinovich. Going deeper with convolutions. In Proceedings of IEEE Conference on Computer Vision and Pattern Recognition, Boston, USA, pp. 1\u20139, 2015. DOI: https:\/\/doi.org\/10.1109\/CVPR.2015.7298594.","DOI":"10.1109\/CVPR.2015.7298594"},{"key":"1417_CR31","doi-asserted-by":"publisher","unstructured":"K. M. He, X. Y. Zhang, S. Q. Ren, J. Sun. Deep residual learning for image recognition. In Proceedings of IEEE Conference on Computer Vision and Pattern Recognition, Las Vegas, USA, pp. 770\u2013778, 2016. DOI: https:\/\/doi.org\/10.1109\/CVPR.2016.90.","DOI":"10.1109\/CVPR.2016.90"},{"key":"1417_CR32","doi-asserted-by":"publisher","unstructured":"P. Hu, D. Q. Cai, S. D. Wang, A. B. Yao, Y. R. Chen. Learning supervised scoring ensemble for emotion recognition in the wild. In Proceedings of the 19th ACM International Conference on Multimodal Interaction, Glasgow, UK, pp. 553\u2013560, 2017. DOI: https:\/\/doi.org\/10.1145\/3136755.3143009.","DOI":"10.1145\/3136755.3143009"},{"key":"1417_CR33","doi-asserted-by":"publisher","first-page":"480","DOI":"10.1109\/CVPRW.2018.00077","volume-title":"Covariance pooling for facial expression recognition","author":"D Acharya","year":"2018","unstructured":"D. Acharya, Z. W. Huang, D. P. Paudel, L. van Gool. Covariance pooling for facial expression recognition. In Proceedings of IEEE\/CVF Conference on Computer Vision and Pattern Recognition Workshops, IEEE, Salt Lake City, USA, pp. 480\u20134807, 2018. DOI: https:\/\/doi.org\/10.1109\/CVPRW.2018.00077."},{"issue":"6\u20137","key":"1417_CR34","doi-asserted-by":"publisher","first-page":"884","DOI":"10.1007\/s11263-018-1131-1","volume":"127","author":"S Li","year":"2019","unstructured":"S. Li, W. H. Deng. Blended emotion in-the-wild: Multi-label facial expression recognition using crowdsourced annotations and deep locality feature learning. International Journal of Computer Vision, vol. 127, no. 6\u20137, pp. 884\u2013906, 2019. DOI: https:\/\/doi.org\/10.1007\/s11263-018-1131-1.","journal-title":"International Journal of Computer Vision"},{"key":"1417_CR35","doi-asserted-by":"publisher","first-page":"556","DOI":"10.1109\/ACII.2017.8273654","volume-title":"CNN based 3D facial expression recognition using masking and landmark features","author":"H Y Yang","year":"2017","unstructured":"H. Y. Yang, L. J. Yin. CNN based 3D facial expression recognition using masking and landmark features. In Proceedings of the 7th International Conference on Affective Computing and Intelligent Interaction, IEEE, San Antonio, USA, pp. 556\u2013560, 2017. DOI: https:\/\/doi.org\/10.1109\/ACII.2017.8273654."},{"key":"1417_CR36","doi-asserted-by":"publisher","first-page":"1524","DOI":"10.1109\/ICPR.2018.8545725","volume-title":"Facial expression recognition for different pose faces based on special landmark detection","author":"W Q Wu","year":"2018","unstructured":"W. Q. Wu, Y. J. Yin, Y. Y. Wang, X. G. Wang, D. Xu. Facial expression recognition for different pose faces based on special landmark detection. In Proceedings of the 24th International Conference on Pattern Recognition, IEEE, Beijing, China, pp. 1524\u20131529, 2018. DOI: https:\/\/doi.org\/10.1109\/ICPR.2018.8545725."},{"key":"1417_CR37","doi-asserted-by":"publisher","first-page":"227","DOI":"10.1007\/978-3-030-01261-8_14","volume-title":"Facial expression recognition with inconsistently annotated datasets","author":"J B Zeng","year":"2018","unstructured":"J. B. Zeng, S. G. Shan, X. L. Chen. Facial expression recognition with inconsistently annotated datasets. In Proceedings of the 15th European Conference on Computer Vision, Springer, Munich, Germany, pp. 227\u2013243, 2018. DOI: https:\/\/doi.org\/10.1007\/978-3-030-01261-8_14."},{"key":"1417_CR38","doi-asserted-by":"publisher","first-page":"105","DOI":"10.1016\/j.patrec.2019.04.002","volume":"125","author":"Y L Gan","year":"2019","unstructured":"Y. L. Gan, J. Y. Chen, L. H. Xu. Facial expression recognition boosted by soft label with a diverse ensemble. Pattern Recognition Letters, vol. 125, pp. 105\u2013112, 2019. DOI: https:\/\/doi.org\/10.1016\/j.patrec.2019.04.002.","journal-title":"Pattern Recognition Letters"},{"key":"1417_CR39","doi-asserted-by":"publisher","first-page":"2168","DOI":"10.1109\/CVPR.2018.00231","volume-title":"Facial expression recognition by de-expression residue learning","author":"H Y Yang","year":"2018","unstructured":"H. Y. Yang, U. Ciftci, L. J. Yin. Facial expression recognition by de-expression residue learning. In Proceedings of IEEE\/CVF Conference on Computer Vision and Pattern Recognition, IEEE, Salt Lake City, USA, pp. 2168\u20132177, 2018. DOI: https:\/\/doi.org\/10.1109\/CVPR.2018.00231."},{"key":"1417_CR40","doi-asserted-by":"publisher","first-page":"3359","DOI":"10.1109\/CVPR.2018.00354","volume-title":"Joint pose and expression modeling for facial expression recognition","author":"F F Zhang","year":"2018","unstructured":"F. F. Zhang, T. Z. Zhang, Q. R. Mao, C. S. Xu. Joint pose and expression modeling for facial expression recognition. In Proceedings of IEEE\/CVF Conference on Computer Vision and Pattern Recognition, IEEE, Salt Lake City, USA, pp. 3359\u20133368, 2018. DOI: https:\/\/doi.org\/10.1109\/CVPR.2018.00354."},{"key":"1417_CR41","doi-asserted-by":"publisher","unstructured":"S. C. Zhao, C. Lin, P. F. Xu, S. D. Zhao, Y. C. Guo, R. Krishna, G. G. Ding, K. Keutzer. CycleemotionGAN: Emotional semantic consistency preserved cycleGAN for adapting image emotions. In Proceedings of the 33rd AAAI Conference on Artificial Intelligence, Honolulu, USA, pp. 2620\u20132627, 2019. DOI: https:\/\/doi.org\/10.1609\/aaai.v33i01.33012620.","DOI":"10.1609\/aaai.v33i01.33012620"},{"key":"1417_CR42","doi-asserted-by":"publisher","unstructured":"L. J. Fan, W. B. Huang, C. Gan, J. Z. Huang, B. Q. Gong. Controllable image-to-video translation: A case study on facial expression generation. In Proceedings of the 33rd AAAI Conference on Artificial Intelligence, Honolulu, USA, pp. 3510\u20133517, 2019. DOI: https:\/\/doi.org\/10.1609\/aaai.v33i01.33013510.","DOI":"10.1609\/aaai.v33i01.33013510"},{"key":"1417_CR43","doi-asserted-by":"publisher","first-page":"5020","DOI":"10.1109\/CVPR42600.2020.00507","volume-title":"Cascade EFGAN: Progressive facial expression editing with local focuses","author":"R L Wu","year":"2020","unstructured":"R. L. Wu, G. J. Zhang, S. J. Lu, T. Chen. Cascade EFGAN: Progressive facial expression editing with local focuses. In Proceedings of IEEE\/CVF Conference on Computer Vision and Pattern Recognition, IEEE, Seattle, USA, pp. 5020\u20135029, 2020. DOI: https:\/\/doi.org\/10.1109\/CVPR42600.2020.00507."},{"key":"1417_CR44","doi-asserted-by":"publisher","first-page":"835","DOI":"10.1007\/978-3-030-01249-6_50","volume-title":"GANimation: Anatomically-aware facial animation from a single image","author":"A Pumarola","year":"2018","unstructured":"A. Pumarola, A. Agudo, A. M. Martinez, A. Sanfeliu, F. Moreno-Noguer. GANimation: Anatomically-aware facial animation from a single image. In Proceedings of the 15th European Conference on Computer Vision, Springer, Munich, Germany, pp. 835\u2013851, 2018. DOI: https:\/\/doi.org\/10.1007\/978-3-030-01249-6_50."},{"key":"1417_CR45","doi-asserted-by":"publisher","first-page":"8789","DOI":"10.1109\/CVPR.2018.00916","volume-title":"StarGAN: Unified generative adversarial networks for multi-domain image-to-image translation","author":"Y Choi","year":"2018","unstructured":"Y. Choi, M. Choi, M. Kim, J. W. Ha, S. Kim, J. Choo. StarGAN: Unified generative adversarial networks for multi-domain image-to-image translation. In Proceedings of IEEE\/CVF Conference on Computer Vision and Pattern Recognition, IEEE, Salt Lake City, USA, pp. 8789\u20138797, 2018. DOI: https:\/\/doi.org\/10.1109\/CVPR.2018.00916."},{"key":"1417_CR46","doi-asserted-by":"publisher","first-page":"104","DOI":"10.1016\/j.neucom.2017.01.096","volume":"253","author":"P Barros","year":"2017","unstructured":"P. Barros, G. I. Parisi, C. Weber, S. Wermter. Emotion-modulated attention improves expression recognition: A deep learning model. Neurocomputing, vol. 253, pp. 104\u2013114, 2017. DOI: https:\/\/doi.org\/10.1016\/j.neucom.2017.01.096.","journal-title":"Emotion-modulated attention improves expression recognition: A deep learning model"},{"key":"1417_CR47","doi-asserted-by":"publisher","first-page":"217","DOI":"10.1016\/j.jvcir.2019.05.009","volume":"62","author":"X H Wang","year":"2019","unstructured":"X. H. Wang, M. Z. Peng, L. J. Pan, M. Hu, C. H. Jin, F. J. Ren. Two-level attention with two-stage multi-task learning for facial emotion recognition. Journal of Visual Communication and Image Representation, vol. 62, pp. 217\u2013225, 2019. DOI: https:\/\/doi.org\/10.1016\/j.jvcir.2019.05.009.","journal-title":"Journal of Visual Communication and Image Representation"},{"key":"1417_CR48","doi-asserted-by":"publisher","first-page":"234","DOI":"10.1007\/978-3-319-24574-4_28","volume-title":"U-Net: Convolutional networks for biomedical image segmentation","author":"O Ronneberger","year":"2015","unstructured":"O. Ronneberger, P. Fischer, T. Brox. U-Net: Convolutional networks for biomedical image segmentation. In Proceedings of the 18th International Conference on Medical Image Computing and Computer-assisted Intervention, Springer, Munich, Germany, pp. 234\u2013241, 2015. DOI: https:\/\/doi.org\/10.1007\/978-3-319-24574-4_28."},{"issue":"1","key":"1417_CR49","doi-asserted-by":"publisher","first-page":"67","DOI":"10.1038\/s41592-018-0261-2","volume":"16","author":"T Falk","year":"2019","unstructured":"T. Falk, D. Mai, R. Bensch, \u00d6. \u00c7i\u00e7ek, A. Abdulkadir, Y. Marrakchi, A. B\u00f6hm, J. Deubner, Z. J\u00e4ckel, K. Seiwald, A. Dovzhenko, O. Tietz, C. Dal Bosco, S. Walsh, D. Saltukoglu, T. L. Tay, M. Prinz, K. Palme, M. Simons, I. Diester, T. Brox, O. Ronneberger. U-Net: Deep learning for cell counting, detection, and morphometry. Nature Methods, vol. 16, no. 1, pp. 67\u201370, 2019. DOI: https:\/\/doi.org\/10.1038\/s41592-018-0261-2.","journal-title":"Nature Methods"},{"issue":"5","key":"1417_CR50","doi-asserted-by":"publisher","first-page":"749","DOI":"10.1109\/LGRS.2018.2802944","volume":"15","author":"Z X Zhang","year":"2018","unstructured":"Z. X. Zhang, Q. J. Liu, Y. H. Wang. Road extraction by deep residual U-Net. IEEE Geoscience and Remote Sensing Letters, vol. 15, no. 5, pp. 749\u2013753, 2018. DOI: https:\/\/doi.org\/10.1109\/LGRS.2018.2802944.","journal-title":"IEEE Geoscience and Remote Sensing Letters"},{"key":"1417_CR51","doi-asserted-by":"publisher","unstructured":"T. Y. Lin, P. Doll\u00e1r, R. Girshick, K. M. He, B. Hariharan, S. Belongie. Feature pyramid networks for object detection. In Proceedings of IEEE Conference on Computer Vision and Pattern Recognition, Honolulu, USA, pp. 936\u2013944, 2017. DOI: https:\/\/doi.org\/10.1109\/CVPR.2017.106.","DOI":"10.1109\/CVPR.2017.106"},{"key":"1417_CR52","doi-asserted-by":"publisher","unstructured":"J. Long, E. Shelhamer, T. Darrell. Fully convolutional networks for semantic segmentation. In Proceedings of IEEE Conference on Computer Vision and Pattern Recognition, Boston, USA, pp. 3431\u20133440, 2015. DOI: https:\/\/doi.org\/10.1109\/CVPR.2015.7298965.","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"1417_CR53","doi-asserted-by":"publisher","unstructured":"A. Vaswani, N. Shazeer, N. Parmar, J. Uszkoreit, L. Jones, A. N. Gomez, \u0141. Kaiser, I. Polosukhin. Attention is all you need. In Proceedings of the 31st International Conference on Neural Information Processing Systems, Long Beach, USA, pp. 6000\u20136010, 2017. DOI: https:\/\/doi.org\/10.5555\/3295222.3295349.","DOI":"10.5555\/3295222.3295349"},{"key":"1417_CR54","doi-asserted-by":"publisher","first-page":"7794","DOI":"10.1109\/CVPR.2018.00813","volume-title":"Non-local neural networks","author":"X L Wang","year":"2018","unstructured":"X. L. Wang, R. Girshick, A. Gupta, K. M. He. Non-local neural networks. In Proceedings of IEEE\/CVF Conference on Computer Vision and Pattern Recognition, IEEE, Salt Lake City, USA, pp. 7794\u20137803, 2018. DOI: https:\/\/doi.org\/10.1109\/CVPR.2018.00813."},{"key":"1417_CR55","doi-asserted-by":"publisher","unstructured":"H. S. Zhao, J. P. Shi, X. J. Qi, X. G. Wang, J. Y. Jia. Pyramid scene parsing network. In Proceed-ings of IEEE Conference on Computer Vision and Pattern Recognition, Honolulu, USA, pp. 6230\u20136239, 2017. DOI: https:\/\/doi.org\/10.1109\/CVPR.2017.660.","DOI":"10.1109\/CVPR.2017.660"},{"key":"1417_CR56","doi-asserted-by":"publisher","unstructured":"A. Dhall, R. Goecke, S. Lucey, T. Gedeon. Static facial expression analysis in tough conditions: Data, evaluation protocol and benchmark. In Proceedings of IEEE International Conference on Computer Vision Workshops, Barcelona, Spain, pp. 2106\u20132112, 2011. DOI: https:\/\/doi.org\/10.1109\/ICCVW.2011.6130508.","DOI":"10.1109\/ICCVW.2011.6130508"},{"key":"1417_CR57","unstructured":"J. Goldberger, E. Ben-Reuven. Training deep neural-networks using a noise adaptation layer. In Proceedings of the 5th International Conference on Learning Representations, Toulon, France, 2017."},{"key":"1417_CR58","doi-asserted-by":"publisher","first-page":"499","DOI":"10.1007\/978-3-319-46478-7_31","volume-title":"A discriminative feature learning approach for deep face recognition","author":"Y D Wen","year":"2016","unstructured":"Y. D. Wen, K. P. Zhang, Z. F. Li, Y. Qiao. A discriminative feature learning approach for deep face recognition. In Proceedings of the 14th European Conference on Computer Vision, Springer, Amsterdam, The Netherlands, pp. 499\u2013515, 2016. DOI: https:\/\/doi.org\/10.1007\/978-3-319-46478-7_31."},{"key":"1417_CR59","doi-asserted-by":"publisher","first-page":"13981","DOI":"10.1109\/CVPR42600.2020.01400","volume-title":"Label distribution learning on auxiliary label space graphs for facial expression recognition","author":"S K Chen","year":"2020","unstructured":"S. K. Chen, J. F. Wang, Y. D. Chen, Z. C. Shi, X. Geng, Y. Rui. Label distribution learning on auxiliary label space graphs for facial expression recognition. In Proceedings of IEEE\/CVF Conference on Computer Vision and Pattern Recognition, IEEE, Seattle, USA, pp. 13981\u201313990, 2020. DOI: https:\/\/doi.org\/10.1109\/CVPR42600.2020.01400."},{"key":"1417_CR60","doi-asserted-by":"publisher","first-page":"26756","DOI":"10.1109\/ACCESS.2022.3156598","volume":"10","author":"A P Fard","year":"2022","unstructured":"A. P. Fard, M. H. Mahoor. Ad-corre: Adaptive correlation-based loss for facial expression recognition in the wild. IEEE Access, vol. 10, pp. 26756\u201326768, 2022. DOI: https:\/\/doi.org\/10.1109\/ACCESS.2022.3156598.","journal-title":"IEEE Access"}],"container-title":["Machine Intelligence Research"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11633-023-1417-9.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11633-023-1417-9","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11633-023-1417-9.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,4]],"date-time":"2026-06-04T08:33:04Z","timestamp":1780561984000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11633-023-1417-9"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,1,11]]},"references-count":60,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2024,4]]}},"alternative-id":["1417"],"URL":"https:\/\/doi.org\/10.1007\/s11633-023-1417-9","relation":{},"ISSN":["2731-538X","2731-5398"],"issn-type":[{"value":"2731-538X","type":"print"},{"value":"2731-5398","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,1,11]]},"assertion":[{"value":"30 November 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"18 January 2023","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"11 January 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"The authors declared that they have no conflicts of interest to this work.","order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations of conflict of interest"}}]}}