{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,26]],"date-time":"2026-05-26T11:05:46Z","timestamp":1779793546445,"version":"3.53.1"},"reference-count":66,"publisher":"Springer Science and Business Media LLC","issue":"6","license":[{"start":{"date-parts":[[2026,4,1]],"date-time":"2026-04-01T00:00:00Z","timestamp":1775001600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,4,1]],"date-time":"2026-04-01T00:00:00Z","timestamp":1775001600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"name":"the National Key Laboratory","award":["No. SKLK22-11"],"award-info":[{"award-number":["No. SKLK22-11"]}]},{"name":"the Key Research and Development Projects of Shaanxi Province","award":["No. K20220022"],"award-info":[{"award-number":["No. K20220022"]}]},{"name":"the Special Project for Local Service of Shaanxi Provincial Department of Education","award":["No. 23JC039"],"award-info":[{"award-number":["No. 23JC039"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Appl Intell"],"published-print":{"date-parts":[[2026,4]]},"DOI":"10.1007\/s10489-026-07195-0","type":"journal-article","created":{"date-parts":[[2026,4,9]],"date-time":"2026-04-09T03:38:24Z","timestamp":1775705904000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["DAMT-Former: Dynamic Attention and Multi-scale Temporal Former for Facial Expression Recognition"],"prefix":"10.1007","volume":"56","author":[{"ORCID":"https:\/\/orcid.org\/0009-0006-5459-0220","authenticated-orcid":false,"given":"Daipeng","family":"Guo","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Fei","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,4,9]]},"reference":[{"key":"7195_CR1","doi-asserted-by":"publisher","DOI":"10.1093\/oso\/9780195392289.001.0001","volume-title":"The expression of the emotions in man and animals","author":"C Darwin","year":"2009","unstructured":"Darwin C (2009) The expression of the emotions in man and animals. Cambridge University Press, Cambridge"},{"key":"7195_CR2","doi-asserted-by":"publisher","first-page":"2918","DOI":"10.1007\/s10489-021-02575-0","volume":"52","author":"W Zou","year":"2022","unstructured":"Zou W, Zhang D, Lee D-J (2022) A new multi-feature fusion based convolutional neural network for facial expression recognition. Appl Intell 52:2918\u20132929","journal-title":"Appl Intell"},{"key":"7195_CR3","doi-asserted-by":"crossref","unstructured":"Yang H, Ciftci U, Yin L (2018) Facial expression recognition by De-expression residue learning. IEEE\/CVF Conf Comput Vis Pattern Recognit 2168\u20132177","DOI":"10.1109\/CVPR.2018.00231"},{"key":"7195_CR4","doi-asserted-by":"publisher","first-page":"58","DOI":"10.1007\/s11036-020-01709-x","volume":"27","author":"X Liu","year":"2022","unstructured":"Liu X, Li C, Dai C, Lai J, Chao H-C (2022) Nonnegative tensor factorization based on low-rank subspace for facial expression recognition. Mob Netw Appl 27:58\u201369","journal-title":"Mob Netw Appl"},{"key":"7195_CR5","doi-asserted-by":"publisher","first-page":"6544","DOI":"10.1109\/TIP.2021.3093397","volume":"30","author":"Z Zhao","year":"2021","unstructured":"Zhao Z, Liu Q, Wang S (2021) Learning deep global multi-scale and local attention features for facial expression recognition in the wild. IEEE Trans Image Process 30:6544\u20136556","journal-title":"IEEE Trans Image Process"},{"key":"7195_CR6","doi-asserted-by":"publisher","first-page":"1834","DOI":"10.1109\/TCSVT.2021.3083326","volume":"32","author":"C Wang","year":"2022","unstructured":"Wang C, Xue J, Lu K, Yan Y (2022) Light attention embedding for facial expression recognition. IEEE Trans Circuits Syst Video Technol 32:1834\u20131847","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"7195_CR7","doi-asserted-by":"publisher","first-page":"3178","DOI":"10.1109\/TCSVT.2021.3103760","volume":"32","author":"Y Li","year":"2022","unstructured":"Li Y, Lu Y, Chen B, Zhang Z, Li J, Lu G, Zhang D (2022) Learning informative and discriminative features for facial expression recognition in the wild. IEEE Trans Circuits Syst Video Technol 32:3178\u20133189","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"7195_CR8","doi-asserted-by":"crossref","unstructured":"Li Q, Liu X, Gong X, Jing S (2019) INDReview on facial expression analysis and its application in education. Chinese Automation Congress (CAC), pp. 4526\u20134530","DOI":"10.1109\/CAC48633.2019.8996796"},{"key":"7195_CR9","doi-asserted-by":"publisher","DOI":"10.1016\/j.cmpb.2023.107480","volume":"233","author":"C-W Huang","year":"2023","unstructured":"Huang C-W, Wu BCY, Nguyen PA, Wang H-H, Kao C-C, Lee P-C, Rahmanti AR, Hsu JC, Yang H-C, Li Y-C (2023) Emotion recognition in doctor-patient interactions from real-world clinical video database: initial development of artificial empathy. Comput Methods Programs Biomed 233:107480","journal-title":"Comput Methods Programs Biomed"},{"key":"7195_CR10","doi-asserted-by":"publisher","DOI":"10.3390\/s18124270","author":"M Jeong","year":"2018","unstructured":"Jeong M, Ko BC (2018) Driver\u2019s facial expression recognition in real-time for safe driving. Sensors. 2018;18(12):4270. https:\/\/doi.org\/10.3390\/s18124270","journal-title":"Sensors"},{"key":"7195_CR11","doi-asserted-by":"crossref","unstructured":"Lucey P, Cohn JF, Kanade T, Saragih J, Ambadar Z, Matthews I (2010) The Extended Cohn-Kanade Dataset (CK+): A complete dataset for action unit and emotion-specified expression. IEEE Comput Soc Conf Comput Vis Pattern Recognit - Workshops, pp. 94\u2013101","DOI":"10.1109\/CVPRW.2010.5543262"},{"key":"7195_CR12","doi-asserted-by":"crossref","unstructured":"Lyons M, Akamatsu S, Kamachi M, Gyoba J (1998) Coding facial expressions with Gabor wavelets.\u00a0Proc Third IEEE Int Conf Autom Face Gesture Recognit\u00a0200\u2013205","DOI":"10.1109\/AFGR.1998.670949"},{"key":"7195_CR13","unstructured":"Pantic M, Valstar M, Rademaker R, Maat L Web-based database for facial expression analysis.\u00a0IEEE Int Conf Multimedia Expo, p. 5 pp"},{"key":"7195_CR14","doi-asserted-by":"crossref","unstructured":"Zhang YH, Huang R, Zeng J, Shan S M3F: Multi-modal continuous valence-arousal estimation in the wild. 15th IEEE Int Conf Autom Face Gesture Recognit (FG 2020), pp. 632\u2013636","DOI":"10.1109\/FG47880.2020.00098"},{"key":"7195_CR15","doi-asserted-by":"crossref","unstructured":"Jiang X, Zong Y, Zheng W, Tang C, Xia W, Lu C, Liu J (2020) DFEW: A large-scale database for recognizing dynamic facial expressions in the wild. Proceedings of the 28th ACM International Conference on Multimedia, Association for Computing Machinery, Seattle, WA, USA, pp. 2881\u20132889","DOI":"10.1145\/3394171.3413620"},{"key":"7195_CR16","doi-asserted-by":"crossref","unstructured":"Wang Y, Sun Y, Huang Y, Liu Z, Gao S, Zhang W, Ge W, Zhang W (2022) FERV39k: A large-scale multi-scene dataset for facial expression recognition in videos. IEEE\/CVF Conf Comput Vis Pattern Recognit (CVPR), pp. 20890\u201320899","DOI":"10.1109\/CVPR52688.2022.02025"},{"key":"7195_CR17","doi-asserted-by":"publisher","first-page":"34","DOI":"10.1109\/MMUL.2012.26","volume":"19","author":"A Dhall","year":"2012","unstructured":"Dhall A, Goecke R, Lucey S, Gedeon T (2012) Collecting large, richly annotated facial-expression databases from movies. IEEE MultiMedia 19:34\u201341","journal-title":"IEEE MultiMedia"},{"key":"7195_CR18","doi-asserted-by":"crossref","unstructured":"Lee J, Kim S, Kim S, Park J, Sohn K (2019) Context-aware emotion recognition networks.\u00a0IEEE\/CVF Int Conf Comput Vis (ICCV), pp. 10142\u201310151","DOI":"10.1109\/ICCV.2019.01024"},{"key":"7195_CR19","doi-asserted-by":"crossref","unstructured":"Dhall A, Goecke R, Joshi J, Wagner M, Gedeon T (2013) Emotion recognition in the wild challenge. Proceedings of the 15th ACM on International conference on multimodal interaction, Association for Computing Machinery, Sydney, Australia, pp. 509\u2013516","DOI":"10.1145\/2522848.2531739"},{"key":"7195_CR20","doi-asserted-by":"crossref","unstructured":"Sikka K, Dykstra K, Sathyanarayana S, Littlewort G, Bartlett M (2013) Multiple kernel learning for emotion recognition in the wild. Proceedings of the 15th ACM on International conference on multimodal interaction, Association for Computing Machinery, Sydney, Australia, pp. 517\u2013524","DOI":"10.1145\/2522848.2531741"},{"key":"7195_CR21","doi-asserted-by":"crossref","unstructured":"Meng D, Peng X, Wang K, Qiao Y Frame attention networks for facial expression recognition in videos. IEEE Int Conf Image Process (ICIP), pp. 3866\u20133870","DOI":"10.1109\/ICIP.2019.8803603"},{"key":"7195_CR22","doi-asserted-by":"crossref","unstructured":"Lu C, Zheng W, Li C, Tang C, Liu S, Yan S, Zong Y (2018) Multiple Spatio-temporal feature learning for video-based emotion recognition in the wild. Proceedings of the 20th ACM International Conference on Multimodal Interaction, Association for Computing Machinery, Boulder, CO, USA, pp. 646\u2013652","DOI":"10.1145\/3242969.3264992"},{"key":"7195_CR23","doi-asserted-by":"crossref","unstructured":"Fan Y, Lu X, Li D, Liu Y (2016) Video-based emotion recognition using CNN-RNN and C3D hybrid networks. Proceedings of the 18th ACM International Conference on Multimodal Interaction, Association for Computing Machinery, Tokyo, Japan, pp. 445\u2013450","DOI":"10.1145\/2993148.2997632"},{"key":"7195_CR24","doi-asserted-by":"crossref","unstructured":"Zhao Z, Liu Q (2021) Former-DFER: Dynamic facial expression recognition transformer.\u00a0Proceedings of the 29th ACM International Conference on Multimedia, Association for Computing Machinery, Virtual Event, China, pp. 1553\u20131561","DOI":"10.1145\/3474085.3475292"},{"key":"7195_CR25","doi-asserted-by":"crossref","unstructured":"Lee B, Shin H, Ku B, Ko H (2023) Frame level emotion guided dynamic facial expression recognition with emotion grouping.\u00a0IEEE\/CVF Conf Comput Vis Pattern Recognit Workshops (CVPRW), pp. 5681\u20135691","DOI":"10.1109\/CVPRW59228.2023.00602"},{"key":"7195_CR26","doi-asserted-by":"crossref","unstructured":"Wang Y, Sun Y, Song W, Gao S, Huang Y, Chen Z, Ge W, Zhang W (2022) DPCNet: Dual path multi-excitation collaborative network for facial expression representation learning in videos.\u00a0Proceedings of the 30th ACM International Conference on Multimedia, Association for Computing Machinery, Lisboa, Portugal, pp. 101\u2013110","DOI":"10.1145\/3503161.3547865"},{"key":"7195_CR27","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2023.109368","volume":"138","author":"Y Liu","year":"2023","unstructured":"Liu Y, Wang W, Feng C, Zhang H, Chen Z, Zhan Y (2023) Expression snippet transformer for robust video-based facial expression recognition. Pattern Recognit 138:109368","journal-title":"Pattern Recognit"},{"key":"7195_CR28","doi-asserted-by":"publisher","first-page":"30219","DOI":"10.1007\/s10489-023-05052-y","volume":"53","author":"Nidhi","year":"2023","unstructured":"Nidhi, Verma B (2023) From methods to datasets: a detailed study on facial emotion recognition. Appl Intell 53:30219\u201330249","journal-title":"Appl Intell"},{"key":"7195_CR29","doi-asserted-by":"publisher","first-page":"283","DOI":"10.1038\/s44159-023-00172-1","volume":"2","author":"EG Krumhuber","year":"2023","unstructured":"Krumhuber EG, Skora LI, Hill HCH, Lander K (2023) The role of facial movements in emotion recognition. Nat Rev Psychol 2:283\u2013296","journal-title":"Nat Rev Psychol"},{"key":"7195_CR30","doi-asserted-by":"crossref","unstructured":"Wang Y, Wu J, Hoashi K (2019) Multi-attention fusion network for video-based emotion recognition.\u00a0International Conference on Multimodal Interaction, Association for Computing Machinery, Suzhou, China, 2019, pp. 595\u2013601","DOI":"10.1145\/3340555.3355720"},{"key":"7195_CR31","doi-asserted-by":"publisher","first-page":"839","DOI":"10.1109\/TCYB.2017.2788081","volume":"49","author":"T Zhang","year":"2019","unstructured":"Zhang T, Zheng W, Cui Z, Zong Y, Li Y (2019) Spatial\u2013temporal recurrent neural network for emotion recognition. IEEE Trans Cybern 49:839\u2013847","journal-title":"IEEE Trans Cybern"},{"key":"7195_CR32","doi-asserted-by":"crossref","unstructured":"Hara K, Kataoka H, Satoh Y (2018) Can Spatiotemporal 3D CNNs Retrace the History of 2D CNNs and ImageNet?. IEEE\/CVF Conf Comput Vis Pattern Recognit\u00a06546\u20136555","DOI":"10.1109\/CVPR.2018.00685"},{"key":"7195_CR33","doi-asserted-by":"crossref","unstructured":"Kossaifi J, Toisoul A, Bulat A, Panagakis Y, Hospedales TM, Pantic M (2020) Factorized higher-order CNNs with an application to spatio-temporal emotion estimation. IEEE\/CVF Conf Comput Vis Pattern Recognit (CVPR), pp. 6059\u20136068","DOI":"10.1109\/CVPR42600.2020.00610"},{"key":"7195_CR34","unstructured":"Vaswani A, Shazeer N, Parmar N, Uszkoreit J, Jones L, Gomez AN, Kaiser \u0141, Polosukhin I (2017) Attention is all you need. Proceedings of the 31st International Conference on Neural Information Processing Systems, Curran Associates Inc., Long Beach, California, USA, pp. 6000\u20136010"},{"key":"7195_CR35","unstructured":"Li H, Sui M, Zhu Z, Zhao F (2022) NR-DFERNet: Noise-Robust Network for Dynamic Facial Expression Recognition, CoRR abs\/2206.04975"},{"key":"7195_CR36","doi-asserted-by":"crossref","unstructured":"Ma F, Sun B, Li S (2023) Logo-Former: Local-Global Spatio-Temporal Transformer for Dynamic Facial Expression Recognition. ICASSP 2023\u20132023 IEEE Int Conf Acoust, Speech Signal Process (ICASSP) pp. 1\u20135","DOI":"10.1109\/ICASSP49357.2023.10095448"},{"key":"7195_CR37","doi-asserted-by":"crossref","unstructured":"Li H, Niu H, Zhu Z, Zhao F (2023) Intensity-aware loss for dynamic facial expression recognition in the wild. Proceedings of the Thirty-Seventh AAAI Conference on Artificial Intelligence and Thirty-Fifth Conference on Innovative Applications of Artificial Intelligence and Thirteenth Symposium on Educational Advances in Artificial Intelligence, AAAI Press, p. Article 8","DOI":"10.1609\/aaai.v37i1.25077"},{"key":"7195_CR38","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2024.123635","volume":"249","author":"D Chen","year":"2024","unstructured":"Chen D, Wen G, Li H, Yang P, Chen C, Wang B (2024) Multi-geometry embedded transformer for facial expression recognition in videos. Expert Syst Appl 249:123635","journal-title":"Expert Syst Appl"},{"key":"7195_CR39","doi-asserted-by":"publisher","first-page":"697","DOI":"10.1080\/08839514.2021.1922841","volume":"35","author":"I Iqbal","year":"2021","unstructured":"Iqbal I, Odesanmi GA, Wang J, Liu L (2021) Comparative investigation of learning algorithms for image classification with small dataset. Appl Artif Intell 35:697\u2013716","journal-title":"Appl Artif Intell"},{"key":"7195_CR40","doi-asserted-by":"publisher","DOI":"10.3390\/diagnostics10050325","author":"I Iqbal","year":"2020","unstructured":"Iqbal I, Mustafa G, Ma J (2020) Deep learning-based morphological classification of human sperm heads. Diagnostics. 2020;10(5):325. https:\/\/doi.org\/10.3390\/diagnostics10050325","journal-title":"Diagnostics"},{"key":"7195_CR41","doi-asserted-by":"publisher","first-page":"243","DOI":"10.28991\/ESJ-2025-09-01-014","volume":"9","author":"M Shakir","year":"2025","unstructured":"Shakir M (2025) Enhancing user differentiation in the Electronic Personal Synthesis Behavior (EPSBV01) algorithm by adopting the time series analysis. Emerg Sci J 9:243\u2013260","journal-title":"Emerg Sci J"},{"key":"7195_CR42","doi-asserted-by":"publisher","first-page":"662","DOI":"10.28991\/HIJ-2025-06-02-020","volume":"6","author":"MM Otoom","year":"2025","unstructured":"Otoom MM, Etoom AM (2025) Leveraging image analysis and deep convolutional neural networks for cutting-edge malware detection and mitigation. HighTech Innov J 6:662\u2013686","journal-title":"HighTech Innov J"},{"key":"7195_CR43","doi-asserted-by":"publisher","first-page":"468","DOI":"10.28991\/ESJ-2025-09-01-026","volume":"9","author":"S Raja Sekaran","year":"2025","unstructured":"Raja Sekaran S, Pang YH, Yin OS, Zheng You L (2025) HSTCN-NuSVC: a homogeneous stacked deep ensemble learner for classifying human actions using smartphones. Emerg Sci J 9:468\u2013484","journal-title":"Emerg Sci J"},{"key":"7195_CR44","doi-asserted-by":"crossref","unstructured":"Deng J, Guo J, Ververas E, Kotsia I, Zafeiriou S (2020) RetinaFace: single-shot multi-level face localisation in the wild. IEEE\/CVF Conf Comput Vis Pattern Recognit (CVPR) pp. 5202\u20135211","DOI":"10.1109\/CVPR42600.2020.00525"},{"key":"7195_CR45","doi-asserted-by":"publisher","first-page":"2340","DOI":"10.1109\/TIP.2021.3051462","volume":"30","author":"Y Jiang","year":"2021","unstructured":"Jiang Y, Gong X, Liu D, Cheng Y, Fang C, Shen X, Yang J, Zhou P, Wang Z (2021) EnlightenGAN: deep light enhancement without paired supervision. IEEE Trans Image Process 30:2340\u20132349","journal-title":"IEEE Trans Image Process"},{"key":"7195_CR46","doi-asserted-by":"publisher","DOI":"10.1109\/tbiom.2025.3546279","author":"F Liu","year":"2025","unstructured":"Liu F, Wang H, Shen S (2025) Robust dynamic facial expression recognition. IEEE Trans Biometrics Behav Identity Sci. vol. 7, no. 4, pp. 563-572. https:\/\/doi.org\/10.1109\/tbiom.2025.3546279","journal-title":"IEEE Trans Biometrics Behav Identity Sci"},{"key":"7195_CR47","doi-asserted-by":"crossref","unstructured":"Tran D, Bourdev L, Fergus R, Torresani L, Paluri M (2015) Learning Spatiotemporal Features with 3D Convolutional Networks. IEEE Int Conf Comput Vis (ICCV) pp. 4489\u20134497","DOI":"10.1109\/ICCV.2015.510"},{"key":"7195_CR48","doi-asserted-by":"crossref","unstructured":"Wang H, Li B, Wu S, Shen S, Liu F, Ding S, Zhou A (2023) Rethinking the learning paradigm for dynamic facial expression recognition. IEEE\/CVF Conf Comput Vis Pattern Recognit (CVPR) pp. 17958\u201317968","DOI":"10.1109\/CVPR52729.2023.01722"},{"key":"7195_CR49","doi-asserted-by":"crossref","unstructured":"Wang R, Sun X (2023) Dynamic facial expression recognition based on vision transformer with deformable module. IEEE Int Conf Syst, Man, and Cybernetics (SMC) pp. 2138\u20132143","DOI":"10.1109\/SMC53992.2023.10394270"},{"key":"7195_CR50","doi-asserted-by":"publisher","first-page":"10503","DOI":"10.1109\/TMM.2024.3407693","volume":"26","author":"Z Zhang","year":"2024","unstructured":"Zhang Z, Tian X, Zhang Y, Guo K, Xu X (2024) Label-guided dynamic spatial-temporal fusion for video-based facial expression recognition. IEEE Trans Multimedia 26:10503\u201310513","journal-title":"IEEE Trans Multimedia"},{"key":"7195_CR51","doi-asserted-by":"publisher","first-page":"3192","DOI":"10.1109\/TCSVT.2023.3312858","volume":"34","author":"X Zhang","year":"2024","unstructured":"Zhang X, Li M, Lin S, Xu H, Xiao G (2024) Transformer-based multimodal emotional perception for dynamic facial expression recognition in the wild. IEEE Trans Circuits Syst Video Technol 34:3192\u20133203","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"7195_CR52","doi-asserted-by":"publisher","DOI":"10.1016\/j.compeleceng.2024.109125","volume":"115","author":"Z Han","year":"2024","unstructured":"Han Z, Meichen X, Hong P, Zhicai L, Jun G (2024) NSNP-DFER: a nonlinear spiking neural p network for dynamic facial expression recognition. Comput Electr Eng 115:109125","journal-title":"Comput Electr Eng"},{"key":"7195_CR53","doi-asserted-by":"publisher","DOI":"10.1016\/j.ins.2024.120953","volume":"678","author":"M Li","year":"2024","unstructured":"Li M, Zhang X, Fan C, Liao T, Xiao G (2024) Dual-STI: dual-path spatial-temporal interaction learning for dynamic facial expression recognition. Inf Sci 678:120953","journal-title":"Inf Sci"},{"key":"7195_CR54","doi-asserted-by":"publisher","unstructured":"H.Wang et al., (2025) \"D2SP: Dynamic Dual-Stage Purification Framework for Dual Noise Mitigation in Vision-Based Affective Recognition,\" 2025 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), Nashville, TN, USA, pp. 19218-19229. https:\/\/doi.org\/10.1109\/CVPR52734.2025.01790","DOI":"10.1109\/CVPR52734.2025.01790"},{"key":"7195_CR55","doi-asserted-by":"publisher","DOI":"10.1016\/j.engappai.2024.108535","volume":"133","author":"Z Huang","year":"2024","unstructured":"Huang Z, Zhu Y, Li H, Yang D (2024) Dynamic facial expression recognition based on spatial key-points optimized region feature fusion and temporal self-attention. Eng Appl Artif Intell 133:108535","journal-title":"Eng Appl Artif Intell"},{"key":"7195_CR56","doi-asserted-by":"publisher","first-page":"33","DOI":"10.1049\/cvi2.12217","volume":"18","author":"B Yin","year":"2024","unstructured":"Yin B, Yin S, Liu C, Zhang Y, Xi C, Yin B, Ling Z (2024) Dynamic facial expression recognition with pseudo-label guided multi\u2010modal pre\u2010training. IET Comput Vis 18:33\u201345","journal-title":"IET Comput Vis"},{"key":"7195_CR57","doi-asserted-by":"publisher","unstructured":"Neshov, N.; Christoff, N.; Sechkova, T.; Tonchev, K.; Manolova, A. SlowR50-SA: A Self-Attention Enhanced Dynamic Facial Expression Recognition Model for Tactile Internet Applications. Electronics 2024, 13, 1606. N, Christoff N, Sechkova T, Tonchev K, Manolova A (2024) SlowR50-SA: A Self-Attention Enhanced Dynamic Facial Expression Recognition Model for Tactile Internet Applications. in: Electronics https:\/\/doi.org\/10.3390\/electronics13091606Neshov","DOI":"10.3390\/electronics13091606Neshov"},{"key":"7195_CR58","doi-asserted-by":"crossref","unstructured":"Wang L, Kang X, Ding F, Nakagawa S, Ren F (2024) MSSTNet: A multi-scale spatio-temporal cnn-transformer network for dynamic facial expression recognition. ICASSP 2024\u20132024 IEEE Int Conf Acoust Speech Signal Process (ICASSP) pp. 3015\u20133019","DOI":"10.1109\/ICASSP48485.2024.10446699"},{"key":"7195_CR59","doi-asserted-by":"publisher","DOI":"10.1016\/j.ins.2024.121415","volume":"689","author":"S Yan","year":"2025","unstructured":"Yan S, Wang Y, Mai X, Tao Z, Song W, Zhao Q, Wang B, Wang H, Gao S, Zhang W (2025) Observe finer to select better: learning key frame extraction via semantic coherence for dynamic facial expression recognition in the wild. Inf Sci 689:121415","journal-title":"Inf Sci"},{"key":"7195_CR60","doi-asserted-by":"publisher","first-page":"130","DOI":"10.1016\/j.comcom.2023.12.032","volume":"216","author":"S Yan","year":"2024","unstructured":"Yan S, Wang Y, Mai X, Zhao Q, Song W, Huang J, Tao Z, Wang H, Gao S, Zhang W (2024) Empower smart cities with sampling-wise dynamic facial expression recognition via frame-sequence contrastive learning. Comput Commun 216:130\u2013139","journal-title":"Comput Commun"},{"key":"7195_CR61","doi-asserted-by":"publisher","first-page":"30","DOI":"10.1109\/TIP.2024.3504298","volume":"34","author":"M Li","year":"2025","unstructured":"Li M, Zhang X, Liao T, Lin S, Xiao G (2025) PTH-Net: dynamic facial expression recognition without face detection and alignment. IEEE Trans Image Process 34:30\u201343","journal-title":"IEEE Trans Image Process"},{"key":"7195_CR62","doi-asserted-by":"publisher","DOI":"10.1016\/j.imavis.2024.104915","volume":"142","author":"C Lu","year":"2024","unstructured":"Lu C, Jiang Y, Fu K, Zhao Q, Yang H (2024) LSTPNet: long short-term perception network for dynamic facial expression recognition in the wild. Image Vis Comput 142:104915","journal-title":"Image Vis Comput"},{"key":"7195_CR63","doi-asserted-by":"crossref","unstructured":"Tran D, Wang H, Torresani L, Ray J, LeCun Y, Paluri M (2018) A Closer Look at Spatiotemporal Convolutions for Action Recognition. IEEE\/CVF Conf Comput Vis Pattern Recognit pp. 6450\u20136459","DOI":"10.1109\/CVPR.2018.00675"},{"key":"7195_CR64","doi-asserted-by":"publisher","first-page":"1057","DOI":"10.1109\/TAFFC.2020.2988264","volume":"13","author":"Y Fan","year":"2022","unstructured":"Fan Y, Li VOK, Lam JCK (2022) Facial expression recognition with deeply-supervised attention network. IEEE Trans Affect Comput 13:1057\u20131071","journal-title":"IEEE Trans Affect Comput"},{"key":"7195_CR65","doi-asserted-by":"publisher","first-page":"2751","DOI":"10.1109\/TAFFC.2022.3181736","volume":"14","author":"R Zhao","year":"2023","unstructured":"Zhao R, Liu T, Huang Z, Lun DPK, Lam KM (2023) Spatial-temporal graphs plus transformers for geometry-guided facial expression recognition. IEEE Trans Affect Comput 14:2751\u20132767","journal-title":"IEEE Trans Affect Comput"},{"key":"7195_CR66","first-page":"2579","volume":"9","author":"L van der Maaten","year":"2008","unstructured":"van der Maaten L, Hinton G (2008) Visualizing data using t-SNE. J Mach Learn Res 9:2579\u20132605","journal-title":"J Mach Learn Res"}],"container-title":["Applied Intelligence"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-026-07195-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s10489-026-07195-0","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-026-07195-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,5,26]],"date-time":"2026-05-26T10:48:53Z","timestamp":1779792533000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s10489-026-07195-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,4]]},"references-count":66,"journal-issue":{"issue":"6","published-print":{"date-parts":[[2026,4]]}},"alternative-id":["7195"],"URL":"https:\/\/doi.org\/10.1007\/s10489-026-07195-0","relation":{},"ISSN":["0924-669X","1573-7497"],"issn-type":[{"value":"0924-669X","type":"print"},{"value":"1573-7497","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,4]]},"assertion":[{"value":"18 August 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"6 March 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"9 April 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Competing interest"}}],"article-number":"193"}}