{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,2,21]],"date-time":"2026-02-21T12:41:56Z","timestamp":1771677716919,"version":"3.50.1"},"reference-count":60,"publisher":"Springer Science and Business Media LLC","issue":"11","license":[{"start":{"date-parts":[[2023,9,25]],"date-time":"2023-09-25T00:00:00Z","timestamp":1695600000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,9,25]],"date-time":"2023-09-25T00:00:00Z","timestamp":1695600000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"DOI":"10.1007\/s11042-023-16779-8","type":"journal-article","created":{"date-parts":[[2023,9,25]],"date-time":"2023-09-25T01:01:46Z","timestamp":1695603706000},"page":"32993-33017","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":6,"title":["A dynamic fusion of features from deep learning and the HOG-TOP algorithm for facial expression recognition"],"prefix":"10.1007","volume":"83","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-7080-1645","authenticated-orcid":false,"given":"Hajar","family":"Chouhayebi","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mohamed Adnane","family":"Mahraz","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jamal","family":"Riffi","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hamid","family":"Tairi","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2023,9,25]]},"reference":[{"key":"16779_CR1","doi-asserted-by":"publisher","unstructured":"Roccetti M, Marfia G, Zanichelli M (2010) The art and craft of making the tortellino: Playing with a digital gesture recognizer for preparing pasta culinary recipes. Comput Entertain 8(4). https:\/\/doi.org\/10.1145\/1921141.1921148","DOI":"10.1145\/1921141.1921148"},{"issue":"6","key":"16779_CR2","doi-asserted-by":"publisher","first-page":"1113","DOI":"10.1109\/TPAMI.2014.2366127","volume":"37","author":"E Sariyanidi","year":"2015","unstructured":"Sariyanidi E, Gunes H, Cavallaro A (2015) Automatic analysis of facial affect: A survey of registration, representation, and recognition. IEEE Trans Pattern Anal Mach Intell 37(6):1113\u20131133. https:\/\/doi.org\/10.1109\/TPAMI.2014.2366127","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"1","key":"16779_CR3","doi-asserted-by":"publisher","first-page":"32","DOI":"10.1109\/79.911197","volume":"18","author":"R Corive","year":"2001","unstructured":"Corive R et al (2001) Emotion recognition in human-computer interaction. IEEE Signal Process Mag 18(1):32\u201380. https:\/\/doi.org\/10.1109\/79.911197","journal-title":"IEEE Signal Process Mag"},{"key":"16779_CR4","doi-asserted-by":"publisher","first-page":"701","DOI":"10.1109\/ICECA.2017.8203631","volume":"2017-January","author":"ST Saste","year":"2017","unstructured":"Saste ST, Jagdale SM (2017) Emotion recognition from speech using MFCC and DWT for security system. Proc Int Conf Electron Commun Aerosp Technol ICECA 2017 2017-January:701\u2013704. https:\/\/doi.org\/10.1109\/ICECA.2017.8203631","journal-title":"Proc Int Conf Electron Commun Aerosp Technol ICECA 2017"},{"key":"16779_CR5","doi-asserted-by":"publisher","unstructured":"Dang LT, Cooper EW, Kamei K (2014) Development of facial expression recognition for training video customer service representatives. IEEE Int Conf Fuzzy Syst 1297\u20131303. https:\/\/doi.org\/10.1109\/FUZZ-IEEE.2014.6891864","DOI":"10.1109\/FUZZ-IEEE.2014.6891864"},{"key":"16779_CR6","doi-asserted-by":"crossref","unstructured":"Kim Y, Lee H, Provost EM (2013) Deep learning for robust feature generation in audiovisual emotion recognition. \u2217 University of Michigan Electrical Engineering and Computer Science, Ann Arbor, Michigan, USA. Electr Eng. pp 3687\u20133691 [Online]. Available: http:\/\/citeseerx.ist.psu.edu\/viewdoc\/download?doi=10.1.1.428.5585&rep=rep1&type=pdf","DOI":"10.1109\/ICASSP.2013.6638346"},{"key":"16779_CR7","doi-asserted-by":"publisher","unstructured":"Kim J, Ricci M, Serre T (2018) Not-So-CLEVR: Learning same-different relations strains feedforward neural networks. Interface Focus 8(4). https:\/\/doi.org\/10.1098\/rsfs.2018.0011","DOI":"10.1098\/rsfs.2018.0011"},{"key":"16779_CR8","doi-asserted-by":"publisher","first-page":"689","DOI":"10.1016\/j.procs.2020.07.101","volume":"175","author":"W Mellouk","year":"2020","unstructured":"Mellouk W, Handouzi W (2020) Facial emotion recognition using deep learning: Review and insights. Procedia Comput Sci 175:689\u2013694. https:\/\/doi.org\/10.1016\/j.procs.2020.07.101","journal-title":"Procedia Comput Sci"},{"issue":"2","key":"16779_CR9","doi-asserted-by":"publisher","first-page":"423","DOI":"10.1109\/TPAMI.2018.2798607","volume":"41","author":"T Baltrusaitis","year":"2019","unstructured":"Baltrusaitis T, Ahuja C, Morency LP (2019) Multimodal Machine Learning: A Survey and Taxonomy. IEEE Trans Pattern Anal Mach Intell 41(2):423\u2013443. https:\/\/doi.org\/10.1109\/TPAMI.2018.2798607","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"16779_CR10","doi-asserted-by":"crossref","unstructured":"Dalal N, Triggs B (2005) Histograms of oriented gradients for human detection to cite this version\u202f: Histograms of oriented gradients for human detection, 2005 IEEE Comput. Soc. Conf. Comput. Vis. Pattern Recognit., pp 886\u2013893 [Online]. Available: http:\/\/lear.inrialpes.fr","DOI":"10.1109\/CVPR.2005.177"},{"issue":"6","key":"16779_CR11","doi-asserted-by":"publisher","first-page":"915","DOI":"10.1109\/TPAMI.2007.1110","volume":"29","author":"G Zhao","year":"2007","unstructured":"Zhao G, Pietik\u00e4inen M (2007) Dynamic texture recognition using local binary patterns with an application to facial expressions. IEEE Trans Pattern Anal Mach Intell 29(6):915\u2013928. https:\/\/doi.org\/10.1109\/TPAMI.2007.1110","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"16779_CR12","doi-asserted-by":"publisher","unstructured":"Martin O, Kotsia I, Macq B, Pitas I (2006) The eNTERFACE\u201905 Audio-Visual emotion database, ICDEW 2006 - Proc. 22nd Int. Conf. Data Eng. Work (1) pp 2\u20139. https:\/\/doi.org\/10.1109\/ICDEW.2006.145","DOI":"10.1109\/ICDEW.2006.145"},{"issue":"11","key":"16779_CR13","first-page":"86","volume":"11","author":"H-B Deng","year":"2005","unstructured":"Deng H-B, Jin L-W, Zhen L-X, Huang J-C (2005) A new facial expression recognition method based on local gabor filter bank and pca plus lda. Int J Inf Technol 11(11):86\u201396","journal-title":"Int J Inf Technol"},{"issue":"June","key":"16779_CR14","first-page":"89","volume":"3","author":"M Satiyan","year":"2010","unstructured":"Satiyan M (2010) Recognition of facial expression using haar wavelet transform. Int J Electr Electron Syst Res 3(June):89\u201396","journal-title":"Int J Electr Electron Syst Res"},{"issue":"6","key":"16779_CR15","doi-asserted-by":"publisher","first-page":"803","DOI":"10.1016\/j.imavis.2008.08.005","volume":"27","author":"C Shan","year":"2009","unstructured":"Shan C, Gong S, McOwan PW (2009) Facial expression recognition based on Local Binary Patterns: A comprehensive study. Image Vis Comput 27(6):803\u2013816. https:\/\/doi.org\/10.1016\/j.imavis.2008.08.005","journal-title":"Image Vis Comput"},{"issue":"2","key":"16779_CR16","doi-asserted-by":"publisher","first-page":"2243","DOI":"10.1007\/s11042-020-09663-2","volume":"80","author":"DGR Kola","year":"2021","unstructured":"Kola DGR, Samayamantula SK (2021) A novel approach for facial expression recognition using local binary pattern with adaptive window. Multimed Tools Appl 80(2):2243\u20132262. https:\/\/doi.org\/10.1007\/s11042-020-09663-2","journal-title":"Multimed Tools Appl"},{"key":"16779_CR17","doi-asserted-by":"publisher","unstructured":"Huang X, Zhao G, Pietik\u00e4inen M, Zheng W (2011) Expression recognition in videos using a weighted component-based feature descriptor. Lect. Notes Comput. Sci. (including Subser. Lect. Notes Artif. Intell. Lect. Notes Bioinformatics), vol. 6688 LNCS, pp 569\u2013578. https:\/\/doi.org\/10.1007\/978-3-642-21227-7_53","DOI":"10.1007\/978-3-642-21227-7_53"},{"key":"16779_CR18","doi-asserted-by":"publisher","unstructured":"Huang X, He Q, Hong X, Zhao G, Pietik\u00e4nen M (2014) Improved spatiotemporal local monogenic binary pattern for emotion recognition in the wild, ICMI 2014 - Proc. 2014 Int. Conf. Multimodal Interact. (March 2017) pp 514\u2013520. https:\/\/doi.org\/10.1145\/2663204.2666278","DOI":"10.1145\/2663204.2666278"},{"issue":"5","key":"16779_CR19","doi-asserted-by":"publisher","first-page":"243","DOI":"10.1109\/LSP.2012.2188890","volume":"19","author":"X Huang","year":"2012","unstructured":"Huang X, Zhao G, Zheng W, Pietik\u00e4inen M (2012) Spatiotemporal local monogenic binary patterns for facial expression recognition. IEEE Signal Process Lett 19(5):243\u2013246. https:\/\/doi.org\/10.1109\/LSP.2012.2188890","journal-title":"IEEE Signal Process Lett"},{"issue":"1","key":"16779_CR20","doi-asserted-by":"publisher","first-page":"38","DOI":"10.1109\/TAFFC.2016.2593719","volume":"9","author":"J Chen","year":"2018","unstructured":"Chen J, Chen Z, Chi Z, Fu H (2018) Facial expression recognition in video with multiple feature fusion. IEEE Trans Affect Comput 9(1):38\u201350. https:\/\/doi.org\/10.1109\/TAFFC.2016.2593719","journal-title":"IEEE Trans Affect Comput"},{"key":"16779_CR21","doi-asserted-by":"publisher","first-page":"126","DOI":"10.1016\/j.neucom.2012.04.017","volume":"93","author":"F Long","year":"2012","unstructured":"Long F, Wu T, Movellan JR, Bartlett MS, Littlewort G (2012) Learning spatiotemporal features by using independent component analysis with application to facial expression recognition. Neurocomputing 93:126\u2013132. https:\/\/doi.org\/10.1016\/j.neucom.2012.04.017","journal-title":"Neurocomputing"},{"key":"16779_CR22","doi-asserted-by":"publisher","unstructured":"Chew SW, Rana R, Lucey P, Lucey S, Sridharan S (2011) Sparse temporal representations for facial expression recognition. Lect. Notes Comput. Sci. (including Subser. Lect. Notes Artif. Intell. Lect. Notes Bioinformatics) 7088 LNCS(PART 2) pp 311\u2013322. https:\/\/doi.org\/10.1007\/978-3-642-25346-1_28","DOI":"10.1007\/978-3-642-25346-1_28"},{"key":"16779_CR23","doi-asserted-by":"publisher","unstructured":"Almaev TR, Valstar MF (2013) Local gabor binary patterns from three orthogonal planes for automatic facial expression recognition, Proc. - 2013 Hum. Assoc. Conf. Affect. Comput. Intell. Interact. ACII 2013, (August 2014) pp 356\u2013361. https:\/\/doi.org\/10.1109\/ACII.2013.65","DOI":"10.1109\/ACII.2013.65"},{"key":"16779_CR24","doi-asserted-by":"publisher","unstructured":"Hasani B, Mahoor MH (2017) Facial expression recognition using enhanced deep 3D convolutional neural networks, IEEE Comput. Soc. Conf. Comput. Vis. Pattern Recognit. Work. vol. 2017-July, pp 2278\u20132288. https:\/\/doi.org\/10.1109\/CVPRW.2017.282","DOI":"10.1109\/CVPRW.2017.282"},{"key":"16779_CR25","doi-asserted-by":"publisher","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition, Proc. IEEE Comput. Soc. Conf. Comput. Vis. Pattern Recognit., vol. 2016-Decem, pp 770\u2013778. https:\/\/doi.org\/10.1109\/CVPR.2016.90","DOI":"10.1109\/CVPR.2016.90"},{"key":"16779_CR26","doi-asserted-by":"publisher","unstructured":"Szegedy C et al (2015) Going deeper with convolutions, Proc. IEEE Comput. Soc. Conf. Comput. Vis. Pattern Recognit., vol. 07\u201312-June, pp 1\u20139. https:\/\/doi.org\/10.1109\/CVPR.2015.7298594","DOI":"10.1109\/CVPR.2015.7298594"},{"key":"16779_CR27","unstructured":"Krizhevsky A, Hinton G (2012) ImageNet classification with deep convolutional neural networks (presentation). ImageNet Large Scale Vis Recognit Chall 27"},{"key":"16779_CR28","doi-asserted-by":"publisher","unstructured":"Gudi A, Tasli HE, Den Uyl TM, Maroulis A (2015) Deep learning based facs action unit occurrence and intensity estimation, 2015 11th IEEE Int. Conf. Work. Autom. Face Gesture Recognition, FG 2015, vol. 2015-Janua. https:\/\/doi.org\/10.1109\/FG.2015.7284873","DOI":"10.1109\/FG.2015.7284873"},{"issue":"8","key":"16779_CR29","doi-asserted-by":"publisher","first-page":"1301","DOI":"10.1109\/JSTSP.2017.2764438","volume":"11","author":"P Tzirakis","year":"2017","unstructured":"Tzirakis P, Trigeorgis G, Nicolaou MA, Schuller BW, Zafeiriou S (2017) End-to-end multimodal emotion recognition using deep neural networks. IEEE J Sel Top Signal Process 11(8):1301\u20131309. https:\/\/doi.org\/10.1109\/JSTSP.2017.2764438","journal-title":"IEEE J Sel Top Signal Process"},{"key":"16779_CR30","doi-asserted-by":"publisher","first-page":"33","DOI":"10.1016\/j.cviu.2018.06.005","volume":"174","author":"D Nguyen","year":"2018","unstructured":"Nguyen D, Nguyen K, Sridharan S, Dean D, Fookes C (2018) Deep spatio-temporal feature fusion with compact bilinear pooling for multimodal emotion recognition. Comput Vis Image Underst 174:33\u201342. https:\/\/doi.org\/10.1016\/j.cviu.2018.06.005","journal-title":"Comput Vis Image Underst"},{"key":"16779_CR31","doi-asserted-by":"publisher","unstructured":"Ranganathan H, Chakraborty S, Panchanathan S (2016) Multimodal emotion recognition using deep learning architectures, 2016 IEEE Winter Conf. Appl. Comput. Vision, WACV 2016. https:\/\/doi.org\/10.1109\/WACV.2016.7477679","DOI":"10.1109\/WACV.2016.7477679"},{"key":"16779_CR32","doi-asserted-by":"publisher","unstructured":"Chen S, Jin Q (2015) Multi-modal dimensional emotion recognition using recurrent neural networks, AVEC 2015 - Proc. 5th Int. Work. Audio\/Visual Emot. Challenge, co-Located with MM 2015, pp 49\u201356. https:\/\/doi.org\/10.1145\/2808196.2811638","DOI":"10.1145\/2808196.2811638"},{"key":"16779_CR33","doi-asserted-by":"publisher","first-page":"27","DOI":"10.1016\/j.neucom.2018.03.068","volume":"309","author":"J Yan","year":"2018","unstructured":"Yan J, Zheng W, Cui Z, Tang C, Zhang T, Zong Y (2018) Multi-cue fusion for emotion recognition in the wild. Neurocomputing 309:27\u201335. https:\/\/doi.org\/10.1016\/j.neucom.2018.03.068","journal-title":"Neurocomputing"},{"key":"16779_CR34","doi-asserted-by":"publisher","unstructured":"Fan Y, Lu X, Li D, Liu Y (2016) Video-Based emotion recognition using CNN-RNN and C3D hybrid networks, ICMI 2016 - Proc. 18th ACM Int. Conf. Multimodal Interact. pp 445\u2013450. https:\/\/doi.org\/10.1145\/2993148.2997632","DOI":"10.1145\/2993148.2997632"},{"issue":"13","key":"16779_CR35","doi-asserted-by":"publisher","first-page":"7381","DOI":"10.1007\/s00521-020-05557-4","volume":"33","author":"R Miyoshi","year":"2021","unstructured":"Miyoshi R, Nagata N, Hashimoto M (2021) Enhanced convolutional LSTM with spatial and temporal skip connections and temporal gates for facial expression recognition from video. Neural Comput Appl 33(13):7381\u20137392. https:\/\/doi.org\/10.1007\/s00521-020-05557-4","journal-title":"Neural Comput Appl"},{"key":"16779_CR36","doi-asserted-by":"publisher","unstructured":"Ding H, Zhou SK, Chellappa R (2017) FaceNet2ExpNet: Regularizing a deep face recognition net for expression recognition, Proc. - 12th IEEE Int. Conf. Autom. Face Gesture Recognition, FG 2017 - 1st Int. Work. Adapt. Shot Learn. Gesture Underst. Prod. ASL4GUP 2017, Biometrics Wild, Bwild 2017, Heteroge, pp 118\u2013126. https:\/\/doi.org\/10.1109\/FG.2017.23","DOI":"10.1109\/FG.2017.23"},{"issue":"January","key":"16779_CR37","doi-asserted-by":"publisher","first-page":"57","DOI":"10.1016\/j.ijcce.2021.02.002","volume":"2","author":"B Li","year":"2021","unstructured":"Li B, Lima D (2021) Facial expression recognition via ResNet-50. Int J Cogn Comput Eng 2(January):57\u201364. https:\/\/doi.org\/10.1016\/j.ijcce.2021.02.002","journal-title":"Int J Cogn Comput Eng"},{"issue":"October","key":"16779_CR38","doi-asserted-by":"publisher","first-page":"1","DOI":"10.3389\/fnbot.2021.763100","volume":"15","author":"J Gao","year":"2021","unstructured":"Gao J, Zhao Y (2021) TFE: A transformer architecture for occlusion aware facial expression recognition. Front Neurorobot 15(October):1\u201310. https:\/\/doi.org\/10.3389\/fnbot.2021.763100","journal-title":"Front Neurorobot"},{"key":"16779_CR39","doi-asserted-by":"publisher","unstructured":"Ng HW, Nguyen VD, Vonikakis V, Winkler S (2015) Deep learning for emotion recognition on small datasets using transfer learning, ICMI 2015 - Proc. 2015 ACM Int. Conf. Multimodal Interact., pp 443\u2013449. https:\/\/doi.org\/10.1145\/2818346.2830593","DOI":"10.1145\/2818346.2830593"},{"key":"16779_CR40","doi-asserted-by":"publisher","unstructured":"Priyasad D, Fernando T, Denman S, Sridharan S, Fookes C (2020) Learning salient features for multimodal emotion recognition with recurrent neural networks and attention based fusion (August) pp. 21\u201326. https:\/\/doi.org\/10.21437\/avsp.2019-5","DOI":"10.21437\/avsp.2019-5"},{"key":"16779_CR41","doi-asserted-by":"publisher","unstructured":"Liu W et al (2016) SSD: Single shot multibox detector, Lect. Notes Comput. Sci. (including Subser. Lect. Notes Artif. Intell. Lect. Notes Bioinformatics), vol. 9905 LNCS, pp 21\u201337. https:\/\/doi.org\/10.1007\/978-3-319-46448-0_2","DOI":"10.1007\/978-3-319-46448-0_2"},{"key":"16779_CR42","unstructured":"Simonyan K, Zisserman A (2015) Very deep convolutional networks for large-scale image recognition, 3rd Int. Conf. Learn. Represent. ICLR 2015 - Conf. Track Proc., pp 1\u201314"},{"key":"16779_CR43","unstructured":"Staudemeyer RC, Morris ER (2019) Understanding LSTM -- a tutorial into Long Short-Term Memory Recurrent Neural Networks, pp 1\u201342, [Online]. Available: http:\/\/arxiv.org\/abs\/1909.09586"},{"issue":"13","key":"16779_CR44","doi-asserted-by":"publisher","first-page":"5858","DOI":"10.1016\/j.eswa.2014.03.026","volume":"41","author":"CS Ooi","year":"2014","unstructured":"Ooi CS, Seng KP, Ang LM, Chew LW (2014) A new approach of audio emotion recognition. Expert Syst Appl 41(13):5858\u20135869. https:\/\/doi.org\/10.1016\/j.eswa.2014.03.026","journal-title":"Expert Syst Appl"},{"issue":"November","key":"16779_CR45","doi-asserted-by":"publisher","first-page":"2014","DOI":"10.1017\/ATSIP.2014.11","volume":"3","author":"CH Wu","year":"2014","unstructured":"Wu CH, Lin JC, Wei WL (2014) Survey on audiovisual emotion recognition: Databases, features, and data fusion strategies. APSIPA Trans Signal Inf Process 3(November):2014. https:\/\/doi.org\/10.1017\/ATSIP.2014.11","journal-title":"APSIPA Trans Signal Inf Process"},{"issue":"1","key":"16779_CR46","doi-asserted-by":"publisher","first-page":"71","DOI":"10.1007\/bf01238028","volume":"1","author":"CL Lisetti","year":"1998","unstructured":"Lisetti CL (1998) Affective computing. Pattern Anal Appl 1(1):71\u201373. https:\/\/doi.org\/10.1007\/bf01238028","journal-title":"Pattern Anal Appl"},{"key":"16779_CR47","doi-asserted-by":"publisher","unstructured":"Lin TY, Roychowdhury A, Maji S (2015) Bilinear CNN models for fine-grained visual recognition, Proc. IEEE Int. Conf. Comput. Vis., vol. 2015 Inter, pp 1449\u20131457. https:\/\/doi.org\/10.1109\/ICCV.2015.170","DOI":"10.1109\/ICCV.2015.170"},{"key":"16779_CR48","doi-asserted-by":"publisher","unstructured":"Fukui A, Park DH, Yang D, Rohrbach A, Darrell T, Rohrbach M (2016) Multimodal compact bilinear pooling for visual question answering and visual grounding, EMNLP 2016 - Conf. Empir. Methods Nat. Lang. Process. Proc., pp 457\u2013468. https:\/\/doi.org\/10.18653\/v1\/d16-1044","DOI":"10.18653\/v1\/d16-1044"},{"key":"16779_CR49","unstructured":"Delbrouck J-B, Dupont S (2017) Multimodal compact bilinear pooling for multimodal neural machine translation, no. 2014, pp 2014\u20132017, [Online]. Available: http:\/\/arxiv.org\/abs\/1703.08084"},{"key":"16779_CR50","doi-asserted-by":"publisher","unstructured":"Huang YY, Wang WY (2017) Deep residual learning for weakly-supervised relation extraction, EMNLP 2017 - Conf. Empir. Methods Nat. Lang. Process. Proc., pp 1803\u20131807. https:\/\/doi.org\/10.18653\/v1\/d17-1191","DOI":"10.18653\/v1\/d17-1191"},{"key":"16779_CR51","doi-asserted-by":"publisher","unstructured":"Deng J, Dong W, Socher R, Li L-J, Li K, Fei-Fei L (2010) ImageNet: A large-scale hierarchical image database. IEEE Conf. Comput. Vis. pattern Recognit., no. June, pp 248\u2013255. https:\/\/doi.org\/10.1109\/cvpr.2009.5206848","DOI":"10.1109\/cvpr.2009.5206848"},{"issue":"2","key":"16779_CR52","doi-asserted-by":"publisher","first-page":"107","DOI":"10.1142\/S0218488598000094","volume":"6","author":"S Hochreiter","year":"1998","unstructured":"Hochreiter S (1998) The vanishing gradient problem during learning recurrent neural nets and problem solutions. Int. J Uncertainty Fuzziness Knowlege-Based Syst 6(2):107\u2013116. https:\/\/doi.org\/10.1142\/S0218488598000094","journal-title":"Int. J Uncertainty Fuzziness Knowlege-Based Syst"},{"key":"16779_CR53","unstructured":"Chen G (2016) A gentle tutorial of recurrent neural network with error backpropagation. pp 1\u20139 [Online]. Available: http:\/\/arxiv.org\/abs\/1610.02583"},{"key":"16779_CR54","doi-asserted-by":"publisher","unstructured":"Gritti T, Shan C, Jeanne V, Braspenning R (2008) \u201cLocal features based facial expression recognition with face registration errors,\u201d 2008 8th IEEE Int. Conf. Autom. Face Gesture Recognition, FG 2008, no. October, pp. 1\u20138. https:\/\/doi.org\/10.1109\/AFGR.2008.4813379","DOI":"10.1109\/AFGR.2008.4813379"},{"key":"16779_CR55","first-page":"1755","volume":"10","author":"DE King","year":"2009","unstructured":"King DE (2009) Dlib-ml: A machine learning toolkit. J Mach Learn Res 10:1755\u20131758","journal-title":"J Mach Learn Res"},{"key":"16779_CR56","doi-asserted-by":"publisher","first-page":"3","DOI":"10.1016\/j.imavis.2016.01.002","volume":"47","author":"C Sagonas","year":"2016","unstructured":"Sagonas C, Antonakos E, Tzimiropoulos G, Zafeiriou S, Pantic M (2016) 300 Faces In-The-Wild Challenge: database and results. Image Vis Comput 47:3\u201318. https:\/\/doi.org\/10.1016\/j.imavis.2016.01.002","journal-title":"Image Vis Comput"},{"key":"16779_CR57","doi-asserted-by":"publisher","unstructured":"Charikar M, Chen K, Farach-Colton M (2002) Finding frequent items in data streams. Lect Notes Comput Sci (including Subser Lect Notes Artif Intell Lect Notes Bioinformatics) vol. 2380 LNCS:693\u2013703. https:\/\/doi.org\/10.1007\/3-540-45465-9_59","DOI":"10.1007\/3-540-45465-9_59"},{"key":"16779_CR58","doi-asserted-by":"publisher","unstructured":"Pham N, Pagh R (2013) Fast and scalable polynomial kernels via explicit feature maps. Proc ACM SIGKDD Int Conf Knowl Discov Data Min vol. Part F1288, pp 239\u2013247. https:\/\/doi.org\/10.1145\/2487575.2487591","DOI":"10.1145\/2487575.2487591"},{"issue":"4","key":"16779_CR59","doi-asserted-by":"publisher","first-page":"923","DOI":"10.1007\/s13042-019-01056-8","volume":"11","author":"Z Wang","year":"2020","unstructured":"Wang Z, Zhou X, Wang W, Liang C (2020) Emotion recognition using multimodal deep learning in multiple psychophysiological signals and video. Int J Mach Learn Cybern 11(4):923\u2013934. https:\/\/doi.org\/10.1007\/s13042-019-01056-8","journal-title":"Int J Mach Learn Cybern"},{"key":"16779_CR60","doi-asserted-by":"publisher","first-page":"3227","DOI":"10.1109\/ICASSP40776.2020.9054441","volume":"2020-May","author":"D Priyasad","year":"2020","unstructured":"Priyasad D, Fernando T, Denman S, Sridharan S, Fookes C (2020) Attention driven fusion for multi-modal emotion recognition. ICASSP IEEE Int Conf Acoust Speech Signal Process- Proc 2020-May:3227\u20133231. https:\/\/doi.org\/10.1109\/ICASSP40776.2020.9054441","journal-title":"ICASSP IEEE Int Conf Acoust Speech Signal Process- Proc"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-023-16779-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11042-023-16779-8\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-023-16779-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,10,28]],"date-time":"2024-10-28T21:43:59Z","timestamp":1730151839000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11042-023-16779-8"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,9,25]]},"references-count":60,"journal-issue":{"issue":"11","published-online":{"date-parts":[[2024,3]]}},"alternative-id":["16779"],"URL":"https:\/\/doi.org\/10.1007\/s11042-023-16779-8","relation":{},"ISSN":["1573-7721"],"issn-type":[{"value":"1573-7721","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,9,25]]},"assertion":[{"value":"6 June 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"22 July 2023","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"31 August 2023","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"25 September 2023","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors have no competing interests to declare that are relevant to the content of this article.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}