{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,6]],"date-time":"2026-05-06T15:45:01Z","timestamp":1778082301090,"version":"3.51.4"},"publisher-location":"Cham","reference-count":25,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783031808555","type":"print"},{"value":"9783031808562","type":"electronic"}],"license":[{"start":{"date-parts":[[2025,1,1]],"date-time":"2025-01-01T00:00:00Z","timestamp":1735689600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,1,1]],"date-time":"2025-01-01T00:00:00Z","timestamp":1735689600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-80856-2_6","type":"book-chapter","created":{"date-parts":[[2025,2,8]],"date-time":"2025-02-08T14:16:28Z","timestamp":1739024188000},"page":"81-93","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["Leveraging Vision Language Models for\u00a0Facial Expression Recognition in\u00a0Driving Environment"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0009-0002-4231-4246","authenticated-orcid":false,"given":"Ibtissam","family":"Saadi","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9092-735X","authenticated-orcid":false,"given":"Abdenour","family":"Hadid","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1419-2552","authenticated-orcid":false,"given":"Douglas W.","family":"Cunningham","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7218-3799","authenticated-orcid":false,"given":"Abdelmalik","family":"Taleb-Ahmed","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3980-9902","authenticated-orcid":false,"given":"Yassin","family":"El Hillali","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2025,2,9]]},"reference":[{"issue":"12","key":"6_CR1","doi-asserted-by":"publisher","first-page":"2444","DOI":"10.1049\/itr2.12423","volume":"17","author":"X Chen","year":"2023","unstructured":"Chen, X., Du, J., Deng, F., Zhao, F.: Transferable driver facial expression recognition based on joint discriminative correlation alignment network with enhanced feature attention. IET Intell. Transport Syst. 17(12), 2444\u20132457 (2023)","journal-title":"IET Intell. Transport Syst."},{"key":"6_CR2","doi-asserted-by":"crossref","unstructured":"Foteinopoulou, N.M., Patras, I.: EmoCLIP: a vision-language method for zero-shot video facial expression recognition. arXiv preprint arXiv:2310.16640 (2023)","DOI":"10.1109\/FG59268.2024.10581982"},{"key":"6_CR3","unstructured":"Goodfellow, I.J., et al.: Challenges in representation learning: a report on three machine learning contests. In: Neural Information Processing: 20th International Conference, ICONIP 2013, Part III, Daegu, Korea, 3\u20137 November 2013, pp. 117\u2013124. Springer (2013)"},{"key":"6_CR4","doi-asserted-by":"publisher","first-page":"104659","DOI":"10.1016\/j.imavis.2023.104659","volume":"133","author":"DK Jain","year":"2023","unstructured":"Jain, D.K., Dutta, A.K., Verd\u00fa, E., Alsubai, S., Sait, A.R.W.: An automated hyperparameter tuned deep learning model enabled facial emotion recognition for autonomous vehicle drivers. Image Vis. Comput. 133, 104659 (2023)","journal-title":"Image Vis. Comput."},{"issue":"12","key":"6_CR5","doi-asserted-by":"publisher","first-page":"4270","DOI":"10.3390\/s18124270","volume":"18","author":"M Jeong","year":"2018","unstructured":"Jeong, M., Ko, B.C.: Driver\u2019s facial expression recognition in real-time for safe driving. Sensors 18(12), 4270 (2018)","journal-title":"Sensors"},{"key":"6_CR6","doi-asserted-by":"publisher","first-page":"60344","DOI":"10.1109\/ACCESS.2020.2983202","volume":"8","author":"M Jeong","year":"2020","unstructured":"Jeong, M., Nam, J., Ko, B.C.: Lightweight multilayer random forests for monitoring driver emotional status. IEEE Access 8, 60344\u201360354 (2020)","journal-title":"IEEE Access"},{"key":"6_CR7","first-page":"1755","volume":"10","author":"DE King","year":"2009","unstructured":"King, D.E.: Dlib-ml: a machine learning toolkit. J. Mach. Learn. Res. 10, 1755\u20131758 (2009)","journal-title":"J. Mach. Learn. Res."},{"issue":"9","key":"6_CR8","doi-asserted-by":"publisher","first-page":"2942","DOI":"10.3390\/s21092942","volume":"21","author":"A Leone","year":"2021","unstructured":"Leone, A., Caroppo, A., Manni, A., Siciliano, P.: Vision-based road rage detection framework in automotive safety applications. Sensors 21(9), 2942 (2021)","journal-title":"Sensors"},{"key":"6_CR9","doi-asserted-by":"crossref","unstructured":"Li, H., Niu, H., Zhu, Z., Zhao, F.: CLIPER: a unified vision-language framework for in-the-wild facial expression recognition. arXiv preprint arXiv:2303.00193 (2023)","DOI":"10.1109\/ICME57554.2024.10687508"},{"key":"6_CR10","doi-asserted-by":"crossref","unstructured":"Li, S., Deng, W., Du, J.: Reliable crowdsourcing and deep locality-preserving learning for expression recognition in the wild. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 2852\u20132861. IEEE (2017)","DOI":"10.1109\/CVPR.2017.277"},{"key":"6_CR11","doi-asserted-by":"publisher","first-page":"102367","DOI":"10.1016\/j.inffus.2024.102367","volume":"108","author":"Z Lian","year":"2024","unstructured":"Lian, Z., et al.: GPT-4v with emotion: a zero-shot benchmark for generalized emotion recognition. Inf. Fusion 108, 102367 (2024)","journal-title":"Inf. Fusion"},{"key":"6_CR12","unstructured":"Paradies, M.: Is human error the cause of 94% of vehicle accidents? Would automation stop these crashes? (2022). https:\/\/www.taproot.com\/is-human-error-the-cause-of-vehicle-accidents\/. Accessed 04 Dec 2023"},{"key":"6_CR13","doi-asserted-by":"crossref","unstructured":"Patil, M., Veni, S.: Driver emotion recognition for enhancement of human machine interface in vehicles. In: 2019 International Conference on Communication and Signal Processing (ICCSP), pp. 0420\u20130424. IEEE (2019)","DOI":"10.1109\/ICCSP.2019.8698045"},{"key":"6_CR14","unstructured":"Radford, A., et\u00a0al.: Learning transferable visual models from natural language supervision. In: International Conference on Machine Learning, pp. 8748\u20138763. PMLR (2021)"},{"key":"6_CR15","doi-asserted-by":"publisher","unstructured":"Saadi, I., Cunningham, D.W., Abdelmalik, T.A., Hadid, A., El\u00a0Hillali, Y.: Driver\u2019s facial expression recognition using global context vision transformer. In: 2023 IEEE International Conference on Computer Vision and Machine Intelligence (CVMI), pp.\u00a01\u20138. IEEE, Gwalior (2023). https:\/\/doi.org\/10.1109\/CVMI59935.2023.10464794","DOI":"10.1109\/CVMI59935.2023.10464794"},{"key":"6_CR16","doi-asserted-by":"publisher","first-page":"122784","DOI":"10.1016\/j.eswa.2023.122784","volume":"242","author":"I Saadi","year":"2024","unstructured":"Saadi, I., Cunningham, D.W., Taleb-Ahmed, A., Hadid, A., El Hillali, Y.: Driver\u2019s facial expression recognition: a comprehensive survey. Expert Syst. Appl. 242, 122784 (2024)","journal-title":"Expert Syst. Appl."},{"key":"6_CR17","doi-asserted-by":"crossref","unstructured":"Sahoo, G.K., Das, S.K., Singh, P.: Deep learning-based facial emotion recognition for driver healthcare. In: 2022 National Conference on Communications (NCC), pp. 154\u2013159. IEEE, Mumbai (2022)","DOI":"10.1109\/NCC55593.2022.9806751"},{"key":"6_CR18","doi-asserted-by":"crossref","unstructured":"Sahoo, G.K., Das, S.K., Singh, P.: Performance comparison of facial emotion recognition: a transfer learning-based driver assistance framework for in-vehicle applications. Circuits Syst. Signal Process. 1\u201328 (2023)","DOI":"10.1007\/s00034-023-02320-7"},{"key":"6_CR19","unstructured":"Tao, Z., et\u00a0al.: A3lign-DFER: pioneering comprehensive dynamic affective alignment for dynamic facial expression recognition with CLIP. arXiv preprint arXiv:2403.04294 (2024)"},{"issue":"8","key":"6_CR20","doi-asserted-by":"publisher","first-page":"815","DOI":"10.1049\/iet-its.2019.0499","volume":"14","author":"X Wang","year":"2020","unstructured":"Wang, X., Guo, Y., Ban, J., Xu, Q., Bai, C., Liu, S.: Driver emotion recognition of multiple-ECG feature fusion based on BP network and d-s evidence. IET Intell. Transp. Syst. 14(8), 815\u2013824 (2020)","journal-title":"IET Intell. Transp. Syst."},{"issue":"11","key":"6_CR21","doi-asserted-by":"publisher","first-page":"2359","DOI":"10.3390\/electronics12112359","volume":"12","author":"Z Wang","year":"2023","unstructured":"Wang, Z., Chen, M., Feng, G.: Study on driver cross-subject emotion recognition based on raw multi-channels EEG data. Electronics 12(11), 2359 (2023)","journal-title":"Electronics"},{"issue":"4","key":"6_CR22","doi-asserted-by":"publisher","first-page":"687","DOI":"10.3390\/sym14040687","volume":"14","author":"K Zaman","year":"2022","unstructured":"Zaman, K., Sun, Z., Shah, S.M., Shoaib, M., Pei, L., Hussain, A.: Driver emotions recognition based on improved faster R-CNN and neural architectural search network. Symmetry 14(4), 687 (2022)","journal-title":"Symmetry"},{"key":"6_CR23","doi-asserted-by":"crossref","unstructured":"Zhang, J., Mei, X., Liu, H., Yuan, S., Qian, T.: Detecting negative emotional stress based on facial expression in real time. In: 2019 IEEE 4th International Conference on Signal and Image Processing (ICSIP), pp. 430\u2013434. IEEE (2019)","DOI":"10.1109\/SIPROCESS.2019.8868735"},{"issue":"10","key":"6_CR24","doi-asserted-by":"publisher","first-page":"1499","DOI":"10.1109\/LSP.2016.2603342","volume":"23","author":"K Zhang","year":"2016","unstructured":"Zhang, K., Zhang, Z., Li, Z., Qiao, Y.: Joint face detection and alignment using multitask cascaded convolutional networks. IEEE Signal Process. Lett. 23(10), 1499\u20131503 (2016)","journal-title":"IEEE Signal Process. Lett."},{"key":"6_CR25","unstructured":"Zhao, Z., Patras, I.: Prompting visual-language models for dynamic facial expression recognition. arXiv preprint arXiv:2308.13382 (2023)"}],"container-title":["Lecture Notes in Computer Science","Sensor-Based Activity Recognition and Artificial Intelligence"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-80856-2_6","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,2,8]],"date-time":"2025-02-08T14:16:36Z","timestamp":1739024196000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-80856-2_6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025]]},"ISBN":["9783031808555","9783031808562"],"references-count":25,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-80856-2_6","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025]]},"assertion":[{"value":"9 February 2025","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"iWOAR","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Workshop on Sensor-Based Activity Recognition and Artificial Intelligence","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Potsdam","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Germany","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"26 September 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"27 September 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"9","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"iwoar2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/iwoar.org\/2024\/cfp.html","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}