{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,20]],"date-time":"2026-05-20T16:34:32Z","timestamp":1779294872174,"version":"3.51.4"},"publisher-location":"Singapore","reference-count":29,"publisher":"Springer Nature Singapore","isbn-type":[{"value":"9789819533923","type":"print"},{"value":"9789819533930","type":"electronic"}],"license":[{"start":{"date-parts":[[2025,11,1]],"date-time":"2025-11-01T00:00:00Z","timestamp":1761955200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,11,1]],"date-time":"2025-11-01T00:00:00Z","timestamp":1761955200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2026]]},"DOI":"10.1007\/978-981-95-3393-0_35","type":"book-chapter","created":{"date-parts":[[2025,10,31]],"date-time":"2025-10-31T09:51:09Z","timestamp":1761904269000},"page":"430-442","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["SPViT-FER: A Sparse Pruning Based Vision Transformer for\u00a0Facial Expression Recognition"],"prefix":"10.1007","author":[{"given":"Hao","family":"Qin","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Haitao","family":"Yin","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2025,11,1]]},"reference":[{"key":"35_CR1","doi-asserted-by":"crossref","unstructured":"Barsoum, E., Zhang, C., Ferrer, C.C., Zhang, Z.: Training deep networks for facial expression recognition with crowd-sourced label distribution. In: Proceedings of the 18th ACM International Conference on Multimodal Interaction, pp. 279\u2013283 (2016)","DOI":"10.1145\/2993148.2993165"},{"key":"35_CR2","unstructured":"Chen, C.: PyTorch face landmark: a fast and accurate facial landmark detector (2021). https:\/\/github.com\/cunjian\/pytorch_face_landmark"},{"key":"35_CR3","doi-asserted-by":"crossref","unstructured":"Deng, J., Guo, J., Xue, N., Zafeiriou, S.: ArcFace: additive angular margin loss for deep face recognition. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 4690\u20134699 (2019)","DOI":"10.1109\/CVPR.2019.00482"},{"key":"35_CR4","unstructured":"Dosovitskiy, A., et al.: An image is worth 16x16 words: transformers for image recognition at scale. In: International Conference on Learning Representations (2021)"},{"issue":"4","key":"35_CR5","doi-asserted-by":"publisher","first-page":"3281","DOI":"10.1109\/TAFFC.2022.3220972","volume":"14","author":"YF Huang","year":"2023","unstructured":"Huang, Y.F., Tsai, C.H.: PIDViT: pose-invariant distilled vision transformer for facial expression recognition in the wild. IEEE Trans. Affect. Comput. 14(4), 3281\u20133293 (2023)","journal-title":"IEEE Trans. Affect. Comput."},{"key":"35_CR6","doi-asserted-by":"crossref","unstructured":"Hwang, H., Kim, S., Park, W.J., Seo, J., Ko, K., Yeo, H.: Vision transformer equipped with neural resizer on facial expression recognition task. In: IEEE International Conference on Acoustics, Speech and Signal Processing, pp. 2614\u20132618 (2022)","DOI":"10.1109\/ICASSP43922.2022.9746526"},{"key":"35_CR7","unstructured":"Li, H., Sui, M., Zhao, F., Zha, Z., Wu, F.: MVT: mask vision transformer for facial expression recognition in the wild. arXiv preprint arXiv:2106.04520 (2021)"},{"issue":"3","key":"35_CR8","doi-asserted-by":"publisher","first-page":"1195","DOI":"10.1109\/TAFFC.2020.2981446","volume":"13","author":"S Li","year":"2022","unstructured":"Li, S., Deng, W.: Deep facial expression recognition: a survey. IEEE Trans. Affect. Comput. 13(3), 1195\u20131215 (2022)","journal-title":"IEEE Trans. Affect. Comput."},{"key":"35_CR9","doi-asserted-by":"crossref","unstructured":"Li, S., Deng, W., Du, J.: Reliable crowdsourcing and deep locality-preserving learning for expression recognition in the wild. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition, pp. 2584\u20132593 (2017)","DOI":"10.1109\/CVPR.2017.277"},{"key":"35_CR10","unstructured":"Liang, Y., Ge, C., Tong, Z., Song, Y., Wang, J., Xie, P.: EViT: expediting vision transformers via token reorganizations. In: International Conference on Learning Representations (2022)"},{"key":"35_CR11","doi-asserted-by":"crossref","unstructured":"Liu, S., Xu, Y., Wan, T., Kui, X.: A dual-branch adaptive distribution fusion framework for real-world facial expression recognition. In: IEEE International Conference on Acoustics, Speech and Signal Processing, pp.\u00a01\u20135 (2023)","DOI":"10.1109\/ICASSP49357.2023.10097033"},{"key":"35_CR12","doi-asserted-by":"crossref","unstructured":"Liu, X., Wu, T., Guo, G.: Adaptive sparse VIT: towards learnable adaptive token pruning by fully exploiting self-attention. In: Proceedings of the Thirty-Second International Joint Conference on Artificial Intelligence, pp. 1222\u20131230 (2023)","DOI":"10.24963\/ijcai.2023\/136"},{"issue":"2","key":"35_CR13","doi-asserted-by":"publisher","first-page":"593","DOI":"10.1109\/TAFFC.2023.3285231","volume":"15","author":"F Ma","year":"2024","unstructured":"Ma, F., Sun, B., Li, S.: Transformer-augmented network with online label correction for facial expression recognition. IEEE Trans. Affect. Comput. 15(2), 593\u2013605 (2024)","journal-title":"IEEE Trans. Affect. Comput."},{"key":"35_CR14","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2024.110951","volume":"157","author":"J Mao","year":"2025","unstructured":"Mao, J., et al.: POSTER++: a simpler and stronger facial expression recognition network. Pattern Recogn. 157, 110951 (2025)","journal-title":"Pattern Recogn."},{"key":"35_CR15","doi-asserted-by":"crossref","unstructured":"Meng, S., Shi, W.: Fusing structure and appearance features in facial expression recognition transformer. In: IEEE International Conference on Acoustics, Speech and Signal Processing, pp. 3600\u20133604 (2024)","DOI":"10.1109\/ICASSP48485.2024.10447031"},{"issue":"1","key":"35_CR16","doi-asserted-by":"publisher","first-page":"18","DOI":"10.1109\/TAFFC.2017.2740923","volume":"10","author":"A Mollahosseini","year":"2017","unstructured":"Mollahosseini, A., Hasani, B., Mahoor, M.H.: AffectNet: a database for facial expression, valence, and arousal computing in the wild. IEEE Trans. Affect. Comput. 10(1), 18\u201331 (2017)","journal-title":"IEEE Trans. Affect. Comput."},{"key":"35_CR17","unstructured":"Rao, Y., Zhao, W., Liu, B., Lu, J., Zhou, J., Hsieh, C.J.: DynamicViT: efficient vision transformers with dynamic token sparsification. In: Advances in Neural Information Processing Systems, vol.\u00a034, pp. 13937\u201313949 (2021)"},{"key":"35_CR18","unstructured":"Touvron, H., Cord, M., et\u00a0al., D.: Training data-efficient image transformers & distillation through attention. In: International Conference on Machine Learning, pp. 10347\u201310357 (2021)"},{"key":"35_CR19","unstructured":"Vaswani, A., et al.: Attention is all you need. In: Advances in Neural Information Processing Systems, vol.\u00a030 (2017)"},{"key":"35_CR20","doi-asserted-by":"crossref","unstructured":"Wang, K., Peng, X., Yang, J., Lu, S., Qiao, Y.: Suppressing uncertainties for large-scale facial expression recognition. In: 2020 IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 6896\u20136905 (2020)","DOI":"10.1109\/CVPR42600.2020.00693"},{"key":"35_CR21","doi-asserted-by":"publisher","first-page":"4057","DOI":"10.1109\/TIP.2019.2956143","volume":"29","author":"K Wang","year":"2020","unstructured":"Wang, K., Peng, X., Yang, J., Meng, D., Qiao, Y.: Region attention networks for pose and occlusion robust facial expression recognition. IEEE Trans. Image Process. 29, 4057\u20134069 (2020)","journal-title":"IEEE Trans. Image Process."},{"issue":"2","key":"35_CR22","doi-asserted-by":"publisher","first-page":"199","DOI":"10.3390\/biomimetics8020199","volume":"8","author":"Z Wen","year":"2023","unstructured":"Wen, Z., Lin, W., Wang, T., Xu, G.: Distract your attention: multi-head cross attention network for facial expression recognition. Biomimetics 8(2), 199 (2023)","journal-title":"Biomimetics"},{"key":"35_CR23","doi-asserted-by":"crossref","unstructured":"Xu, Y., et al.: Evo-ViT: slow-fast token evolution for dynamic vision transformer. In: Proceedings of the AAAI Conference on Artificial Intelligence, pp. 2964\u20132972 (2022)","DOI":"10.1609\/aaai.v36i3.20202"},{"key":"35_CR24","doi-asserted-by":"crossref","unstructured":"Xue, F., Wang, Q., Guo, G.: Transfer: learning relation-aware facial expression representations with transformers. In: 2021 IEEE\/CVF International Conference on Computer Vision, pp. 3581\u20133590 (2021)","DOI":"10.1109\/ICCV48922.2021.00358"},{"issue":"4","key":"35_CR25","doi-asserted-by":"publisher","first-page":"3244","DOI":"10.1109\/TAFFC.2022.3226473","volume":"14","author":"F Xue","year":"2023","unstructured":"Xue, F., Wang, Q., Tan, Z., Ma, Z., Guo, G.: Vision transformer with attentive pooling for robust facial expression recognition. IEEE Trans. Affect. Comput. 14(4), 3244\u20133256 (2023)","journal-title":"IEEE Trans. Affect. Comput."},{"key":"35_CR26","unstructured":"Zhang, Y., Wang, C., Deng, W.: Relative uncertainty learning for facial expression recognition. In: Advances in Neural Information Processing Systems, vol.\u00a034, pp. 17616\u201317627 (2021)"},{"key":"35_CR27","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Wang, C., Ling, X., Deng, W.: Learn from all: erasing attention consistency for noisy label facial expression recognition. In: European Conference on Computer Vision, pp. 418\u2013434 (2022)","DOI":"10.1007\/978-3-031-19809-0_24"},{"key":"35_CR28","doi-asserted-by":"crossref","unstructured":"Zheng, C., Mendieta, M., Chen, C.: Poster: a pyramid cross-fusion transformer network for facial expression recognition. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 3146\u20133155 (2023)","DOI":"10.1109\/ICCVW60793.2023.00339"},{"key":"35_CR29","doi-asserted-by":"crossref","unstructured":"Zhu, J., Luo, B., Sun, A., Tan, J., Zhao, X., Gao, Y.: Variance-aware bi-attention expression transformer for open-set facial expression recognition in the wild. In: Proceedings of the 31st ACM International Conference on Multimedia, pp. 862\u2013870 (2023)","DOI":"10.1145\/3581783.3612546"}],"container-title":["Lecture Notes in Computer Science","Image and Graphics"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-981-95-3393-0_35","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,4]],"date-time":"2026-04-04T16:30:21Z","timestamp":1775320221000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-981-95-3393-0_35"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,11,1]]},"ISBN":["9789819533923","9789819533930"],"references-count":29,"URL":"https:\/\/doi.org\/10.1007\/978-981-95-3393-0_35","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,11,1]]},"assertion":[{"value":"1 November 2025","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ICIG","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Image and Graphics","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Xuzhou","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"China","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2025","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"31 October 2025","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2 November 2025","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"13","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"icig2025","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/icig.csig.org.cn\/2025\/index.html","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}