{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,27]],"date-time":"2026-07-27T12:07:45Z","timestamp":1785154065717,"version":"3.55.0"},"reference-count":125,"publisher":"Springer Science and Business Media LLC","issue":"2","license":[{"start":{"date-parts":[[2018,5,8]],"date-time":"2018-05-08T00:00:00Z","timestamp":1525737600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2018,5,8]],"date-time":"2018-05-08T00:00:00Z","timestamp":1525737600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2019,2,15]]},"DOI":"10.1007\/s11263-018-1097-z","type":"journal-article","created":{"date-parts":[[2018,5,8]],"date-time":"2018-05-08T15:14:54Z","timestamp":1525792494000},"page":"115-142","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":313,"title":["Facial Landmark Detection: A Literature Survey"],"prefix":"10.1007","volume":"127","author":[{"given":"Yue","family":"Wu","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Qiang","family":"Ji","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2018,5,8]]},"reference":[{"issue":"6","key":"1097_CR1","doi-asserted-by":"publisher","first-page":"569,028","DOI":"10.1155\/S1110865702203078","volume":"2002","author":"J Ahlberg","year":"2002","unstructured":"Ahlberg, J. (2002). An active model for facial feature tracking. EURASIP Journal on Advances in Signal Processing, 2002(6), 569,028.","journal-title":"EURASIP Journal on Advances in Signal Processing"},{"key":"1097_CR2","doi-asserted-by":"crossref","unstructured":"Alabort-I-Medina, J., & Zafeiriou, S. (2014). Bayesian active appearance models. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2014.439"},{"key":"1097_CR3","doi-asserted-by":"crossref","unstructured":"Asthana, A., Zafeiriou, S., Cheng, S., & Pantic, M. (2013). Robust discriminative response map fitting with constrained local models. In IEEE conference on computer vision and pattern recognition, CVPR \u201913, pp. 3444\u20133451.","DOI":"10.1109\/CVPR.2013.442"},{"key":"1097_CR4","doi-asserted-by":"crossref","unstructured":"Asthana, A., Zafeiriou, S., Cheng, S., & Pantic, M. (2014). Incremental face alignment in the wild. In IEEE conference on computer vision and pattern recognition, pp. 1859\u20131866.","DOI":"10.1109\/CVPR.2014.240"},{"key":"1097_CR5","doi-asserted-by":"publisher","first-page":"221","DOI":"10.1023\/B:VISI.0000011205.11775.fd","volume":"56","author":"S Baker","year":"2002","unstructured":"Baker, S., Gross, R., & Matthews, I. (2002). Lucas-kanade 20 years on: A unifying framework: Part 3. International Journal of Computer Vision, 56, 221\u2013255.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR6","doi-asserted-by":"crossref","unstructured":"Baltrusaitis, T., Robinson, P., & Morency, L. P. (2014). Continuous conditional neural fields for structured regression. In European conference on computer vision (pp. 593\u2013608). Springer.","DOI":"10.1007\/978-3-319-10593-2_39"},{"key":"1097_CR7","doi-asserted-by":"crossref","unstructured":"Baltru\u0161aitis, T., Robinson, P., & Morency, L. P. (2012). 3D constrained local model for rigid and non-rigid facial tracking. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2012.6247980"},{"issue":"12","key":"1097_CR8","doi-asserted-by":"publisher","first-page":"2930","DOI":"10.1109\/TPAMI.2013.23","volume":"35","author":"P Belhumeur","year":"2013","unstructured":"Belhumeur, P., Jacobs, D., Kriegman, D., & Kumar, N. (2013). Localizing parts of faces using a consensus of exemplars. IEEE Transactions on Pattern Analysis and Machine Intelligence, 35(12), 2930\u20132940.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR9","doi-asserted-by":"crossref","unstructured":"Belhumeur, P. N., Jacobs, D. W., Kriegman, D. J., & Kumar, N. (2011). Localizing parts of faces using a consensus of exemplars. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2011.5995602"},{"key":"1097_CR10","unstructured":"BioID. https:\/\/www.bioid.com\/About\/BioID-Face-Database. Accessed 30 August 2015."},{"key":"1097_CR11","doi-asserted-by":"crossref","unstructured":"Bourel, F., Chibelushi, C., & Low, A. (2000). Robust facial feature tracking. In British Machine Vision Conference, pp. 24.1\u201324.10.","DOI":"10.5244\/C.14.24"},{"key":"1097_CR12","doi-asserted-by":"crossref","unstructured":"Burgos-Artizzu, X. P., Perona, P., & Dollar, P. (2013). Robust face landmark estimation under occlusion. In IEEE international conference on computer vision, pp. 1513\u20131520.","DOI":"10.1109\/ICCV.2013.191"},{"key":"1097_CR13","doi-asserted-by":"publisher","first-page":"177","DOI":"10.1007\/s11263-013-0667-3","volume":"107","author":"X Cao","year":"2014","unstructured":"Cao, X., Wei, Y., Wen, F., & Sun, J. (2014). Face alignment by explicit shape regression. International Journal of Computer Vision, 107, 177\u2013190.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR14","first-page":"109","volume-title":"European Conference on Computer Vision, Lecture Notes in Computer Science","author":"D Chen","year":"2014","unstructured":"Chen, D., Ren, S., Wei, Y., Cao, X., & Sun, J. (2014). Joint cascade face detection and alignment. In D. Fleet, T. Pajdla, B. Schiele, & T. Tuytelaars (Eds.), European Conference on Computer Vision, Lecture Notes in Computer Science (Vol. 8694, pp. 109\u2013122). Berlin: Springer."},{"key":"1097_CR15","doi-asserted-by":"publisher","first-page":"198","DOI":"10.1007\/s11263-017-0999-5","volume":"126","author":"GG Chrysos","year":"2017","unstructured":"Chrysos, G. G., Antonakos, E., Snape, P., Asthana, A., & Zafeiriou, S. (2017). A comprehensive performance evaluation of deformable face tracking \"in-the-wild\". International Journal of Computer Vision, 126, 198\u2013232.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR16","doi-asserted-by":"crossref","unstructured":"Cootes, T., Walker, K., & Taylor, C. (2000). View-based active appearance models. In IEEE international conference on automatic face and gesture recognition, pp. 227\u2013232.","DOI":"10.5244\/C.14.6"},{"issue":"6","key":"1097_CR17","doi-asserted-by":"publisher","first-page":"681","DOI":"10.1109\/34.927467","volume":"23","author":"TF Cootes","year":"2001","unstructured":"Cootes, T. F., Edwards, G. J., & Taylor, C. J. (2001). Active appearance models. IEEE Transactions on Pattern Analysis and Machine Intelligence, 23(6), 681\u2013685.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR18","doi-asserted-by":"crossref","unstructured":"Cootes, T. F., Ionita, M. C., Lindner, C., & Sauer, P. (2012). Robust and accurate shape model fitting using random forest regression voting. In European Conference on Computer Vision\u2014Volume Part VII, pp. 278\u2013291.","DOI":"10.1007\/978-3-642-33786-4_21"},{"issue":"1","key":"1097_CR19","doi-asserted-by":"publisher","first-page":"38","DOI":"10.1006\/cviu.1995.1004","volume":"61","author":"TF Cootes","year":"1995","unstructured":"Cootes, T. F., Taylor, C. J., Cooper, D. H., & Graham, J. (1995). Active shape models their training and application. Computer Vision and Image Understanding, 61(1), 38\u201359.","journal-title":"Computer Vision and Image Understanding"},{"issue":"5","key":"1097_CR20","doi-asserted-by":"publisher","first-page":"335","DOI":"10.1016\/j.imavis.2010.12.001","volume":"29","author":"S Cosar","year":"2011","unstructured":"Cosar, S., & Cetin, M. (2011). A graphical model based solution to the facial feature point tracking problem. Image and Vision Computing, 29(5), 335\u2013350.","journal-title":"Image and Vision Computing"},{"key":"1097_CR21","doi-asserted-by":"crossref","unstructured":"Cristinacce, D., & Cootes, T. (2007). Boosted regression active shape models. In British Machine Vision Conference, pp. 880\u2013889.","DOI":"10.5244\/C.21.79"},{"key":"1097_CR22","doi-asserted-by":"crossref","unstructured":"Cristinacce, D., & Cootes, T. F. (2004). A comparison of shape constrained facial feature detectors. In International conference on automatic face and gesture recognition, pp. 375\u2013380.","DOI":"10.1109\/AFGR.2004.1301561"},{"key":"1097_CR23","doi-asserted-by":"crossref","unstructured":"Cristinacce, D., & Cootes, T. F. (2006). Feature detection and tracking with constrained local models. In British Machine Vision Conference.","DOI":"10.5244\/C.20.95"},{"key":"1097_CR24","doi-asserted-by":"crossref","unstructured":"Dantone, M., Gall, J., Fanelli, G., & Gool, L. V. (2012). Real-time facial feature detection using conditional regression forests. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2012.6247976"},{"issue":"10","key":"1097_CR25","doi-asserted-by":"publisher","first-page":"1690","DOI":"10.1109\/TPAMI.2006.206","volume":"28","author":"R Donner","year":"2006","unstructured":"Donner, R., Reiter, M., Langs, G., Peloschek, P., & Bischof, H. (2006). Fast active appearance model search using canonical correlation analysis. IEEE Transactions on Pattern Analysis and Machine Intelligence, 28(10), 1690\u20131694.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR26","doi-asserted-by":"crossref","unstructured":"Edwards, G. J., Taylor, C. J., & Cootes, T. F. (1998). Interpreting face images using active appearance models. In IEEE international conference on face and gesture recognition (pp. 300\u2013305). IEEE Computer Society.","DOI":"10.1109\/AFGR.1998.670965"},{"issue":"C","key":"1097_CR27","doi-asserted-by":"publisher","first-page":"27","DOI":"10.1016\/j.imavis.2015.11.004","volume":"47","author":"H Fan","year":"2016","unstructured":"Fan, H., & Zhou, E. (2016). Approaching human level facial landmark localization by deep learning. Image and Vision Computing, 47(C), 27\u201335.","journal-title":"Image and Vision Computing"},{"issue":"9","key":"1097_CR28","doi-asserted-by":"publisher","first-page":"1627","DOI":"10.1109\/TPAMI.2009.167","volume":"32","author":"PF Felzenszwalb","year":"2010","unstructured":"Felzenszwalb, P. F., Girshick, R. B., McAllester, D., & Ramanan, D. (2010). Object detection with discriminatively trained part-based models. IEEE Transactions on Pattern Analysis and Machine Intellgence, 32(9), 1627\u20131645.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intellgence"},{"issue":"1","key":"1097_CR29","doi-asserted-by":"publisher","first-page":"76","DOI":"10.1109\/LSP.2014.2347011","volume":"22","author":"ZH Feng","year":"2015","unstructured":"Feng, Z. H., Huber, P., Kittler, J., Christmas, W., & Wu, X. J. (2015). Random cascaded-regression copse for robust facial landmark detection. IEEE Signal Processing Letters, 22(1), 76\u201380.","journal-title":"IEEE Signal Processing Letters,"},{"issue":"6","key":"1097_CR30","doi-asserted-by":"publisher","first-page":"643","DOI":"10.1109\/34.927464","volume":"23","author":"A Georghiades","year":"2001","unstructured":"Georghiades, A., Belhumeur, P., & Kriegman, D. (2001). From few to many: Illumination cone models for face recognition under variable lighting and pose. IEEE Transactions on Pattern Analysis and Machine Intelligence, 23(6), 643\u2013660.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR31","doi-asserted-by":"crossref","unstructured":"Ghiasi, G., & Fowlkes, C. (2014). Occlusion coherence: Localizing occluded faces with a hierarchical deformable part model. In IEEE conference on computer vision and pattern recognition, pp. 1899\u20131906.","DOI":"10.1109\/CVPR.2014.306"},{"key":"1097_CR32","doi-asserted-by":"crossref","unstructured":"Girshick, R. (2015). Fast r-cnn. In The IEEE international conference on computer vision (ICCV).","DOI":"10.1109\/ICCV.2015.169"},{"key":"1097_CR33","doi-asserted-by":"crossref","unstructured":"Girshick, R., Donahue, J., Darrell, T., & Malik, J. (2014). Rich feature hierarchies for accurate object detection and semantic segmentation. In The IEEE conference on computer vision and pattern recognition (CVPR).","DOI":"10.1109\/CVPR.2014.81"},{"key":"1097_CR34","doi-asserted-by":"crossref","unstructured":"Gou, C., Wu, Y., Wang, F. Y., & Ji, Q. (2016). Shape augmented regression for 3D face alignment, pp. 604\u2013615. Cham.","DOI":"10.1007\/978-3-319-48881-3_42"},{"issue":"1","key":"1097_CR35","doi-asserted-by":"publisher","first-page":"33","DOI":"10.1007\/BF02291478","volume":"40","author":"JC Gower","year":"1975","unstructured":"Gower, J. C. (1975). Generalized procrustes analysis. Psychometrika, 40(1), 33\u201351.","journal-title":"Psychometrika"},{"issue":"4","key":"1097_CR36","doi-asserted-by":"publisher","first-page":"449","DOI":"10.1109\/TPAMI.2004.1265861","volume":"26","author":"R Gross","year":"2004","unstructured":"Gross, R., Matthews, I., & Baker, S. (2004). Appearance-based face recognition and light-fields. IEEE Transactions on Pattern Analysis and Machine Intelligence, 26(4), 449\u2013465.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"12","key":"1097_CR37","doi-asserted-by":"publisher","first-page":"1080","DOI":"10.1016\/j.imavis.2005.07.009","volume":"23","author":"R Gross","year":"2005","unstructured":"Gross, R., Matthews, I., & Baker, S. (2005). Generic vs. person specific active appearance models. Image Vision and Computing, 23(12), 1080\u20131093.","journal-title":"Image Vision and Computing"},{"issue":"5","key":"1097_CR38","doi-asserted-by":"publisher","first-page":"807","DOI":"10.1016\/j.imavis.2009.08.002","volume":"28","author":"R Gross","year":"2010","unstructured":"Gross, R., Matthews, I., Cohn, J., Kanade, T., & Baker, S. (2010). Multi-pie. Image Vision and Computing, 28(5), 807\u2013813.","journal-title":"Image Vision and Computing"},{"key":"1097_CR39","doi-asserted-by":"crossref","unstructured":"Gu, L., & Kanade, T. (2008). A generative shape regularization model for robust face alignment. In European Conference on Computer Vision: Part I (pp. 413\u2013426). Berlin, Heidelberg: Springer.","DOI":"10.1007\/978-3-540-88682-2_32"},{"issue":"3","key":"1097_CR40","doi-asserted-by":"publisher","first-page":"478","DOI":"10.1109\/TPAMI.2009.30","volume":"32","author":"DW Hansen","year":"2010","unstructured":"Hansen, D. W., & Ji, Q. (2010). In the eye of the beholder: A survey of models for eyes and gaze. IEEE Transactions on Pattern Analysis and Machine Intelligence, 32(3), 478\u2013500.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"2","key":"1097_CR41","doi-asserted-by":"publisher","first-page":"167","DOI":"10.1007\/s11263-006-0006-z","volume":"74","author":"B Heisele","year":"2007","unstructured":"Heisele, B., Serre, T., & Poggio, T. (2007). A component-based framework for face detection and identification. International Journal of Computer Vision, 74(2), 167\u2013181.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR42","unstructured":"Hou, X., Li, S., Zhang, H., & Cheng, Q. (2001). Direct appearance models. In IEEE conference on computer vision and pattern recognition, Vol. 1."},{"key":"1097_CR43","doi-asserted-by":"crossref","unstructured":"Hsu, G. S., Chang, K. H., & Huang, S. C. (2015). Regressive tree structured model for facial landmark localization. In IEEE International conference on computer vision, pp. 3855\u20133861.","DOI":"10.1109\/ICCV.2015.439"},{"key":"1097_CR44","doi-asserted-by":"crossref","unstructured":"Hu, C., Feris, R., & Turk, M. (2003). Real-time view-based face alignment using active wavelet networks. In IEEE international workshop on analysis and modeling of faces and gestures, pp. 215\u2013221.","DOI":"10.1109\/AMFG.2003.1240846"},{"key":"1097_CR45","doi-asserted-by":"crossref","unstructured":"Jeni, L. A., Cohn, J. F., & Kanade, T. (2015). Dense 3D face alignment from 2D videos in real-time. In 2015 11th IEEE international conference and workshops on automatic face and gesture recognition (FG). articles\/Jeni15FG_ZFace.pdf.","DOI":"10.1109\/FG.2015.7163142"},{"key":"1097_CR46","unstructured":"Jiao, F., Li, S., Shum, H., & Schuurmans, D. (2003). Face alignment using statistical models and wavelet features. In IEEE conference on computer vision and pattern recognition."},{"issue":"2","key":"1097_CR47","doi-asserted-by":"publisher","first-page":"107","DOI":"10.1023\/A:1008074226832","volume":"29","author":"M Jones","year":"1998","unstructured":"Jones, M., & Poggio, T. (1998). Multidimensional morphable models: A framework for representing and matching object classes. International Journal of Computer Vision, 29(2), 107\u2013131.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR48","doi-asserted-by":"crossref","unstructured":"Jourabloo, A., & Liu, X. (2015). Pose-invariant 3D face alignment. In 2015 IEEE international conference on computer vision (ICCV), pp. 3694\u20133702.","DOI":"10.1109\/ICCV.2015.421"},{"key":"1097_CR49","doi-asserted-by":"crossref","unstructured":"Jourabloo, A., & Liu, X. (2016). Large-pose face alignment via CNN-based dense 3D model fitting. In IEEE conference on computer vision and pattern recognition. Las Vegas, NV.","DOI":"10.1109\/CVPR.2016.454"},{"key":"1097_CR50","unstructured":"Kanade, T., Cohn, J. F., & Tian, Y. Comprehensive database for facial expression analysis. In IEEE international conference on automatic face and gesture recognition, pp. 46\u201353."},{"key":"1097_CR51","doi-asserted-by":"crossref","unstructured":"Kazemi, V., & Sullivan, J. (2014). One millisecond face alignment with an ensemble of regression trees. In IEEE conference on computer vision and pattern recognition (CVPR), pp. 1867\u20131874.","DOI":"10.1109\/CVPR.2014.241"},{"key":"1097_CR52","doi-asserted-by":"crossref","unstructured":"Koestinger, M., Wohlhart, P., Roth, P. M., & Bischof, H. (2011). Annotated facial landmarks in the wild: A large-scale, real-world database for facial landmark localization. In First IEEE international workshop on benchmarking facial image analysis technologies.","DOI":"10.1109\/ICCVW.2011.6130513"},{"key":"1097_CR53","unstructured":"Landmark annotation for AR database. http:\/\/personalpages.manchester.ac.uk\/staff\/timothy.f.cootes\/data\/tarfd_markup\/tarfd_markup.html."},{"key":"1097_CR54","doi-asserted-by":"crossref","unstructured":"Le, V., Brandt, J., Lin, Z., Bourdev, L., & Huang, T. S. (2012). Interactive facial feature localization. In European Conference on Computer Vision\u2014Volume Part III, pp. 679\u2013692.","DOI":"10.1007\/978-3-642-33712-3_49"},{"key":"1097_CR55","doi-asserted-by":"crossref","unstructured":"Levi, G., & Hassncer, T. (2015). Age and gender classification using convolutional neural networks. In 2015 IEEE conference on computer vision and pattern recognition workshops (CVPRW), pp. 34\u201342.","DOI":"10.1109\/CVPRW.2015.7301352"},{"issue":"7","key":"1097_CR56","doi-asserted-by":"publisher","first-page":"2559","DOI":"10.1109\/TIP.2013.2253483","volume":"22","author":"Y Li","year":"2013","unstructured":"Li, Y., Wang, S., Zhao, Y., & Ji, Q. (2013). Simultaneous facial feature tracking and facial expression recognition. IEEE Transactions on Image Processing, 22(7), 2559\u20132573.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1097_CR57","unstructured":"Liang\u00a0S Wu\u00a0J, Liang, S., Wu, J., Weinberg, S. M., & Shapiro, L. G. (2013). Improved detection of landmarks on 3D human face data. In Annual international conference of the IEEE Engineering in Medicine and Biology Society."},{"key":"1097_CR58","doi-asserted-by":"publisher","first-page":"610","DOI":"10.1016\/j.patcog.2016.07.026","volume":"61","author":"AT Lopes","year":"2017","unstructured":"Lopes, A. T., de Aguiar, E., Souza, A. F. D., & Oliveira-Santos, T. (2017). Facial expression recognition with convolutional neural networks: Coping with few data and the training sample order. Pattern Recognition, 61, 610\u2013628.","journal-title":"Pattern Recognition"},{"key":"1097_CR59","doi-asserted-by":"crossref","unstructured":"Lucey, P., Cohn, J., Kanade, T., Saragih, J., Ambadar, Z., & Matthews, I. (2010). The extended Cohn-Kanade dataset (CK+): A complete dataset for action unit and emotion-specified expression. In IEEE conference on computer vision and pattern recognition workshops, pp. 94\u2013101.","DOI":"10.1109\/CVPRW.2010.5543262"},{"key":"1097_CR60","unstructured":"Mart\u00ednez, A., & Benavente, R. (1998). The AR face database."},{"issue":"5","key":"1097_CR61","doi-asserted-by":"publisher","first-page":"1149","DOI":"10.1109\/TPAMI.2012.205","volume":"35","author":"B Martinez","year":"2013","unstructured":"Martinez, B., Valstar, M. F., Binefa, X., & Pantic, M. (2013). Local evidence aggregation for regression-based facial point detection. IEEE Transactions on Pattern Analysis and Machine Intelligence, 35(5), 1149\u20131163.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR62","doi-asserted-by":"crossref","unstructured":"Mathias, M., Benenson, R., Pedersoli, M., & Van Gool, L. (2014). Face detection without bells and whistles. In European Conference on Computer Vision.","DOI":"10.1007\/978-3-319-10593-2_47"},{"issue":"2","key":"1097_CR63","doi-asserted-by":"publisher","first-page":"135","DOI":"10.1023\/B:VISI.0000029666.37597.d3","volume":"60","author":"I Matthews","year":"2004","unstructured":"Matthews, I., & Baker, S. (2004). Active appearance models revisited. International Journal of Computer Vision, 60(2), 135\u2013164.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR64","unstructured":"Messer, K., Matas, J., Kittler, J., & Jonsson, K. (1999). XM2VTSDB: The extended M2VTS database. In International conference on audio and video-based biometric person authentication, pp. 72\u201377."},{"key":"1097_CR65","doi-asserted-by":"crossref","unstructured":"Milborrow, S., & Nicolls, F. (2008). Locating facial features with an extended active shape model. In European Conference on Computer Vision: Part IV (pp. 504\u2013513). Berlin, Heidelberg: Springer.","DOI":"10.1007\/978-3-540-88693-8_37"},{"issue":"4","key":"1097_CR66","doi-asserted-by":"publisher","first-page":"607","DOI":"10.1109\/TPAMI.2008.106","volume":"31","author":"E Murphy-Chutorian","year":"2009","unstructured":"Murphy-Chutorian, E., & Trivedi, M. (2009). Head pose estimation in computer vision: A survey. IEEE Transactions on Pattern Analysis and Machine Intelligence, 31(4), 607\u2013626.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR67","doi-asserted-by":"publisher","first-page":"47","DOI":"10.1016\/S0262-8856(01)00076-2","volume":"20","author":"K Nickels","year":"2002","unstructured":"Nickels, K., & Hutchinson, S. (2002). Estimating uncertainty in SSD-based feature tracking. Image and Vision Computing, 20, 47\u201358.","journal-title":"Image and Vision Computing"},{"issue":"12","key":"1097_CR68","doi-asserted-by":"publisher","first-page":"1424","DOI":"10.1109\/34.895976","volume":"22","author":"M Pantic","year":"2000","unstructured":"Pantic, M., & Rothkrantz, L. J. M. (2000). Automatic analysis of facial expressions: The state of the art. IEEE Transanctions on Pattern Analysis and Machine Intellgence, 22(12), 1424\u20131445.","journal-title":"IEEE Transanctions on Pattern Analysis and Machine Intellgence"},{"key":"1097_CR69","doi-asserted-by":"crossref","unstructured":"Papazov, C., Marks, T., & Jones, M. (2015). Real-time head pose and facial landmark estimation from depth images using triangular surface patch features. In IEEE conference on computer vision and pattern recognition (CVPR) (pp. 4722\u20134730). IEEE.","DOI":"10.1109\/CVPR.2015.7299104"},{"key":"1097_CR70","doi-asserted-by":"publisher","first-page":"132","DOI":"10.1016\/j.patcog.2017.06.009","volume":"71","author":"M Patacchiola","year":"2017","unstructured":"Patacchiola, M., & Cangelosi, A. (2017). Head pose estimation in the wild using convolutional neural networks and adaptive gradient methods. Pattern Recognition, 71, 132\u2013143.","journal-title":"Pattern Recognition"},{"key":"1097_CR71","doi-asserted-by":"crossref","unstructured":"Patrick Sauer, T. C., & Taylor, C. (2011). Accurate regression procedures for active appearance models. In British Machine Vision Conference.","DOI":"10.5244\/C.25.30"},{"issue":"7","key":"1097_CR72","doi-asserted-by":"publisher","first-page":"1552","DOI":"10.1109\/TPAMI.2012.247","volume":"35","author":"P Perakis","year":"2013","unstructured":"Perakis, P., Passalis, G., Theoharis, T., & Kakadiaris, I. A. (2013). 3D facial landmark detection under large yaw and expression variations. IEEE Transactions on Pattern Analysis and Machine Intelligence, 35(7), 1552\u20131564.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR73","unstructured":"Phillips, P. J., Flynn, P. J., Scruggs, T., Bowyer, K. W., Chang, J., Hoffman, K., et al. (2005). Overview of the face recognition grand challenge. In IEEE conference on computer vision and pattern recognition, CVPR \u201905 (pp. 947\u2013954). Washington, DC: IEEE Computer Society."},{"key":"1097_CR74","doi-asserted-by":"crossref","unstructured":"Phillips, P. J., Moon, H., Rauss, P., & Rizvi, S. A. (1997). The FERET evaluation methodology for face-recognition algorithms. In IEEE conference on computer vision and pattern recognition, CVPR \u201997 (pp. 137\u2013143). Washington, DC: IEEE Computer Society.","DOI":"10.6028\/NIST.IR.6264"},{"key":"1097_CR75","unstructured":"Ranjan, R., Patel, V. M., & Chellappa, R. (2016). Hyperface: A deep multi-task learning framework for face detection, landmark localization, pose estimation, and gender recognition. CoRR arXiv:1603.01249."},{"key":"1097_CR76","doi-asserted-by":"crossref","unstructured":"Ren, S., Cao, X., Wei, Y., & Sun, J. (2014). Face alignment at 3000 FPS via regressing local binary features. In IEEE conference on computer vision and pattern recognition (CVPR), pp. 1685\u20131692.","DOI":"10.1109\/CVPR.2014.218"},{"key":"1097_CR77","unstructured":"Ren, S., He, K., Girshick, R., & Sun, J. (2015). Faster r-cnn: Towards real-time object detection with region proposal networks. In NIPS."},{"key":"1097_CR78","doi-asserted-by":"crossref","unstructured":"Sagonas, C., Antonakos, E., Tzimiropoulos, G., Zafeiriou, S., & Pantic, M. (2016). 300 faces in-the-wild challenge: Database and results. Image and Vision Computing, 47, 3\u201318. 300-W, the First Automatic Facial Landmark Detection in-the-Wild Challenge.","DOI":"10.1016\/j.imavis.2016.01.002"},{"key":"1097_CR79","doi-asserted-by":"crossref","unstructured":"Sagonas, C., Tzimiropoulos, G., Zafeiriou, S., & Pantic, M. (2013). 300 faces in-the-wild challenge: The first facial landmark localization challenge. In IEEE international conference on computer vision, 300 Faces in-the-Wild Challenge (300-W). Sydney, Australia.","DOI":"10.1109\/ICCVW.2013.59"},{"key":"1097_CR80","doi-asserted-by":"crossref","unstructured":"Sagonas, C., Tzimiropoulos, G., Zafeiriou, S., & Pantic, M. (2013a). A semi-automatic methodology for facial landmark annotation. In 2013 IEEE conference on computer vision and pattern recognition workshops, pp. 896\u2013903.","DOI":"10.1109\/CVPRW.2013.132"},{"key":"1097_CR81","doi-asserted-by":"crossref","unstructured":"Sagonas, C., Tzimiropoulos, G., Zafeiriou, S., & Pantic, M. (2013b). A semi-automatic methodology for facial landmark annotation. In IEEE conference on computer vision and pattern recognition workshop. Portland Oregon, USA.","DOI":"10.1109\/CVPRW.2013.132"},{"issue":"11","key":"1097_CR82","doi-asserted-by":"publisher","first-page":"2628","DOI":"10.1016\/j.patcog.2009.04.014","volume":"42","author":"J Saragih","year":"2009","unstructured":"Saragih, J., & Gocke, R. (2009). Learning AAM fitting through simulation. Pattern Recognition, 42(11), 2628\u20132636.","journal-title":"Pattern Recognition"},{"key":"1097_CR83","doi-asserted-by":"crossref","unstructured":"Saragih, J., & Goecke, R. (2007). A nonlinear discriminative approach to AAM fitting. In International conference on computer vision, pp. 1\u20138.","DOI":"10.1109\/ICCV.2007.4409106"},{"issue":"2","key":"1097_CR84","doi-asserted-by":"publisher","first-page":"200","DOI":"10.1007\/s11263-010-0380-4","volume":"91","author":"JM Saragih","year":"2011","unstructured":"Saragih, J. M., Lucey, S., & Cohn, J. F. (2011). Deformable model fitting by regularized landmark mean-shift. International Journal of Computer Vision, 91(2), 200\u2013215.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR85","doi-asserted-by":"crossref","unstructured":"Schroff, F., Kalenichenko, D., & Philbin, J. (2015). Facenet: A unified embedding for face recognition and clustering.","DOI":"10.1109\/CVPR.2015.7298682"},{"key":"1097_CR86","doi-asserted-by":"crossref","unstructured":"Shen, J., Zafeiriou, S., Chrysos, G. G., Kossaifi, J., Tzimiropoulos, G., & Pantic, M. (2015). The first facial landmark tracking in-the-wild challenge: Benchmark and results. In The IEEE international conference on computer vision (ICCV) workshops.","DOI":"10.1109\/ICCVW.2015.132"},{"key":"1097_CR87","doi-asserted-by":"crossref","unstructured":"Shen, X., Lin, Z., Brandt, J., & Wu, Y. (2013). Detecting and aligning faces by image retrieval. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2013.444"},{"key":"1097_CR88","doi-asserted-by":"crossref","unstructured":"Smith, B., Brandt, J., Lin, Z., & Zhang, L. (2014). Nonparametric context modeling of local appearance for pose- and expression-robust facial landmark localization. In IEEE conference on computer vision and pattern recognition, pp. 1741\u20131748.","DOI":"10.1109\/CVPR.2014.225"},{"key":"1097_CR89","doi-asserted-by":"crossref","unstructured":"Smith, B. M., & Zhang, L. (2014). Collaborative facial landmark localization for transferring annotations across datasets (pp. 78\u201393). Cham: Springer.","DOI":"10.1007\/978-3-319-10599-4_6"},{"key":"1097_CR90","unstructured":"Sun, Y., Liang, D., Wang, X., & Tang, X. (2015). Deepid3: Face recognition with very deep neural networks. CoRR arXiv:1502.00873."},{"key":"1097_CR91","doi-asserted-by":"crossref","unstructured":"Sun, Y., Wang, X., & Tang, X. (2013). Deep convolutional network cascade for facial point detection. In IEEE conference on computer vision and pattern recognition, pp. 3476\u20133483.","DOI":"10.1109\/CVPR.2013.446"},{"key":"1097_CR92","doi-asserted-by":"crossref","unstructured":"Taigman, Y., Yang, M., Ranzato, M., & Wolf, L. (2014). Deepface: Closing the gap to human-level performance in face verification.","DOI":"10.1109\/CVPR.2014.220"},{"issue":"8","key":"1097_CR93","doi-asserted-by":"publisher","first-page":"922","DOI":"10.1016\/j.cviu.2012.03.008","volume":"116","author":"Y Tong","year":"2012","unstructured":"Tong, Y., Liu, X., Wheeler, F. W., & Tu, P. H. (2012). Semi-supervised facial landmark annotation. Computer Vision and Image Understanding, 116(8), 922\u2013935.","journal-title":"Computer Vision and Image Understanding"},{"issue":"11","key":"1097_CR94","doi-asserted-by":"publisher","first-page":"3195","DOI":"10.1016\/j.patcog.2007.02.021","volume":"40","author":"Y Tong","year":"2007","unstructured":"Tong, Y., Wang, Y., Zhu, Z., & Ji, Q. (2007). Robust facial feature tracking under varying face pose and facial expression. Pattern Recognition, 40(11), 3195\u20133208.","journal-title":"Pattern Recognition"},{"key":"1097_CR95","doi-asserted-by":"crossref","unstructured":"Tresadern, P., Sauer, P., & Cootes, T. (2010). Additive update predictors in active appearance models. In British Machine Vision Conference (pp. 91.1\u201391.12). BMVA Press.","DOI":"10.5244\/C.24.91"},{"key":"1097_CR96","doi-asserted-by":"crossref","unstructured":"Trigeorgis, G., Snape, P., Nicolaou, M. A., Antonakos, E., & Zafeiriou, S. (2016). Mnemonic descent method: A recurrent process applied for end-to-end face alignment. In IEEE conference on computer vision and pattern recognition (CVPR), pp. 4177\u20134187. Las Vegas, NV, USA.","DOI":"10.1109\/CVPR.2016.453"},{"key":"1097_CR97","doi-asserted-by":"crossref","unstructured":"Tulyakov, S., & Sebe, N. (2015). Regressing a 3D face shape from a single image. In IEEE international conference on computer vision, pp. 3748\u20133755.","DOI":"10.1109\/ICCV.2015.427"},{"key":"1097_CR98","doi-asserted-by":"crossref","unstructured":"Tzimiropoulos, G., i\u00a0medina, J. A., Zafeiriou, S., Pantic, M. (2012). Generic active appearance models revisited. In Asian Conference on Computer Vision, pp. 650\u2013663. Daejeon, Korea.","DOI":"10.1007\/978-3-642-37431-9_50"},{"key":"1097_CR99","unstructured":"Tzimiropoulos, G., & Pantic, M. Optimization problems for fast aam fitting in-the-wild. In IEEE international conference on computer vision, pp. 593\u2013600."},{"key":"1097_CR100","doi-asserted-by":"crossref","unstructured":"Tzimiropoulos, G., & Pantic, M. (2014). Gauss-Newton deformable part models for face alignment in-the-wild. In IEEE conference on computer vision and pattern recognition, pp. 1851\u20131858.","DOI":"10.1109\/CVPR.2014.239"},{"key":"1097_CR101","unstructured":"U\u0159i\u010d\u00e1\u0159, M., Franc, V., & Hlav\u00e1\u010d, V. (2012). Detector of facial landmarks learned by the structured output SVM. In International conference on computer vision theory and applications (Vol. 1, pp. 547\u2013556). Portugal."},{"key":"1097_CR102","doi-asserted-by":"crossref","unstructured":"Valstar, M., Martinez, B., Binefa, V., & Pantic, M. (2010). Facial point detection using boosted regression and graph models. In IEEE conference on computer vision and pattern recognition, pp. 13\u201318.","DOI":"10.1109\/CVPR.2010.5539996"},{"key":"1097_CR103","doi-asserted-by":"crossref","unstructured":"Viola, P., & Jones, M. (2001). Rapid object detection using a boosted cascade of simple features. In IEEE conference on computer vision and pattern recognition, Vol. 1, pp. I-511\u2013I-518.","DOI":"10.1109\/CVPR.2001.990517"},{"issue":"8","key":"1097_CR104","doi-asserted-by":"publisher","first-page":"1292","DOI":"10.1109\/TPAMI.2005.167","volume":"27","author":"O Williams","year":"2005","unstructured":"Williams, O., Blake, A., & Cipolla, R. (2005). Sparse Bayesian learning for efficient visual tracking. IEEE Transactions on Pattern Analysis and Machine Intelligence, 27(8), 1292\u20131304.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"1","key":"1097_CR105","doi-asserted-by":"publisher","first-page":"37","DOI":"10.1007\/s11263-014-0775-8","volume":"113","author":"Y Wu","year":"2015","unstructured":"Wu, Y., & Ji, Q. (2015). Discriminative deep face shape model for facial point detection. International Journal of Computer Vision, 113(1), 37\u201353.","journal-title":"International Journal of Computer Vision"},{"key":"1097_CR106","doi-asserted-by":"crossref","unstructured":"Wu, Y., & Ji, Q. (2015). Robust facial landmark detection under significant head poses and occlusion. In International conference on computer vision.","DOI":"10.1109\/ICCV.2015.417"},{"key":"1097_CR107","doi-asserted-by":"crossref","unstructured":"Wu, Y., & Ji, Q. (2016). Constrained joint cascade regression framework for simultaneous facial action unit recognition and facial landmark detection. In IEEE conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2016.370"},{"key":"1097_CR108","doi-asserted-by":"crossref","unstructured":"Wu, Y., Wang, Z., & Ji, Q. (2013). Facial feature tracking under varying facial expressions and face poses based on restricted Boltzmann machines. In IEEE conference on computer vision and pattern recognition, pp. 3452\u20133459.","DOI":"10.1109\/CVPR.2013.443"},{"key":"1097_CR109","doi-asserted-by":"crossref","unstructured":"Wu, Y., Wang, Z., & Ji, Q. (2014). A hierarchical probabilistic model for facial feature detection. In IEEE conference on computer vision and pattern recognition, pp. 1781\u20131788.","DOI":"10.1109\/CVPR.2014.230"},{"key":"1097_CR110","doi-asserted-by":"crossref","unstructured":"Xiong, X., & De la Torre Frade, F. (2013). Supervised descent method and its applications to face alignment. In IEEE international conference on computer vision and pattern recognition.","DOI":"10.1109\/CVPR.2013.75"},{"key":"1097_CR111","doi-asserted-by":"crossref","unstructured":"Xiong, X., & la Torre, F. D. (2015). Global supervised descent method. In IEEE conference on computer vision and pattern recognition, pp. 2664\u20132673.","DOI":"10.1109\/CVPR.2015.7298882"},{"key":"1097_CR112","doi-asserted-by":"publisher","first-page":"106","DOI":"10.1002\/ima.10039","volume":"13","author":"S Yan","year":"2003","unstructured":"Yan, S., Hou, X., Li, S. Z., Zhang, H., & Cheng, Q. (2003). Face alignment using view-based direct appearance models. Special issue on facial image processing, analysis and synthesis. International Journal of Imaging Systems and Technology, 13, 106\u2013112.","journal-title":"International Journal of Imaging Systems and Technology"},{"key":"1097_CR113","unstructured":"Yang, H., & Patras, I. (2013). Privileged information-based conditional regression forest for facial feature detection. In IEEE international conference and workshops on automatic face and gesture recognition, pp. 1\u20136."},{"key":"1097_CR114","doi-asserted-by":"crossref","unstructured":"Yin, L., Chen, X., Sun, Y., Worm, T., & Reale, M. (2008). A high-resolution 3D dynamic facial expression database. FG 2,3,5.","DOI":"10.1109\/AFGR.2008.4813324"},{"key":"1097_CR115","doi-asserted-by":"crossref","unstructured":"Yu, X., Huang, J., Zhang, S., Yan, W., & Metaxas, D. (2013). Pose free facial landmark fitting via optimized part mixtures and cascaded deformable shape model. In IEEE international conference on computer vision.","DOI":"10.1109\/ICCV.2013.244"},{"key":"1097_CR116","first-page":"105","volume-title":"European Conference on Computer Vision, Lecture Notes in Computer Science","author":"X Yu","year":"2014","unstructured":"Yu, X., Lin, Z., Brandt, J., & Metaxas, D. N. (2014). Consensus of regression for occlusion-robust facial feature localization. In D. Fleet, T. Pajdla, B. Schiele, & T. Tuytelaars (Eds.), European Conference on Computer Vision, Lecture Notes in Computer Science (Vol. 8692, pp. 105\u2013118). Berlin: Springer."},{"key":"1097_CR117","unstructured":"Zhang, C., & Zhang, Z. (2010). A survey of recent advances in face detection. Tech. Rep. MSR-TR-2010-66."},{"key":"1097_CR118","doi-asserted-by":"crossref","unstructured":"Zhang, J., Shan, S., Kan, M., & Chen, X. (2014). Coarse-to-fine auto-encoder networks (CFAN) for real-time face alignment. In European Conference on Computer Vision, Part II, pp. 1\u201316.","DOI":"10.1007\/978-3-319-10605-2_1"},{"key":"1097_CR119","doi-asserted-by":"crossref","unstructured":"Zhang, Z., Luo, P., Loy, C., & Tang, X. (2014). Facial landmark detection by deep multi-task learning. In European Conference on Computer Vision, Part II, pp. 94\u2013108.","DOI":"10.1007\/978-3-319-10599-4_7"},{"issue":"5","key":"1097_CR120","doi-asserted-by":"publisher","first-page":"918","DOI":"10.1109\/TPAMI.2015.2469286","volume":"38","author":"Z Zhang","year":"2016","unstructured":"Zhang, Z., Luo, P., Loy, C. C., & Tang, X. (2016). Learning deep representation for face alignment with auxiliary attributes. IEEE Transactions on Pattern Analysis and Machine Intelligence, 38(5), 918\u2013930.","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1097_CR121","doi-asserted-by":"crossref","unstructured":"Zhao, X., Kim, T. K., & Luo, W. (2014). Unified face analysis by iterative multi-output random forests. In IEEE conference on computer vision and pattern recognition, pp. 1765\u20131772.","DOI":"10.1109\/CVPR.2014.228"},{"key":"1097_CR122","doi-asserted-by":"crossref","unstructured":"Zhou, E., Fan, H., Cao, Z., Jiang, Y., & Yin, Q. (2013). Extensive facial landmark localization with coarse-to-fine convolutional network cascade. In IEEE international conference on computer vision workshops, pp. 386\u2013391.","DOI":"10.1109\/ICCVW.2013.58"},{"key":"1097_CR123","unstructured":"Zhu, S., Li, C., Change Loy, C., & Tang, X. (2015). Face alignment by coarse-to-fine shape searching. In IEEE conference on computer vision and pattern recognition."},{"key":"1097_CR124","doi-asserted-by":"crossref","unstructured":"Zhu, X., Lei, Z., Liu, X., Shi, H., Li, S. (2016). Face alignment across large poses: A 3D solution. In IEEE conference on computer vision and pattern recognition. Las Vegas, NV.","DOI":"10.1109\/CVPR.2016.23"},{"key":"1097_CR125","unstructured":"Zhu, X., & Ramanan, D. (2012). Face detection, pose estimation, and landmark localization in the wild. In IEEE conference on computer vision and pattern recognition, pp. 2879\u20132886."}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11263-018-1097-z\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-018-1097-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-018-1097-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,2,17]],"date-time":"2022-02-17T01:04:35Z","timestamp":1645059875000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11263-018-1097-z"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,5,8]]},"references-count":125,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2019,2,15]]}},"alternative-id":["1097"],"URL":"https:\/\/doi.org\/10.1007\/s11263-018-1097-z","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2018,5,8]]},"assertion":[{"value":"3 November 2016","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"26 April 2018","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 May 2018","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}