{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,3]],"date-time":"2026-07-03T16:19:13Z","timestamp":1783095553722,"version":"3.54.6"},"publisher-location":"Cham","reference-count":64,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783031729973","type":"print"},{"value":"9783031729980","type":"electronic"}],"license":[{"start":{"date-parts":[[2024,9,30]],"date-time":"2024-09-30T00:00:00Z","timestamp":1727654400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,9,30]],"date-time":"2024-09-30T00:00:00Z","timestamp":1727654400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-72998-0_4","type":"book-chapter","created":{"date-parts":[[2024,9,29]],"date-time":"2024-09-29T18:01:58Z","timestamp":1727632918000},"page":"55-72","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":11,"title":["EmoTalk3D: High-Fidelity Free-View Synthesis of\u00a0Emotional 3D Talking Head"],"prefix":"10.1007","author":[{"given":"Qianyun","family":"He","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xinya","family":"Ji","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yicheng","family":"Gong","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yuanxun","family":"Lu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhengyu","family":"Diao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Linjia","family":"Huang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yao","family":"Yao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Siyu","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhan","family":"Ma","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Songcen","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiaofei","family":"Wu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zixiao","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xun","family":"Cao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hao","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,9,30]]},"reference":[{"key":"4_CR1","doi-asserted-by":"crossref","unstructured":"Alghamdi, N., Maddock, S., Marxer, R., Barker, J., Brown, G.J.: A corpus of audio-visual lombard speech with frontal and profile views. J. Acoust. Soc. Am. 143(6), EL523\u2013EL529 (2018)","DOI":"10.1121\/1.5042758"},{"key":"4_CR2","doi-asserted-by":"crossref","unstructured":"Amberg, B., Romdhani, S., Vetter, T.: Optimal step nonrigid ICP algorithms for surface registration. In: CVPR, pp.\u00a01\u20138 (2007)","DOI":"10.1109\/CVPR.2007.383165"},{"key":"4_CR3","unstructured":"Baevski, A., Zhou, Y., Mohamed, A., Auli, M.: Wav2vec 2.0: a framework for self-supervised learning of speech representations. NIPS 33, 12449\u201312460 (2020)"},{"key":"4_CR4","doi-asserted-by":"crossref","unstructured":"Brand, M.: Voice puppetry. In: SIGGRAPH, pp. 21\u201328 (1999)","DOI":"10.1145\/311535.311537"},{"key":"4_CR5","unstructured":"Chen, G., et\u00a0al.: PP-Matting: high-accuracy natural image matting. arXiv preprint arXiv:2204.09433 (2022)"},{"key":"4_CR6","doi-asserted-by":"publisher","unstructured":"Chen, L., Li, Z., Maddox, R.K., Duan, Z., Xu, C.: Lip movements generation at a glance. In: Ferrari, V., Hebert, M., Sminchisescu, C., Weiss, Y. (eds.) Computer Vision \u2013 ECCV 2018. ECCV 2018. LNCS, vol. 11211, pp. 520\u2013535. Springer, Cham (2018). https:\/\/doi.org\/10.1007\/978-3-030-01234-2_32","DOI":"10.1007\/978-3-030-01234-2_32"},{"key":"4_CR7","doi-asserted-by":"crossref","unstructured":"Chen, L., Maddox, R.K., Duan, Z., Xu, C.: Hierarchical cross-modal talking face generation with dynamic pixel-wise loss. In: CVPR, pp. 7832\u20137841 (2019)","DOI":"10.1109\/CVPR.2019.00802"},{"key":"4_CR8","doi-asserted-by":"crossref","unstructured":"Cho, K., van Merri\u00ebnboer, B., Bahdanau, D., Bengio, Y.: On the properties of neural machine translation: encoder\u2013decoder approaches. Syntax, Semantics and Structure in Statistical Translation, p.\u00a0103 (2014)","DOI":"10.3115\/v1\/W14-4012"},{"key":"4_CR9","unstructured":"Chung, J.S., Jamaludin, A., Zisserman, A.: You said that? arXiv preprint arXiv:1705.02966 (2017)"},{"key":"4_CR10","doi-asserted-by":"crossref","unstructured":"Cudeiro, D., Bolkart, T., Laidlaw, C., Ranjan, A., Black, M.J.: Capture, learning, and synthesis of 3D speaking styles. In: CVPR, pp. 10101\u201310111 (2019)","DOI":"10.1109\/CVPR.2019.01034"},{"key":"4_CR11","doi-asserted-by":"crossref","unstructured":"Dan\u011b\u010dek, R., Chhatre, K., Tripathi, S., Wen, Y., Black, M., Bolkart, T.: Emotional speech-driven animation with content-emotion disentanglement. In: SIGGRAPH Asia, pp. 1\u201313 (2023)","DOI":"10.1145\/3610548.3618183"},{"key":"4_CR12","first-page":"3480","volume":"24","author":"SE Eskimez","year":"2021","unstructured":"Eskimez, S.E., Zhang, Y., Duan, Z.: Speech driven talking face generation from a single image and an emotion condition. TMM 24, 3480\u20133490 (2021)","journal-title":"TMM"},{"issue":"3","key":"4_CR13","doi-asserted-by":"publisher","first-page":"388","DOI":"10.1145\/566654.566594","volume":"21","author":"T Ezzat","year":"2002","unstructured":"Ezzat, T., Geiger, G., Poggio, T.: Trainable videorealistic speech animation. ToG 21(3), 388\u2013398 (2002)","journal-title":"ToG"},{"issue":"3","key":"4_CR14","doi-asserted-by":"publisher","first-page":"437","DOI":"10.1007\/s11263-012-0549-0","volume":"101","author":"G Fanelli","year":"2013","unstructured":"Fanelli, G., Dantone, M., Gall, J., Fossati, A., Van Gool, L.: Random forests for real time 3D face analysis. IJCV 101(3), 437\u2013458 (2013)","journal-title":"IJCV"},{"key":"4_CR15","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"758","DOI":"10.1007\/978-3-030-58621-8_44","volume-title":"Computer Vision \u2013 ECCV 2020","author":"C Gan","year":"2020","unstructured":"Gan, C., Huang, D., Chen, P., Tenenbaum, J.B., Torralba, A.: Foley music: learning to generate music from videos. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) ECCV 2020. LNCS, vol. 12356, pp. 758\u2013775. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58621-8_44"},{"key":"4_CR16","doi-asserted-by":"crossref","unstructured":"Gan, Y., Yang, Z., Yue, X., Sun, L., Yang, Y.: Efficient emotional adaptation for audio-driven talking-head generation. In: ICCV, pp. 22634\u201322645 (2023)","DOI":"10.1109\/ICCV51070.2023.02069"},{"key":"4_CR17","doi-asserted-by":"crossref","unstructured":"Garrido, P., et al.: VDub: modifying face video of actors for plausible visual alignment to a dubbed audio track. In: CGF, vol.\u00a034, pp. 193\u2013204. Wiley Online Library (2015)","DOI":"10.1111\/cgf.12552"},{"key":"4_CR18","doi-asserted-by":"crossref","unstructured":"Ginosar, S., Bar, A., Kohavi, G., Chan, C., Owens, A., Malik, J.: Learning individual styles of conversational gesture. In: CVPR, pp. 3497\u20133506 (2019)","DOI":"10.1109\/CVPR.2019.00361"},{"key":"4_CR19","doi-asserted-by":"crossref","unstructured":"Guo, Y., Chen, K., Liang, S., Liu, Y.J., Bao, H., Zhang, J.: Ad-nerf: audio driven neural radiance fields for talking head synthesis. In: ICCV, pp. 5784\u20135794 (2021)","DOI":"10.1109\/ICCV48922.2021.00573"},{"key":"4_CR20","doi-asserted-by":"crossref","unstructured":"Haque, K.I., Yumak, Z.: Facexhubert: text-less speech-driven e (x) pressive 3d facial animation synthesis using self-supervised speech representation learning. In: International Conference on Multimodal Interaction (2023)","DOI":"10.1145\/3577190.3614157"},{"key":"4_CR21","unstructured":"He, Y., et al.: Learning a parametric 3d full-head for free-view synthesis in 360$$\\circ $$. In: ECCV (2022)"},{"key":"4_CR22","doi-asserted-by":"crossref","unstructured":"Hore, A., Ziou, D.: Image quality metrics: psnr vs. ssim. In: ICPR, pp. 2366\u20132369. IEEE (2010)","DOI":"10.1109\/ICPR.2010.579"},{"key":"4_CR23","first-page":"3451","volume":"29","author":"WN Hsu","year":"2021","unstructured":"Hsu, W.N., Bolte, B., Tsai, Y.H.H., Lakhotia, K., Salakhutdinov, R., Mohamed, A.: Hubert: self-supervised speech representation learning by masked prediction of hidden units. TASLP 29, 3451\u20133460 (2021)","journal-title":"TASLP"},{"key":"4_CR24","doi-asserted-by":"crossref","unstructured":"Ji, X., et al.: Eamm: one-shot emotional talking face via audio-based emotion-aware motion model. In: SIGGRAPH, pp. 1\u201310 (2022)","DOI":"10.1145\/3528233.3530745"},{"key":"4_CR25","doi-asserted-by":"crossref","unstructured":"Ji, X., et al.: Audio-driven emotional video portraits. In: CVPR, pp. 14080\u201314089 (2021)","DOI":"10.1109\/CVPR46437.2021.01386"},{"key":"4_CR26","doi-asserted-by":"crossref","unstructured":"Kerbl, B., Kopanas, G., Leimk\u00fchler, T., Drettakis, G.: 3D Gaussian splatting for real-time radiance field rendering. ToG 42(4) (2023)","DOI":"10.1145\/3592433"},{"key":"4_CR27","unstructured":"Kingma, D.P., Ba, J.: Adam: a method for stochastic optimization. arXiv preprint arXiv:1412.6980 (2014)"},{"key":"4_CR28","doi-asserted-by":"crossref","unstructured":"Li, J., Zhang, J., Bai, X., Zhou, J., Gu, L.: Efficient region-aware neural radiance fields for high-fidelity talking portrait synthesis. In: ICCV, pp. 7568\u20137578 (2023)","DOI":"10.1016\/j.inffus.2024.102456"},{"key":"4_CR29","doi-asserted-by":"crossref","unstructured":"Liang, B., et al.: Expressive talking head generation with granular audio-visual control. In: CVPR, pp. 3387\u20133396 (2022)","DOI":"10.1109\/CVPR52688.2022.00338"},{"key":"4_CR30","doi-asserted-by":"crossref","unstructured":"Liao, M., Zhang, S., Wang, P., Zhu, H., Zuo, X., Yang, R.: Speech2video synthesis with 3D skeleton regularization and expressive body poses. In: ACCV (2020)","DOI":"10.1007\/978-3-030-69541-5_19"},{"key":"4_CR31","doi-asserted-by":"publisher","unstructured":"Liu, X., Xu, Y., Wu, Q., Zhou, H., Wu, W., Zhou, B.: Semantic-aware implicit neural audio-driven video portrait generation. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) Computer Vision \u2013 ECCV 2022. ECCV 2022. LNCS, vol. 13697, pp. 106\u2013125. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-19836-6_7","DOI":"10.1007\/978-3-031-19836-6_7"},{"key":"4_CR32","doi-asserted-by":"crossref","unstructured":"Lu, Y., Chai, J., Cao, X.: Live speech portraits: real-time photorealistic talking-head animation. ToG 40(6) (2021)","DOI":"10.1145\/3478513.3480484"},{"key":"4_CR33","unstructured":"Ma, Y., Zhang, S., Wang, J., Wang, X., Zhang, Y., Deng, Z.: Dreamtalk: when expressive talking head generation meets diffusion probabilistic models. arXiv preprint arXiv:2312.09767 (2023)"},{"issue":"1","key":"4_CR34","doi-asserted-by":"publisher","first-page":"99","DOI":"10.1145\/3503250","volume":"65","author":"B Mildenhall","year":"2021","unstructured":"Mildenhall, B., Srinivasan, P.P., Tancik, M., Barron, J.T., Ramamoorthi, R., Ng, R.: NeRF: representing scenes as neural radiance fields for view synthesis. Commun. ACM 65(1), 99\u2013106 (2021)","journal-title":"Commun. ACM"},{"key":"4_CR35","doi-asserted-by":"crossref","unstructured":"Narvekar, N.D., Karam, L.J.: A no-reference perceptual image sharpness metric based on a cumulative probability of blur detection. In: International Workshop on Quality of Multimedia Experience, pp. 87\u201391. IEEE (2009)","DOI":"10.1109\/QOMEX.2009.5246972"},{"key":"4_CR36","unstructured":"Pan, D., et\u00a0al.: Renderme-360: a large digital asset library and benchmarks towards high-fidelity head avatars. NIPS 36 (2024)"},{"key":"4_CR37","doi-asserted-by":"crossref","unstructured":"Pan, Y., Landreth, C., Fiume, E., Singh, K.: Vocal: vowel and consonant layering for expressive animator-centric singing animation. In: SIGGRAPH Asia, pp.\u00a01\u20139 (2022)","DOI":"10.1145\/3550469.3555408"},{"key":"4_CR38","doi-asserted-by":"crossref","unstructured":"Prajwal, K., Mukhopadhyay, R., Namboodiri, V.P., Jawahar, C.: A lip sync expert is all you need for speech to lip generation in the wild. In: MM, pp. 484\u2013492 (2020)","DOI":"10.1145\/3394171.3413532"},{"key":"4_CR39","doi-asserted-by":"crossref","unstructured":"Richard, A., Zollh\u00f6fer, M., Wen, Y., De\u00a0la Torre, F., Sheikh, Y.: Meshtalk: 3d face animation from speech using cross-modality disentanglement. In: ICCV, pp. 1173\u20131182 (2021)","DOI":"10.1109\/ICCV48922.2021.00121"},{"key":"4_CR40","doi-asserted-by":"publisher","unstructured":"Shen, S., Li, W., Zhu, Z., Duan, Y., Zhou, J., Lu, J.: Learning dynamic facial radiance fields for few-shot talking head synthesis. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) Computer Vision \u2013 ECCV 2022. ECCV 2022. LNCS, vol. 13672, pp. 666\u2013682. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-19775-8_39","DOI":"10.1007\/978-3-031-19775-8_39"},{"key":"4_CR41","doi-asserted-by":"crossref","unstructured":"Shiratori, T., Nakazawa, A., Ikeuchi, K.: Dancing-to-music character animation. In: CGF, vol.\u00a025, pp. 449\u2013458. Wiley Online Library (2006)","DOI":"10.1111\/j.1467-8659.2006.00964.x"},{"key":"4_CR42","doi-asserted-by":"crossref","unstructured":"Song, Y., Zhu, J., Li, D., Wang, X., Qi, H.: Talking face generation by conditional recurrent adversarial network. arXiv preprint arXiv:1804.04786 (2018)","DOI":"10.24963\/ijcai.2019\/129"},{"key":"4_CR43","doi-asserted-by":"crossref","unstructured":"Sun, J., et al.: Next3D: generative neural texture rasterization for 3d-aware head avatars. In: CVPR, pp. 20991\u201321002 (2023)","DOI":"10.1109\/CVPR52729.2023.02011"},{"key":"4_CR44","doi-asserted-by":"crossref","unstructured":"Sun, Y., et al.: Masked lip-sync prediction by audio-visual contextual exploitation in transformers. In: SIGGRAPH Asia, pp.\u00a01\u20139 (2022)","DOI":"10.1145\/3550469.3555393"},{"issue":"4","key":"4_CR45","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3072959.3073640","volume":"36","author":"S Suwajanakorn","year":"2017","unstructured":"Suwajanakorn, S., Seitz, S.M., Kemelmacher-Shlizerman, I.: Synthesizing obama: learning lip sync from audio. ToG 36(4), 1\u201313 (2017)","journal-title":"ToG"},{"key":"4_CR46","doi-asserted-by":"crossref","unstructured":"Tan, S., Ji, B., Pan, Y.: Emmn: emotional motion memory network for audio-driven emotional talking face generation. In: ICCV, pp. 22146\u201322156 (2023)","DOI":"10.1109\/ICCV51070.2023.02024"},{"key":"4_CR47","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"716","DOI":"10.1007\/978-3-030-58517-4_42","volume-title":"Computer Vision \u2013 ECCV 2020","author":"J Thies","year":"2020","unstructured":"Thies, J., Elgharib, M., Tewari, A., Theobalt, C., Nie\u00dfner, M.: Neural voice puppetry: audio-driven facial reenactment. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) ECCV 2020. LNCS, vol. 12361, pp. 716\u2013731. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58517-4_42"},{"key":"4_CR48","unstructured":"Vaswani, A., et al.: Attention is all you need. NIPS 30 (2017)"},{"key":"4_CR49","doi-asserted-by":"crossref","unstructured":"Wang, D., Deng, Y., Yin, Z., Shum, H.Y., Wang, B.: Progressive disentangled representation learning for fine-grained controllable talking head synthesis. In: CVPR, pp. 17979\u201317989 (2023)","DOI":"10.1109\/CVPR52729.2023.01724"},{"key":"4_CR50","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"700","DOI":"10.1007\/978-3-030-58589-1_42","volume-title":"Computer Vision \u2013 ECCV 2020","author":"K Wang","year":"2020","unstructured":"Wang, K., et al.: MEAD: a large-scale audio-visual dataset for emotional talking-face generation. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) ECCV 2020. LNCS, vol. 12366, pp. 700\u2013717. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58589-1_42"},{"issue":"4","key":"4_CR51","first-page":"600","volume":"13","author":"Z Wang","year":"2004","unstructured":"Wang, Z., Bovik, A.C., Sheikh, H.R., Simoncelli, E.P.: Image quality assessment: from error visibility to structural similarity. TIP 13(4), 600\u2013612 (2004)","journal-title":"TIP"},{"key":"4_CR52","unstructured":"Wuu, C.H., et\u00a0al.: Multiface: a dataset for neural face rendering. arXiv preprint arXiv:2207.11243 (2022)"},{"key":"4_CR53","doi-asserted-by":"crossref","unstructured":"Yang, H., et al.: Facescape: a large-scale high quality 3d face dataset and detailed riggable 3d face prediction. In: CVPR, pp. 601\u2013610 (2020)","DOI":"10.1109\/CVPR42600.2020.00068"},{"key":"4_CR54","unstructured":"Yao, S., Zhong, R., Yan, Y., Zhai, G., Yang, X.: DFA-NeRF: personalized talking head generation via disentangled face attributes neural rendering. arXiv preprint arXiv:2201.00791 (2022)"},{"key":"4_CR55","unstructured":"Ye, Z., Jiang, Z., Ren, Y., Liu, J., He, J., Zhao, Z.: Geneface: generalized and high-fidelity audio-driven 3d talking face synthesis. arXiv preprint arXiv:2301.13430 (2023)"},{"key":"4_CR56","unstructured":"Ye, Z., et\u00a0al.: Real3d-portrait: one-shot realistic 3d talking portrait synthesis. arXiv preprint arXiv:2401.08503 (2024)"},{"key":"4_CR57","doi-asserted-by":"publisher","first-page":"199","DOI":"10.1007\/s11263-022-01697-3","volume":"131","author":"J Zhang","year":"2022","unstructured":"Zhang, J., Li, S., Luo, Z., Fang, T., Yao, Y.: Vis-MVSNet: visibility-aware multi-view stereo network. IJCV 131, 199\u2013214 (2022)","journal-title":"IJCV"},{"key":"4_CR58","doi-asserted-by":"crossref","unstructured":"Zhang, R., Isola, P., Efros, A.A., Shechtman, E., Wang, O.: The unreasonable effectiveness of deep features as a perceptual metric. In: CVPR, pp. 586\u2013595 (2018)","DOI":"10.1109\/CVPR.2018.00068"},{"key":"4_CR59","doi-asserted-by":"crossref","unstructured":"Zhang, W., et al.: Sadtalker: learning realistic 3d motion coefficients for stylized audio-driven single image talking face animation. In: CVPR, pp. 8652\u20138661 (2023)","DOI":"10.1109\/CVPR52729.2023.00836"},{"key":"4_CR60","doi-asserted-by":"crossref","unstructured":"Zhang, Z., Li, L., Ding, Y., Fan, C.: Flow-guided one-shot talking face generation with a high-resolution audio-visual dataset. In: CVPR, pp. 3661\u20133670 (2021)","DOI":"10.1109\/CVPR46437.2021.00366"},{"key":"4_CR61","doi-asserted-by":"crossref","unstructured":"Zhou, H., Liu, Y., Liu, Z., Luo, P., Wang, X.: Talking face generation by adversarially disentangled audio-visual representation. In: AAAI, vol.\u00a033, pp. 9299\u20139306 (2019)","DOI":"10.1609\/aaai.v33i01.33019299"},{"issue":"6","key":"4_CR62","first-page":"1","volume":"39","author":"Y Zhou","year":"2020","unstructured":"Zhou, Y., Han, X., Shechtman, E., Echevarria, J., Kalogerakis, E., Li, D.: Makelttalk: speaker-aware talking-head animation. ToG 39(6), 1\u201315 (2020)","journal-title":"ToG"},{"key":"4_CR63","doi-asserted-by":"crossref","unstructured":"Zhu, H., et al.: Facescape: 3d facial dataset and benchmark for single-view 3d face reconstruction. TPAMI (2023)","DOI":"10.1109\/TPAMI.2023.3307338"},{"key":"4_CR64","doi-asserted-by":"publisher","unstructured":"Zhuang, Y., Zhu, H., Sun, X., Cao, X.: MoFaNeRF: morphable facial neural radiance field. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) Computer Vision \u2013 ECCV 2022. ECCV 2022. LNCS, vol. 13663, pp. 268\u2013285. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-20062-5_16","DOI":"10.1007\/978-3-031-20062-5_16"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2024"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-72998-0_4","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,9,29]],"date-time":"2024-09-29T18:02:57Z","timestamp":1727632977000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-72998-0_4"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,9,30]]},"ISBN":["9783031729973","9783031729980"],"references-count":64,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-72998-0_4","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,9,30]]},"assertion":[{"value":"30 September 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Milan","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Italy","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"29 September 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"4 October 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"18","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/eccv2024.ecva.net\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}