{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,29]],"date-time":"2026-07-29T06:04:23Z","timestamp":1785305063432,"version":"3.55.0"},"reference-count":61,"publisher":"Springer Science and Business Media LLC","issue":"7","license":[{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/100003536","name":"Youth Foundation","doi-asserted-by":"crossref","award":["62202243"],"award-info":[{"award-number":["62202243"]}],"id":[{"id":"10.13039\/100003536","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2026,7]]},"DOI":"10.1007\/s11263-026-02916-x","type":"journal-article","created":{"date-parts":[[2026,7,12]],"date-time":"2026-07-12T14:52:05Z","timestamp":1783867925000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["MaTe3D: Mask-Guided Text-based 3D-Aware Portrait Editing"],"prefix":"10.1007","volume":"134","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-9102-9527","authenticated-orcid":false,"given":"Kangneng","family":"Zhou","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Daiheng","family":"Gao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xuan","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8219-5590","authenticated-orcid":false,"given":"Jie","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Peng","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xusen","family":"Sun","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Longhao","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shiqi","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bang","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Liefeng","family":"Bo","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-6609-1003","authenticated-orcid":false,"given":"Yaxing","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5550-8758","authenticated-orcid":false,"given":"Ming-Ming","family":"Cheng","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,7,12]]},"reference":[{"key":"2916_CR1","doi-asserted-by":"crossref","unstructured":"Karras, T., Laine, S., & Aila, T. (2019). A Style-Based Generator Architecture for Generative Adversarial Networks, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4401\u20134410.","DOI":"10.1109\/CVPR.2019.00453"},{"key":"2916_CR2","doi-asserted-by":"crossref","unstructured":"Karras, T., Laine, S., Aittala, M., Hellsten, J., Lehtinen, J., & Aila, T. (2020). Analyzing and Improving the Image Quality of StyleGAN, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 8107\u20138116.","DOI":"10.1109\/CVPR42600.2020.00813"},{"key":"2916_CR3","unstructured":"Karras, T., Aittala, M., Laine, S., E. H\u00e4rk\u00f6nen, Hellsten, J., Lehtinen, J., & Aila, T. (2021). Alias-Free Generative Adversarial Networks, In Advances in Neural Information Processing Systems, pp. 852\u2013863."},{"key":"2916_CR4","doi-asserted-by":"crossref","unstructured":"Zhou, K., Zhu, X., Gao, D., Lee, K., Li, X., & Yin, X.-C. (2022). SD-GAN: Semantic Decomposition for Face Image Synthesis with Discrete Attribute, In Proceedings of the 30th ACM International Conference on Multimedia, pp. 2513\u20132524.","DOI":"10.1145\/3503161.3547791"},{"key":"2916_CR5","doi-asserted-by":"crossref","unstructured":"Chan, E.R., Lin, C.Z., Chan, M.A., Nagano, K., Pan, B., Mello, S.D., Gallo, O., Guibas, L., Tremblay, J., Khamis, S., Karras, T., & Wetzstein, G. (2022) Efficient Geometry-aware 3D Generative Adversarial Networks, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 16\u00a0123\u201316\u00a0133.","DOI":"10.1109\/CVPR52688.2022.01565"},{"key":"2916_CR6","doi-asserted-by":"crossref","unstructured":"Or-El, R., Luo, X., Shan, M., Shechtman, E., Park, J.J., & Kemelmacher-Shlizerman, I. (2022). StyleSDF: High-Resolution 3D-Consistent Image and Geometry Generation, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 13\u00a0503\u201313\u00a0513.","DOI":"10.1109\/CVPR52688.2022.01314"},{"key":"2916_CR7","unstructured":"Gu, J., Liu, L., Wang, P., & Theobalt, C. (2022). StyleNeRF: A Style-based 3D Aware Generator for High-resolution Image Synthesis, In Proceedings of the International Conference on Learning Representations."},{"key":"2916_CR8","unstructured":"Zhou, P., Xie, L., Ni, B., & Tian, Q. (2021). CIPS-3D: A 3D-Aware Generator of GANs Based on Conditionally-Independent Pixel Synthesis, arXiv preprint arXiv:2110.09788."},{"key":"2916_CR9","doi-asserted-by":"crossref","unstructured":"Zhang, J., Zhou, K., Luximon, Y., Li, P., & Lee, T. (2023). MeshWGAN: Mesh-to-Mesh Wasserstein GAN with Multi-Task Gradient Penalty for 3D Facial Geometric Age Transformation, IEEE Transactions on Visualization and Computer Graphics, pp. 1\u201314, (Early Access).","DOI":"10.1109\/TVCG.2023.3284500"},{"key":"2916_CR10","doi-asserted-by":"crossref","unstructured":"Sun, J., Wang, X., Zhang, Y., Li, X., Zhang, Q., Liu, Y., & Wang, J. (2022). FENeRF: Face Editing in Neural Radiance Fields, in Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 7672\u20137682.","DOI":"10.1109\/CVPR52688.2022.00752"},{"key":"2916_CR11","doi-asserted-by":"crossref","unstructured":"Sun, J., Wang, X., Shi, Y., Wang, L., Wang, J., & Liu, Y. (2022). IDE-3D: Interactive Disentangled Editing for High-Resolution 3D-aware Portrait Synthesis, ACM Transactions on Graphics, vol. 41, no. 6, pp. 1\u201310.","DOI":"10.1145\/3550454.3555506"},{"key":"2916_CR12","doi-asserted-by":"crossref","unstructured":"Hyung, J., Hwang, S., Kim, D., Lee, H., & Choo, J. (2023). Local 3D Editing via 3D Distillation of CLIP Knowledge, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 12\u00a0674\u201312\u00a0684.","DOI":"10.1109\/CVPR52729.2023.01219"},{"key":"2916_CR13","doi-asserted-by":"crossref","unstructured":"Wang, C., Chai, M., He, M., Chen, D., & Liao, J. (2022). CLIP-NeRF: Text-and-Image Driven Manipulation of Neural Radiance Fields, In Proceedings of the Conference on Computer Vision and Pattern Recognition, pp. 3835\u20133844.","DOI":"10.1109\/CVPR52688.2022.00381"},{"key":"2916_CR14","unstructured":"Radford, A., Kim, J., W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J. et\u00a0al. (2021). Learning Transferable Visual Models From Natural Language Supervision, In Proceedings of the International Conference on Machine Learning, pp. 8748\u20138763."},{"key":"2916_CR15","doi-asserted-by":"crossref","unstructured":"Mildenhall, B., Srinivasan, P.P., Tancik, M., Barron, J.T., Ramamoorthi, R., & Ng, R. (2020). NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis, In Proceedings of the European Conference on Computer Vision, pp. 405\u2013421.","DOI":"10.1007\/978-3-030-58452-8_24"},{"key":"2916_CR16","unstructured":"Sitzmann, V., Martel, J., Bergman, A., Lindell, D., & Wetzstein, G. (2020). Implicit Neural Representations with Periodic Activation Functions, In Advances in Neural Information Processing Systems, pp. 7462\u20137473."},{"key":"2916_CR17","unstructured":"Schwarz, K., Liao, Y., Niemeyer, M., & Geiger, A. (2020). GRAF: Generative Radiance Fields for 3D-Aware Image Synthesis, In Advances in Neural Information Processing Systems, pp. 20\u00a0154\u201320\u00a0166."},{"key":"2916_CR18","doi-asserted-by":"crossref","unstructured":"Chan, E.R., Monteiro, M., Kellnhofer, P., Wu, J., & Wetzstein, G. (2021). pi-GAN: Periodic Implicit Generative Adversarial Networks for 3D-Aware Image Synthesis, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 5799\u20135809.","DOI":"10.1109\/CVPR46437.2021.00574"},{"key":"2916_CR19","doi-asserted-by":"crossref","unstructured":"Park, J.J., Florence, P., Straub, J., Newcombe, R., & Lovegrove, S. (2019). DeepSDF: Learning Continuous Signed Distance Functions for Shape Representation, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 165\u2013174.","DOI":"10.1109\/CVPR.2019.00025"},{"key":"2916_CR20","doi-asserted-by":"crossref","unstructured":"Jiang, K., Chen, S.-Y., Liu, F.-L., Fu, H., & Gao, L. (2025). Towards high-quality and disentangled face editing in a 3d gan, IEEE Transactions on Pattern Analysis and Machine Intelligence, pp. 1\u201312.","DOI":"10.1109\/TPAMI.2024.3523422"},{"key":"2916_CR21","unstructured":"Liao, T., Yi, H., Xiu, Y., Tang, J., Huang, Y., Thies, J., & Black, M. J. (2023). Tada! Text to Animatable Digital Avatars arXiv:2308.10899 arXiv preprint."},{"key":"2916_CR22","doi-asserted-by":"crossref","unstructured":"Li, Y., Dou, Y., Shi, Y., Lei, Y., Chen, X., Zhang, Y., Zhou, P., & Ni, B. (2023). FocalDreamer: Text-driven 3D Editing via Focal-fusion Assembly arXiv:2308.10608 arXiv preprint.","DOI":"10.1609\/aaai.v38i4.28113"},{"key":"2916_CR23","doi-asserted-by":"crossref","unstructured":"Song, K., Han, L., Liu, B., Metaxas, D., & Elgammal, A. (2024). StyleGAN-Fusion: Diffusion Guided Domain Adaptation of Image Generators, In Proceedings of the IEEE Conference on Applications of Computer Vision, pp. 5453\u20135463.","DOI":"10.1109\/WACV57701.2024.00537"},{"key":"2916_CR24","unstructured":"Zhang, H., T. DAI, Xu, Y., Y.-Tai, W., & C.-Tang, K. (2024). FaceDNeRF: Semantics-Driven Face Reconstruction, Prompt Editing and Relighting with Diffusion Models, In Advances in Neural Information Processing Systems, pp. 55\u00a0647\u201355\u00a0667."},{"key":"2916_CR25","doi-asserted-by":"crossref","unstructured":"Haque, A., Tancik, M., Efros, A.A., Holynski, A., & Kanazawa, A. (2023). Instruct-NeRF2NeRF: Editing 3D Scenes with Instructions, in Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 19\u00a0740\u201319\u00a0750.","DOI":"10.1109\/ICCV51070.2023.01808"},{"key":"2916_CR26","doi-asserted-by":"crossref","unstructured":"Brooks, T., Holynski, A., & Efros, A.A. (2023). Instructpix2pix: Learning to Follow Image Editing Instructions, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 18\u00a0392\u201318\u00a0402.","DOI":"10.1109\/CVPR52729.2023.01764"},{"key":"2916_CR27","doi-asserted-by":"crossref","unstructured":"Gordon, O., Avrahami, O., & Lischinski, D. (2023). Blended-NeRF: Zero-Shot Object Generation and Blending in Existing Neural Radiance Fields, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 2941\u20132951.","DOI":"10.1109\/ICCVW60793.2023.00316"},{"key":"2916_CR28","unstructured":"Poole, B., Jain, A., Barron, J.T., & Mildenhall, B. (2022). DreamFusion: Text-to-3D using 2D Diffusion, In Proceedings of the International Conference on Learning Representations."},{"key":"2916_CR29","doi-asserted-by":"crossref","unstructured":"Zhuang, J., Wang, C., Lin, L., Liu, L., & Li, G. (2023). DreamEditor: Text-Driven 3D Scene Editing with Neural Fields, in Proceeding of the ACM SIGGRAPH Asia, pp. 1\u201310.","DOI":"10.1145\/3610548.3618190"},{"issue":"4","key":"2916_CR30","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3528223.3530129","volume":"41","author":"MMA Morsy","year":"2022","unstructured":"Morsy, M. M. A., Brunton, A., & Urban, P. (2022). Shape Dithering for 3D Printing. ACM Transactions on Graphics, 41(4), 1\u201312.","journal-title":"ACM Transactions on Graphics"},{"key":"2916_CR31","doi-asserted-by":"crossref","unstructured":"Mikaeili, A., Perel, O., Safaee, M., Cohen-Or, D., & Mahdavi-Amiri, A. (2023). SKED: Sketch-guided Text-based 3D Editing, In Proceedings of the IEEE International Conference on Computer Vision, pp. 14\u00a0607\u201314\u00a0619.","DOI":"10.1109\/ICCV51070.2023.01343"},{"key":"2916_CR32","doi-asserted-by":"crossref","unstructured":"Han, X., Cao, Y., Han, K., Zhu, X., Deng, J., Song, Y.-Z., Xiang, T., & Wong, K.-Y.K. (2023). HeadSculpt: Crafting 3D Head Avatars with Text, In Advances in Neural Information Processing Systems, pp. 4915\u20134936.","DOI":"10.52202\/075280-0218"},{"key":"2916_CR33","doi-asserted-by":"crossref","unstructured":"Liu, H., Wang, X., Wan, Z., Shen, Y., Song, Y., Liao, J., & Chen, Q. (2024). Headartist: Text-conditioned 3d head generation with self score distillation, In ACM SIGGRAPH 2024 Conference Papers, pp. 1\u201312.","DOI":"10.1145\/3641519.3657512"},{"key":"2916_CR34","doi-asserted-by":"crossref","unstructured":"Zhang, L., Rao, A., & Agrawala, M. (2023). Adding Conditional Control to Text-to-Image Diffusion Models, In Proceedings of the IEEE International Conference on Computer Vision, pp. 3836\u20133847.","DOI":"10.1109\/ICCV51070.2023.00355"},{"key":"2916_CR35","unstructured":"Shen, T., Gao, J., Yin, K., Liu, M.-Y., & Fidler, S. (2021). Deep Marching Tetrahedra: a Hybrid Representation for High-Resolution 3D Shape Synthesis, In Advances in Neural Information Processing Systems, pp. 6087\u20136101."},{"key":"2916_CR36","unstructured":"Yariv, L., Gu, J., Kasten, Y., & Lipman, Y. (2021). Volume Rendering of Neural Implicit Surfaces, In Advances in Neural Information Processing Systems, pp. 4805\u20134815."},{"key":"2916_CR37","doi-asserted-by":"crossref","unstructured":"Wu, Q., Liu, X., Chen, Y., Li, K., Zheng, C., Cai, J., & Zheng, J. (2022). Object-Compositional Neural Implicit Surfaces, In Proceedings of the European Conference on Computer Vision, pp. 197\u2013213.","DOI":"10.1007\/978-3-031-19812-0_12"},{"issue":"1","key":"2916_CR38","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3544777","volume":"42","author":"D Roich","year":"2022","unstructured":"Roich, D., Mokady, R., Bermano, A. H., & Cohen-Or, D. (2022). Pivotal Tuning for Latent-based Editing of Real Images. ACM Transactions on Graphics, 42(1), 1\u201313.","journal-title":"ACM Transactions on Graphics"},{"key":"2916_CR39","unstructured":"Liao, T., Yi, H., Xiu, Y., Tang, J., Huang, Y., Thies, J., & Black, M.J. (2023). Tada! Text to Animatable Digital Avatars, arXiv preprint arXiv:2308.10899."},{"key":"2916_CR40","unstructured":"Kingma, D. P. Ba, J. (2015). Adam: A Method for Stochastic Optimization, In Proceeding or the International Conference on Learning Representations."},{"key":"2916_CR41","doi-asserted-by":"crossref","unstructured":"Shin, M., Seo, Y., Bae, J., Choi, Y.S., Kim, H., Byun, H., & Uh, Y. (2023). BallGAN: 3D-aware Image Synthesis with a Spherical Background, In Proceedings of the IEEE International Conference on Computer Vision, pp. 7268\u20137279.","DOI":"10.1109\/ICCV51070.2023.00668"},{"key":"2916_CR42","doi-asserted-by":"crossref","unstructured":"Zhang, X., Zheng, Z., Gao, D., Zhang, B., Yang, Y., & Chua, T.-S. (2023). Multi-view consistent generative adversarial networks for compositional 3d-aware image synthesis, International Journal of Computer Vision, vol. 131, no. 8, pp. 2219\u20132242.","DOI":"10.1007\/s11263-023-01805-x"},{"key":"2916_CR43","doi-asserted-by":"crossref","unstructured":"Mescheder, L., Oechsle, M., Niemeyer, M., Nowozin, S., & Geiger, A. (2019). Occupancy networks: Learning 3D Reconstruction in Function Space, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4460\u20134470.","DOI":"10.1109\/CVPR.2019.00459"},{"key":"2916_CR44","unstructured":"Heusel, M., Ramsauer, H., Unterthiner, T., Nessler, B., & Hochreiter, S. (2017). GANs Trained by a Two Time-Scale Update Rule Converge to a Nash Equilibrium, In Advances in neural information processing systems."},{"key":"2916_CR45","unstructured":"M. Bi\u0144kowski, Sutherland, D.J., Arbel, M., & Gretton, A. (2018). Demystifying MMD GANs, In Proceedings of the international conference on learning representations."},{"issue":"6","key":"2916_CR46","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3550454.3555506","volume":"41","author":"J Sun","year":"2022","unstructured":"Sun, J., Wang, X., Shi, Y., Wang, L., Wang, J., & Liu, Y. (2022). IDE-3D: Interactive Disentangled Editing for High-Resolution 3D-aware Portrait Synthesis. ACM Transactions on Graphics, 41(6), 1\u201310.","journal-title":"ACM Transactions on Graphics"},{"key":"2916_CR47","doi-asserted-by":"crossref","unstructured":"Morsy, M.M.A., Brunton, A., & Urban, P. (2022). Shape Dithering for 3D Printing, ACM Transactions on Graphics, vol. 41, no. 4, pp. 1\u201312.","DOI":"10.1145\/3528223.3530129"},{"key":"2916_CR48","doi-asserted-by":"publisher","first-page":"8406","DOI":"10.52202\/075280-0368","volume":"36","author":"Z Wang","year":"2023","unstructured":"Wang, Z., Lu, C., Wang, Y., Bao, F., Li, C., Su, H., & Zhu, S. (2023). Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distillation. Advances in neural information processing systems, 36, 8406\u20138441.","journal-title":"Advances in neural information processing systems"},{"key":"2916_CR49","doi-asserted-by":"crossref","unstructured":"Hessel, J., Holtzman, A., Forbes, M., Le\u00a0Bras, R. & Choi, Y. (2021). CLIPScore: A Reference-free Evaluation Metric for Image Captioning, In Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing, pp. 7514\u20137528.","DOI":"10.18653\/v1\/2021.emnlp-main.595"},{"key":"2916_CR50","doi-asserted-by":"crossref","unstructured":"Zhou, K., Zhu, X., Gao, D., Lee, K., Li, X., & Yin, X.-C. (2022). Sd-gan: semantic decomposition for face image synthesis with discrete attribute, In Proceedings of the 30th ACM International Conference on Multimedia, pp. 2513\u20132524.","DOI":"10.1145\/3503161.3547791"},{"key":"2916_CR51","doi-asserted-by":"crossref","unstructured":"Mou, C., Wang, X., Song, J., Shan, Y., & Zhang, J. (2024). Diffeditor: Boosting accuracy and flexibility on diffusion-based image editing, In Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 8488\u20138497.","DOI":"10.1109\/CVPR52733.2024.00811"},{"key":"2916_CR52","unstructured":"Zhang, Z., Xie, J., Lu, Y., Yang, Z., Yang, Y., & ReLER, C. (2025). Enabling instructional image editing with in-context generation in large scale diffusion transformer, In The Thirty-ninth Annual Conference on Neural Information Processing Systems, vol. 3, no. 7."},{"key":"2916_CR53","doi-asserted-by":"crossref","unstructured":"Zhou, J.J., Gao, H., Voleti, V., Vasishta, A., Yao, C.-H., Boss, M., Torr, P., Rupprecht, C., & Jampani, V. (2025). Stable virtual camera: Generative view synthesis with diffusion models, arXiv preprint.","DOI":"10.1109\/ICCV51701.2025.01153"},{"key":"2916_CR54","doi-asserted-by":"crossref","unstructured":"Ren, X., Shen, T., Huang, J., Ling, H., Lu, Y., Nimier-David, M., M\u00fcller, T., Keller, A., Fidler, S., & Gao, J. (2025). Gen3c: 3d-informed world-consistent video generation with precise camera control, In Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition.","DOI":"10.1109\/CVPR52734.2025.00574"},{"key":"2916_CR55","doi-asserted-by":"crossref","unstructured":"Wang, Z., Lu, C., Wang, Y., Bao, F., Li, C., Su, H., & Zhu, S. (2023). Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distillation, Advances in neural information processing systems, vol. 36, pp. 8406\u20138441.","DOI":"10.52202\/075280-0368"},{"key":"2916_CR56","doi-asserted-by":"crossref","unstructured":"Zhang, X., Zheng, Z., Gao, D., Zhang, B., Yang, Y., & Chua, T.-S. (2023). Multi-view consistent generative adversarial networks for compositional 3d-aware image synthesis. International Journal of Computer Vision,131(8), 2219\u20132242.","DOI":"10.1007\/s11263-023-01805-x"},{"key":"2916_CR57","doi-asserted-by":"crossref","unstructured":"Roich, D., Mokady, R., Bermano, A.H., & Cohen-Or, D. (2022). Pivotal Tuning for Latent-based Editing of Real Images, ACM Transactions on Graphics, vol. 42, no. 1, pp. 1\u201313.","DOI":"10.1145\/3544777"},{"key":"2916_CR58","doi-asserted-by":"crossref","unstructured":"Li, Y., Ma, C., Yan, Y., Zhu, W., & Yang, X. (2023). 3d-aware face swapping, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 12\u00a0705\u201312\u00a0714.","DOI":"10.1109\/CVPR52729.2023.01222"},{"key":"2916_CR59","doi-asserted-by":"crossref","unstructured":"Zhou, J. J., Gao, H., Voleti, V., Vasishta, A., Yao, C.-H., Boss, M., Torr, P., Rupprecht, C., & Jampani, V. (2025). Stable virtual camera: Generative view synthesis with diffusion models arXiv preprint.","DOI":"10.1109\/ICCV51701.2025.01153"},{"key":"2916_CR60","unstructured":"Zhou, P., Xie, L., Ni, B., & Tian, Q. (2021). CIPS-3D: A 3D-Aware Generator of GANs Based on Conditionally-Independent Pixel Synthesis arXiv:2110.09788 arXiv preprint."},{"key":"2916_CR61","doi-asserted-by":"crossref","unstructured":"Choi, Y., Choi, M., Kim, M., Ha, J.-W. Kim, S., & Choo, J. (2018). StarGAN: Unified Generative Adversarial Networks for Multi-domain Image-to-Image Translation, In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 8789\u20138797.","DOI":"10.1109\/CVPR.2018.00916"}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-026-02916-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11263-026-02916-x","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-026-02916-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,7,29]],"date-time":"2026-07-29T05:50:26Z","timestamp":1785304226000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11263-026-02916-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,7]]},"references-count":61,"journal-issue":{"issue":"7","published-print":{"date-parts":[[2026,7]]}},"alternative-id":["2916"],"URL":"https:\/\/doi.org\/10.1007\/s11263-026-02916-x","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,7]]},"assertion":[{"value":"7 July 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"1 June 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"12 July 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"MaTe3D can reconstruct the representation of a given face and then launch mask-guided and text-based editing. A series of 3D-consistent images can thus be produced by taking advantage of MaTe3D, which means the great potential to empower areas like artistic creation and industrial design. However, the synthesized images can be wrongly identified by face recognition systems with high probability. Besides, downstream applications like single-view 3D inversion and mask-guided and text-based editing can be misused for generating edited imagery of real people. Such misusage put cyberspace in danger inevitably. Overall, the use of this technology needs to be more careful and better regulated.","order":1,"name":"Ethics","label":"Ethical Concerns","group":{"name":"EthicsHeading","label":"Declarations"}}],"article-number":"345"}}