{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,18]],"date-time":"2025-06-18T04:19:59Z","timestamp":1750220399333,"version":"3.41.0"},"publisher-location":"New York, NY, USA","reference-count":24,"publisher":"ACM","license":[{"start":{"date-parts":[[2021,11,26]],"date-time":"2021-11-26T00:00:00Z","timestamp":1637884800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2021,11,26]]},"DOI":"10.1145\/3503047.3503054","type":"proceedings-article","created":{"date-parts":[[2022,1,19]],"date-time":"2022-01-19T23:32:54Z","timestamp":1642635174000},"page":"1-6","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["Few-shot Adversarial Audio Driving Talking Face Generation"],"prefix":"10.1145","author":[{"given":"Ruyi","family":"Chen","sequence":"first","affiliation":[{"name":"Wuhan University of Technology, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shengwu","family":"Xiong","sequence":"additional","affiliation":[{"name":"Wuhan University of Technology, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2022,1,19]]},"reference":[{"volume-title":"International Joint Conferences on Artificial Intelligence Organization","year":"2019","unstructured":"2019. Talking Face Generation by Conditional Recurrent Adversarial Network . International Joint Conferences on Artificial Intelligence Organization , Macao, China, 919\u2013925. https:\/\/doi.org\/10.24963\/ijcai. 2019 \/129 10.24963\/ijcai.2019 2019. Talking Face Generation by Conditional Recurrent Adversarial Network. International Joint Conferences on Artificial Intelligence Organization, Macao, China, 919\u2013925. https:\/\/doi.org\/10.24963\/ijcai.2019\/129","key":"e_1_3_2_1_1_1"},{"key":"e_1_3_2_1_2_1","volume-title":"CREMA-D: Crowd-sourced emotional multimodal actors dataset","author":"Cao Houwei","year":"2014","unstructured":"Houwei Cao , David\u00a0 G Cooper , Michael\u00a0 K Keutmann , Ruben\u00a0 C Gur , Ani Nenkova , and Ragini Verma . 2014. CREMA-D: Crowd-sourced emotional multimodal actors dataset . IEEE transactions on affective computing 5, 4 ( 2014 ), 377\u2013390. Houwei Cao, David\u00a0G Cooper, Michael\u00a0K Keutmann, Ruben\u00a0C Gur, Ani Nenkova, and Ragini Verma. 2014. CREMA-D: Crowd-sourced emotional multimodal actors dataset. IEEE transactions on affective computing 5, 4 (2014), 377\u2013390."},{"unstructured":"Lele Chen Guofeng Cui Celong Liu Zhong Li Ziyi Kou Yi Xu and Chenliang Xu. 2020. Talking-Head Generation with Rhythmic Head Motion. arXiv:2007.08547 [cs](2020). arxiv:2007.08547\u00a0[cs]  Lele Chen Guofeng Cui Celong Liu Zhong Li Ziyi Kou Yi Xu and Chenliang Xu. 2020. Talking-Head Generation with Rhythmic Head Motion. arXiv:2007.08547 [cs](2020). arxiv:2007.08547\u00a0[cs]","key":"e_1_3_2_1_3_1"},{"unstructured":"Lele Chen Zhiheng Li Ross\u00a0K. Maddox Zhiyao Duan and Chenliang Xu. 2018. Lip Movements Generation at a Glance. arXiv:1803.10404 [cs](2018). arxiv:1803.10404\u00a0[cs]  Lele Chen Zhiheng Li Ross\u00a0K. Maddox Zhiyao Duan and Chenliang Xu. 2018. Lip Movements Generation at a Glance. arXiv:1803.10404 [cs](2018). arxiv:1803.10404\u00a0[cs]","key":"e_1_3_2_1_4_1"},{"doi-asserted-by":"crossref","unstructured":"Lele Chen Ross\u00a0K. Maddox Zhiyao Duan and Chenliang Xu. 2019. Hierarchical Cross-Modal Talking Face Generationwith Dynamic Pixel-Wise Loss. arXiv:1905.03820 [cs](2019). arxiv:1905.03820\u00a0[cs]  Lele Chen Ross\u00a0K. Maddox Zhiyao Duan and Chenliang Xu. 2019. Hierarchical Cross-Modal Talking Face Generationwith Dynamic Pixel-Wise Loss. arXiv:1905.03820 [cs](2019). arxiv:1905.03820\u00a0[cs]","key":"e_1_3_2_1_5_1","DOI":"10.1109\/CVPR.2019.00802"},{"doi-asserted-by":"crossref","unstructured":"J.\u00a0S. Chung A. Nagrani and A. Zisserman. 2018. VoxCeleb2: Deep Speaker Recognition. In INTERSPEECH.  J.\u00a0S. Chung A. Nagrani and A. Zisserman. 2018. VoxCeleb2: Deep Speaker Recognition. In INTERSPEECH.","key":"e_1_3_2_1_6_1","DOI":"10.21437\/Interspeech.2018-1929"},{"volume-title":"Lip Reading in the Wild. In Asian Conference on Computer Vision.","author":"Chung S.","unstructured":"J.\u00a0 S. Chung and A. Zisserman . 2016 . Lip Reading in the Wild. In Asian Conference on Computer Vision. J.\u00a0S. Chung and A. Zisserman. 2016. Lip Reading in the Wild. In Asian Conference on Computer Vision.","key":"e_1_3_2_1_7_1"},{"key":"e_1_3_2_1_8_1","volume-title":"Workshop on Multi-view Lip-reading, ACCV.","author":"Chung Joon\u00a0Son","year":"2016","unstructured":"Joon\u00a0Son Chung and Andrew Zisserman . 2016 . Out of time: automated lip sync in the wild . In Workshop on Multi-view Lip-reading, ACCV. Joon\u00a0Son Chung and Andrew Zisserman. 2016. Out of time: automated lip sync in the wild. In Workshop on Multi-view Lip-reading, ACCV."},{"unstructured":"Ian\u00a0J. Goodfellow Jean Pouget-Abadie Mehdi Mirza Bing Xu David Warde-Farley Sherjil Ozair Aaron Courville and Yoshua Bengio. 2014. Generative Adversarial Networks. arXiv:1406.2661 [cs stat](2014). arxiv:1406.2661\u00a0[cs stat]  Ian\u00a0J. Goodfellow Jean Pouget-Abadie Mehdi Mirza Bing Xu David Warde-Farley Sherjil Ozair Aaron Courville and Yoshua Bengio. 2014. Generative Adversarial Networks. arXiv:1406.2661 [cs stat](2014). arxiv:1406.2661\u00a0[cs stat]","key":"e_1_3_2_1_9_1"},{"unstructured":"Martin Heusel Hubert Ramsauer Thomas Unterthiner Bernhard Nessler and Sepp Hochreiter. 2018. GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium. arxiv:1706.08500\u00a0[cs.LG]  Martin Heusel Hubert Ramsauer Thomas Unterthiner Bernhard Nessler and Sepp Hochreiter. 2018. GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium. arxiv:1706.08500\u00a0[cs.LG]","key":"e_1_3_2_1_10_1"},{"doi-asserted-by":"publisher","key":"e_1_3_2_1_11_1","DOI":"10.1007\/s11263-019-01150-y"},{"unstructured":"Ming-Yu Liu Xun Huang Arun Mallya Tero Karras Timo Aila Jaakko Lehtinen and Jan Kautz. 2019. Few-Shot Unsupervised Image-to-Image Translation. arxiv:1905.01723\u00a0[cs.CV]  Ming-Yu Liu Xun Huang Arun Mallya Tero Karras Timo Aila Jaakko Lehtinen and Jan Kautz. 2019. Few-Shot Unsupervised Image-to-Image Translation. arxiv:1905.01723\u00a0[cs.CV]","key":"e_1_3_2_1_12_1"},{"unstructured":"Alex Nichol Joshua Achiam and John Schulman. 2018. On First-Order Meta-Learning Algorithms. arxiv:1803.02999\u00a0[cs.LG]  Alex Nichol Joshua Achiam and John Schulman. 2018. On First-Order Meta-Learning Algorithms. arxiv:1803.02999\u00a0[cs.LG]","key":"e_1_3_2_1_13_1"},{"doi-asserted-by":"crossref","unstructured":"Stavros Petridis Themos Stafylakis Pingchuan Ma Feipeng Cai Georgios Tzimiropoulos and Maja Pantic. 2018. End-to-End Audiovisual Speech Recognition. arXiv:1802.06424 [cs](2018). arxiv:1802.06424\u00a0[cs]  Stavros Petridis Themos Stafylakis Pingchuan Ma Feipeng Cai Georgios Tzimiropoulos and Maja Pantic. 2018. End-to-End Audiovisual Speech Recognition. arXiv:1802.06424 [cs](2018). arxiv:1802.06424\u00a0[cs]","key":"e_1_3_2_1_14_1","DOI":"10.1109\/ICASSP.2018.8461326"},{"doi-asserted-by":"crossref","unstructured":"K.\u00a0R. Prajwal Rudrabha Mukhopadhyay Vinay Namboodiri and C.\u00a0V. Jawahar. 2020. A Lip Sync Expert Is All You Need for Speech to Lip Generation In The Wild. arXiv:2008.10010 [cs eess](2020). https:\/\/doi.org\/10.1145\/3394171.3413532 arxiv:2008.10010\u00a0[cs eess] 10.1145\/3394171.3413532","key":"#cr-split#-e_1_3_2_1_15_1.1","DOI":"10.1145\/3394171.3413532"},{"doi-asserted-by":"crossref","unstructured":"K.\u00a0R. Prajwal Rudrabha Mukhopadhyay Vinay Namboodiri and C.\u00a0V. Jawahar. 2020. A Lip Sync Expert Is All You Need for Speech to Lip Generation In The Wild. arXiv:2008.10010 [cs eess](2020). https:\/\/doi.org\/10.1145\/3394171.3413532 arxiv:2008.10010\u00a0[cs eess]","key":"#cr-split#-e_1_3_2_1_15_1.2","DOI":"10.1145\/3394171.3413532"},{"doi-asserted-by":"publisher","key":"e_1_3_2_1_16_1","DOI":"10.1145\/3072959.3073640"},{"unstructured":"Ting-Chun Wang Ming-Yu Liu Andrew Tao Guilin Liu Jan Kautz and Bryan Catanzaro. 2019. Few-Shot Video-to-Video Synthesis. arXiv:1910.12713 [cs](2019). arxiv:1910.12713\u00a0[cs]  Ting-Chun Wang Ming-Yu Liu Andrew Tao Guilin Liu Jan Kautz and Bryan Catanzaro. 2019. Few-Shot Video-to-Video Synthesis. arXiv:1910.12713 [cs](2019). arxiv:1910.12713\u00a0[cs]","key":"e_1_3_2_1_17_1"},{"key":"e_1_3_2_1_18_1","volume-title":"Image quality assessment: from error visibility to structural similarity","author":"Wang Zhou","year":"2004","unstructured":"Zhou Wang , Alan\u00a0 C Bovik , Hamid\u00a0 R Sheikh , and Eero\u00a0 P Simoncelli . 2004. Image quality assessment: from error visibility to structural similarity . IEEE transactions on image processing 13, 4 ( 2004 ), 600\u2013612. Zhou Wang, Alan\u00a0C Bovik, Hamid\u00a0R Sheikh, and Eero\u00a0P Simoncelli. 2004. Image quality assessment: from error visibility to structural similarity. IEEE transactions on image processing 13, 4 (2004), 600\u2013612."},{"unstructured":"Ran Yi Zipeng Ye Juyong Zhang Hujun Bao and Yong-Jin Liu. 2020. Audio-Driven Talking Face Video Generation with Learning-Based Personalized Head Pose. arXiv:2002.10137 [cs](2020). arxiv:2002.10137\u00a0[cs]  Ran Yi Zipeng Ye Juyong Zhang Hujun Bao and Yong-Jin Liu. 2020. Audio-Driven Talking Face Video Generation with Learning-Based Personalized Head Pose. arXiv:2002.10137 [cs](2020). arxiv:2002.10137\u00a0[cs]","key":"e_1_3_2_1_19_1"},{"doi-asserted-by":"crossref","unstructured":"Egor Zakharov Aliaksandra Shysheya Egor Burkov and Victor Lempitsky. 2019. Few-Shot Adversarial Learning of Realistic Neural Talking Head Models. arXiv:1905.08233 [cs](2019). arxiv:1905.08233\u00a0[cs]  Egor Zakharov Aliaksandra Shysheya Egor Burkov and Victor Lempitsky. 2019. Few-Shot Adversarial Learning of Realistic Neural Talking Head Models. arXiv:1905.08233 [cs](2019). arxiv:1905.08233\u00a0[cs]","key":"e_1_3_2_1_20_1","DOI":"10.1109\/ICCV.2019.00955"},{"doi-asserted-by":"publisher","key":"e_1_3_2_1_21_1","DOI":"10.1609\/aaai.v33i01.33019299"},{"doi-asserted-by":"crossref","unstructured":"Hang Zhou Yasheng Sun Wayne Wu Chen\u00a0Change Loy Xiaogang Wang and Ziwei Liu. 2021. Pose-Controllable Talking Face Generation by Implicitly Modularized Audio-Visual Representation. arXiv:2104.11116 [cs eess](2021). arxiv:2104.11116\u00a0[cs eess]  Hang Zhou Yasheng Sun Wayne Wu Chen\u00a0Change Loy Xiaogang Wang and Ziwei Liu. 2021. Pose-Controllable Talking Face Generation by Implicitly Modularized Audio-Visual Representation. arXiv:2104.11116 [cs eess](2021). arxiv:2104.11116\u00a0[cs eess]","key":"e_1_3_2_1_22_1","DOI":"10.1109\/CVPR46437.2021.00416"},{"doi-asserted-by":"publisher","key":"e_1_3_2_1_23_1","DOI":"10.24963\/ijcai.2020\/327"}],"event":{"acronym":"AISS 2021","name":"AISS 2021: 2021 3rd International Conference on Advanced Information Science and System","location":"Sanya China"},"container-title":["Proceedings of the 3rd International Conference on Advanced Information Science and System"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3503047.3503054","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3503047.3503054","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T20:18:48Z","timestamp":1750191528000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3503047.3503054"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,11,26]]},"references-count":24,"alternative-id":["10.1145\/3503047.3503054","10.1145\/3503047"],"URL":"https:\/\/doi.org\/10.1145\/3503047.3503054","relation":{},"subject":[],"published":{"date-parts":[[2021,11,26]]},"assertion":[{"value":"2022-01-19","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}