{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,21]],"date-time":"2026-05-21T03:43:25Z","timestamp":1779335005235,"version":"3.51.4"},"reference-count":66,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"11","license":[{"start":{"date-parts":[[2020,11,1]],"date-time":"2020-11-01T00:00:00Z","timestamp":1604188800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2020,11,1]],"date-time":"2020-11-01T00:00:00Z","timestamp":1604188800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2020,11,1]],"date-time":"2020-11-01T00:00:00Z","timestamp":1604188800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Multimedia"],"published-print":{"date-parts":[[2020,11]]},"DOI":"10.1109\/tmm.2019.2963621","type":"journal-article","created":{"date-parts":[[2020,1,1]],"date-time":"2020-01-01T20:55:07Z","timestamp":1577912107000},"page":"2808-2819","source":"Crossref","is-referenced-by-count":20,"title":["Learning How to Smile: Expression Video Generation With Conditional Adversarial Recurrent Nets"],"prefix":"10.1109","volume":"22","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-5477-1017","authenticated-orcid":false,"given":"Wei","family":"Wang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-5354-1084","authenticated-orcid":false,"given":"Xavier","family":"Alameda-Pineda","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7718-6224","authenticated-orcid":false,"given":"Dan","family":"Xu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0228-1147","authenticated-orcid":false,"given":"Elisa","family":"Ricci","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6597-7248","authenticated-orcid":false,"given":"Nicu","family":"Sebe","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2016.182"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1109\/T-AFFC.2013.4"},{"key":"ref33","first-page":"6781","article-title":"ExprGan: Facial expression editing with controllable expression intensity","author":"ding","year":"0","journal-title":"Proc AAAI Conf Artif Intell"},{"key":"ref32","first-page":"702","article-title":"Precomputed real-time texture synthesis with markovian generative adversarial networks","author":"li","year":"0","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref31","first-page":"597","article-title":"Generative visual manipulation on the natural image manifold","author":"zhu","year":"0","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.632"},{"key":"ref37","first-page":"525","article-title":"Are you really smiling at me? spontaneous versus posed enjoyment smiles","author":"dibeklio?lu","year":"2012","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref36","first-page":"1558","article-title":"Autoencoding beyond pixels using a learned similarity metric","author":"larsen","year":"0","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P17-1175"},{"key":"ref34","first-page":"2852","article-title":"SeqGan: Sequence generative adversarial nets with policy gradient","author":"yu","year":"0","journal-title":"Proc AAAI Conf Artif Intell"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2011.112"},{"key":"ref62","first-page":"1","article-title":"OpenFace: an open source facial behavior analysis toolkit","author":"baltru\u0161aitis","year":"0","journal-title":"Proc IEEE Int Conf Winter App Comput Vision"},{"key":"ref61","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2013.23"},{"key":"ref63","article-title":"Adam: A method for stochastic optimization","author":"kingma","year":"2015","journal-title":"Proc Int Conf Learning Representations"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-46478-7_51"},{"key":"ref64","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00165"},{"key":"ref27","first-page":"2539","article-title":"Deep convolutional inverse graphics network","author":"kulkarni","year":"0","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref65","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2015.7298682"},{"key":"ref66","first-page":"1578","article-title":"All about VLAD","author":"arandjelovi?","year":"0","journal-title":"Proc IEEE Int Conf Comput Vision Pattern Recognit"},{"key":"ref29","article-title":"Conditional generative adversarial nets","year":"0","journal-title":"arXiv1411 1784"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1145\/2733373.2806362"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TMM.2016.2523421"},{"key":"ref20","first-page":"2863","article-title":"Action-conditional video prediction using deep networks in atari games","author":"oh","year":"0","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref22","first-page":"517","article-title":"Pixel-level domain transfer","author":"yoo","year":"0","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-46484-8_16"},{"key":"ref24","first-page":"1857","article-title":"Learning to discover cross-domain relations with generative adversarial networks","author":"kim","year":"0","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.310"},{"key":"ref26","first-page":"1462","article-title":"DRAW: A recurrent neural network for image generation","author":"gregor","year":"2015","journal-title":"Proc IEEE Int Conf Comput Vision"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.244"},{"key":"ref50","first-page":"2863","article-title":"Action-Conditional video prediction using deep networks in atari games","author":"oh","year":"0","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1109\/FG.2017.14"},{"key":"ref59","doi-asserted-by":"crossref","first-page":"1941","DOI":"10.1109\/TPAMI.2008.238","article-title":"Discriminative face alignment","volume":"31","author":"liu","year":"2009","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.1109\/34.927467"},{"key":"ref57","first-page":"1","article-title":"Cross-dataset learning and person-specific normalisation for automatic action unit detection","author":"baltru\u0161aitis","year":"2015","journal-title":"Proc IEEE Int Conf Face Gesture Recognit"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1109\/34.908962"},{"key":"ref55","year":"0"},{"key":"ref54","first-page":"1771","article-title":"Video pixel networks","author":"kalchbrenner","year":"0","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D15-1199"},{"key":"ref52","article-title":"Unsupervised representation learning with deep convolutional generative adversarial networks","author":"radford","year":"0","journal-title":"Proc Int Conf Learn Representations"},{"key":"ref10","first-page":"271","article-title":"f-GAN: Training generative neural samplers using variational divergence minimization","author":"nowozin","year":"0","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.304"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-46493-0_47"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/WACV.2017.131"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.545"},{"key":"ref14","first-page":"3738","article-title":"Ladder variational autoencoders","author":"s\u00f8nderby","year":"2016","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref15","article-title":"Deep unsupervised clustering with Gaussian mixture variational autoencoders","author":"dilokthanakul","year":"2016","journal-title":"arXiv 1611 02648"},{"key":"ref16","first-page":"1218","article-title":"Markov chain Monte Carlo and variational inference: Bridging the gap","author":"salimans","year":"2015","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref17","first-page":"843","article-title":"Unsupervised learning of video representations using LSTMs","author":"mansimov","year":"0","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2012.59"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2015.2430335"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1145\/2964284.2967240"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1145\/1631272.1631358"},{"key":"ref6","first-page":"2672","article-title":"Generative adversarial nets","author":"goodfellow","year":"0","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1016\/j.imavis.2008.11.007"},{"key":"ref8","first-page":"214","article-title":"Wasserstein generative adversarial networks","author":"arjovsky","year":"0","journal-title":"Proc Int Conf Mach Learn"},{"key":"ref7","first-page":"1486","article-title":"Deep generative image models using a laplacian pyramid of adversarial networks","author":"denton","year":"2015","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.308"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-019-01265-2"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1145\/2929464.2929475"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.1145\/311535.311556"},{"key":"ref48","first-page":"613","article-title":"Generating videos with scene dynamics","author":"vondrick","year":"0","journal-title":"Proc Int Conf Neural Inf Process"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1145\/3197517.3201283"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.141"},{"key":"ref41","article-title":"Deep identity-aware transfer of facial attributes","author":"li","year":"2016","journal-title":"arXiv1610 05586"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-01261-8_41"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-01249-6_50"}],"container-title":["IEEE Transactions on Multimedia"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6046\/9238041\/08948254.pdf?arnumber=8948254","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,4,27]],"date-time":"2022-04-27T15:55:19Z","timestamp":1651074919000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8948254\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,11]]},"references-count":66,"journal-issue":{"issue":"11"},"URL":"https:\/\/doi.org\/10.1109\/tmm.2019.2963621","relation":{},"ISSN":["1520-9210","1941-0077"],"issn-type":[{"value":"1520-9210","type":"print"},{"value":"1941-0077","type":"electronic"}],"subject":[],"published":{"date-parts":[[2020,11]]}}}