{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,16]],"date-time":"2026-05-16T09:22:24Z","timestamp":1778923344490,"version":"3.51.4"},"publisher-location":"Cham","reference-count":43,"publisher":"Springer International Publishing","isbn-type":[{"value":"9783319464923","type":"print"},{"value":"9783319464930","type":"electronic"}],"license":[{"start":{"date-parts":[[2016,1,1]],"date-time":"2016-01-01T00:00:00Z","timestamp":1451606400000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2016,1,1]],"date-time":"2016-01-01T00:00:00Z","timestamp":1451606400000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2016]]},"DOI":"10.1007\/978-3-319-46493-0_47","type":"book-chapter","created":{"date-parts":[[2016,9,16]],"date-time":"2016-09-16T14:59:53Z","timestamp":1474037993000},"page":"776-791","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":301,"title":["Attribute2Image: Conditional Image Generation from Visual Attributes"],"prefix":"10.1007","author":[{"given":"Xinchen","family":"Yan","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jimei","family":"Yang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kihyuk","family":"Sohn","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Honglak","family":"Lee","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2016,9,17]]},"reference":[{"key":"47_CR1","unstructured":"Bengio, Y., Thibodeau-Laufer, E., Alain, G., Yosinski, J.: Deep generative stochastic networks trainable by backprop. arXiv preprint \n                      arXiv:1306.1091\n                      \n                     (2013)"},{"key":"47_CR2","unstructured":"Collobert, R., Kavukcuoglu, K., Farabet, C.: Torch7: a matlab-like environment for machine learning. In: BigLearn, NIPS Workshop (2011)"},{"key":"47_CR3","unstructured":"Denton, E., Chintala, S., Szlam, A., Fergus, R.: Deep generative image models using a Laplacian pyramid of adversarial networks. In: NIPS (2015)"},{"key":"47_CR4","doi-asserted-by":"crossref","unstructured":"Dosovitskiy, A., Springenberg, J.T., Brox, T.: Learning to generate chairs with convolutional neural networks. In: CVPR (2015)","DOI":"10.1109\/CVPR.2015.7298761"},{"key":"47_CR5","unstructured":"Eigen, D., Puhrsch, C., Fergus, R.: Depth map prediction from a single image using a multi-scale deep network. In: NIPS (2014)"},{"key":"47_CR6","doi-asserted-by":"crossref","unstructured":"Gatys, L.A., Ecker, A.S., Bethge, M.: Texture synthesis using convolutional neural networks. In: NIPS (2015)","DOI":"10.1109\/CVPR.2016.265"},{"key":"47_CR7","unstructured":"Gauthier, J.: Conditional generative adversarial nets for convolutional face generation. Technical report (2015)"},{"key":"47_CR8","unstructured":"Goodfellow, I., Pouget-Abadie, J., Mirza, M., Xu, B., Warde-Farley, D., Ozair, S., Courville, A., Bengio, Y.: Generative adversarial nets. In: NIPS, pp. 2672\u20132680 (2014)"},{"key":"47_CR9","unstructured":"Gregor, K., Danihelka, I., Graves, A., Wierstra, D.: DRAW: a recurrent neural network for image generation. In: ICML (2015)"},{"key":"47_CR10","unstructured":"Huang, G.B., Ramesh, M., Berg, T.: Labeled faces in the wild: a database for studying, 07\u201349 (2007)"},{"key":"47_CR11","doi-asserted-by":"crossref","unstructured":"Isola, P., Liu, C.: Scene collaging: analysis and synthesis of natural images with semantic layers. In: ICCV (2013)","DOI":"10.1109\/ICCV.2013.457"},{"key":"47_CR12","doi-asserted-by":"crossref","unstructured":"Kemelmacher-Shlizerman, I., Suwajanakorn, S., Seitz, S.M.: Illumination-aware age progression. In: CVPR (2014)","DOI":"10.1109\/CVPR.2014.426"},{"key":"47_CR13","unstructured":"Kingma, D., Ba, J.: ADAM: a method for stochastic optimization. In: ICLR (2015)"},{"key":"47_CR14","unstructured":"Kingma, D.P., Mohamed, S., Rezende, D.J., Welling, M.: Semi-supervised learning with deep generative models. In: NIPS (2014)"},{"key":"47_CR15","unstructured":"Kingma, D.P., Welling, M.: Auto-encoding variational Bayes. In: ICLR (2014)"},{"key":"47_CR16","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G.E.: Imagenet classification with deep convolutional neural networks. In: NIPS (2012)"},{"key":"47_CR17","unstructured":"Kulkarni, T.D., Whitney, W., Kohli, P., Tenenbaum, J.B.: Deep convolutional inverse graphics network. In: NIPS (2015)"},{"key":"47_CR18","doi-asserted-by":"crossref","unstructured":"Kumar, N., Berg, A.C., Belhumeur, P.N., Nayar, S.K.: Attribute and simile classifiers for face verification. In: ICCV (2009)","DOI":"10.1109\/ICCV.2009.5459250"},{"key":"47_CR19","doi-asserted-by":"crossref","unstructured":"Laput, G.P., Dontcheva, M., Wilensky, G., Chang, W., Agarwala, A., Linder, J., Adar, E.: Pixeltone: a multimodal interface for image editing. In: Proceedings of the SIGCHI Conference on Human Factors in Computing Systems (2013)","DOI":"10.1145\/2470654.2481301"},{"issue":"3","key":"47_CR20","doi-asserted-by":"publisher","first-page":"593","DOI":"10.1162\/NECO_a_00086","volume":"23","author":"N Le Roux","year":"2011","unstructured":"Le Roux, N., Heess, N., Shotton, J., Winn, J.: Learning a generative model of images by factoring appearance and shape. Neural Comput. 23(3), 593\u2013650 (2011)","journal-title":"Neural Comput."},{"key":"47_CR21","doi-asserted-by":"crossref","unstructured":"Lee, H., Grosse, R., Ranganath, R., Ng, A.Y.: Convolutional deep belief networks for scalable unsupervised learning of hierarchical representations. In: ICML (2009)","DOI":"10.1145\/1553374.1553453"},{"key":"47_CR22","unstructured":"Ngiam, J., Khosla, A., Kim, M., Nam, J., Lee, H., Ng, A.Y.: Multimodal deep learning. In: ICML (2011)"},{"key":"47_CR23","unstructured":"Nitzberg, M., Mumford, D.: The 2.1-d sketch. In: ICCV (1990)"},{"key":"47_CR24","doi-asserted-by":"crossref","unstructured":"Porter, T., Duff, T.: Compositing digital images. In: ACM Siggraph Computer Graphics, vol. 18, pp. 253\u2013259. ACM (1984)","DOI":"10.1145\/964965.808606"},{"key":"47_CR25","unstructured":"Radford, A., Metz, L., Chintala, S.: Unsupervised representation learning with deep convolutional generative adversarial networks. arXiv preprint \n                      arXiv:1511.06434\n                      \n                     (2015)"},{"key":"47_CR26","unstructured":"Ranzato, M., Mnih, V., Hinton, G.E.: Generating more realistic images using gated MRFS. In: NIPS (2010)"},{"key":"47_CR27","unstructured":"Reed, S., Sohn, K., Zhang, Y., Lee, H.: Learning to disentangle factors of variation with manifold interaction. In: ICML (2014)"},{"key":"47_CR28","unstructured":"Rezende, D.J., Mohamed, S., Wierstra, D.: Stochastic backpropagation and approximate inference in deep generative models. In: ICML (2014)"},{"key":"47_CR29","unstructured":"Simonyan, K., Zisserman, A.: Very deep convolutional networks for large-scale image recognition. arXiv preprint \n                      arXiv:1409.1556\n                      \n                     (2014)"},{"key":"47_CR30","unstructured":"Smolensky, P.: Information processing in dynamical systems: foundations of harmony theory. In: Rumelhart, D.E., McClelland, J.L. (eds.) Parallel Distributed Processing, vol. 1 (1986)"},{"key":"47_CR31","unstructured":"Sohn, K., Shang, W., Lee, H.: Improved multimodal deep learning with variation of information. In: NIPS (2014)"},{"issue":"1","key":"47_CR32","doi-asserted-by":"publisher","first-page":"17","DOI":"10.1023\/A:1021889010444","volume":"18","author":"A Srivastava","year":"2003","unstructured":"Srivastava, A., Lee, A.B., Simoncelli, E.P., Zhu, S.C.: On advances in statistical modeling of natural images. J. Math. Imaging Vis. 18(1), 17\u201333 (2003)","journal-title":"J. Math. Imaging Vis."},{"key":"47_CR33","unstructured":"Srivastava, N., Salakhutdinov, R.R.: Multimodal learning with deep Boltzmann machines. In: NIPS (2012)"},{"key":"47_CR34","unstructured":"Tang, Y., Salakhutdinov, R.: Learning stochastic feedforward neural networks. In: NIPS (2013)"},{"key":"47_CR35","unstructured":"Tang, Y., Salakhutdinov, R., Hinton, G.: Robust boltzmann machines for recognition and denoising. In: CVPR (2012)"},{"key":"47_CR36","doi-asserted-by":"crossref","unstructured":"Tu, Z.: Learning generative models via discriminative approaches. In: CVPR (2007)","DOI":"10.1109\/CVPR.2007.383035"},{"key":"47_CR37","unstructured":"Wah, C., Branson, S., Welinder, P., Perona, P., Belongie, S.: The Caltech-UCSD birds-200-2011 dataset (2011)"},{"issue":"5","key":"47_CR38","doi-asserted-by":"publisher","first-page":"625","DOI":"10.1109\/83.334981","volume":"3","author":"JY Wang","year":"1994","unstructured":"Wang, J.Y., Adelson, E.H.: Representing moving images with layers. IEEE Trans. Image Process. 3(5), 625\u2013638 (1994)","journal-title":"IEEE Trans. Image Process."},{"issue":"5","key":"47_CR39","doi-asserted-by":"publisher","first-page":"1039","DOI":"10.1162\/089976604773135096","volume":"16","author":"CK Williams","year":"2004","unstructured":"Williams, C.K., Titsias, M.K.: Greedy learning of multiple objects in images using robust statistics and factorial learning. Neural Comput. 16(5), 1039\u20131062 (2004)","journal-title":"Neural Comput."},{"key":"47_CR40","doi-asserted-by":"crossref","unstructured":"Yang, F., Wang, J., Shechtman, E., Bourdev, L., Metaxas, D.: Expression flow for 3D-aware face component transfer. In: SIGGRAPH (2011)","DOI":"10.1145\/1964921.1964955"},{"issue":"9","key":"47_CR41","doi-asserted-by":"publisher","first-page":"1731","DOI":"10.1109\/TPAMI.2011.208","volume":"34","author":"Y Yang","year":"2012","unstructured":"Yang, Y., Hallman, S., Ramanan, D., Fowlkes, C.C.: Layered object models for image segmentation. PAMI 34(9), 1731\u20131743 (2012)","journal-title":"PAMI"},{"key":"47_CR42","unstructured":"Yosinski, J., Clune, J., Nguyen, A., Fuchs, T., Lipson, H.: Understanding neural networks through deep visualization. arXiv preprint \n                      arXiv:1506.06579\n                      \n                     (2015)"},{"key":"47_CR43","unstructured":"Zhu, S., Li, C., Loy, C.C., Tang, X.: Transferring landmark annotations for cross-dataset face alignment. arXiv preprint \n                      arXiv:1409.0602\n                      \n                     (2014)"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2016"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-319-46493-0_47","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2020,10,10]],"date-time":"2020-10-10T01:27:56Z","timestamp":1602293276000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-319-46493-0_47"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016]]},"ISBN":["9783319464923","9783319464930"],"references-count":43,"URL":"https:\/\/doi.org\/10.1007\/978-3-319-46493-0_47","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016]]},"assertion":[{"value":"17 September 2016","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Amsterdam","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"The Netherlands","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2016","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"8 October 2016","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"16 October 2016","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"14","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2016","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/www.eccv2016.org\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"This content has been made available to all.","name":"free","label":"Free to read"}]}}