{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,11]],"date-time":"2026-07-11T02:45:25Z","timestamp":1783737925154,"version":"3.55.0"},"publisher-location":"Cham","reference-count":73,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783031851803","type":"print"},{"value":"9783031851810","type":"electronic"}],"license":[{"start":{"date-parts":[[2025,1,1]],"date-time":"2025-01-01T00:00:00Z","timestamp":1735689600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,1,1]],"date-time":"2025-01-01T00:00:00Z","timestamp":1735689600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-85181-0_19","type":"book-chapter","created":{"date-parts":[[2025,4,22]],"date-time":"2025-04-22T06:58:03Z","timestamp":1745305083000},"page":"295-311","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":2,"title":["Latent Diffusion Counterfactual Explanations"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0009-0003-7006-953X","authenticated-orcid":false,"given":"Simon","family":"Schrodi","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8054-0004","authenticated-orcid":false,"given":"Karim","family":"Farid","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1288-7476","authenticated-orcid":false,"given":"Max","family":"Argus","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6282-8861","authenticated-orcid":false,"given":"Thomas","family":"Brox","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,4,23]]},"reference":[{"key":"19_CR1","doi-asserted-by":"crossref","unstructured":"Akula, A., Wang, S., Zhu, S.C.: CoCoX: generating conceptual and counterfactual explanations via fault-lines. In: AAAI (2020)","DOI":"10.1609\/aaai.v34i03.5643"},{"key":"19_CR2","unstructured":"Arrieta, A.B., et\u00a0al.: Explainable artificial intelligence (XAI): concepts, taxonomies, opportunities and challenges toward responsible AI. Information Fusion (2020)"},{"key":"19_CR3","doi-asserted-by":"crossref","unstructured":"Augustin, M., Boreiko, V., Croce, F., Hein, M.: Diffusion visual counterfactual explanations. In: NeurIPS (2022)","DOI":"10.1007\/978-3-031-16788-1_9"},{"key":"19_CR4","doi-asserted-by":"crossref","unstructured":"Avrahami, O., Lischinski, D., Fried, O.: Blended diffusion for text-driven editing of natural images. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01767"},{"key":"19_CR5","doi-asserted-by":"crossref","unstructured":"Bach, S., Binder, A., Montavon, G., Klauschen, F., M\u00fcller, K.R., Samek, W.: On pixel-wise explanations for non-linear classifier decisions by layer-wise relevance propagation. PLoS ONE 10, e0130140 (2015)","DOI":"10.1371\/journal.pone.0130140"},{"key":"19_CR6","doi-asserted-by":"crossref","unstructured":"Bansal, A., et al.: Universal guidance for diffusion models. arXiv (2023)","DOI":"10.1109\/CVPRW59228.2023.00091"},{"key":"19_CR7","doi-asserted-by":"crossref","unstructured":"Bau, D., Zhou, B., Khosla, A., Oliva, A., Torralba, A.: Network dissection: quantifying interpretability of deep visual representations. In: CVPR (2017)","DOI":"10.1109\/CVPR.2017.354"},{"key":"19_CR8","doi-asserted-by":"crossref","unstructured":"Bianchi, F., et al.: Easily accessible text-to-image generation amplifies demographic stereotypes at large scale. In: FAccT (2023)","DOI":"10.1145\/3593013.3594095"},{"key":"19_CR9","doi-asserted-by":"crossref","unstructured":"B\u00f6hle, M., Fritz, M., Schiele, B.: B-cos Networks: alignment is all we need for interpretability. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01008"},{"key":"19_CR10","unstructured":"Bolya, D., Fu, C.Y., Dai, X., Zhang, P., Feichtenhofer, C., Hoffman, J.: Token merging: your ViT but faster. In: ICLR (2023)"},{"key":"19_CR11","doi-asserted-by":"crossref","unstructured":"Boreiko, V., Augustin, M., Croce, F., Berens, P., Hein, M.: Sparse visual counterfactual explanations in image space. In: GCPR (2022)","DOI":"10.1007\/978-3-031-16788-1_9"},{"key":"19_CR12","unstructured":"Brendel, W., Bethge, M.: Approximating CNNs with Bag-of-local-Features models works surprisingly well on ImageNet. In: ICLR (2019)"},{"key":"19_CR13","doi-asserted-by":"crossref","unstructured":"Brooks, T., Holynski, A., Efros, A.A.: InstructPix2Pix: learning to follow image editing instructions. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01764"},{"key":"19_CR14","unstructured":"Chen, C., Li, O., Tao, D., Barnett, A., Rudin, C., Su, J.K.: This looks like that: deep learning for interpretable image recognition. In: NeurIPS (2019)"},{"key":"19_CR15","doi-asserted-by":"crossref","unstructured":"Chen, X., He, K.: Exploring simple siamese representation learning. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.01549"},{"key":"19_CR16","doi-asserted-by":"crossref","unstructured":"Cherti, M., et al.: Reproducible scaling laws for contrastive language-Image learning. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.00276"},{"key":"19_CR17","unstructured":"Croce, F., Hein, M.: Adversarial robustness against multiple and single $$l_p$$-Threat models via quick fine-tuning of robust classifiers. In: ICML (2022)"},{"key":"19_CR18","unstructured":"Dao, T., Fu, D., Ermon, S., Rudra, A., R\u00e9, C.: FLASHATTENTION: fast and memory-efficient exact attention with IO-awareness. In: NeurIPS (2022)"},{"key":"19_CR19","doi-asserted-by":"crossref","unstructured":"Deng, J., Dong, W., Socher, R., Li, L.J., Li, K., Fei-Fei, L.: ImageNet: a large-scale hierarchical image database. In: CVPR (2009)","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"19_CR20","unstructured":"Dhariwal, P., Nichol, A.: Diffusion models beat GANs on image synthesis. In: NeurIPS (2021)"},{"key":"19_CR21","unstructured":"Erhan, D., Bengio, Y., Courville, A., Vincent, P.: Visualizing higher-layer features of a deep network. University of Montreal (2009)"},{"key":"19_CR22","doi-asserted-by":"crossref","unstructured":"Esser, P., Rombach, R., Ommer, B.: Taming transformers for high-resolution image synthesis. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.01268"},{"key":"19_CR23","doi-asserted-by":"crossref","unstructured":"Goodfellow, I., et al.: Generative adversarial networks. Commun. ACM 63, 139\u2013144 (2020)","DOI":"10.1145\/3422622"},{"key":"19_CR24","unstructured":"Goyal, Y., Wu, Z., Ernst, J., Batra, D., Parikh, D., Lee, S.: Counterfactual visual explanations. In: ICML (2019)"},{"key":"19_CR25","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: CVPR (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"19_CR26","unstructured":"Ho, J., Jain, A., Abbeel, P.: Denoising diffusion probabilistic models. In: NeurIPS (2020)"},{"key":"19_CR27","unstructured":"Ho, J., Salimans, T.: Classifier-free diffusion guidance. In: NeurIPS Workshop (2022)"},{"key":"19_CR28","doi-asserted-by":"crossref","unstructured":"Huang, G., Liu, Z., Van Der\u00a0Maaten, L., Weinberger, K.Q.: Densely connected convolutional networks. In: CVPR (2017)","DOI":"10.1109\/CVPR.2017.243"},{"key":"19_CR29","doi-asserted-by":"crossref","unstructured":"Hvilsh\u00f8j, F., Iosifidis, A., Assent, I.: ECINN: efficient counterfactuals from invertible neural networks. In: BMVC (2021)","DOI":"10.5244\/C.35.159"},{"key":"19_CR30","doi-asserted-by":"crossref","unstructured":"Jacob, P., Zablocki, \u00c9., Ben-Younes, H., Chen, M., P\u00e9rez, P., Cord, M.: STEEX: steering counterfactual explanations with semantics. In: ECCV (2022)","DOI":"10.1007\/978-3-031-19775-8_23"},{"key":"19_CR31","doi-asserted-by":"crossref","unstructured":"Jeanneret, G., Simon, L., Jurie, F.: Diffusion models for counterfactual explanations. In: ACCV (2022)","DOI":"10.1007\/978-3-031-26293-7_14"},{"key":"19_CR32","doi-asserted-by":"crossref","unstructured":"Jeanneret, G., Simon, L., Jurie, F.: Adversarial counterfactual visual explanations. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01576"},{"key":"19_CR33","doi-asserted-by":"crossref","unstructured":"Khorram, S., Fuxin, L.: Cycle-consistent counterfactuals by latent transformations. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.00996"},{"key":"19_CR34","unstructured":"Kim, B., Wattenberg, M., Gilmer, J., Cai, C., Wexler, J., Viegas, F., et\u00a0al.: Interpretability beyond feature attribution: quantitative testing with concept activation vectors (TCAV). In: ICML (2018)"},{"key":"19_CR35","unstructured":"Kingma, D.P., Welling, M.: Auto-encoding variational bayes. ICLR (2014)"},{"key":"19_CR36","unstructured":"Koh, P.W., et al.: Concept bottleneck models. In: ICML (2020)"},{"key":"19_CR37","unstructured":"Kynk\u00e4\u00e4nniemi, T., Karras, T., Laine, S., Lehtinen, J., Aila, T.: Improved precision and recall metric for assessing generative models. In: NeurIPS (2019)"},{"key":"19_CR38","doi-asserted-by":"crossref","unstructured":"Lang, O., et\u00a0al.: Explaining in style: training a GAN to explain a classifier in StyleSpace. In: CVPR (2021)","DOI":"10.1109\/ICCV48922.2021.00073"},{"key":"19_CR39","doi-asserted-by":"crossref","unstructured":"Lee, C.H., Liu, Z., Wu, L., Luo, P.: MaskGAN: towards diverse and interactive facial image manipulation. In: CVPR (2020)","DOI":"10.1109\/CVPR42600.2020.00559"},{"key":"19_CR40","unstructured":"Luccioni, A.S., Akiki, C., Mitchell, M., Jernite, Y.: Stable bias: analyzing societal representations in diffusion models. In: NeurIPS (2023)"},{"key":"19_CR41","unstructured":"Lundberg, S.M., Lee, S.I.: A unified approach to interpreting model predictions. In: NeurIPS (2017)"},{"key":"19_CR42","doi-asserted-by":"crossref","unstructured":"Meng, C., Gao, R., Kingma, D.P., Ermon, S., Ho, J., Salimans, T.: On distillation of guided diffusion models. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01374"},{"key":"19_CR43","doi-asserted-by":"crossref","unstructured":"Miller, G.A.: WordNet: a lexical database for English. Communications of the ACM (1995)","DOI":"10.1145\/219717.219748"},{"key":"19_CR44","doi-asserted-by":"crossref","unstructured":"Nilsback, M.E., Zisserman, A.: Automated flower classification over a large number of classes. In: Indian Conference on Computer Vision, Graphics & Image Processing (2008)","DOI":"10.1109\/ICVGIP.2008.47"},{"key":"19_CR45","doi-asserted-by":"crossref","unstructured":"Olah, C., Mordvintsev, A., Schubert, L.: Feature Visualization. Distill (2017)","DOI":"10.23915\/distill.00007"},{"key":"19_CR46","doi-asserted-by":"crossref","unstructured":"Parkhi, O.M., Vedaldi, A., Zisserman, A., Jawahar, C.: Cats and dogs. In: CVPR (2012)","DOI":"10.1109\/CVPR.2012.6248092"},{"key":"19_CR47","unstructured":"Pinkey, J.: miniSD (2023). https:\/\/huggingface.co\/justinpinkney\/miniSD"},{"key":"19_CR48","unstructured":"Radford, A., et\u00a0al.: Learning transferable visual models from natural language supervision. In: ICML (2021)"},{"key":"19_CR49","unstructured":"Rezende, D., Mohamed, S.: Variational inference with normalizing flows. In: ICML (2015)"},{"key":"19_CR50","unstructured":"Rezende, D.J., Mohamed, S., Wierstra, D.: Stochastic backpropagation and approximate inference in deep generative models. In: ICML (2014)"},{"key":"19_CR51","doi-asserted-by":"crossref","unstructured":"Rodriguez, P., et al.: Beyond trivial counterfactual explanations with diverse valuable explanations. In: CVPR (2021)","DOI":"10.1109\/ICCV48922.2021.00109"},{"key":"19_CR52","doi-asserted-by":"crossref","unstructured":"Rombach, R., Blattmann, A., Lorenz, D., Esser, P., Ommer, B.: High-resolution image synthesis with latent diffusion models. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01042"},{"key":"19_CR53","doi-asserted-by":"crossref","unstructured":"Ronneberger, O., Fischer, P., Brox, T.: U-Net: convolutional networks for biomedical image segmentation. In: MICCAI (2015)","DOI":"10.1007\/978-3-319-24574-4_28"},{"key":"19_CR54","unstructured":"Salimans, T., Ho, J.: Progressive distillation for fast sampling of diffusion models. In: ICLR (2022)"},{"key":"19_CR55","doi-asserted-by":"crossref","unstructured":"Samangouei, P., Saeedi, A., Nakagawa, L., Silberman, N.: ExplainGAN: model explanation via decision boundary crossing transformations. In: ECCV (2018)","DOI":"10.1007\/978-3-030-01249-6_41"},{"key":"19_CR56","unstructured":"Sanchez, P., Tsaftaris, S.A.: Diffusion causal models for counterfactual estimation. In: CLeaR (2022)"},{"key":"19_CR57","unstructured":"Santurkar, S., Ilyas, A., Tsipras, D., Engstrom, L., Tran, B., Madry, A.: Image synthesis with a single (robust) classifier. In: NeurIPS (2019)"},{"key":"19_CR58","unstructured":"Sauer, A., Geiger, A.: Counterfactual generative networks. In: ICLR (2021)"},{"key":"19_CR59","doi-asserted-by":"crossref","unstructured":"Sauer, A., Lorenz, D., Blattmann, A., Rombach, R.: Adversarial diffusion distillation. arXiv preprint arXiv:2311.17042 (2023)","DOI":"10.1007\/978-3-031-73016-0_6"},{"key":"19_CR60","unstructured":"Schuhmann, C., et al.: LAION-400M: open dataset of CLIP-filtered 400 million image-text pairs. arXiv (2021)"},{"key":"19_CR61","doi-asserted-by":"crossref","unstructured":"Selvaraju, R.R., Cogswell, M., Das, A., Vedantam, R., Parikh, D., Batra, D.: Grad-CAM: visual explanations from deep networks via gradient-based localization. In: CVPR (2017)","DOI":"10.1109\/ICCV.2017.74"},{"key":"19_CR62","unstructured":"Simonyan, K., Vedaldi, A., Zisserman, A.: Deep inside convolutional networks: visualising image classification models and saliency maps. In: ICLR Workshop (2014)"},{"key":"19_CR63","unstructured":"Sohl-Dickstein, J., Weiss, E., Maheswaranathan, N., Ganguli, S.: Deep unsupervised learning using nonequilibrium thermodynamics. In: ICML (2015)"},{"key":"19_CR64","unstructured":"Song, J., Meng, C., Ermon, S.: Denoising diffusion implicit models. In: ICLR (2021)"},{"key":"19_CR65","unstructured":"Song, Y., Dhariwal, P., Chen, M., Sutskever, I.: Consistency models. In: ICML (2023)"},{"key":"19_CR66","unstructured":"Song, Y., Ermon, S.: Generative modeling by estimating gradients of the data distribution. In: NeurIPS (2019)"},{"key":"19_CR67","unstructured":"Song, Y., Sohl-Dickstein, J., Kingma, D.P., Kumar, A., Ermon, S., Poole, B.: Score-based generative modeling through stochastic differential equations. In: ICLR (2021)"},{"key":"19_CR68","unstructured":"Thiagarajan, J., Narayanaswamy, V.S., Rajan, D., Liang, J., Chaudhari, A., Spanias, A.: Designing counterfactual generators using deep model inversion. In: NeurIPS (2021)"},{"key":"19_CR69","doi-asserted-by":"crossref","unstructured":"Van\u00a0Looveren, A., Klaise, J.: Interpretable counterfactual explanations guided by prototypes. In: ECML PKDD (2021)","DOI":"10.1007\/978-3-030-86520-7_40"},{"key":"19_CR70","doi-asserted-by":"crossref","unstructured":"Vandenhende, S., Mahajan, D., Radenovic, F., Ghadiyaram, D.: Making heads or tails: towards semantically consistent visual counterfactuals. In: ECCV (2022)","DOI":"10.1007\/978-3-031-19775-8_16"},{"key":"19_CR71","doi-asserted-by":"crossref","unstructured":"Wachter, S., Mittelstadt, B., Russell, C.: Counterfactual Explanations Without Opening the Black Box: Automated Decisions and the GDPR. Harv. JL & Tech. (2017)","DOI":"10.2139\/ssrn.3063289"},{"key":"19_CR72","doi-asserted-by":"crossref","unstructured":"Wallace, B., Gokul, A., Ermon, S., Naik, N.: End-to-end diffusion latent optimization improves classifier guidance. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.00669"},{"key":"19_CR73","doi-asserted-by":"crossref","unstructured":"Wang, P., Li, Y., Singh, K.K., Lu, J., Vasconcelos, N.: IMAGINE: Image Synthesis by Image-Guided Model Inversion. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.00368"}],"container-title":["Lecture Notes in Computer Science","Pattern Recognition"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-85181-0_19","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,9,23]],"date-time":"2025-09-23T13:15:47Z","timestamp":1758633347000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-85181-0_19"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025]]},"ISBN":["9783031851803","9783031851810"],"references-count":73,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-85181-0_19","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025]]},"assertion":[{"value":"23 April 2025","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}}]}}