{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T18:22:15Z","timestamp":1783189335786,"version":"3.54.6"},"publisher-location":"Cham","reference-count":34,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783031986871","type":"print"},{"value":"9783031986888","type":"electronic"}],"license":[{"start":{"date-parts":[[2025,7,17]],"date-time":"2025-07-17T00:00:00Z","timestamp":1752710400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,7,17]],"date-time":"2025-07-17T00:00:00Z","timestamp":1752710400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2026]]},"DOI":"10.1007\/978-3-031-98688-8_13","type":"book-chapter","created":{"date-parts":[[2025,7,16]],"date-time":"2025-07-16T09:09:18Z","timestamp":1752656958000},"page":"174-186","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Cardiac Ultrasound Video Generation Using a\u00a0Diffusion Model with\u00a0Temporal Transformer"],"prefix":"10.1007","author":[{"given":"Wenbin","family":"Wang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Ping","family":"Lu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,7,17]]},"reference":[{"issue":"11","key":"13_CR1","doi-asserted-by":"publisher","first-page":"2514","DOI":"10.1109\/TMI.2018.2837502","volume":"37","author":"O Bernard","year":"2018","unstructured":"Bernard, O., et al.: Deep learning techniques for automatic MRI cardiac multi-structures segmentation and diagnosis: is the problem solved? IEEE Trans. Med. Imaging 37(11), 2514\u20132525 (2018)","journal-title":"IEEE Trans. Med. Imaging"},{"issue":"1","key":"13_CR2","doi-asserted-by":"publisher","first-page":"280","DOI":"10.1109\/TMI.2018.2863670","volume":"38","author":"C Qin","year":"2018","unstructured":"Qin, C., et al.: Convolutional recurrent neural networks for dynamic MR image reconstruction. IEEE Trans. Med. Imaging 38(1), 280\u2013290 (2018)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"13_CR3","doi-asserted-by":"crossref","unstructured":"Wolleb, J., et al.: Diffusion models for medical anomaly detection. In: International Conference on Medical Image Computing and Computer-Assisted Intervention, pp. 35\u201345 (2022)","DOI":"10.1007\/978-3-031-16452-1_4"},{"key":"13_CR4","unstructured":"Chen, J., et al.: TransUNet: transformers make strong encoders for medical image segmentation. arXiv preprint arXiv:2102.04306 (2021)"},{"issue":"7802","key":"13_CR5","doi-asserted-by":"publisher","first-page":"252","DOI":"10.1038\/s41586-020-2145-8","volume":"580","author":"D Ouyang","year":"2020","unstructured":"Ouyang, D., et al.: Video-based AI for beat-to-beat assessment of cardiac function. Nature 580(7802), 252\u2013256 (2020)","journal-title":"Nature"},{"key":"13_CR6","unstructured":"Vaswani, A., et al.: Attention is all you need. In: Advances in Neural Information Processing Systems, pp. 5998\u20136008 (2017)"},{"key":"13_CR7","doi-asserted-by":"crossref","unstructured":"Zhang, L., et al.: Adding conditional control to text-to-image diffusion models. In: Proceedings of the of ICCV, pp. 18436\u201318446 (2023)","DOI":"10.1109\/ICCV51070.2023.00355"},{"key":"13_CR8","unstructured":"Ho, J., Jain, A., Abbeel, P.: Denoising diffusion probabilistic models. In: Advances in Neural Information Processing Systems, vol. 33, pp. 6840\u20136851 (2020)"},{"issue":"4","key":"13_CR9","doi-asserted-by":"publisher","first-page":"600","DOI":"10.1109\/TIP.2003.819861","volume":"13","author":"Z Wang","year":"2004","unstructured":"Wang, Z., Bovik, A.C., Sheikh, H.R., Simoncelli, E.P.: Image quality assessment: from error visibility to structural similarity. IEEE Trans. Image Process. 13(4), 600\u2013612 (2004)","journal-title":"IEEE Trans. Image Process."},{"issue":"4","key":"13_CR10","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3414685.3417799","volume":"39","author":"M Huang","year":"2020","unstructured":"Huang, M., et al.: Learning temporal coherence via self-supervision for GAN-based video generation. ACM Trans. Graph. (TOG) 39(4), 1\u201312 (2020)","journal-title":"ACM Trans. Graph. (TOG)"},{"issue":"1","key":"13_CR11","doi-asserted-by":"publisher","first-page":"47","DOI":"10.1109\/TCI.2016.2644865","volume":"3","author":"H Zhao","year":"2016","unstructured":"Zhao, H., Gallo, O., Frosio, I., Kautz, J.: Loss functions for image restoration with neural networks. IEEE Trans. Comput. Imaging 3(1), 47\u201357 (2016)","journal-title":"IEEE Trans. Comput. Imaging"},{"key":"13_CR12","unstructured":"Heusel, M., Ramsauer, H., Unterthiner, T., Nessler, B., Hochreiter, S.: GANs trained by a two time-scale update rule converge to a local Nash equilibrium. In: Advances in Neural Information Processing Systems, pp. 6626\u20136637 (2017)"},{"key":"13_CR13","unstructured":"Unterthiner, T., et al.: FVD: A new metric for video generation. In: ICLR Workshop on Deep Generative Models for Highly Structured Data (2019)"},{"key":"13_CR14","doi-asserted-by":"crossref","unstructured":"Voleti, V., et al.: MCVD: masked conditional video diffusion for prediction, generation, and interpolation. arXiv preprint arXiv:2205.09853 (2022)","DOI":"10.52202\/068431-1698"},{"key":"13_CR15","doi-asserted-by":"crossref","unstructured":"Ge, S., et al.: Long video generation with time-agnostic VQGAN and time-sensitive Transformer. In: European Conference on Computer Vision, pp. 370\u2013386. Springer (2022)","DOI":"10.1007\/978-3-031-19790-1_7"},{"key":"13_CR16","unstructured":"Salimans, T., Goodfellow, I., Zaremba, W., Cheung, V., Radford, A., Chen, X.: Improved techniques for training GANs. In: Advances in Neural Information Processing Systems, pp. 2234\u20132242 (2016)"},{"key":"13_CR17","doi-asserted-by":"publisher","first-page":"101552","DOI":"10.1016\/j.media.2019.101552","volume":"58","author":"X Yi","year":"2019","unstructured":"Yi, X., Walia, E., Babyn, P.: Generative adversarial network in medical imaging: a review. Med. Image Anal. 58, 101552 (2019)","journal-title":"Med. Image Anal."},{"key":"13_CR18","unstructured":"Song, Y., Ermon, S.: Generative modelling by estimating gradients of the data distribution. In: Advances in Neural Information Processing Systems (NeurIPS) (2019)"},{"key":"13_CR19","unstructured":"Wolleb, J., Van Gool, L., & L\u00fcthi, M.: Diffusion models for medical image analysis: a comprehensive survey. arXiv preprint arXiv:2211.07804 (2022)"},{"key":"13_CR20","unstructured":"Vaswani, A., et al.: Attention is all you need. In: Advances in Neural Information Processing Systems, vol. 30 (2017)"},{"key":"13_CR21","doi-asserted-by":"crossref","unstructured":"Arnab, A., Dehghani, M., Heigold, G., Sun, C., Lu\u010di\u0107, M., Schmid, C.: ViViT: a video vision transformer. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision (ICCV), pp. 6836\u20136846 (2021)","DOI":"10.1109\/ICCV48922.2021.00676"},{"issue":"2","key":"13_CR22","first-page":"427","volume":"42","author":"K Yan","year":"2023","unstructured":"Yan, K., Wang, C., Yu, H., Liang, D.: Neural motion fields for dynamic MRI reconstruction. IEEE Trans. Med. Imaging 42(2), 427\u2013438 (2023)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"13_CR23","unstructured":"Shi, X., et al.: Video diffusion models. arXiv preprint arXiv:2204.03458 (2022)"},{"key":"13_CR24","doi-asserted-by":"crossref","unstructured":"Zhang, L., Chen, H., Zhang, J., et al.: Adding conditional control to text-to-image diffusion models. In: CVPR 2023, pp. 14065\u201314075 (2023)","DOI":"10.1109\/ICCV51070.2023.00355"},{"key":"13_CR25","doi-asserted-by":"crossref","first-page":"9140","DOI":"10.1109\/TIP.2020.3023615","volume":"29","author":"Y Huang","year":"2020","unstructured":"Huang, Y., Wu, W., et al.: Learning of temporal consistency for video super-resolution. IEEE Trans. Image Process. 29, 9140\u20139153 (2020)","journal-title":"IEEE Trans. Image Process."},{"key":"13_CR26","unstructured":"Author(s). D\u2019ARTAGNAN: counterfactual video generation. Proceedings of [Conference Name] (2023)"},{"key":"13_CR27","unstructured":"Author(s). EchoNet-synthetic: privacy-preserving video generation for safe medical data sharing. In: Proceedings of [Conference Name] (2023)"},{"key":"13_CR28","unstructured":"Author(s). Generating chest radiology report findings using a multinodal method. Journal or Conference (2023)"},{"key":"13_CR29","doi-asserted-by":"crossref","unstructured":"Ge, Y., Dai, B., Wu, J., Torralba, A., Freeman, W. T., Liu, C.: Long-term video synthesis with time-agnostic VQGAN and time-aware transformer. In: Advances in Neural Information Processing Systems (NeurIPS) (2022)","DOI":"10.1007\/978-3-031-19790-1_7"},{"issue":"8","key":"13_CR30","doi-asserted-by":"publisher","first-page":"1735","DOI":"10.1162\/neco.1997.9.8.1735","volume":"9","author":"S Hochreiter","year":"1997","unstructured":"Hochreiter, S., Schmidhuber, J.: Long short-term memory. Neural Comput. 9(8), 1735\u20131780 (1997)","journal-title":"Neural Comput."},{"key":"13_CR31","unstructured":"Yuan L., et al.: D\u2019ARTAGNAN: counterfactual video generation with latent diffusion. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision (ICCV), pp. 20187\u201320197 (2023)"},{"issue":"9","key":"13_CR32","doi-asserted-by":"publisher","first-page":"2198","DOI":"10.1109\/TMI.2019.2900516","volume":"38","author":"S Leclerc","year":"2019","unstructured":"Leclerc, S., Smistad, E., Pedrosa, J., Ostvik, A., et al.: Deep learning for segmentation using an open large-scale dataset in 2D echocardiography. IEEE Trans. Med. Imaging 38(9), 2198\u20132210 (2019). https:\/\/doi.org\/10.1109\/TMI.2019.2900516","journal-title":"IEEE Trans. Med. Imaging"},{"key":"13_CR33","unstructured":"Hannun, A.Y., Rajpurkar, P., Saeed, M.S.M., et al.: A large-scale benchmark for automated cardiac view classification and disease detection. In: NeurIPS 2019 Machine Learning for Health Workshop (2019). https:\/\/echonet.github.io\/dataset\/download.html"},{"key":"13_CR34","unstructured":"Villegas, R., Yang, J., Hong, S., Lin, X., Lee, H.: Decomposing motion and content for natural video sequence prediction. In: International Conference on Learning Representations (ICLR) (2017)"}],"container-title":["Lecture Notes in Computer Science","Medical Image Understanding and Analysis"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-98688-8_13","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,7,4]],"date-time":"2026-07-04T18:10:25Z","timestamp":1783188625000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-98688-8_13"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,7,17]]},"ISBN":["9783031986871","9783031986888"],"references-count":34,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-98688-8_13","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,7,17]]},"assertion":[{"value":"17 July 2025","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"MIUA","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Annual Conference on Medical Image Understanding and Analysis","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Leeds","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"United Kingdom","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2025","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"15 July 2025","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"17 July 2025","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"29","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"miua2025","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/conferences.leeds.ac.uk\/miua\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}