{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,22]],"date-time":"2026-04-22T19:37:05Z","timestamp":1776886625463,"version":"3.51.2"},"publisher-location":"Cham","reference-count":52,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783032049704","type":"print"},{"value":"9783032049711","type":"electronic"}],"license":[{"start":{"date-parts":[[2025,9,20]],"date-time":"2025-09-20T00:00:00Z","timestamp":1758326400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,9,20]],"date-time":"2025-09-20T00:00:00Z","timestamp":1758326400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2026]]},"DOI":"10.1007\/978-3-032-04971-1_3","type":"book-chapter","created":{"date-parts":[[2025,9,19]],"date-time":"2025-09-19T17:09:37Z","timestamp":1758301777000},"page":"24-34","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":2,"title":["Adapting Vision Foundation Models for\u00a0Real-Time Ultrasound Image Segmentation"],"prefix":"10.1007","author":[{"given":"Xiaoran","family":"Zhang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Eric Z.","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lin","family":"Zhao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiao","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yikang","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Boris","family":"Maihe","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"James S.","family":"Duncan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Terrence","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shanhui","family":"Sun","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2025,9,20]]},"reference":[{"key":"3_CR1","unstructured":"Thyroid Ultrasound Cine-clip |Center for AI in Medicine & Imaging"},{"key":"3_CR2","unstructured":"Amiri, M., et\u00a0al.: Fine-Tuning U-Net for Ultrasound Image Segmentation: Different Layers, Different Outcomes. IEEE Trans. Ultrason. Ferroelectr. Freq. Control"},{"key":"3_CR3","unstructured":"Ansari, M.Y., et\u00a0al.: Advancements in deep learning for b-mode ultrasound segmentation: a comprehensive review. IEEE Trans. Emerg. Top. Comput. Intell"},{"key":"3_CR4","doi-asserted-by":"publisher","DOI":"10.1016\/j.compbiomed.2022.106478","volume":"153","author":"MY Ansari","year":"2023","unstructured":"Ansari, M.Y., et al.: Dense-PSP-UNet: A neural network for fast inference liver ultrasound segmentation. Comput. Biol. Med. 153, 106478 (2023)","journal-title":"Comput. Biol. Med."},{"key":"3_CR5","unstructured":"Awais, M., et\u00a0al.: Foundation models defining a new era in vision: a survey and outlook. IEEE Trans. Pattern Anal. Mach. Intell, pp. 1\u201320 (2025)"},{"issue":"11","key":"3_CR6","doi-asserted-by":"publisher","first-page":"2514","DOI":"10.1109\/TMI.2018.2837502","volume":"37","author":"O Bernard","year":"2018","unstructured":"Bernard, O., et al.: Deep learning techniques for automatic MRI cardiac multi-structures segmentation and diagnosis: is the problem solved? IEEE Trans. Med. Imaging 37(11), 2514\u20132525 (2018)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"3_CR7","unstructured":"Cardoso, M.J., et\u00a0al.: MONAI: An open-source framework for deep learning in healthcare (2022). arXiv:2211.02701 [cs]"},{"key":"3_CR8","unstructured":"Chen, J., et\u00a0al.: TransUNet: Transformers Make Strong Encoders for Medical Image Segmentation (2021). arXiv:2102.04306 [cs]"},{"key":"3_CR9","doi-asserted-by":"crossref","unstructured":"Deng, X., et\u00a0al.: MemSAM: Taming Segment Anything Model for Echocardiography Video Segmentation. In: CVPR, pp. 9622\u20139631. IEEE (2024)","DOI":"10.1109\/CVPR52733.2024.00919"},{"key":"3_CR10","doi-asserted-by":"crossref","unstructured":"Dorent, R., et\u00a0al.: Patient-Specific Real-Time Segmentation in Trackerless Brain Ultrasound. In: MICCAI 2024, pp. 477\u2013487. Springer Nature Switzerland (2024)","DOI":"10.1007\/978-3-031-72089-5_45"},{"key":"3_CR11","unstructured":"Dosovitskiy, A., et\u00a0al.: An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale (2020)"},{"key":"3_CR12","doi-asserted-by":"crossref","unstructured":"Gong, H., et\u00a0al.: Multi-Task Learning For Thyroid Nodule Segmentation With Thyroid Region Prior. In: ISBI, pp. 257\u2013261 (2021)","DOI":"10.1109\/ISBI48211.2021.9434087"},{"key":"3_CR13","doi-asserted-by":"crossref","unstructured":"He, Y., et\u00a0al.: SwinUNETR-V2: Stronger Swin Transformers with Stagewise Convolutions for 3D Medical Image Segmentation. In: MICCAI. Springer (2023)","DOI":"10.1007\/978-3-031-43901-8_40"},{"key":"3_CR14","doi-asserted-by":"publisher","DOI":"10.1016\/j.ultras.2024.107251","volume":"140","author":"L Howell","year":"2024","unstructured":"Howell, L., et al.: Deep learning for real-time multi-class segmentation of artefacts in lung ultrasound. Ultrasonics 140, 107251 (2024)","journal-title":"Ultrasonics"},{"key":"3_CR15","unstructured":"Hu, E.J., et\u00a0al.: LoRA: Low-Rank Adaptation of Large Language Models"},{"issue":"2","key":"3_CR16","doi-asserted-by":"publisher","first-page":"203","DOI":"10.1038\/s41592-020-01008-z","volume":"18","author":"F Isensee","year":"2021","unstructured":"Isensee, F., et al.: nnU-Net: a self-configuring method for deep learning-based biomedical image segmentation. Nat. Methods 18(2), 203\u2013211 (2021)","journal-title":"Nat. Methods"},{"key":"3_CR17","doi-asserted-by":"crossref","unstructured":"Jia, M., et\u00a0al.: Visual Prompt Tuning. In: Comput. Vis. \u2013 ECCV 2022, vol. 13693, pp. 709\u2013727. Springer Nature Switzerland, Cham (2022)","DOI":"10.1007\/978-3-031-19827-4_41"},{"key":"3_CR18","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2023.102878","volume":"89","author":"Z Jiang","year":"2023","unstructured":"Jiang, Z., et al.: Robotic ultrasound imaging: state-of-the-art and future perspectives. Med. Image Anal. 89, 102878 (2023)","journal-title":"Med. Image Anal."},{"key":"3_CR19","doi-asserted-by":"crossref","unstructured":"Kirillov, A., et\u00a0al.: Segment Anything. In: ICCV, pp. 3992\u20134003. IEEE (2023)","DOI":"10.1109\/ICCV51070.2023.00371"},{"key":"3_CR20","doi-asserted-by":"crossref","unstructured":"Leclerc, S., et\u00a0al.: Deep learning for segmentation using an open large-scale dataset in 2d echocardiography. IEEE Trans. Med. Imaging 38, 2198\u20132210","DOI":"10.1109\/TMI.2019.2900516"},{"key":"3_CR21","doi-asserted-by":"crossref","unstructured":"Lester, B., et\u00a0al.: The power of scale for parameter-efficient prompt tuning. In: EMNLP, pp. 3045\u20133059. ACL","DOI":"10.18653\/v1\/2021.emnlp-main.243"},{"key":"3_CR22","doi-asserted-by":"crossref","unstructured":"Li, Y., et\u00a0al.: MViTv2: improved multiscale vision transformers for classification and detection. In: (CVPR), pp. 4794\u20134804. IEEE (2022)","DOI":"10.1109\/CVPR52688.2022.00476"},{"key":"3_CR23","doi-asserted-by":"crossref","unstructured":"Lin, X., et\u00a0al.: Beyond Adapting SAM: Towards End-to-End Ultrasound Image Segmentation via Auto Prompting (2024). arXiv:2309.06824 [cs]","DOI":"10.1007\/978-3-031-72111-3_3"},{"issue":"12","key":"3_CR24","doi-asserted-by":"publisher","first-page":"1073","DOI":"10.1007\/s11517-014-1203-5","volume":"52","author":"CP Loizou","year":"2014","unstructured":"Loizou, C.P.: A review of ultrasound common carotid artery image and video segmentation techniques. Med. Bio. Eng. Comput. 52(12), 1073\u20131093 (2014). https:\/\/doi.org\/10.1007\/s11517-014-1203-5","journal-title":"Med. Bio. Eng. Comput."},{"key":"3_CR25","doi-asserted-by":"crossref","unstructured":"Looney, P., et\u00a0al.: Fully automated, real-time 3D ultrasound segmentation to estimate first trimester placental volume using deep learning. JCI Insight 3(11)","DOI":"10.1172\/jci.insight.120178"},{"key":"3_CR26","unstructured":"Ma, J., et\u00a0al.: Segment Anything in Medical Images and Videos: Benchmark and Deployment (2024). arXiv:2408.03322 [eess]"},{"issue":"1","key":"3_CR27","doi-asserted-by":"publisher","first-page":"64","DOI":"10.1109\/TUFFC.2006.1588392","volume":"53","author":"OV Michailovich","year":"2006","unstructured":"Michailovich, O.V., et al.: Despeckling of medical ultrasound images. IEEE Trans. Ultrason. Ferroelectr. Freq. Control 53(1), 64\u201378 (2006)","journal-title":"IEEE Trans. Ultrason. Ferroelectr. Freq. Control"},{"key":"3_CR28","unstructured":"Oquab, M., et\u00a0al.: DINOv2: Learning robust visual features without supervision. Trans. Mach. Learn. Res. (2023)"},{"key":"3_CR29","doi-asserted-by":"publisher","DOI":"10.1016\/j.compbiomed.2024.108501","volume":"175","author":"Z Ou","year":"2024","unstructured":"Ou, Z., et al.: RTSeg-net: a lightweight network for real-time segmentation of fetal head and pubic symphysis from intrapartum ultrasound images. Comput. Biol. Med. 175, 108501 (2024)","journal-title":"Comput. Biol. Med."},{"key":"3_CR30","doi-asserted-by":"crossref","unstructured":"Pedraza, L., et\u00a0al.: An open access thyroid ultrasound image database. In: 10th Int. Symp. Med. Inf. Process. Anal. vol.\u00a09287, pp. 188\u2013193. SPIE (2015)","DOI":"10.1117\/12.2073532"},{"key":"3_CR31","unstructured":"Qiu, Z., et\u00a0al.: Controlling Text-to-Image Diffusion by Orthogonal Finetuning"},{"key":"3_CR32","unstructured":"Ravi, N., et\u00a0al.: SAM 2: Segment Anything in Images and Videos (2024)"},{"key":"3_CR33","doi-asserted-by":"crossref","unstructured":"Ravishankar, H., et\u00a0al.: SonoSAM - segment anything on ultrasound images. In: Simplifying Medical Ultrasound, pp. 23\u201333. Springer Nature Switzerland","DOI":"10.1007\/978-3-031-44521-7_3"},{"key":"3_CR34","unstructured":"Rebuffi, S.A., et\u00a0al.: Learning multiple visual domains with residual adapters. In: Adv. Neural Inf. Process. Syst. (NeurIPS) 30. Curran Associates, Inc. (2017)"},{"key":"3_CR35","doi-asserted-by":"publisher","unstructured":"Ronneberger, O., Fischer, P., Brox, T.: U-Net: Convolutional Networks for Biomedical Image Segmentation. In: Navab, N., Hornegger, J., Wells, W.M., Frangi, A.F. (eds.) MICCAI 2015. LNCS, vol. 9351, pp. 234\u2013241. Springer, Cham (2015). https:\/\/doi.org\/10.1007\/978-3-319-24574-4_28","DOI":"10.1007\/978-3-319-24574-4_28"},{"key":"3_CR36","doi-asserted-by":"crossref","unstructured":"Roy, S., et\u00a0al.: MedNeXt: transformer-driven scaling of convnets for medical image segmentation. In: MICCAI 2023, vol. 14223, pp. 405\u2013415. Springer","DOI":"10.1007\/978-3-031-43901-8_39"},{"key":"3_CR37","unstructured":"Ryali, C., et\u00a0al.: Hiera: a hierarchical vision transformer without the bells-and-whistles. In: ICML. PMLR (2023)"},{"key":"3_CR38","unstructured":"Salcudean, S.E., et\u00a0al.: Robot-assisted medical imaging: a review. Proc. IEEE"},{"key":"3_CR39","doi-asserted-by":"crossref","unstructured":"Steitz, J.M.O., et\u00a0al.: Adapters strike back. In: CVPR. IEEE (2024)","DOI":"10.1109\/CVPR52733.2024.02213"},{"key":"3_CR40","doi-asserted-by":"crossref","unstructured":"Stock, R., et\u00a0al.: Segment Anything in Medical Images with nnUNet (2024)","DOI":"10.1007\/978-3-031-81854-7_11"},{"issue":"5","key":"3_CR41","doi-asserted-by":"publisher","first-page":"2010","DOI":"10.1109\/TMI.2024.3355383","volume":"43","author":"K Ta","year":"2024","unstructured":"Ta, K., et al.: Multi-Task learning for motion analysis and segmentation in 3d echocardiography. IEEE Trans. Med. Imaging 43(5), 2010\u20132020 (2024)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"3_CR42","unstructured":"Tong, S., et\u00a0al.: Cambrian-1: a fully open, vision-centric exploration of multimodal LLMs (2024). arXiv:2406.16860 [cs]"},{"key":"3_CR43","doi-asserted-by":"crossref","unstructured":"Vaze, S., et\u00a0al.: Low-memory CNNs enabling real-time ultrasound segmentation towards mobile deployment. IEEE J. Biomed. Health Inform. 24(4), 1059\u20131069","DOI":"10.1109\/JBHI.2019.2961264"},{"key":"3_CR44","doi-asserted-by":"publisher","DOI":"10.1016\/j.compbiomed.2021.104966","volume":"139","author":"JM Webb","year":"2021","unstructured":"Webb, J.M., et al.: Comparing deep learning-based automatic segmentation of breast masses to expert interobserver variability in ultrasound imaging. Comput. Biol. Med. 139, 104966 (2021)","journal-title":"Comput. Biol. Med."},{"issue":"6","key":"3_CR45","doi-asserted-by":"publisher","first-page":"1619","DOI":"10.1109\/TMI.2022.3233648","volume":"42","author":"H Wu","year":"2023","unstructured":"Wu, H., et al.: Cross-image dependency modeling for breast ultrasound segmentation. IEEE Trans. Med. Imaging 42(6), 1619\u20131631 (2023)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"3_CR46","doi-asserted-by":"crossref","unstructured":"Yang, J., et\u00a0al.: GraphEcho: graph-driven unsupervised domain adaptation for echocardiogram video segmentation. In: ICCV, pp. 11844\u201311853. IEEE","DOI":"10.1109\/ICCV51070.2023.01091"},{"key":"3_CR47","unstructured":"Yeh, S.Y., et\u00a0al.: Navigating text-to-image customization: from LyCORIS fine-tuning to model evaluation (2024). arXiv:2309.14859 [cs]"},{"key":"3_CR48","doi-asserted-by":"crossref","unstructured":"Zhang, R., et\u00a0al.: SHAN: shape guided network for thyroid nodule ultrasound cross-domain segmentation. In: MICCAI, vol. 15004, pp. 732\u2013741. Springer (2024)","DOI":"10.1007\/978-3-031-72083-3_68"},{"key":"3_CR49","doi-asserted-by":"crossref","unstructured":"Zhang, X., et\u00a0al.: Adaptive correspondence scoring for unsupervised medical image registration. In: ECCV 2024, vol. 15096, pp. 76\u201392. Springer","DOI":"10.1007\/978-3-031-72920-1_5"},{"key":"3_CR50","doi-asserted-by":"crossref","unstructured":"Zhang, X., et\u00a0al.: Heteroscedastic uncertainty estimation framework for unsupervised registration. In: MICCAI 2024, pp. 651\u2013661. Springer","DOI":"10.1007\/978-3-031-72069-7_61"},{"issue":"1","key":"3_CR51","doi-asserted-by":"publisher","first-page":"66","DOI":"10.1016\/j.radonc.2016.11.016","volume":"122","author":"R Zhou","year":"2017","unstructured":"Zhou, R., et al.: Cardiac atlas development and validation for automatic segmentation of cardiac substructures. Radiother. Oncol. 122(1), 66\u201371 (2017)","journal-title":"Radiother. Oncol."},{"key":"3_CR52","unstructured":"Zhu, J., et\u00a0al.: Medical SAM 2: Segment medical images as video via Segment Anything Model 2 (2024). arXiv:2408.00874 [cs]"}],"container-title":["Lecture Notes in Computer Science","Medical Image Computing and Computer Assisted Intervention \u2013 MICCAI 2025"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-032-04971-1_3","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,2,22]],"date-time":"2026-02-22T06:45:31Z","timestamp":1771742731000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-032-04971-1_3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,9,20]]},"ISBN":["9783032049704","9783032049711"],"references-count":52,"URL":"https:\/\/doi.org\/10.1007\/978-3-032-04971-1_3","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,9,20]]},"assertion":[{"value":"20 September 2025","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"The authors have no competing interests to declare that are relevant to the content of this article.","order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Disclosure of Interests"}},{"value":"MICCAI","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Medical Image Computing and Computer-Assisted Intervention","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Daejeon","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Korea (Republic of)","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2025","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"23 September 2025","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"27 September 2025","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"28","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"miccai2025","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/conferences.miccai.org\/2025\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}