{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,29]],"date-time":"2026-07-29T15:13:07Z","timestamp":1785337987946,"version":"3.55.0"},"reference-count":299,"publisher":"Association for Computing Machinery (ACM)","issue":"11","funder":[{"name":"Shanghai Agricultural Science and Technology Innovation Program","award":["K2025001"],"award-info":[{"award-number":["K2025001"]}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":["ACM Comput. Surv."],"published-print":{"date-parts":[[2026,8,30]]},"abstract":"<jats:p>\n                    The advent of foundation models (FMs) as an emerging suite of AI techniques has struck a wave of opportunities in computational healthcare. The interactive nature of these models, guided by pre-training data and human instructions, has ignited a data-centric AI paradigm that emphasizes better data characterization, quality, and scale. In healthcare AI, obtaining and processing high-quality clinical data records has been a longstanding challenge, encompassing data quantity, annotation, patient privacy, and ethics. In this survey, we investigate a wide range of data-centric approaches in the FM era (from model pre-training to inference) towards improving the healthcare workflow. We discuss key perspectives in AI security, assessment, and alignment with human values. Finally, we offer a promising outlook on FM-based analytics to enhance patient outcomes and clinical workflows in the evolving landscape of healthcare and medicine. We provide an up-to-date list of healthcare-related foundation models and datasets at\n                    <jats:ext-link xmlns:xlink=\"http:\/\/www.w3.org\/1999\/xlink\" ext-link-type=\"url\" xlink:href=\"https:\/\/github.com\/Yunkun-Zhang\/Data-Centric-FM-Healthcare\">https:\/\/github.com\/Yunkun-Zhang\/Data-Centric-FM-Healthcare<\/jats:ext-link>\n                    .\n                  <\/jats:p>","DOI":"10.1145\/3800677","type":"journal-article","created":{"date-parts":[[2026,3,28]],"date-time":"2026-03-28T20:34:44Z","timestamp":1774730084000},"page":"1-35","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":5,"title":["Data-Centric Foundation Models in Computational Healthcare: A Survey"],"prefix":"10.1145","volume":"58","author":[{"ORCID":"https:\/\/orcid.org\/0009-0005-6164-9748","authenticated-orcid":false,"given":"Yunkun","family":"Zhang","sequence":"first","affiliation":[{"name":"Shanghai Jiao Tong University","place":["Shanghai, China"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0002-1129-8490","authenticated-orcid":false,"given":"Jin","family":"Gao","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University","place":["Shanghai, China"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0000-7087-1985","authenticated-orcid":false,"given":"Zheling","family":"Tan","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University","place":["Shanghai, China"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0005-0437-0310","authenticated-orcid":false,"given":"Lingfeng","family":"Zhou","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University","place":["Shanghai, China"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3561-3195","authenticated-orcid":false,"given":"Kexin","family":"Ding","sequence":"additional","affiliation":[{"name":"Rutgers University","place":["New Brunswick, United States"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4902-0259","authenticated-orcid":false,"given":"Mu","family":"Zhou","sequence":"additional","affiliation":[{"name":"Rutgers University","place":["New Brunswick, United States"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8719-448X","authenticated-orcid":false,"given":"Shaoting","family":"Zhang","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University","place":["Shanghai, China"]}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8270-8448","authenticated-orcid":false,"given":"Dequan","family":"Wang","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University","place":["Shanghai, China"]},{"name":"Shanghai Innovation Institute","place":["Shanghai, China"]}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"320","published-online":{"date-parts":[[2026,4,25]]},"reference":[{"key":"e_1_3_3_2_2","unstructured":"Asma Ben Abacha and Pierre Zweigenbaum. 2011. Medical Entity Recognition: A Comparaison of Semantic and Statistical Methods. In Proceedings of the BioNLP 2011 Workshop56\u201364 pages Portland Oregon USA. Association for Computational Linguistics."},{"key":"e_1_3_3_3_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-0-387-70992-5_2"},{"key":"e_1_3_3_4_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41746-021-00438-z"},{"key":"e_1_3_3_5_2","unstructured":"Mohamed Akrout B\u00e1lint Gyepesi P\u00e9ter Holl\u00f3 Adrienn Po\u00f3r Bl\u00e1ga Kincs\u0151 Stephen Solis Katrina Cirone Jeremy Kawahara Dekker Slade Latif Abid et\u00a0al. 2023. Diffusion-based aata augmentation for skin disease classification: Impact across original medical datasets to fully synthetic images. arxiv:2301.04802. Retrieved from https:\/\/arxiv.org\/abs\/2301.04802 (2023)."},{"key":"e_1_3_3_6_2","doi-asserted-by":"publisher","DOI":"10.52202\/068431-1723"},{"key":"e_1_3_3_7_2","unstructured":"Emily Alsentzer John R. Murphy Willie Boag Wei-Hung Weng Di Jin Tristan Naumann and Matthew McDermott. 2019. Publicly available clinical BERT embeddings. arxiv:1904.03323. Retrieved from https:\/\/arxiv.org\/abs\/1904.03323 (2019)."},{"key":"e_1_3_3_8_2","unstructured":"Rahul K. Arora Jason Wei Rebecca Soskin Hicks Preston Bowman Joaquin Qui\u00f1onero-Candela Foivos Tsimpourlas Michael Sharman Meghan Shah Andrea Vallone Alex Beutel et\u00a0al. 2025. HealthBench: Evaluating large language models towards improved human health. arxiv:2505.08775. Retrieved from https:\/\/arxiv.org\/abs\/2505.08775 (2025)."},{"key":"e_1_3_3_9_2","first-page":"1","article-title":"Robust and data-efficient generalization of self-supervised machine learning for diagnostic imaging","author":"Azizi Shekoofeh","year":"2023","unstructured":"Shekoofeh Azizi, Laura Culp, Jan Freyberg, Basil Mustafa, Sebastien Baur, Simon Kornblith, Ting Chen, Nenad Tomasev, Jovana Mitrovi\u0107, Patricia Strachan, et\u00a0al. 2023. Robust and data-efficient generalization of self-supervised machine learning for diagnostic imaging. Nature Biomedical Engineering 7, 6 (2023), 1\u201324.","journal-title":"Nature Biomedical Engineering"},{"key":"e_1_3_3_10_2","doi-asserted-by":"crossref","unstructured":"Ashwin Belle Raghuram Thiagarajan S. M. Soroushmehr Fatemeh Navidi Daniel A. Beard and Kayvan Najarian. 2015. Big data analytics in healthcare. BioMed Research International 2015 Article 370194 (2015) 16.","DOI":"10.1155\/2015\/370194"},{"key":"e_1_3_3_11_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D19-1371"},{"key":"e_1_3_3_12_2","unstructured":"Louis Blankemeier Joseph Paul Cohen Ashwin Kumar Dave Van Veen Syed Jamal Safdar Gardezi Magdalini Paschali Zhihong Chen Jean-Benoit Delbrouck Eduardo Reis Cesar Truyts et\u00a0al. 2024. Merlin: A vision language foundation model for 3D computed tomography. arxiv:2406.06512. Retrieved from https:\/\/arxiv.org\/abs\/2406.06512. (2024)."},{"key":"e_1_3_3_13_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41551-024-01246-y"},{"key":"e_1_3_3_14_2","first-page":"1","volume-title":"Proceedings of the European Conference on Computer Vision","author":"Boecking Benedikt","year":"2022","unstructured":"Benedikt Boecking, Naoto Usuyama, Shruthi Bannur, Daniel C. Castro, Anton Schwaighofer, Stephanie Hyland, Maria Wetscherek, Tristan Naumann, Aditya Nori, Javier Alvarez-Valle, et\u00a0al. 2022. Making the most of text semantics to improve biomedical vision\u2013language processing. In Proceedings of the European Conference on Computer Vision. Springer, 1\u201321."},{"key":"e_1_3_3_15_2","unstructured":"Rishi Bommasani Drew A. Hudson Ehsan Adeli Russ Altman Simran Arora Sydney von Arx Michael S. Bernstein Jeannette Bohg Antoine Bosselut Emma Brunskill et\u00a0al. 2021. On the opportunities and risks of foundation models. arxiv:2108.07258. Retrieved from https:\/\/arxiv.org\/abs\/2108.07258 (2021)."},{"key":"e_1_3_3_16_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-87240-3_64"},{"key":"e_1_3_3_17_2","doi-asserted-by":"publisher","DOI":"10.1592\/phco.28.4.437"},{"key":"e_1_3_3_18_2","first-page":"1877","article-title":"Language models are few-shot learners","volume":"33","author":"Brown Tom","year":"2020","unstructured":"Tom Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared D. Kaplan, Prafulla Dhariwal, Arvind Neelakantan, Pranav Shyam, Girish Sastry, Amanda Askell, et\u00a0al. 2020. Language models are few-shot learners. Advances in Neural Information Processing Systems 33 (2020), 1877\u20131901.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_3_19_2","first-page":"146","article-title":"Fusion strategies for large-scale multi-modal image retrieval","author":"Budikova Petra","year":"2017","unstructured":"Petra Budikova, Michal Batko, and Pavel Zezula. 2017. Fusion strategies for large-scale multi-modal image retrieval. Transactions on Large-Scale Data-and Knowledge-Centered Systems XXXIII (2017), 146\u2013184.","journal-title":"Transactions on Large-Scale Data-and Knowledge-Centered Systems"},{"key":"e_1_3_3_20_2","first-page":"267","volume-title":"Proceedings of the 28th USENIX Security Symposium (USENIX Security 19)","author":"Carlini Nicholas","year":"2019","unstructured":"Nicholas Carlini, Chang Liu, \u00dalfar Erlingsson, Jernej Kos, and Dawn Song. 2019. The secret sharer: Evaluating and testing unintended memorization in neural networks. In Proceedings of the 28th USENIX Security Symposium (USENIX Security 19). 267\u2013284."},{"key":"e_1_3_3_21_2","first-page":"2633","volume-title":"Proceedings of the 30th USENIX Security Symposium (USENIX Security 21)","author":"Carlini Nicholas","year":"2021","unstructured":"Nicholas Carlini, Florian Tramer, Eric Wallace, Matthew Jagielski, Ariel Herbert-Voss, Katherine Lee, Adam Roberts, Tom Brown, Dawn Song, Ulfar Erlingsson, et\u00a0al. 2021. Extracting training data from large language models. In Proceedings of the 30th USENIX Security Symposium (USENIX Security 21). 2633\u20132650."},{"key":"e_1_3_3_22_2","first-page":"2023","article-title":"BrainLM: A foundation model for brain activity recordings","author":"Caro Josue Ortega","year":"2023","unstructured":"Josue Ortega Caro, Antonio H. de O Fonseca, Christopher Averill, Syed A. Rizvi, Matteo Rosati, James L. Cross, Prateek Mittal, Emanuele Zappala, Daniel Levine, Rahul M. Dhodapkar, et\u00a0al. 2023. BrainLM: A foundation model for brain activity recordings. bioRxiv (2023), 2023\u201309.","journal-title":"bioRxiv"},{"key":"e_1_3_3_23_2","unstructured":"Pierre Chambon Christian Bluethgen Curtis P. Langlotz and Akshay Chaudhari. 2022. Adapting pretrained vision-language foundational models to medical imaging domains. arxiv:2210.04133. Retrieved from https:\/\/arxiv.org\/abs\/2210.04133 (2022)."},{"key":"e_1_3_3_24_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41467-023-40687-y"},{"key":"e_1_3_3_25_2","unstructured":"Yupeng Chang Xu Wang Jindong Wang Yuan Wu Kaijie Zhu Hao Chen Linyi Yang Xiaoyuan Yi Cunxiang Wang Yidong Wang et\u00a0al. 2023. A survey on evaluation of large language models. arxiv:2307.03109. Retrieved from https:\/\/arxiv.org\/abs\/2307.03109 (2023)."},{"key":"e_1_3_3_26_2","doi-asserted-by":"publisher","DOI":"10.1038\/s43588-025-00818-5"},{"key":"e_1_3_3_27_2","unstructured":"Richard J. Chen Tong Ding Ming Y. Lu Drew F. K. Williamson Guillaume Jaume Bowen Chen Andrew Zhang Daniel Shao Andrew H. Song Muhammad Shaban et\u00a0al. 2023. A general-purpose self-supervised model for computational pathology. arxiv:2308.15474. Retrieved from https:\/\/arxiv.org\/abs\/2308.15474 (2023)."},{"key":"e_1_3_3_28_2","first-page":"1597","volume-title":"Proceedings of the International Conference on Machine Learning","author":"Chen Ting","year":"2020","unstructured":"Ting Chen, Simon Kornblith, Mohammad Norouzi, and Geoffrey Hinton. 2020. A simple framework for contrastive learning of visual representations. In Proceedings of the International Conference on Machine Learning. PMLR, 1597\u20131607."},{"key":"e_1_3_3_29_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.omtn.2023.02.019"},{"key":"e_1_3_3_30_2","unstructured":"Xuanzhong Chen Xiaohao Mao Qihan Guo Lun Wang Shuyang Zhang and Ting Chen. 2024. RareBench: Can LLMs serve as rare diseases specialists?arxiv:2402.06341. Retrieved from https:\/\/arxiv.org\/abs\/2402.06341 (2024)."},{"key":"e_1_3_3_31_2","doi-asserted-by":"publisher","DOI":"10.1109\/iccv48922.2021.00950"},{"key":"e_1_3_3_32_2","doi-asserted-by":"crossref","unstructured":"Yi Chen Rui Wang Haiyun Jiang Shuming Shi and Ruifeng Xu. 2023. Exploring the use of large language models for reference-free text quality evaluation: A preliminary empirical study. arxiv:2304.00723. Retrieved from https:\/\/arxiv.org\/abs\/2304.00723 (2023).","DOI":"10.18653\/v1\/2023.findings-ijcnlp.32"},{"key":"e_1_3_3_33_2","doi-asserted-by":"crossref","unstructured":"Zhiyu Chen Yujie Lu and William Yang Wang. 2023. Empowering psychotherapy with large language models: Cognitive distortion detection through diagnosis of thought prompting. arxiv:2310.07146. Retrieved from https:\/\/arxiv.org\/abs\/2310.07146 (2023).","DOI":"10.18653\/v1\/2023.findings-emnlp.284"},{"key":"e_1_3_3_34_2","unstructured":"Zhihong Chen Maya Varma Jean-Benoit Delbrouck Magdalini Paschali Louis Blankemeier Dave Van Veen Jeya Maria Jose Valanarasu Alaa Youssef Joseph Paul Cohen Eduardo Pontes Reis et\u00a0al. 2024. Chexagent: Towards a foundation model for chest x-ray interpretation. arxiv:2401.12208. Retrieved from https:\/\/arxiv.org\/abs\/2401.12208 (2024)."},{"key":"e_1_3_3_35_2","unstructured":"Dongjie Cheng Ziyuan Qin Zekun Jiang Shaoting Zhang Qicheng Lao and Kang Li. 2023. Sam on medical images: A comprehensive study on three prompt modes. arxiv:2305.00035. Retrieved from https:\/\/arxiv.org\/abs\/2305.00035 (2023)."},{"key":"e_1_3_3_36_2","doi-asserted-by":"publisher","DOI":"10.1126\/science.adg7492"},{"key":"e_1_3_3_37_2","unstructured":"Cheng-Han Chiang and Hung-yi Lee. 2023. Can large language models be an alternative to human evaluations?arxiv:2305.01937. Retrieved from https:\/\/arxiv.org\/abs\/2305.01937 (2023)."},{"key":"e_1_3_3_38_2","unstructured":"Aakanksha Chowdhery Sharan Narang Jacob Devlin Maarten Bosma Gaurav Mishra Adam Roberts Paul Barham Hyung Won Chung Charles Sutton Sebastian Gehrmann et\u00a0al. 2022. Palm: Scaling language modeling with pathways. arxiv:2204.02311. Retrieved from https:\/\/arxiv.org\/abs\/2204.02311 (2022)."},{"key":"e_1_3_3_39_2","first-page":"1","article-title":"Vision\u2013language foundation model for echocardiogram interpretation","author":"Christensen Matthew","year":"2024","unstructured":"Matthew Christensen, Milos Vukadinovic, Neal Yuan, and David Ouyang. 2024. Vision\u2013language foundation model for echocardiogram interpretation. Nature Medicine 30, 5 (2024), 1\u20138.","journal-title":"Nature Medicine"},{"key":"e_1_3_3_40_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.jclinepi.2019.02.004"},{"key":"e_1_3_3_41_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.mlwa.2021.100198"},{"key":"e_1_3_3_42_2","doi-asserted-by":"publisher","DOI":"10.1093\/jamia\/ocac155"},{"key":"e_1_3_3_43_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2024.103301"},{"key":"e_1_3_3_44_2","doi-asserted-by":"publisher","DOI":"10.2352\/EI.2025.37.14.COIMG-132"},{"key":"e_1_3_3_45_2","unstructured":"Zhongying Deng Yiqing Shen Hyunwoo J. Kim Won-Ki Jeong Angelica I. Aviles-Rivero Junjun He and Shaoting Zhang. 2024. Foundation models for general medical AI. In Foundation Models for General Medical AI: Second International Workshop (MedAGI\u201924). Conjunction MICCAI 2024. Marrakesh Morocco. (October 6 2024)."},{"key":"e_1_3_3_46_2","unstructured":"Jacob Devlin Ming-Wei Chang Kenton Lee and Kristina Toutanova. 2018. Bert: Pre-training of deep bidirectional transformers for language understanding. arxiv:1810.04805. Retrieved from https:\/\/arxiv.org\/abs\/1810.04805 (2018)."},{"key":"e_1_3_3_47_2","doi-asserted-by":"publisher","DOI":"10.1109\/ISBI.2018.8363518"},{"key":"e_1_3_3_48_2","doi-asserted-by":"crossref","unstructured":"Jiayu Ding Shuming Ma Li Dong Xingxing Zhang Shaohan Huang Wenhui Wang Nanning Zheng and Furu Wei. 2023. LongNet: Scaling transformers to 1 000 000 000 tokens. arxiv:2307.02486. Retrieved from https:\/\/arxiv.org\/abs\/2307.02486 (2023).","DOI":"10.14218\/JCTH.2022.00006S"},{"key":"e_1_3_3_49_2","unstructured":"Kexin Ding Mu Zhou Akshay Chaudhari Shaoting Zhang and Dimitris N. Metaxas. 2025. Aligning large language models with healthcare stakeholders: A pathway to trustworthy AI integration. arxiv:2505.02848. Retrieved from https:\/\/arxiv.org\/abs\/2505.02848 (2025)."},{"key":"e_1_3_3_50_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41597-023-02125-y"},{"key":"e_1_3_3_51_2","doi-asserted-by":"publisher","DOI":"10.1038\/s42256-023-00626-4"},{"key":"e_1_3_3_52_2","doi-asserted-by":"publisher","DOI":"10.1056\/AIoa2400468"},{"key":"e_1_3_3_53_2","unstructured":"Qingxiu Dong Lei Li Damai Dai Ce Zheng Zhiyong Wu Baobao Chang Xu Sun Jingjing Xu and Zhifang Sui. 2022. A survey for in-context learning. arxiv:2301.00234. Retrieved from https:\/\/arxiv.org\/abs\/2301.00234 (2022)."},{"key":"e_1_3_3_54_2","unstructured":"Tian Dong Bo Zhao and Lingjuan Lyu. 2022. Privacy for free: How does dataset condensation help privacy?arxiv:2206.00240. Retrieved from https:\/\/arxiv.org\/abs\/2206.00240 (2022)."},{"key":"e_1_3_3_55_2","unstructured":"Raman Dutt Ondrej Bohdal Sotirios A. Tsaftaris and Timothy Hospedales. 2023. Fairtune: Optimizing parameter efficient fine tuning for fairness in medical image analysis. arxiv:2310.05055. Retrieved from https:\/\/arxiv.org\/abs\/2310.05055 (2023)."},{"key":"e_1_3_3_56_2","unstructured":"Raman Dutt Linus Ericsson Pedro Sanchez Sotirios A. Tsaftaris and Timothy Hospedales. 2023. Parameter-efficient fine-tuning for medical image analysis: The missed opportunity. arxiv:2305.08252. Retrieved from https:\/\/arxiv.org\/abs\/2305.08252 (2023)."},{"key":"e_1_3_3_57_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP49357.2023.10095889"},{"key":"e_1_3_3_58_2","unstructured":"Sedigheh Eslami Gerard de Melo and Christoph Meinel. 2021. Does clip benefit visual question answering in the medical domain as much as it does in the general domain?arxiv:2112.13906. Retrieved from https:\/\/arxiv.org\/abs\/2112.13906 (2021)."},{"key":"e_1_3_3_59_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-018-0316-z"},{"key":"e_1_3_3_60_2","unstructured":"Adibvafa Fallahpour Mahshid Alinoori Arash Afkanpour and Amrit Krishnan. 2024. EHRMamba: Towards generalizable and scalable foundation models for electronic health records. arxiv:2405.14567. Retrieved from https:\/\/arxiv.org\/abs\/2405.14567 (2024)."},{"key":"e_1_3_3_61_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2025.findings-naacl.3"},{"key":"e_1_3_3_62_2","doi-asserted-by":"crossref","unstructured":"Emilio Ferrara. 2023. Should chatgpt be biased? challenges and risks of bias in large language models. arxiv:2304.03738. Retrieved from https:\/\/arxiv.org\/abs\/2304.03738 (2023).","DOI":"10.2139\/ssrn.4627814"},{"key":"e_1_3_3_63_2","doi-asserted-by":"publisher","DOI":"10.1101\/2023.07.21.23292757"},{"key":"e_1_3_3_64_2","first-page":"2023","article-title":"GET: A foundation model of transcription across human cell types","author":"Fu Xi","year":"2023","unstructured":"Xi Fu, Shentong Mo, Anqi Shao, Anouchka Laurent, Alejandro Buendia, Adolfo A. Ferrando, Alberto Ciccia, Yanyan Lan, Teresa Palomero, David M Owens, et\u00a0al. 2023. GET: A foundation model of transcription across human cell types. bioRxiv (2023), 2023\u201309.","journal-title":"bioRxiv"},{"key":"e_1_3_3_65_2","doi-asserted-by":"publisher","DOI":"10.1038\/s42003-020-01233-4"},{"key":"e_1_3_3_66_2","doi-asserted-by":"publisher","DOI":"10.1145\/1749603.1749605"},{"key":"e_1_3_3_67_2","doi-asserted-by":"publisher","DOI":"10.1007\/s11023-020-09539-2"},{"key":"e_1_3_3_68_2","unstructured":"Yunhe Gao Zhuowei Li Di Liu Mu Zhou Shaoting Zhang and Dimitris N. Meta. 2023. Training like a medical resident: Universal medical image segmentation via context prior learning. arxiv:2306.02416. Retrieved from https:\/\/arxiv.org\/abs\/2306.02416 (2023)."},{"key":"e_1_3_3_69_2","unstructured":"Yunhe Gao Mu Zhou Di Liu Zhennan Yan Shaoting Zhang and Dimitris N. Metaxas. 2022. A data-scalable transformer for medical image segmentation: Architecture model efficiency and benchmark. arxiv:2203.00131. Retrieved from https:\/\/arxiv.org\/abs\/2203.00131 (2022)."},{"key":"e_1_3_3_70_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-87199-4_6"},{"key":"e_1_3_3_71_2","unstructured":"Chunjiang Ge Sijie Cheng Ziming Wang Jiale Yuan Yuan Gao Jun Song Shiji Song Gao Huang and Bo Zheng. 2024. ConvLLaVA: Hierarchical backbones as visual encoder for large multimodal models. arxiv:2405.15738. Retrieved from https:\/\/arxiv.org\/abs\/2405.15738 (2024)."},{"key":"e_1_3_3_72_2","doi-asserted-by":"publisher","DOI":"10.1613\/jair.1.13715"},{"key":"e_1_3_3_73_2","unstructured":"Aryo Gema Luke Daines Pasquale Minervini and Beatrice Alex. 2023. Parameter-efficient fine-tuning of LLaMA for the clinical domain. arxiv:2307.03042. Retrieved from https:\/\/arxiv.org\/abs\/2307.03042 (2023)."},{"key":"e_1_3_3_74_2","first-page":"1","article-title":"Large language model AI chatbots require approval as medical devices","author":"Gilbert Stephen","year":"2023","unstructured":"Stephen Gilbert, Hugh Harvey, Tom Melvin, Erik Vollebregt, and Paul Wicks. 2023. Large language model AI chatbots require approval as medical devices. Nature Medicine 29 (2023), 1\u20133.","journal-title":"Nature Medicine"},{"key":"e_1_3_3_75_2","doi-asserted-by":"crossref","unstructured":"Aidan Gilson Conrad Safranek Thomas Huang Vimig Socrates Ling Chi R. Andrew Taylor and David Chartash. 2022. How does ChatGPT perform on the medical licensing exams? The implications of large language models for medical education and knowledge assessment. JMIR Medical Education 9 (2023) e45312.","DOI":"10.2196\/45312"},{"key":"e_1_3_3_76_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.jbi.2014.06.002"},{"key":"e_1_3_3_77_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2024.103324"},{"key":"e_1_3_3_78_2","unstructured":"Albert Gu and Tri Dao. 2023. Mamba: Linear-time sequence modeling with selective state spaces. arxiv:2312.00752. Retrieved from https:\/\/arxiv.org\/abs\/2312.00752 (2023)."},{"key":"e_1_3_3_79_2","unstructured":"Difei Gu Yunhe Gao Mu Zhou and Dimitris Metaxas. 2025. Anatomy-VLM: A fine-grained vision-language model for medical interpretation. arxiv:2511.08402. Retrieved from https:\/\/arxiv.org\/abs\/2511.08402 (2025)."},{"key":"e_1_3_3_80_2","doi-asserted-by":"publisher","DOI":"10.1145\/3458754"},{"key":"e_1_3_3_81_2","unstructured":"Yu Gu Jianwei Yang Naoto Usuyama Chunyuan Li Sheng Zhang Matthew P. Lungren Jianfeng Gao and Hoifung Poon. 2023. BiomedJourney: Counterfactual biomedical image generation by instruction-learning from multimodal patient journeys. arxiv:2310.10765. Retrieved from https:\/\/arxiv.org\/abs\/2310.10765 (2023)."},{"key":"e_1_3_3_82_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-025-09422-z"},{"key":"e_1_3_3_83_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41746-024-01166-w"},{"key":"e_1_3_3_84_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.comcom.2020.02.018"},{"key":"e_1_3_3_85_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01553"},{"key":"e_1_3_3_86_2","unstructured":"Kai He Rui Mao Qika Lin Yucheng Ruan Xiang Lan Mengling Feng and Erik Cambria. 2023. A survey of large language models for healthcare: From data technology and applications to accountability and ethics. arxiv:2310.05694. Retrieved from https:\/\/arxiv.org\/abs\/2310.05694 (2023)."},{"key":"e_1_3_3_87_2","unstructured":"Sheng He Rina Bao Jingpeng Li P. Ellen Grant and Yangming Ou. 2023. Accuracy of segment-anything model (sam) in medical image segmentation tasks. arxiv:2304.09324. Retrieved from https:\/\/arxiv.org\/abs\/2304.09324 (2023)."},{"key":"e_1_3_3_88_2","doi-asserted-by":"publisher","DOI":"10.1136\/jamia.1997.0040342"},{"key":"e_1_3_3_89_2","first-page":"2790","volume-title":"International Conference on Machine Learning","author":"Houlsby Neil","year":"2019","unstructured":"Neil Houlsby, Andrei Giurgiu, Stanislaw Jastrzebski, Bruna Morrone, Quentin De Laroussilhe, Andrea Gesmundo, Mona Attariyan, and Sylvain Gelly. 2019. Parameter-efficient transfer learning for NLP. In International Conference on Machine Learning. PMLR, 2790\u20132799."},{"key":"e_1_3_3_90_2","unstructured":"Chuanfei Hu and Xinde Li. 2023. When sam meets medical images: An investigation of segment anything model (sam) on multi-phase liver tumor segmentation. arxiv:2304.08506. Retrieved from https:\/\/arxiv.org\/abs\/2304.08506 (2023)."},{"key":"e_1_3_3_91_2","unstructured":"Edward J. Hu Yelong Shen Phillip Wallis Zeyuan Allen-Zhu Yuanzhi Li Shean Wang Lu Wang and Weizhu Chen. 2021. Lora: Low-rank adaptation of large language models. arxiv:2106.09685. Retrieved from https:\/\/arxiv.org\/abs\/2106.09685 (2021)."},{"key":"e_1_3_3_92_2","doi-asserted-by":"publisher","unstructured":"Xiaobin Hu Yunhang Qian Jiaquan Yu Jingjing Liu Xiaozhong Ji Peng Tang Chengming Xu Jiawei Liu Xinlei Yu Guibin Zhang et\u00a0al. 2025. The Landscape of Medical Agents: A Survey. DOI:10.36227\/techrxiv.176581395.56964766\/v3TechRxiv preprint (not peer reviewed).","DOI":"10.36227\/techrxiv.176581395.56964766\/v3"},{"key":"e_1_3_3_93_2","unstructured":"Xinrong Hu Xiaowei Xu and Yiyu Shi. 2023. How to efficiently adapt large segmentation model (SAM) to medical images. arxiv:2306.13731. Retrieved from https:\/\/arxiv.org\/abs\/2306.13731 (2023)."},{"key":"e_1_3_3_94_2","unstructured":"Yuzheng Hu Fan Wu Qinbin Li Yunhui Long Gonzalo Munilla Garrido Chang Ge Bolin Ding David Forsyth Bo Li and Dawn Song. 2023. SoK: Privacy-preserving data synthesis. arxiv:2307.02106. Retrieved from https:\/\/arxiv.org\/abs\/2307.02106 (2023)."},{"key":"e_1_3_3_95_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41746-020-00341-z"},{"key":"e_1_3_3_96_2","unstructured":"Yuhao Huang Xin Yang Lian Liu Han Zhou Ao Chang Xinrui Zhou Rusi Chen Junxuan Yu Jiongquan Chen Chaoyu Chen et\u00a0al. 2023. Segment anything model for medical images?arxiv:2304.14660. Retrieved from https:\/\/arxiv.org\/abs\/2304.14660 (2023)."},{"key":"e_1_3_3_97_2","first-page":"1","article-title":"A visual\u2013language foundation model for pathology image analysis using medical Twitter","author":"Huang Zhi","year":"2023","unstructured":"Zhi Huang, Federico Bianchi, Mert Yuksekgonul, Thomas J. Montine, and James Zou. 2023. A visual\u2013language foundation model for pathology image analysis using medical Twitter. Nature Medicine 29, 9 (2023), 1\u201310.","journal-title":"Nature Medicine"},{"key":"e_1_3_3_98_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2025.103499"},{"key":"e_1_3_3_99_2","doi-asserted-by":"publisher","DOI":"10.52202\/079017-0119"},{"key":"e_1_3_3_100_2","unstructured":"Zhongzhen Huang Kui Xue Yongqi Fan Linjie Mu Ruoyu Liu Tong Ruan Shaoting Zhang and Xiaofan Zhang. 2024. Tool calling: Enhancing medication consultation via retrieval-augmented large language models. arxiv:2404.17897. Retrieved from https:\/\/arxiv.org\/abs\/2404.17897 (2024)."},{"key":"e_1_3_3_101_2","doi-asserted-by":"publisher","DOI":"10.3390\/cancers14061524"},{"key":"e_1_3_3_102_2","unstructured":"Wisdom Oluchi Ikezogwo Mehmet Saygin Seyfioglu Fatemeh Ghezloo Dylan Stefan Chan Geva Fatwir Sheikh Mohammed Pavan Kumar Anand Ranjay Krishna and Linda Shapiro. 2023. Quilt-1M: One million image-text pairs for histopathology. arxiv:2306.11207. Retrieved from https:\/\/arxiv.org\/abs\/2306.11207 (2023)."},{"key":"e_1_3_3_103_2","unstructured":"Neel Jain Khalid Saifullah Yuxin Wen John Kirchenbauer Manli Shu Aniruddha Saha Micah Goldblum Jonas Geiping and Tom Goldstein. 2023. Bring your own data! self-supervised evaluation for large language models. arxiv:2306.13651. Retrieved from https:\/\/arxiv.org\/abs\/2306.13651 (2023)."},{"key":"e_1_3_3_104_2","first-page":"4904","volume-title":"Proceedings of the International Conference on Machine Learning","author":"Jia Chao","year":"2021","unstructured":"Chao Jia, Yinfei Yang, Ye Xia, Yi-Ting Chen, Zarana Parekh, Hieu Pham, Quoc Le, Yun-Hsuan Sung, Zhen Li, and Tom Duerig. 2021. Scaling up visual and vision-language representation learning with noisy text supervision. In Proceedings of the International Conference on Machine Learning. PMLR, 4904\u20134916."},{"key":"e_1_3_3_105_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41746-025-02085-0"},{"key":"e_1_3_3_106_2","doi-asserted-by":"publisher","DOI":"10.1038\/sdata.2016.35"},{"key":"e_1_3_3_107_2","doi-asserted-by":"publisher","DOI":"10.1007\/s42979-023-01809-x"},{"key":"e_1_3_3_108_2","doi-asserted-by":"publisher","DOI":"10.1148\/ryai.2021210013"},{"key":"e_1_3_3_109_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-021-03819-2"},{"key":"e_1_3_3_110_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.00326"},{"key":"e_1_3_3_111_2","doi-asserted-by":"publisher","DOI":"10.1109\/JBHI.2018.2824327"},{"key":"e_1_3_3_112_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2023.102846"},{"key":"e_1_3_3_113_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-024-02887-x"},{"key":"e_1_3_3_114_2","doi-asserted-by":"publisher","DOI":"10.1109\/tmi.2025.3580713"},{"key":"e_1_3_3_115_2","doi-asserted-by":"crossref","unstructured":"Alexander Kirillov Eric Mintun Nikhila Ravi Hanzi Mao Chloe Rolland Laura Gustafson Tete Xiao Spencer Whitehead Alexander C. Berg Wan-Yen Lo et\u00a0al. 2023. Segment anything. arxiv:2304.02643. Retrieved from https:\/\/arxiv.org\/abs\/2304.02643 (2023).","DOI":"10.1109\/ICCV51070.2023.00371"},{"key":"e_1_3_3_116_2","first-page":"22199","article-title":"Large language models are zero-shot reasoners","volume":"35","author":"Kojima Takeshi","year":"2022","unstructured":"Takeshi Kojima, Shixiang Shane Gu, Machel Reid, Yutaka Matsuo, and Yusuke Iwasawa. 2022. Large language models are zero-shot reasoners. Advances in Neural Information Processing Systems 35 (2022), 22199\u201322213.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_3_117_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41551-022-00914-1"},{"key":"e_1_3_3_118_2","article-title":"Imagenet classification with deep convolutional neural networks","volume":"25","author":"Krizhevsky Alex","year":"2012","unstructured":"Alex Krizhevsky, Ilya Sutskever, and Geoffrey E. Hinton. 2012. Imagenet classification with deep convolutional neural networks. Advances in Neural Information Processing Systems 25 (2012), 1097\u20131105.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_3_119_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-58280-1_2"},{"key":"e_1_3_3_120_2","doi-asserted-by":"publisher","DOI":"10.1093\/bioinformatics\/btz682"},{"key":"e_1_3_3_121_2","doi-asserted-by":"crossref","unstructured":"Eric Lehman Sarthak Jain Karl Pichotta Yoav Goldberg and Byron C. Wallace. 2021. Does BERT pretrained on clinical notes reveal sensitive data?arxiv:2104.07762. Retrieved from https:\/\/arxiv.org\/abs\/2104.07762 (2021).","DOI":"10.18653\/v1\/2021.naacl-main.73"},{"key":"e_1_3_3_122_2","doi-asserted-by":"publisher","unstructured":"Eric Lehman and Alistair Johnson. 2023. Clinical-t5: Large language models built using MIMIC clinical text (version 1.0.0). PhysioNet. RRID:SCR_007345. DOI:10.13026\/rj8x-v335","DOI":"10.13026\/rj8x-v335"},{"key":"e_1_3_3_123_2","doi-asserted-by":"crossref","unstructured":"Brian Lester Rami Al-Rfou and Noah Constant. 2021. The power of scale for parameter-efficient prompt tuning. arxiv:2104.08691. Retrieved from https:\/\/arxiv.org\/abs\/2104.08691 (2021).","DOI":"10.18653\/v1\/2021.emnlp-main.243"},{"key":"e_1_3_3_124_2","first-page":"9459","article-title":"Retrieval-augmented generation for knowledge-intensive nlp tasks","volume":"33","author":"Lewis Patrick","year":"2020","unstructured":"Patrick Lewis, Ethan Perez, Aleksandra Piktus, Fabio Petroni, Vladimir Karpukhin, Naman Goyal, Heinrich K\u00fcttler, Mike Lewis, Wen-tau Yih, Tim Rockt\u00e4schel, et\u00a0al. 2020. Retrieval-augmented generation for knowledge-intensive nlp tasks. Advances in Neural Information Processing Systems 33 (2020), 9459\u20139474.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_3_125_2","unstructured":"Chunyuan Li Zhe Gan Zhengyuan Yang Jianwei Yang Linjie Li Lijuan Wang and Jianfeng Gao. 2023. Multimodal foundation models: From specialists to general-purpose assistants. arxiv:2309.10020. Retrieved from https:\/\/arxiv.org\/abs\/2309.10020 (2023)."},{"key":"e_1_3_3_126_2","unstructured":"Chunyuan Li Cliff Wong Sheng Zhang Naoto Usuyama Haotian Liu Jianwei Yang Tristan Naumann Hoifung Poon and Jianfeng Gao. 2023. Llava-med: Training a large language-and-vision assistant for biomedicine in one day. arxiv:2306.00890. Retrieved from https:\/\/arxiv.org\/abs\/2306.00890 (2023)."},{"key":"e_1_3_3_127_2","unstructured":"Junnan Li Dongxu Li Silvio Savarese and Steven Hoi. 2023. Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models. arxiv:2301.12597. Retrieved from https:\/\/arxiv.org\/abs\/2301.12597 (2023)."},{"key":"e_1_3_3_128_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01069"},{"key":"e_1_3_3_129_2","unstructured":"Xiang Lisa Li and Percy Liang. 2021. Prefix-tuning: Optimizing continuous prompts for generation. arxiv:2101.00190. Retrieved from https:\/\/arxiv.org\/abs\/2101.00190 (2021)."},{"key":"e_1_3_3_130_2","unstructured":"Yuheng Li Mingzhe Hu and Xiaofeng Yang. 2023. Polyp-sam: Transfer sam for polyp segmentation. arxiv:2305.00293. Retrieved from https:\/\/arxiv.org\/abs\/2305.00293 (2023)."},{"key":"e_1_3_3_131_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41598-020-62922-y"},{"key":"e_1_3_3_132_2","unstructured":"Wenxiong Liao Zhengliang Liu Haixing Dai Shaochen Xu Zihao Wu Yiyang Zhang Xiaoke Huang Dajiang Zhu Hongmin Cai Tianming Liu et\u00a0al. 2023. Differentiate chatgpt-generated and human-written medical texts. arxiv:2304.11567. Retrieved from https:\/\/arxiv.org\/abs\/2304.11567 (2023)."},{"key":"e_1_3_3_133_2","unstructured":"Weixiong Lin Ziheng Zhao Xiaoman Zhang Chaoyi Wu Ya Zhang Yanfeng Wang and Weidi Xie. 2023. Pmc-clip: Contrastive language-image pre-training using biomedical documents. arxiv:2303.07240. Retrieved from https:\/\/arxiv.org\/abs\/2303.07240 (2023)."},{"key":"e_1_3_3_134_2","doi-asserted-by":"publisher","DOI":"10.1126\/science.ade2574"},{"key":"e_1_3_3_135_2","unstructured":"Haotian Liu Chunyuan Li Qingyang Wu and Yong Jae Lee. 2023. Visual instruction tuning. arxiv:2304.08485. Retrieved from https:\/\/arxiv.org\/abs\/2304.08485 (2023)."},{"key":"e_1_3_3_136_2","unstructured":"Jiaming Liu Rushil Anirudh Jayaraman J. Thiagarajan Stewart He K. Aditya Mohan Ulugbek S. Kamilov and Hyojin Kim. 2022. DOLCE: A Model-based probabilistic diffusion framework for limited-angle CT reconstruction. arxiv:2211.12340. Retrieved from https:\/\/arxiv.org\/abs\/2211.12340 (2022)."},{"key":"e_1_3_3_137_2","doi-asserted-by":"publisher","DOI":"10.1109\/TMI.2024.3508698"},{"key":"e_1_3_3_138_2","doi-asserted-by":"crossref","unstructured":"Jie Liu Yixiao Zhang Jie-Neng Chen Junfei Xiao Yongyi Lu Bennett A. Landman Yixuan Yuan Alan Yuille Yucheng Tang and Zongwei Zhou. 2023. Clip-driven universal model for organ segmentation and tumor detection. arxiv:2301.00785. Retrieved from https:\/\/arxiv.org\/abs\/2301.00785 (2023).","DOI":"10.1109\/ICCV51070.2023.01934"},{"key":"e_1_3_3_139_2","unstructured":"Kai Liu Zhan Su Peijie Dong Fengran Mo Jianfei Gao ShaoTing Zhang and Kai Chen. 2025. Smooth reading: Bridging the gap of recurrent llm to self-attention llm on long-context tasks. arxiv:2507.19353. Retrieved from https:\/\/arxiv.org\/abs\/2507.19353 (2025)."},{"key":"e_1_3_3_140_2","unstructured":"Mianxin Liu Jinru Ding Jie Xu Weiguo Hu Xiaoyang Li Lifeng Zhu Zhian Bai Xiaoming Shi Benyou Wang Haitao Song et\u00a0al. 2024. Medbench: A comprehensive standardized and reliable benchmarking system for evaluating chinese medical large language models. arxiv:2407.10990. Retrieved from https:\/\/arxiv.org\/abs\/2407.10990 (2024)."},{"key":"e_1_3_3_141_2","first-page":"4871","volume-title":"Proceedings of the 31st International Conference on Computational Linguistics","author":"Liu Ruoyu","year":"2025","unstructured":"Ruoyu Liu, Kui Xue, Xiaofan Zhang, and Shaoting Zhang. 2025. Interactive evaluation for medical llms via task-oriented dialogue system. In Proceedings of the 31st International Conference on Computational Linguistics. 4871\u20134896."},{"key":"e_1_3_3_142_2","doi-asserted-by":"publisher","DOI":"10.1038\/s42256-023-00759-6"},{"key":"e_1_3_3_143_2","unstructured":"Xiaohong Liu Guoxing Yang Yulin Luo Jiaji Mao Xiang Zhang Ming Gao Shanghang Zhang Jun Shen and Guangyu Wang. 2024. Expert-level vision-language foundation model for real-world radiology and comprehensive evaluation. arxiv:2409.16183. Retrieved from https:\/\/arxiv.org\/abs\/2409.16183 (2024)."},{"key":"e_1_3_3_144_2","unstructured":"Yang Liu Yuanshun Yao Jean-Francois Ton Xiaoying Zhang Ruocheng Guo Hao Cheng Yegor Klochkov Muhammad Faaiz Taufiq and Hang Li. 2023. Trustworthy LLMs: A survey and guideline for evaluating large language models\u2019 alignment. arxiv:2308.05374. Retrieved from https:\/\/arxiv.org\/abs\/2308.05374 (2023)."},{"key":"e_1_3_3_145_2","first-page":"131811","article-title":"DermClinical: Clinical-oriented dataset and evaluation for computer-aided dermatological diagnosis","author":"Liu Zihao","year":"2025","unstructured":"Zihao Liu, Zhiqiang Hu, Ruiqin Xiong, Shaoting Zhang, and Tingting Jiang. 2025. DermClinical: Clinical-oriented dataset and evaluation for computer-aided dermatological diagnosis. Neurocomputing 659 (2025), 131811.","journal-title":"Neurocomputing"},{"key":"e_1_3_3_146_2","unstructured":"Zhengliang Liu Xiaowei Yu Lu Zhang Zihao Wu Chao Cao Haixing Dai Lin Zhao Wei Liu Dinggang Shen Quanzheng Li et\u00a0al. 2023. Deid-gpt: Zero-shot medical text de-identification by gpt-4. arxiv:2303.11032. Retrieved from https:\/\/arxiv.org\/abs\/2303.11032 (2023)."},{"key":"e_1_3_3_147_2","doi-asserted-by":"publisher","DOI":"10.1186\/s12874-022-01665-y"},{"key":"e_1_3_3_148_2","unstructured":"Jiaxuan Lu Junyan Shi Yuhui Lin Fang Yan Yue Gao Shaoting Zhang and Xiaosong Wang. 2025. Graph Mamba for efficient whole slide image understanding. arxiv:2505.17457v1. Retrieved from https:\/\/arxiv.org\/abs\/2505.17457v1 (2025)."},{"key":"e_1_3_3_149_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-72083-3_37"},{"key":"e_1_3_3_150_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-024-02856-4"},{"key":"e_1_3_3_151_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-024-07618-3"},{"key":"e_1_3_3_152_2","doi-asserted-by":"publisher","DOI":"10.1093\/bib\/bbac409"},{"key":"e_1_3_3_153_2","doi-asserted-by":"crossref","unstructured":"Qing Lyu Josh Tan Mike E. Zapadka Janardhana Ponnatapuram Chuang Niu Ge Wang and Christopher T. Whitlow. 2023. Translating radiology reports into plain language using chatgpt and gpt-4 with prompt learning: Promising results limitations and potential. arxiv:2303.09038. Retrieved from https:\/\/arxiv.org\/abs\/2303.09038 (2023).","DOI":"10.1186\/s42492-023-00136-5"},{"key":"e_1_3_3_154_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41467-024-44824-z"},{"key":"e_1_3_3_155_2","unstructured":"Jiabo Ma Yingxue Xu Fengtao Zhou Yihui Wang Cheng Jin Zhengrui Guo Jianfeng Wu On Ki Tang Huajun Zhou Xi Wang et\u00a0al. 2025. PathBench: A comprehensive comparison benchmark for pathology foundation models towards precision oncology. arxiv:2505.20202. Retrieved from https:\/\/arxiv.org\/abs\/2505.20202 (2025)."},{"key":"e_1_3_3_156_2","unstructured":"Aman Madaan Niket Tandon Prakhar Gupta Skyler Hallinan Luyu Gao Sarah Wiegreffe Uri Alon Nouha Dziri Shrimai Prabhumoye Yiming Yang et\u00a0al. 2023. Self-refine: Iterative refinement with self-feedback. arxiv:2303.17651. Retrieved from https:\/\/arxiv.org\/abs\/2303.17651 (2023)."},{"key":"e_1_3_3_157_2","doi-asserted-by":"publisher","DOI":"10.2310\/JIM.0b013e3181c9b2ea"},{"key":"e_1_3_3_158_2","unstructured":"Maciej A. Mazurowski Haoyu Dong Hanxue Gu Jichen Yang Nicholas Konz and Yixin Zhang. 2023. Segment anything model for medical image analysis: An experimental study. arxiv:2304.10517. Retrieved from https:\/\/arxiv.org\/abs\/2304.10517 (2023)."},{"key":"e_1_3_3_159_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-025-08869-4"},{"key":"e_1_3_3_160_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41746-024-01083-y"},{"key":"e_1_3_3_161_2","unstructured":"Aakash Mishra Rajat Mittal Christy Jestin Kostas Tingos and Pranav Rajpurkar. 2023. Improving zero-shot detection of low prevalence chest pathologies using domain pre-trained language models. arxiv:2306.08000. Retrieved from https:\/\/arxiv.org\/abs\/2306.08000 (2023)."},{"key":"e_1_3_3_162_2","doi-asserted-by":"publisher","DOI":"10.1109\/WACV56688.2023.00204"},{"key":"e_1_3_3_163_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-023-05881-4"},{"key":"e_1_3_3_164_2","unstructured":"Michael Moor Qian Huang Shirley Wu Michihiro Yasunaga Cyril Zakka Yash Dalmia Eduardo Pontes Reis Pranav Rajpurkar and Jure Leskovec. 2023. Med-Flamingo: A multimodal medical few-shot learner. arxiv:2307.15189. Retrieved from https:\/\/arxiv.org\/abs\/2307.15189 (2023)."},{"key":"e_1_3_3_165_2","doi-asserted-by":"publisher","DOI":"10.1007\/s10462-023-10556-7"},{"key":"e_1_3_3_166_2","unstructured":"Richard Ngo Lawrence Chan and S\u00f6ren Mindermann. 2022. The alignment problem from a deep learning perspective. arxiv:2209.00626. Retrieved from https:\/\/arxiv.org\/abs\/2209.00626 (2022)."},{"key":"e_1_3_3_167_2","unstructured":"Harsha Nori Nicholas King Scott Mayer McKinney Dean Carignan and Eric Horvitz. 2023. Capabilities of gpt-4 on medical challenge problems. arxiv:2303.13375. Retrieved from https:\/\/arxiv.org\/abs\/2303.13375 (2023)."},{"key":"e_1_3_3_168_2","article-title":"ChatGPT","year":"2021","unstructured":"OpenAI. 2021. ChatGPT. Retrieved from https:\/\/openai.com\/research\/chatgpt.","journal-title":"https:\/\/openai.com\/research\/chatgpt"},{"key":"e_1_3_3_169_2","unstructured":"OpenAI. 2023. GPT-4 technical report. arxiv:2303.08774. Retrieved from https:\/\/arxiv.org\/abs\/2303.08774 (2023)."},{"key":"e_1_3_3_170_2","article-title":"GPT-4o","year":"2024","unstructured":"OpenAI. 2024. GPT-4o. Retrieved from https:\/\/openai.com\/index\/hello-gpt-4o\/.","journal-title":"https:\/\/openai.com\/index\/hello-gpt-4o\/"},{"key":"e_1_3_3_171_2","unstructured":"Maxime Oquab Timoth\u00e9e Darcet Th\u00e9o Moutakanni Huy Vo Marc Szafraniec Vasil Khalidov Pierre Fernandez Daniel Haziza Francisco Massa Alaaeldin El-Nouby et\u00a0al. 2023. Dinov2: Learning robust visual features without supervision. arxiv:2304.07193. Retrieved from https:\/\/arxiv.org\/abs\/2304.07193 (2023)."},{"key":"e_1_3_3_172_2","first-page":"27730","article-title":"Training language models to follow instructions with human feedback","volume":"35","author":"Ouyang Long","year":"2022","unstructured":"Long Ouyang, Jeffrey Wu, Xu Jiang, Diogo Almeida, Carroll Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, et\u00a0al. 2022. Training language models to follow instructions with human feedback. Advances in Neural Information Processing Systems 35 (2022), 27730\u201327744.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_3_173_2","unstructured":"Shirui Pan Linhao Luo Yufei Wang Chen Chen Jiapu Wang and Xindong Wu. 2023. Unifying large language models and knowledge graphs: A roadmap. arxiv:2306.08302. Retrieved from https:\/\/arxiv.org\/abs\/2306.08302 (2023)."},{"key":"e_1_3_3_174_2","unstructured":"Cheng Peng Xi Yang Aokun Chen Kaleb E. Smith Nima PourNejatian Anthony B. Costa Cheryl Martin Mona G. Flores Ying Zhang Tanja Magoc et\u00a0al. 2023. A study of generative large language model for medical research and healthcare. arxiv:2305.13523. Retrieved from https:\/\/arxiv.org\/abs\/2305.13523 (2023)."},{"key":"e_1_3_3_175_2","unstructured":"Yifan Peng Shankai Yan and Zhiyong Lu. 2019. Transfer learning in biomedical natural language processing: An evaluation of BERT and ELMo on ten benchmarking datasets. arxiv:1906.05474. Retrieved from https:\/\/arxiv.org\/abs\/1906.05474 (2019)."},{"key":"e_1_3_3_176_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-18576-2_12"},{"key":"e_1_3_3_177_2","unstructured":"Jianing Qiu Lin Li Jiankai Sun Jiachuan Peng Peilun Shi Ruiyang Zhang Yinzhao Dong Kyle Lam Frank P.-W. Lo Bo Xiao et\u00a0al. 2023. Large ai models in health informatics: Applications challenges and the future. arxiv:2303.11568. Retrieved from https:\/\/arxiv.org\/abs\/2303.11568 (2023)."},{"key":"e_1_3_3_178_2","doi-asserted-by":"publisher","DOI":"10.1056\/aioa2300221"},{"key":"e_1_3_3_179_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.dadm.2018.08.013"},{"key":"e_1_3_3_180_2","unstructured":"Chongyu Qu Tiezheng Zhang Hualin Qiao Jie Liu Yucheng Tang Alan Yuille and Zongwei Zhou. 2023. Annotating 8 000 abdominal CT volumes for multi-organ segmentation in three weeks. arxiv:2305.09666. Retrieved from https:\/\/arxiv.org\/abs\/2305.09666 (2023)."},{"key":"e_1_3_3_181_2","unstructured":"Dilermando Queiroz Anderson Carlos Ma\u00edra Fatoretto Luis Filipe Nakayama Andr\u00e9 Anjos and Lilian Berton. 2024. Does data-efficient generalization exacerbate bias in foundation models?arxiv:2408.16154. Retrieved from https:\/\/arxiv.org\/abs\/2408.16154 (2024)."},{"key":"e_1_3_3_182_2","unstructured":"Qwen An Yang Baosong Yang Beichen Zhang Binyuan Hui Bo Zheng Bowen Yu Chengyuan Li Dayiheng Liu Fei Huang et\u00a0al. 2024. Qwen2.5 technical report. arxiv:2412.15115. Retrieved from https:\/\/arxiv.org\/abs\/2412.15115 (2024)."},{"key":"e_1_3_3_183_2","first-page":"8748","volume-title":"Proceedings of the International Conference on Machine Learning","author":"Radford Alec","year":"2021","unstructured":"Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, et\u00a0al. 2021. Learning transferable visual models from natural language supervision. In Proceedings of the International Conference on Machine Learning. PMLR, 8748\u20138763."},{"key":"e_1_3_3_184_2","unstructured":"Alec Radford Karthik Narasimhan Tim Salimans and Ilya Sutskever. 2018. Improving language understanding by generative pre-training. (2018)."},{"issue":"8","key":"e_1_3_3_185_2","first-page":"9","article-title":"Language models are unsupervised multitask learners","volume":"1","year":"2019","unstructured":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, and Ilya Sutskever. 2019. Language models are unsupervised multitask learners. OpenAI Blog 1, 8 (2019), 9.","journal-title":"OpenAI Blog"},{"key":"e_1_3_3_186_2","doi-asserted-by":"publisher","DOI":"10.5555\/3455716.3455856"},{"key":"e_1_3_3_187_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-021-01614-0"},{"key":"e_1_3_3_188_2","unstructured":"Aditya Ramesh Prafulla Dhariwal Alex Nichol Casey Chu and Mark Chen. 2022. Hierarchical text-conditional image generation with clip latents. arxiv:2204.06125. Retrieved from https:\/\/arxiv.org\/abs\/2204.06125 (2022)."},{"key":"e_1_3_3_189_2","first-page":"8821","volume-title":"Proceedings of the International Conference on Machine Learning","author":"Ramesh Aditya","year":"2021","unstructured":"Aditya Ramesh, Mikhail Pavlov, Gabriel Goh, Scott Gray, Chelsea Voss, Alec Radford, Mark Chen, and Ilya Sutskever. 2021. Zero-shot text-to-image generation. In Proceedings of the International Conference on Machine Learning. PMLR, 8821\u20138831."},{"key":"e_1_3_3_190_2","doi-asserted-by":"crossref","unstructured":"Arya S. Rao Michael Pang John Kim Meghana Kamineni Winston Lie Anoop K. Prasad Adam Landman Keith Dryer and Marc D. Succi. 2023. Assessing the utility of ChatGPT throughout the entire clinical workflow. Journal of Medical Internet Research 25 1 (2023) e48659.","DOI":"10.2196\/48659"},{"key":"e_1_3_3_191_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-65981-7_12"},{"key":"e_1_3_3_192_2","doi-asserted-by":"publisher","DOI":"10.1177\/1533034618775530"},{"key":"e_1_3_3_193_2","doi-asserted-by":"publisher","DOI":"10.1146\/annurev-statistics-030718-105142"},{"key":"e_1_3_3_194_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01042"},{"key":"e_1_3_3_195_2","unstructured":"Saikat Roy Tassilo Wald Gregor Koehler Maximilian R. Rokuss Nico Disch Julius Holzschuh David Zimmerer and Klaus H. Maier-Hein. 2023. Sam. md: Zero-shot medical image segmentation capabilities of the segment anything model. arxiv:2304.05396. Retrieved from https:\/\/arxiv.org\/abs\/2304.05396 (2023)."},{"key":"e_1_3_3_196_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-39539-0_7"},{"key":"e_1_3_3_197_2","unstructured":"Khaled Saab Tao Tu Wei-Hung Weng Ryutaro Tanno David Stutz Ellery Wulczyn Fan Zhang Tim Strother Chunjong Park Elahe Vedadi et\u00a0al. 2024. Capabilities of gemini models in medicine. arxiv:2404.18416. Retrieved from https:\/\/arxiv.org\/abs\/2404.18416 (2024)."},{"key":"e_1_3_3_198_2","unstructured":"Luke W. Sagers James A. Diao Matthew Groh Pranav Rajpurkar Adewole S. Adamson and Arjun K. Manrai. 2022. Improving dermatology classifiers across populations using images generated by large diffusion models. arxiv:2211.13352. Retrieved from https:\/\/arxiv.org\/abs\/2211.13352 (2022)."},{"key":"e_1_3_3_199_2","doi-asserted-by":"publisher","DOI":"10.52225\/narra.v3i1.103"},{"key":"e_1_3_3_200_2","doi-asserted-by":"publisher","DOI":"10.1001\/jama.2023.1044"},{"key":"e_1_3_3_201_2","unstructured":"Samuel Schmidgall Rojin Ziaei Carl Harris Eduardo Reis Jeffrey Jopling and Michael Moor. 2024. AgentClinic: A multimodal agent benchmark to evaluate AI in simulated clinical environments. arxiv:2405.07960. Retrieved from https:\/\/arxiv.org\/abs\/2405.07960 (2024)."},{"key":"e_1_3_3_202_2","first-page":"241","volume-title":"Handbook of Security and Privacy of AI-Enabled Healthcare Systems and Internet of Medical Things","author":"Sei Yuichi","year":"2024","unstructured":"Yuichi Sei, Akihiko Ohsuga, J. Andrew Onesimu, and Agbotiname Lucky Imoize. 2024. Local differential privacy for artificial intelligence of medical things. In Handbook of Security and Privacy of AI-Enabled Healthcare Systems and Internet of Medical Things. CRC Press, 241\u2013270."},{"key":"e_1_3_3_203_2","unstructured":"Rico Sennrich Barry Haddow and Alexandra Birch. 2015. Improving neural machine translation models with monolingual data. arxiv:1511.06709. Retrieved from https:\/\/arxiv.org\/abs\/1511.06709 (2015)."},{"key":"e_1_3_3_204_2","unstructured":"George Shaikovski Adam Casson Kristen Severson Eric Zimmermann Yi Kan Wang Jeremy D. Kunz Juan A. Retamero Gerard Oakley David Klimstra Christopher Kanan et\u00a0al. 2024. PRISM: A multi-modal generative foundation model for slide-level histopathology. arxiv:2405.10254. Retrieved from https:\/\/arxiv.org\/abs\/2405.10254 (2024)."},{"key":"e_1_3_3_205_2","unstructured":"Jing Shao Siyu Chen Yangguang Li Kun Wang Zhenfei Yin Yinan He Jianing Teng Qinghong Sun Mengya Gao Jihao Liu et\u00a0al. 2021. Intern: A new learning paradigm towards general vision. arxiv:2111.08687. Retrieved from https:\/\/arxiv.org\/abs\/2111.08687 (2021)."},{"key":"e_1_3_3_206_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-16434-7_21"},{"key":"e_1_3_3_207_2","unstructured":"Weijia Shi Anirudh Ajith Mengzhou Xia Yangsibo Huang Daogao Liu Terra Blevins Danqi Chen and Luke Zettlemoyer. 2023. Detecting pretraining data from large language models. arxiv:2310.16789. Retrieved from https:\/\/arxiv.org\/abs\/2310.16789 (2023)."},{"key":"e_1_3_3_208_2","doi-asserted-by":"crossref","unstructured":"Hisaichi Shibata Shouhei Hanaoka Takahiro Nakao Tomohiro Kikuchi Yuta Nakamura Yukihiro Nomura Takeharu Yoshikawa and Osamu Abe. 2023. Practical medical image generation with provable privacy protection based on denoising diffusion probabilistic models for high-resolution volumetric images. Applied Sciences 14 8 (2023) 3489.","DOI":"10.3390\/app14083489"},{"key":"e_1_3_3_209_2","doi-asserted-by":"publisher","DOI":"10.1186\/s40537-019-0197-0"},{"key":"e_1_3_3_210_2","doi-asserted-by":"publisher","DOI":"10.1186\/s40537-021-00492-0"},{"key":"e_1_3_3_211_2","unstructured":"Chang Shu Baian Chen Fangyu Liu Zihao Fu Ehsan Shareghi and Nigel Collier. 2023. Visual Med-Alpaca: A Parameter-Efficient Biomedical LLM with Visual Capabilities. Retrieved from https:\/\/cambridgeltl.github.io\/visual-med-alpaca\/"},{"key":"e_1_3_3_212_2","unstructured":"Oriane Sim\u00e9oni Huy V. Vo Maximilian Seitzer Federico Baldassarre Maxime Oquab Cijo Jose Vasil Khalidov Marc Szafraniec Seungeun Yi Micha\u00ebl Ramamonjisoa et\u00a0al. 2025. DINOv3. arxiv:2508.10104. Retrieved from https:\/\/arxiv.org\/abs\/2508.10104 (2025)."},{"key":"e_1_3_3_213_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01519"},{"key":"e_1_3_3_214_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.dsm.2023.06.001"},{"key":"e_1_3_3_215_2","unstructured":"Karan Singhal Shekoofeh Azizi Tao Tu S. Sara Mahdavi Jason Wei Hyung Won Chung Nathan Scales Ajay Tanwani Heather Cole-Lewis Stephen Pfohl et\u00a0al. 2022. Large language models encode clinical knowledge. arxiv:2212.13138. Retrieved from https:\/\/arxiv.org\/abs\/2212.13138 (2022)."},{"key":"e_1_3_3_216_2","unstructured":"Karan Singhal Tao Tu Juraj Gottweis Rory Sayres Ellery Wulczyn Le Hou Kevin Clark Stephen Pfohl Heather Cole-Lewis Darlene Neal et\u00a0al. 2023. Towards expert-level medical question answering with large language models. arxiv:2305.09617. Retrieved from https:\/\/arxiv.org\/abs\/2305.09617 (2023)."},{"key":"e_1_3_3_217_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2024.103248"},{"key":"e_1_3_3_218_2","unstructured":"Tao Song Yicheng Wu Minhao Hu Xiangde Luo Guoting Luo Guotai Wang Yi Guo Feng Xu and Shaoting Zhang. 2024. Cycle-consistent bridge diffusion model for accelerated mri reconstruction. arxiv:2412.09998. Retrieved from https:\/\/arxiv.org\/abs\/2412.09998 (2024)."},{"key":"e_1_3_3_219_2","unstructured":"Tao Song Yicheng Wu Minhao Hu Xiangde Luo Linda Wei Guotai Wang Yi Guo Feng Xu and Shaoting Zhang. 2024. Cross group attention and group-wise rolling for multimodal medical image synthesis. arxiv:2411.14684. Retrieved from https:\/\/arxiv.org\/abs\/2411.14684 (2024)."},{"key":"e_1_3_3_220_2","first-page":"728","volume-title":"Medical Imaging with Deep Learning","author":"Sowrirajan Hari","year":"2021","unstructured":"Hari Sowrirajan, Jingbo Yang, Andrew Y. Ng, and Pranav Rajpurkar. 2021. Moco pretraining improves representation and transferability of chest x-ray models. In Medical Imaging with Deep Learning. PMLR, 728\u2013744."},{"key":"e_1_3_3_221_2","doi-asserted-by":"publisher","DOI":"10.1093\/bib\/bbab569"},{"key":"e_1_3_3_222_2","doi-asserted-by":"publisher","DOI":"10.1109\/ISBI60581.2025.10980879"},{"key":"e_1_3_3_223_2","unstructured":"Yuxuan Sun Yunlong Zhang Yixuan Si Chenglu Zhu Zhongyi Shui Kai Zhang Jingxiong Li Xingheng Lyu Tao Lin and Lin Yang. 2024. PathGen-1.6M: 1.6 Million pathology image-text pairs generation through multi-agent collaboration. arxiv:2407.00203. Retrieved from https:\/\/arxiv.org\/abs\/2407.00203 (2024)."},{"key":"e_1_3_3_224_2","unstructured":"Yuxuan Sun Chenglu Zhu Sunyi Zheng Kai Zhang Zhongyi Shui Xiaoxuan Yu Yizhi Zhao Honglin Li Yunlong Zhang Ruojia Zhao et\u00a0al. 2023. Pathasst: Redefining pathology through generative foundation ai assistant for pathology. arxiv:2305.15072. Retrieved from https:\/\/arxiv.org\/abs\/2305.15072 (2023)."},{"key":"e_1_3_3_225_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.308"},{"key":"e_1_3_3_226_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41746-024-01258-7"},{"key":"e_1_3_3_227_2","unstructured":"Zheling Tan Kexin Ding Jin Gao Mu Zhou Dimitris Metaxas Shaoting Zhang and Dequan Wang. 2025. Medforge: Building medical foundation models like open source software development. arxiv:2502.16055. Retrieved from https:\/\/arxiv.org\/abs\/2502.16055 (2025)."},{"key":"e_1_3_3_228_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP49357.2023.10095697"},{"key":"e_1_3_3_229_2","unstructured":"Ruixiang Tang Xiaotian Han Xiaoqian Jiang and Xia Hu. 2023. Does synthetic data generation of llms help clinical text mining?arxiv:2303.04360. Retrieved from https:\/\/arxiv.org\/abs\/2303.04360 (2023)."},{"key":"e_1_3_3_230_2","article-title":"Stanford Alpaca: An Instruction-following LLaMA model","author":"Taori Rohan","year":"2023","unstructured":"Rohan Taori, Ishaan Gulrajani, Tianyi Zhang, Yann Dubois, Xuechen Li, Carlos Guestrin, Percy Liang, and Tatsunori B. Hashimoto. 2023. Stanford Alpaca: An Instruction-following LLaMA model. Retrieved from https:\/\/github.com\/tatsu-lab\/stanford_alpaca.","journal-title":"https:\/\/github.com\/tatsu-lab\/stanford_alpaca"},{"key":"e_1_3_3_231_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2019.101544"},{"key":"e_1_3_3_232_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-023-02448-8"},{"key":"e_1_3_3_233_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41551-022-00936-9"},{"key":"e_1_3_3_234_2","unstructured":"Hugo Touvron Thibaut Lavril Gautier Izacard Xavier Martinet Marie-Anne Lachaux Timoth\u00e9e Lacroix Baptiste Rozi\u00e8re Naman Goyal Eric Hambro Faisal Azhar et\u00a0al. 2023. Llama: Open and efficient foundation language models. arxiv:2302.13971. Retrieved from https:\/\/arxiv.org\/abs\/2302.13971 (2023)."},{"key":"e_1_3_3_235_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-025-08866-7"},{"key":"e_1_3_3_236_2","unstructured":"Logesh Kumar Umapathi Ankit Pal and Malaikannan Sankarasubbu. 2023. Med-halt: Medical domain hallucination test for large language models. arxiv:2307.15343. Retrieved from https:\/\/arxiv.org\/abs\/2307.15343 (2023)."},{"key":"e_1_3_3_237_2","doi-asserted-by":"publisher","DOI":"10.1093\/eurheartj\/ehac238"},{"key":"e_1_3_3_238_2","unstructured":"Dave Van Veen Cara Van Uden Maayane Attias Anuj Pareek Christian Bluethgen Malgorzata Polacin Wah Chiu Jean-Benoit Delbrouck Juan Manuel Zambrano Chaves Curtis P. Langlotz et\u00a0al. 2023. RadAdapt: Radiology report summarization via lightweight domain adaptation of large language models. arxiv:2305.01146. Retrieved from https:\/\/arxiv.org\/abs\/2305.01146 (2023)."},{"key":"e_1_3_3_239_2","article-title":"Attention is all you need","volume":"30","author":"Vaswani Ashish","year":"2017","unstructured":"Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N. Gomez, \u0141ukasz Kaiser, and Illia Polosukhin. 2017. Attention is all you need. Advances in Neural Information Processing Systems 30 (2017), 5998\u20136008.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_3_240_2","doi-asserted-by":"crossref","unstructured":"Dave Van Veen Cara Van Uden Louis Blankemeier Jean-Benoit Delbrouck Asad Aali Christian Bluethgen Anuj Pareek Malgorzata Polacin William Collins Neera Ahuja et\u00a0al. 2023. Clinical text summarization: adapting large language models can outperform human experts. arxiv:2309.07430. Retrieved from https:\/\/arxiv.org\/abs\/2309.07430 (2023).","DOI":"10.21203\/rs.3.rs-3483777\/v1"},{"key":"e_1_3_3_241_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-024-03141-0"},{"key":"e_1_3_3_242_2","unstructured":"Chenglong Wang Dexuan Li Sucheng Wang Chengxiu Zhang Yida Wang Yun Liu and Guang Yang. 2023. \\(\\mathrm{SAM^{Med}}\\) : A medical image annotation framework based on large vision model. arxiv:2307.05617. Retrieved from https:\/\/arxiv.org\/abs\/2307.05617 (2023)."},{"key":"e_1_3_3_243_2","unstructured":"Chengrui Wang Qingqing Long Xiao Meng Xunxin Cai Chengjun Wu Zhen Meng Xuezhi Wang and Yuanchun Zhou. 2024. BioRAG: A RAG-LLM framework for biological question reasoning. arxiv:2408.01107. Retrieved from https:\/\/arxiv.org\/abs\/2408.01107 (2024)."},{"key":"e_1_3_3_244_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41597-023-02460-0"},{"key":"e_1_3_3_245_2","unstructured":"Rongsheng Wang Yaofei Duan ChanTong Lam Jiexi Chen Jiangsheng Xu Haoming Chen Xiaohong Liu Patrick Cheong-Iao Pang and Tao Tan. 2023. IvyGPT: InteractiVe Chinese pathway language model in medical domain. arxiv:2307.10512. Retrieved from https:\/\/arxiv.org\/abs\/2307.10512 (2023)."},{"key":"e_1_3_3_246_2","doi-asserted-by":"publisher","DOI":"10.1109\/cvpr52729.2023.01838"},{"key":"e_1_3_3_247_2","unstructured":"Wenhui Wang Hangbo Bao Li Dong Johan Bjorck Zhiliang Peng Qiang Liu Kriti Aggarwal Owais Khan Mohammed Saksham Singhal Subhojit Som et\u00a0al. 2022. Image as a foreign language: Beit pretraining for all vision and vision-language tasks. arxiv:2208.10442. Retrieved from https:\/\/arxiv.org\/abs\/2208.10442 (2022)."},{"key":"e_1_3_3_248_2","unstructured":"Wenhai Wang Zhe Chen Xiaokang Chen Jiannan Wu Xizhou Zhu Gang Zeng Ping Luo Tong Lu Jie Zhou Yu Qiao et\u00a0al. 2023. Visionllm: Large language model is also an open-ended decoder for vision-centric tasks. arxiv:2305.11175. Retrieved from https:\/\/arxiv.org\/abs\/2305.11175 (2023)."},{"key":"e_1_3_3_249_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2022.102645"},{"key":"e_1_3_3_250_2","unstructured":"Xuezhi Wang Jason Wei Dale Schuurmans Quoc Le Ed Chi Sharan Narang Aakanksha Chowdhery and Denny Zhou. 2022. Self-consistency improves chain of thought reasoning in language models. arxiv:2203.11171. Retrieved from https:\/\/arxiv.org\/abs\/2203.11171 (2022)."},{"key":"e_1_3_3_251_2","unstructured":"Zirui Wang Jiahui Yu Adams Wei Yu Zihang Dai Yulia Tsvetkov and Yuan Cao. 2021. Simvlm: Simple visual language model pretraining with weak supervision. arxiv:2108.10904. Retrieved from https:\/\/arxiv.org\/abs\/2108.10904 (2021)."},{"key":"e_1_3_3_252_2","unstructured":"Jason Wei Maarten Bosma Vincent Y. Zhao Kelvin Guu Adams Wei Yu Brian Lester Nan Du Andrew M. Dai and Quoc V. Le. 2021. Finetuned language models are zero-shot learners. arxiv:2109.01652. Retrieved from https:\/\/arxiv.org\/abs\/2109.01652 (2021)."},{"key":"e_1_3_3_253_2","doi-asserted-by":"crossref","unstructured":"Jason Wei and Kai Zou. 2019. Eda: Easy data augmentation techniques for boosting performance on text classification tasks. arxiv:1901.11196. Retrieved from https:\/\/arxiv.org\/abs\/1901.11196 (2019).","DOI":"10.18653\/v1\/D19-1670"},{"key":"e_1_3_3_254_2","doi-asserted-by":"publisher","DOI":"10.1038\/sdata.2016.18"},{"key":"e_1_3_3_255_2","doi-asserted-by":"publisher","DOI":"10.1148\/radiol.2020192224"},{"key":"e_1_3_3_256_2","first-page":"67125","article-title":"Ehrshot: An ehr benchmark for few-shot evaluation of foundation models","volume":"36","author":"Wornow Michael","year":"2023","unstructured":"Michael Wornow, Rahul Thapa, Ethan Steinberg, Jason Fries, and Nigam Shah. 2023. Ehrshot: An ehr benchmark for few-shot evaluation of foundation models. Advances in Neural Information Processing Systems 36 (2023), 67125\u201367137.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_3_257_2","unstructured":"Michael Wornow Yizhe Xu Rahul Thapa Birju Patel Ethan Steinberg Scott Fleming Michael A. Pfeffer Jason Fries and Nigam H. Shah. 2023. The shaky foundations of clinical foundation models: A survey of large language models and foundation models for EMRs. arxiv:2303.12961. Retrieved from https:\/\/arxiv.org\/abs\/2303.12961 (2023)."},{"key":"e_1_3_3_258_2","unstructured":"Chaoyi Wu Xiaoman Zhang Ya Zhang Yanfeng Wang and Weidi Xie. 2023. Pmc-llama: Further finetuning llama on medical papers. arxiv:2304.14454. Retrieved from https:\/\/arxiv.org\/abs\/2304.14454 (2023)."},{"key":"e_1_3_3_259_2","unstructured":"Junde Wu Rao Fu Huihui Fang Yuanpei Liu Zhaowei Wang Yanwu Xu Yueming Jin and Tal Arbel. 2023. Medical sam adapter: Adapting segment anything model for medical image segmentation. arxiv:2304.12620. Retrieved from https:\/\/arxiv.org\/abs\/2304.12620 (2023)."},{"key":"e_1_3_3_260_2","unstructured":"Junde Wu Jiayuan Zhu and Yunli Qi. 2024. Medical graph RAG: Towards safe medical large language model via graph retrieval-augmented generation. arxiv:2408.04187. Retrieved from https:\/\/arxiv.org\/abs\/2408.04187 (2024)."},{"key":"e_1_3_3_261_2","unstructured":"Shengqiong Wu Hao Fei Leigang Qu Wei Ji and Tat-Seng Chua. 2023. NExT-GPT: Any-to-any multimodal LLM. arxiv:2309.05519. Retrieved from https:\/\/arxiv.org\/abs\/2309.05519 (2023)."},{"key":"e_1_3_3_262_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-025-03900-7"},{"key":"e_1_3_3_263_2","unstructured":"Zihao Wu Lu Zhang Chao Cao Xiaowei Yu Haixing Dai Chong Ma Zhengliang Liu Lin Zhao Gang Li Wei Liu et\u00a0al. 2023. Exploring the trade-offs: Unified large language models vs local fine-tuned models for highly-specific radiology nli task. arxiv:2304.09138. Retrieved from https:\/\/arxiv.org\/abs\/2304.09138 (2023)."},{"key":"e_1_3_3_264_2","first-page":"21","volume-title":"Proceedings of the 3rd Workshop on Building and Evaluating Resources for Biomedical Text Mining (BioTxtM\u20192012) in Conjunction with the International Conference on Language Resources and Evaluation (LREC), Istanbul, Turkey","author":"Xia Fei","year":"2012","unstructured":"Fei Xia and Meliha Yetisgen-Yildiz. 2012. Clinical corpus annotation: Challenges and strategies. In Proceedings of the 3rd Workshop on Building and Evaluating Resources for Biomedical Text Mining (BioTxtM\u20192012) in Conjunction with the International Conference on Language Resources and Evaluation (LREC), Istanbul, Turkey. 21\u201327."},{"key":"e_1_3_3_265_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00943"},{"key":"e_1_3_3_266_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-024-07441-w"},{"key":"e_1_3_3_267_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41591-025-03747-y"},{"key":"e_1_3_3_268_2","unstructured":"An Yang Anfeng Li Baosong Yang Beichen Zhang Binyuan Hui Bo Zheng Bowen Yu Chang Gao Chengen Huang Chenxu Lv et\u00a0al. 2025. Qwen3 technical report. arxiv:2505.09388. Retrieved from https:\/\/arxiv.org\/abs\/2505.09388 (2025)."},{"key":"e_1_3_3_269_2","doi-asserted-by":"publisher","DOI":"10.34133\/hds.0221"},{"key":"e_1_3_3_270_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2026.113203"},{"key":"e_1_3_3_271_2","unstructured":"Shunyu Yao Dian Yu Jeffrey Zhao Izhak Shafran Thomas L. Griffiths Yuan Cao and Karthik Narasimhan. 2023. Tree of thoughts: Deliberate problem solving with large language models. arxiv:2305.10601. Retrieved from https:\/\/arxiv.org\/abs\/2305.10601 (2023)."},{"key":"e_1_3_3_272_2","unstructured":"Seonghyeon Ye Doyoung Kim Sungdong Kim Hyeonbin Hwang Seungone Kim Yongrae Jo James Thorne Juho Kim and Minjoon Seo. 2023. FLASK: Fine-grained language model evaluation based on alignment skill sets. arxiv:2307.10928. Retrieved from https:\/\/arxiv.org\/abs\/2307.10928 (2023)."},{"key":"e_1_3_3_273_2","unstructured":"Huahui Yi Ziyuan Qin Qicheng Lao Wei Xu Zekun Jiang Dequan Wang Shaoting Zhang and Kang Li. 2023. Towards general purpose medical AI: Continual learning medical foundation model. arxiv:2303.06580. Retrieved from https:\/\/arxiv.org\/abs\/2303.06580 (2023)."},{"key":"e_1_3_3_274_2","doi-asserted-by":"publisher","DOI":"10.1109\/Cybermatics_2018.2018.00042"},{"key":"e_1_3_3_275_2","unstructured":"Jiahui Yu Zirui Wang Vijay Vasudevan Legg Yeung Mojtaba Seyedhosseini and Yonghui Wu. 2022. Coca: Contrastive captioners are image-text foundation models. arxiv:2205.01917. Retrieved from https:\/\/arxiv.org\/abs\/2205.01917 (2022)."},{"key":"e_1_3_3_276_2","unstructured":"Weihao Yu Zhengyuan Yang Linjie Li Jianfeng Wang Kevin Lin Zicheng Liu Xinchao Wang and Lijuan Wang. 2023. MM-Vet: Evaluating large multimodal models for integrated capabilities. arxiv:2308.02490. Retrieved from https:\/\/arxiv.org\/abs\/2308.02490 (2023)."},{"key":"e_1_3_3_277_2","first-page":"1324","volume-title":"AMIA Annual Symposium Proceedings","volume":"2023","author":"Yuan Jiayi","year":"2024","unstructured":"Jiayi Yuan, Ruixiang Tang, Xiaoqian Jiang, and Xia Hu. 2024. Large language models for healthcare data augmentation: An example on patient-trial matching. In AMIA Annual Symposium Proceedings, Vol. 2023. 1324."},{"key":"e_1_3_3_278_2","unstructured":"Lu Yuan Dongdong Chen Yi-Ling Chen Noel Codella Xiyang Dai Jianfeng Gao Houdong Hu Xuedong Huang Boxin Li Chunyuan Li et\u00a0al. 2021. Florence: A new foundation model for computer vision. arxiv:2111.11432. Retrieved from https:\/\/arxiv.org\/abs\/2111.11432 (2021)."},{"key":"e_1_3_3_279_2","doi-asserted-by":"crossref","unstructured":"Li Yunxiang Li Zihan Zhang Kai Dan Ruilong and Zhang You. 2023. Chatdoctor: A medical chat model fine-tuned on llama model using medical domain knowledge. arxiv:2303.14070. Retrieved from https:\/\/arxiv.org\/abs\/2303.14070 (2023).","DOI":"10.7759\/cureus.40895"},{"key":"e_1_3_3_280_2","unstructured":"Elad Ben Zaken Shauli Ravfogel and Yoav Goldberg. 2021. Bitfit: Simple parameter-efficient fine-tuning for transformer-based masked language-models. arxiv:2106.10199. Retrieved from https:\/\/arxiv.org\/abs\/2106.10199 (2021)."},{"key":"e_1_3_3_281_2","unstructured":"Daochen Zha Zaid Pervaiz Bhat Kwei-Herng Lai Fan Yang Zhimeng Jiang Shaochen Zhong and Xia Hu. 2023. Data-centric artificial intelligence: A survey. arxiv:2303.10158. Retrieved from https:\/\/arxiv.org\/abs\/2303.10158 (2023)."},{"key":"e_1_3_3_282_2","unstructured":"Shaoting Zhang and Dimitris Metaxas. 2023. On the challenges and perspectives of foundation models for medical image analysis. arxiv:2306.05705. Retrieved from https:\/\/arxiv.org\/abs\/2306.05705 (2023)."},{"key":"e_1_3_3_283_2","unstructured":"Sheng Zhang Yanbo Xu Naoto Usuyama Jaspreet Bagga Robert Tinn Sam Preston Rajesh Rao Mu Wei Naveen Valluri Cliff Wong et\u00a0al. 2023. Large-scale domain-specific pretraining for biomedical vision-language processing. arxiv:2303.00915. Retrieved from https:\/\/arxiv.org\/abs\/2303.00915 (2023)."},{"key":"e_1_3_3_284_2","unstructured":"Tianyi Zhang Varsha Kishore Felix Wu Kilian Q. Weinberger and Yoav Artzi. 2019. Bertscore: Evaluating text generation with bert. arxiv:1904.09675. Retrieved from https:\/\/arxiv.org\/abs\/1904.09675 (2019)."},{"key":"e_1_3_3_285_2","unstructured":"Xiaoman Zhang Chaoyi Wu Ziheng Zhao Weixiong Lin Ya Zhang Yanfeng Wang and Weidi Xie. 2023. Pmc-vqa: Visual instruction tuning for medical visual question answering. arxiv:2305.10415. Retrieved from https:\/\/arxiv.org\/abs\/2305.10415 (2023)."},{"key":"e_1_3_3_286_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-43904-9_27"},{"key":"e_1_3_3_287_2","first-page":"2","volume-title":"Proceedings of the Machine Learning for Healthcare Conference","author":"Zhang Yuhao","year":"2022","unstructured":"Yuhao Zhang, Hang Jiang, Yasuhide Miura, Christopher D. Manning, and Curtis P. Langlotz. 2022. Contrastive learning of medical visual representations from paired images and text. In Proceedings of the Machine Learning for Healthcare Conference. PMLR, 2\u201325."},{"key":"e_1_3_3_288_2","unstructured":"Yue Zhang Yafu Li Leyang Cui Deng Cai Lemao Liu Tingchen Fu Xinting Huang Enbo Zhao Yu Zhang Yulong Chen et\u00a0al. 2023. Siren\u2019s song in the AI ocean: A survey on hallucination in large language models. arxiv:2309.01219. Retrieved from https:\/\/arxiv.org\/abs\/2309.01219 (2023)."},{"key":"e_1_3_3_289_2","unstructured":"Yizhe Zhang Tao Zhou Peixian Liang and Danny Z. Chen. 2023. Input augmentation with sam: Boosting medical image segmentation with segmentation foundation model. arxiv:2304.11332. Retrieved from https:\/\/arxiv.org\/abs\/2304.11332 (2023)."},{"key":"e_1_3_3_290_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.csbj.2021.04.067"},{"key":"e_1_3_3_291_2","unstructured":"Penghao Zhao Hailin Zhang Qinhan Yu Zhengren Wang Yunteng Geng Fangcheng Fu Ling Yang Wentao Zhang and Bin Cui. 2024. Retrieval-augmented generation for ai-generated content: A survey. arxiv:2402.19473. Retrieved from https:\/\/arxiv.org\/abs\/2402.19473 (2024)."},{"key":"e_1_3_3_292_2","unstructured":"Wayne Xin Zhao Kun Zhou Junyi Li Tianyi Tang Xiaolei Wang Yupeng Hou Yingqian Min Beichen Zhang Junjie Zhang Zican Dong et\u00a0al. 2023. A survey of large language models. arxiv:2303.18223. Retrieved from https:\/\/arxiv.org\/abs\/2303.18223 (2023)."},{"key":"e_1_3_3_293_2","unstructured":"Ce Zhou Qian Li Chen Li Jun Yu Yixin Liu Guangjing Wang Kai Zhang Cheng Ji Qiben Yan Lifang He et\u00a0al. 2023. A comprehensive survey on pretrained foundation models: A history from bert to chatgpt. arxiv:2302.09419. Retrieved from https:\/\/arxiv.org\/abs\/2302.09419 (2023)."},{"key":"e_1_3_3_294_2","first-page":"13","volume-title":"International Workshop on Simulation and Synthesis in Medical Imaging","author":"Zhou Xianhao","year":"2025","unstructured":"Xianhao Zhou, Jianghao Wu, Huangxuan Zhao, Lei Chen, Shaoting Zhang, and Guotai Wang. 2025. GLFC: Unified global-local feature and contrast learning with Mamba-enhanced UNet for synthetic CT generation from CBCT. In International Workshop on Simulation and Synthesis in Medical Imaging. Springer, 13\u201321."},{"key":"e_1_3_3_295_2","doi-asserted-by":"publisher","DOI":"10.1038\/s41586-023-06555-x"},{"key":"e_1_3_3_296_2","unstructured":"Hengchuan Zhu Yihuan Xu Yichen Li Zijie Meng and Zuozhu Liu. 2025. DentalBench: Benchmarking and advancing LLMs capability for bilingual dentistry understanding. arxiv:2508.20416. Retrieved from https:\/\/arxiv.org\/abs\/2508.20416 (2025)."},{"key":"e_1_3_3_297_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2025.naacl-long.587"},{"key":"e_1_3_3_298_2","unstructured":"Yinghao Zhu Changyu Ren Shiyun Xie Shukai Liu Hangyuan Ji Zixiang Wang Tao Sun Long He Zhoujun Li Xi Zhu et\u00a0al. 2024. REALM: RAG-driven enhancement of multimodal electronic health records analysis via large language models. arxiv:2402.07016. Retrieved from https:\/\/arxiv.org\/abs\/2402.07016 (2024)."},{"key":"e_1_3_3_299_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2025.naacl-long.263"},{"key":"e_1_3_3_300_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2024.103258"}],"container-title":["ACM Computing Surveys"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3800677","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,27]],"date-time":"2026-04-27T09:36:35Z","timestamp":1777282595000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3800677"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,4,25]]},"references-count":299,"journal-issue":{"issue":"11","published-print":{"date-parts":[[2026,8,30]]}},"alternative-id":["10.1145\/3800677"],"URL":"https:\/\/doi.org\/10.1145\/3800677","relation":{},"ISSN":["0360-0300","1557-7341"],"issn-type":[{"value":"0360-0300","type":"print"},{"value":"1557-7341","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,4,25]]},"assertion":[{"value":"2023-12-14","order":0,"name":"received","label":"Received","group":{"name":"publication_history","label":"Publication History"}},{"value":"2025-12-14","order":2,"name":"accepted","label":"Accepted","group":{"name":"publication_history","label":"Publication History"}},{"value":"2026-04-25","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}