{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,25]],"date-time":"2026-08-25T23:58:48Z","timestamp":1787702328284,"version":"build-2784847793"},"reference-count":134,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2025,11,26]],"date-time":"2025-11-26T00:00:00Z","timestamp":1764115200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,11,26]],"date-time":"2025-11-26T00:00:00Z","timestamp":1764115200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Health Inf Sci Syst"],"DOI":"10.1007\/s13755-025-00403-0","type":"journal-article","created":{"date-parts":[[2025,11,26]],"date-time":"2025-11-26T17:50:24Z","timestamp":1764179424000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":28,"title":["Reasoning with large language models in medicine: a systematic review of techniques, challenges and clinical integration"],"prefix":"10.1007","volume":"14","author":[{"given":"Isra","family":"Mansoor","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Muhammad","family":"Abdullah","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Muhammad Dawood","family":"Rizwan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-0495-463X","authenticated-orcid":false,"given":"Muhammad Moazam","family":"Fraz","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,11,26]]},"reference":[{"key":"403_CR1","doi-asserted-by":"crossref","unstructured":"Knauff M. Reasoning. In: Encyclopedia of neuroscience, pp. 3377\u20133382. Springer, 2009.","DOI":"10.1007\/978-3-540-29678-2_4949"},{"issue":"1","key":"403_CR2","doi-asserted-by":"publisher","first-page":"109","DOI":"10.1146\/annurev.psych.50.1.109","volume":"50","author":"PN Johnson-Laird","year":"1999","unstructured":"Johnson-Laird PN. Deductive reasoning. Annu Rev Psychol. 1999;50(1):109\u201335.","journal-title":"Annu Rev Psychol"},{"issue":"2","key":"403_CR3","doi-asserted-by":"publisher","first-page":"278","DOI":"10.1002\/wcs.44","volume":"1","author":"BK Hayes","year":"2010","unstructured":"Hayes BK, Heit E, Swendsen H. Inductive reasoning. Wiley Interdiscip Rev Cogn Sci. 2010;1(2):278\u201392.","journal-title":"Wiley Interdiscip Rev Cogn Sci"},{"issue":"4","key":"403_CR4","doi-asserted-by":"publisher","first-page":"569","DOI":"10.3758\/BF03212996","volume":"7","author":"E Heit","year":"2000","unstructured":"Heit E. Properties of inductive reasoning. Psychon Bull Rev. 2000;7(4):569\u201392.","journal-title":"Psychon Bull Rev"},{"issue":"2","key":"403_CR5","doi-asserted-by":"publisher","first-page":"109","DOI":"10.1007\/BF00849080","volume":"7","author":"G Paul","year":"1993","unstructured":"Paul G. Approaches to abductive reasoning: an overview. Artif Intell Rev. 1993;7(2):109\u201352.","journal-title":"Artif Intell Rev"},{"key":"403_CR6","doi-asserted-by":"publisher","DOI":"10.2307\/jj.30297486","volume-title":"Abductive reasoning","author":"D Walton","year":"2014","unstructured":"Walton D. Abductive reasoning. Tuscaloosa, Alabama: University of Alabama Press; 2014."},{"key":"403_CR7","unstructured":"Marcus G. The next decade in ai: four steps towards robust artificial intelligence. arXiv preprint arXiv:2002.06177, 2020."},{"issue":"1","key":"403_CR8","first-page":"47","volume":"8","author":"ZA Caddick","year":"2023","unstructured":"Caddick ZA, Fraundorf SH, Rottman BM, Nokes-Malach TJ. Cognitive perspectives on maintaining. Cognitive Research: Principles and Implications physicians\u2019 medical expertise: Ii acquiring, maintaining, and updating cognitive skills. 2023;8(1):47.","journal-title":"Cognitive Research: Principles and Implications physicians\u2019 medical expertise: Ii. acquiring, maintaining, and updating cognitive skills"},{"issue":"1","key":"403_CR9","doi-asserted-by":"publisher","first-page":"159","DOI":"10.1093\/jamia\/ocz169","volume":"27","author":"PI Dissanayake","year":"2020","unstructured":"Dissanayake PI, Colicchio TK, Cimino JJ. Using clinical reasoning ontologies to make smarter clinical decision support systems: a systematic review and data synthesis. J Am Med Inform Assoc. 2020;27(1):159\u201374.","journal-title":"J Am Med Inform Assoc"},{"key":"403_CR10","unstructured":"Ferhi LA, Amar MB, Masmoudi A, Choubani F, Bouallegue R. Improving symptom-based medical diagnosis using ensemble learning approaches. Syst Res Behavioral Sci, 2025."},{"issue":"1","key":"403_CR11","doi-asserted-by":"publisher","first-page":"24","DOI":"10.1038\/s41591-018-0316-z","volume":"25","author":"A Esteva","year":"2019","unstructured":"Esteva A, Robicquet A, Ramsundar B, Kuleshov V, DePristo M, Chou K, et al. A guide to deep learning in healthcare. Nat Med. 2019;25(1):24\u20139.","journal-title":"Nat Med"},{"key":"403_CR12","doi-asserted-by":"crossref","unstructured":"Jiang F, Jiang Y, Zhi H, Dong Y, Li H, Ma S, Wang Y, Dong Q, Shen H, Wang Y. Artificial intelligence in healthcare: past, present and future. Stroke Vascular Neurology, 2017;2(4).","DOI":"10.1136\/svn-2017-000101"},{"issue":"240","key":"403_CR13","first-page":"1","volume":"24","author":"A Chowdhery","year":"2023","unstructured":"Chowdhery A, Narang S, Devlin J, Bosma M, Mishra G, Roberts A, et al. Palm: Scaling language modeling with pathways. J Mach Learn Res. 2023;24(240):1\u2013113.","journal-title":"J Mach Learn Res"},{"issue":"7972","key":"403_CR14","doi-asserted-by":"publisher","first-page":"172","DOI":"10.1038\/s41586-023-06291-2","volume":"620","author":"K Singhal","year":"2023","unstructured":"Singhal K, Azizi S, Tu T, Mahdavi SS, Wei J, Chung HW, et al. Large language models encode clinical knowledge. Nature. 2023;620(7972):172\u201380.","journal-title":"Nature"},{"issue":"8","key":"403_CR15","doi-asserted-by":"publisher","DOI":"10.1073\/pnas.2422455122","volume":"122","author":"A Reinhart","year":"2025","unstructured":"Reinhart A, Markey B, Laudenbach M, Pantusen K, Yurko R, Weinberg G, et al. Do llms write like humans? variation in grammatical and rhetorical styles. Proc Natl Acad Sci. 2025;122(8):e2422455122.","journal-title":"Proc Natl Acad Sci"},{"issue":"11","key":"403_CR16","doi-asserted-by":"publisher","first-page":"299","DOI":"10.1007\/s10462-024-10921-0","volume":"57","author":"D Wang","year":"2024","unstructured":"Wang D, Zhang S. Large language models in medical and healthcare fields: applications, advances, and challenges. Artif Intell Rev. 2024;57(11):299.","journal-title":"Artif Intell Rev"},{"key":"403_CR17","first-page":"24824","volume":"35","author":"J Wei","year":"2022","unstructured":"Wei J, Wang X, Schuurmans D, Bosma M, Xia F, Chi E, et al. Chain-of-thought prompting elicits reasoning in large language models. Adv Neural Inf Proc Syst. 2022;35:24824\u201337.","journal-title":"Adv Neural Inf Proc Syst"},{"key":"403_CR18","first-page":"11809","volume":"36","author":"S Yao","year":"2023","unstructured":"Yao S, Yu D, Zhao J, Shafran I, Griffiths T, Cao Y, et al. Tree of thoughts: Deliberate problem solving with large language models. Adv Neural Inf Proc Syst. 2023;36:11809\u201322.","journal-title":"Adv Neural Inf Proc Syst"},{"key":"403_CR19","unstructured":"Sun J, Xu C, Tang L, Wang S, Lin C, Gong Y, Ni LM, Shum H-Y, Guo J. Think-on-graph: Deep and responsible reasoning of large language model on knowledge graph. arXiv preprint arXiv:2307.07697, 2023."},{"issue":"1","key":"403_CR20","doi-asserted-by":"publisher","DOI":"10.2196\/53164","volume":"26","author":"M Chelli","year":"2024","unstructured":"Chelli M, Descamps J, Lavou\u00e9 V, Trojani C, Azar M, Deckert M, et al. Hallucination rates and reference accuracy of chatgpt and bard for systematic reviews: comparative analysis. J Med Internet Res. 2024;26(1):e53164.","journal-title":"J Med Internet Res"},{"issue":"6","key":"403_CR21","doi-asserted-by":"publisher","first-page":"bbac409","DOI":"10.1093\/bib\/bbac409","volume":"23","author":"R Luo","year":"2022","unstructured":"Luo R, Sun L, Xia Y, Qin T, Zhang S, Poon H, et al. Biogpt: generative pre-trained transformer for biomedical text generation and mining. Briefings Bioinformatics. 2022;23(6):bbac409.","journal-title":"Briefings Bioinformatics"},{"issue":"1","key":"403_CR22","doi-asserted-by":"publisher","first-page":"84","DOI":"10.1038\/s41746-024-01083-y","volume":"7","author":"N Mehandru","year":"2024","unstructured":"Mehandru N, Miao BY, Almaraz ER, Sushil M, Butte AJ, Alaa A. Evaluating large language models as agents in the clinic. NPJ Digital Med. 2024;7(1):84.","journal-title":"NPJ Digital Med"},{"issue":"1","key":"403_CR23","doi-asserted-by":"publisher","first-page":"17","DOI":"10.1186\/s41235-023-00472-3","volume":"8","author":"S Sheldon","year":"2023","unstructured":"Sheldon S, Fan C, Uner I, Young M. Learning strategy impacts medical diagnostic reasoning in early learners. Cognitive Res Princ Implic. 2023;8(1):17.","journal-title":"Cognitive Res Princ Implic"},{"issue":"1","key":"403_CR24","doi-asserted-by":"publisher","first-page":"117","DOI":"10.1186\/s12911-025-02954-4","volume":"25","author":"S Shool","year":"2025","unstructured":"Shool S, Adimi S, Amleshi RS, Bitaraf E, Golpira R, Tara M. A systematic review of large language model (llm) evaluations in clinical medicine. BMC Med Inform Decis Mak. 2025;25(1):117.","journal-title":"BMC Med Inform Decis Mak"},{"issue":"8","key":"403_CR25","doi-asserted-by":"publisher","first-page":"1930","DOI":"10.1038\/s41591-023-02448-8","volume":"29","author":"AJ Thirunavukarasu","year":"2023","unstructured":"Thirunavukarasu AJ, Ting DSJ, Elangovan K, Gutierrez L, Tan TF, Ting DSW. Large language models in medicine. Nat Med. 2023;29(8):1930\u201340.","journal-title":"Nat Med"},{"key":"403_CR26","doi-asserted-by":"crossref","unstructured":"Nazi ZA, Peng W. Large language models in healthcare and medical domain: A review. In: Informatics, vol 11, pp \u00a057. MDPI, 2024.","DOI":"10.3390\/informatics11030057"},{"key":"403_CR27","doi-asserted-by":"crossref","unstructured":"Moher D, Liberati A, Tetzlaff J, Altman DG. Preferred reporting items for systematic reviews and meta-analyses: the prisma statement. Bmj, 339, 2009.","DOI":"10.1136\/bmj.b2535"},{"key":"403_CR28","doi-asserted-by":"crossref","unstructured":"Page MJ, Moher D, Bossuyt PM, Boutron I, Hoffmann TC, Mulrow CD, Shamseer L, Tetzlaff JM, Akl EA, Brennan SE, et\u00a0al. Prisma 2020 explanation and elaboration: updated guidance and exemplars for reporting systematic reviews. bmj, 372, 2021.","DOI":"10.1136\/bmj.n160"},{"key":"403_CR29","first-page":"22199","volume":"35","author":"T Kojima","year":"2022","unstructured":"Kojima T, Gu SS, Reid M, Matsuo Y, Iwasawa Y. Large language models are zero-shot reasoners. Adv Neural Inf Process Syst. 2022;35:22199\u2013213.","journal-title":"Adv Neural Inf Process Syst"},{"key":"403_CR30","doi-asserted-by":"crossref","unstructured":"Hussain M, Ur Rehman U, Nguyen TDT, Lee S, Kim ST, Bae S-H, Kim JU. Chain-of-factors: A zero-shot prompting methodology enabling factor-centric reasoning in large language models. In: 2024 International Conference on Machine Learning and Applications (ICMLA), pp. 1621\u20131627. IEEE, 2024.","DOI":"10.1109\/ICMLA61862.2024.00250"},{"issue":"7","key":"403_CR31","doi-asserted-by":"publisher","first-page":"3580","DOI":"10.1109\/TKDE.2024.3352100","volume":"36","author":"S Pan","year":"2024","unstructured":"Pan S, Luo L, Wang Y, Chen C, Wang J, Wu X. Unifying large language models and knowledge graphs: A roadmap. IEEE Trans Knowl Data Eng. 2024;36(7):3580\u201399.","journal-title":"IEEE Trans Knowl Data Eng"},{"key":"403_CR32","unstructured":"Lambert N, Morrison J, Pyatkin V, Huang S, Ivison H, Brahman F, Miranda LJV, Liu A, Dziri N, Lyu S, et\u00a0al. Tulu 3: Pushing frontiers in open language model post-training. arXiv preprint arXiv:2411.15124, 2024."},{"key":"403_CR33","unstructured":"Guo D, Yang D, Zhang H, Song J, Zhang R, Xu R, Zhu Q, Ma S, Wang P, Bi X, et\u00a0al. Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning. arXiv preprint arXiv:2501.12948, 2025."},{"key":"403_CR34","doi-asserted-by":"crossref","unstructured":"Li Z, Jin X, Guan S, Wang Y, Cheng X. Path reasoning over knowledge graph: A multi-agent and reinforcement learning based method. In: 2018 IEEE International conference on data mining workshops (ICDMW), pp 929\u2013936. IEEE, 2018.","DOI":"10.1109\/ICDMW.2018.00135"},{"key":"403_CR35","unstructured":"Gu Y, Dong L, Wei F, Huang M. Minillm: Knowledge distillation of large language models. arXiv preprint arXiv:2306.08543, 2023."},{"key":"403_CR36","doi-asserted-by":"publisher","unstructured":"Vedula KS, Gupta A, Swaminathan A, L\u00f3pez I, Bedi S, Shah NH. Distilling large language models for efficient clinical information extraction. CoRR, arXiv:2501.00031, 2025. https:\/\/doi.org\/10.48550\/ARXIV.2501.00031.","DOI":"10.48550\/ARXIV.2501.00031"},{"issue":"6","key":"403_CR37","doi-asserted-by":"publisher","first-page":"60","DOI":"10.1109\/MPUL.2011.942929","volume":"2","author":"F Ritter","year":"2011","unstructured":"Ritter F, Boskamp T, Homeyer A, Laue H, Schwier M, Link F, et al. Medical image analysis. IEEE pulse. 2011;2(6):60\u201370.","journal-title":"IEEE pulse"},{"key":"403_CR38","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2024.103279","volume":"97","author":"X Hu","year":"2024","unstructured":"Hu X, Gu L, Kobayashi K, Liu L, Zhang M, Harada T, et al. Interpretable medical image visual question answering via multi-modal relationship graph learning. Med Image Anal. 2024;97:103279.","journal-title":"Med Image Anal"},{"key":"403_CR39","doi-asserted-by":"publisher","first-page":"4773","DOI":"10.1109\/TNSRE.2023.3337533","volume":"31","author":"C-C Fan","year":"2023","unstructured":"Fan C-C, Yang H, Zhang C, Peng L, Zhou X, Liu S, et al. Graph reasoning module for alzheimer\u2019s disease diagnosis: A plug-and-play method. IEEE Trans Neural Syst Rehabil Eng. 2023;31:4773\u201380.","journal-title":"IEEE Trans Neural Syst Rehabil Eng"},{"issue":"1","key":"403_CR40","doi-asserted-by":"publisher","first-page":"60","DOI":"10.1186\/s41747-024-00457-x","volume":"8","author":"S Rau","year":"2024","unstructured":"Rau S, Rau A, Nattenm\u00fcller J, Fink A, Bamberg F, Reisert M, et al. A retrieval-augmented chatbot based on gpt-4 provides appropriate differential diagnosis in gastrointestinal radiology: a proof of concept study. Eur Radiol Exp. 2024;8(1):60.","journal-title":"Eur Radiol Exp"},{"key":"403_CR41","first-page":"9459","volume":"33","author":"P Lewis","year":"2020","unstructured":"Lewis P, Perez E, Piktus A, Petroni F, Karpukhin V, Goyal N, et al. Retrieval-augmented generation for knowledge-intensive nlp tasks. Adv Neural Inf Process Syst. 2020;33:9459\u201374.","journal-title":"Adv Neural Inf Process Syst"},{"issue":"2","key":"403_CR42","doi-asserted-by":"publisher","first-page":"412","DOI":"10.1177\/08465371231218250","volume":"75","author":"JL Gamble","year":"2024","unstructured":"Gamble JL, Ferguson D, Yuen J, Sheikh A. Limitations of gpt-3.5 and gpt-4 in applying fleischner society guidelines to incidental lung nodules. Canadian Assoc Radiologists J. 2024;75(2):412\u20136.","journal-title":"Canadian Assoc Radiologists J"},{"key":"403_CR43","doi-asserted-by":"crossref","unstructured":"Gu Z, Liu F, Chen J, Yin C, Zhang P. A proactive agent collaborative framework for zero-shot multimodal medical reasoning. Adv Intell Syst, 2025;2400840.","DOI":"10.1002\/aisy.202400840"},{"key":"403_CR44","doi-asserted-by":"crossref","unstructured":"Seyfioglu MS, Ikezogwo WO, Ghezloo F, Krishna R, Shapiro L. Quilt-llava: Visual instruction tuning by extracting localized narratives from open-source histopathology videos. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2024;13183\u201313192.","DOI":"10.1109\/CVPR52733.2024.01252"},{"issue":"12","key":"403_CR45","doi-asserted-by":"publisher","first-page":"2273","DOI":"10.3390\/electronics13122273","volume":"13","author":"J Wang","year":"2024","unstructured":"Wang J, Seng KP, Shen Y, Ang L-M, Huang D. Image to label to answer: An efficient framework for enhanced clinical applications in medical visual question answering. Electronics. 2024;13(12):2273.","journal-title":"Electronics"},{"key":"403_CR46","doi-asserted-by":"crossref","unstructured":"Kanemaru N, Yasaka K, Okimoto N, Sato M, Nomura T, Morita Y, Katayama A, Kiryu S, Abe O. Efficacy of fine-tuned large language model in ct protocol assignment as clinical decision-supporting system. J Imag Inf Med, 2025;1\u201313,","DOI":"10.1007\/s10278-025-01433-6"},{"issue":"1","key":"403_CR47","doi-asserted-by":"publisher","first-page":"40","DOI":"10.1186\/s12911-024-02444-z","volume":"24","author":"S Talebi","year":"2024","unstructured":"Talebi S, Tong E, Li A, Yamin G, Zaharchuk G, Mofrad MRK. Exploring the performance and explainability of fine-tuned bert models for neuroradiology protocol assignment. BMC Med Inform Decis Mak. 2024;24(1):40.","journal-title":"BMC Med Inform Decis Mak"},{"key":"403_CR48","doi-asserted-by":"crossref","unstructured":"Kandi V, Vadakedath S. Clinical trials and clinical research: a comprehensive review. Cureus, 2023;15(2).","DOI":"10.7759\/cureus.35077"},{"key":"403_CR49","doi-asserted-by":"crossref","unstructured":"Sun Z, Yan D, Wang A, Agustoslu T, Feng Q, Hu C, Zuo L, Zhou S, Kleiner H, Hong P. Lmu-bionlp at semeval-2024 task 2: Large diverse ensembles for robust clinical nli. In: Proceedings of the 18th International Workshop on Semantic Evaluation (SemEval-2024), 2024;1577\u20131583 .","DOI":"10.18653\/v1\/2024.semeval-1.224"},{"key":"403_CR50","doi-asserted-by":"publisher","unstructured":"Mandal S, Modi A. IITK at SemEval-2024 task 2: Exploring the capabilities of LLMs for safe biomedical natural language inference for clinical trials. In Atul\u00a0Kr. Ojha, A.\u00a0Seza Do\u011fru\u00f6z, Harish Tayyar\u00a0Madabushi, Giovanni Da\u00a0San\u00a0Martino, Sara Rosenthal, and Aiala Ros\u00e1, editors, Proceedings of the 18th International Workshop on Semantic Evaluation (SemEval-2024), pages 1397\u20131404, Mexico City, Mexico, June 2024. Association for Computational Linguistics. https:\/\/doi.org\/10.18653\/v1\/2024.semeval-1.201. URL https:\/\/aclanthology.org\/2024.semeval-1.201\/.","DOI":"10.18653\/v1\/2024.semeval-1.201"},{"key":"403_CR51","doi-asserted-by":"crossref","unstructured":"Fahfouh A, Benlahbib A, Riffi J, Tairi H. Usmba-nlp at semeval-2024 task 2: Safe biomedical natural language inference for clinical trials using bert. In: Proceedings of the 18th International Workshop on Semantic Evaluation (SemEval-2024), 2024;432\u2013436.","DOI":"10.18653\/v1\/2024.semeval-1.66"},{"key":"403_CR52","unstructured":"Nutan P, Patel D. Drug discovery. 2011."},{"issue":"6","key":"403_CR53","doi-asserted-by":"publisher","first-page":"1648","DOI":"10.1093\/bioinformatics\/btac001","volume":"38","author":"H Balabin","year":"2022","unstructured":"Balabin H, Hoyt CT, Birkenbihl C, Gyori BM, Bachman J, Kodamullil AT, et al. Stonkgs: a sophisticated transformer trained on biomedical text and knowledge graphs. Bioinformatics. 2022;38(6):1648\u201356.","journal-title":"Bioinformatics"},{"issue":"6","key":"403_CR54","doi-asserted-by":"publisher","first-page":"1574","DOI":"10.1038\/s41591-024-02933-8","volume":"30","author":"C Pais","year":"2024","unstructured":"Pais C, Liu J, Voigt R, Gupta V, Wade E, Bayati M. Large language models for preventing medication direction errors in online pharmacies. Nat Med. 2024;30(6):1574\u201382.","journal-title":"Nat Med"},{"key":"403_CR55","doi-asserted-by":"crossref","unstructured":"Xu T, Li B. Kellm: Knowledge-enhanced label-wise large language model for safe and interpretable drug recommendation. Electronics (2079-9292), 2025;14(1).","DOI":"10.3390\/electronics14010154"},{"key":"403_CR56","doi-asserted-by":"publisher","first-page":"1389475","DOI":"10.3389\/fncom.2024.1389475","volume":"18","author":"T Xu","year":"2024","unstructured":"Xu T, Gu Y, Xue M, Gu R, Li B, Gu X. Knowledge graph construction for heart failure using large language models with prompt engineering. Front Comput Neurosci. 2024;18:1389475.","journal-title":"Front Comput Neurosci"},{"key":"403_CR57","doi-asserted-by":"publisher","first-page":"giae082","DOI":"10.1093\/gigascience\/giae082","volume":"14","author":"Y Feng","year":"2025","unstructured":"Feng Y, Zhou L, Ma C, Zheng Y, He R, Li Y. Knowledge graph-based thought: a knowledge graph-enhanced llm framework for pan-cancer question answering. GigaScience. 2025;14:giae082.","journal-title":"GigaScience"},{"key":"403_CR58","doi-asserted-by":"crossref","unstructured":"Gu Y, Xu Z, Yang C. Empowering graph neural network-based computational drug repositioning with large language model-inferred knowledge representation. Interdisciplinary Sciences: Computational Life Sciences, pp 1\u201318, 2024.","DOI":"10.1007\/s12539-024-00654-7"},{"key":"403_CR59","doi-asserted-by":"crossref","unstructured":"Lin C, Kuo C-F. Roles and potential of large language models in healthcare: a comprehensive review. Biomedical J, pp 100868, 2025.","DOI":"10.1016\/j.bj.2025.100868"},{"issue":"02","key":"403_CR60","doi-asserted-by":"publisher","first-page":"130","DOI":"10.1097\/CM9.0000000000003456","volume":"138","author":"X Yang","year":"2025","unstructured":"Yang X, Li T, Su Q, Liu Y, Kang C, Lyu Y, et al. Application of large language models in disease diagnosis and treatment. Chin Med J. 2025;138(02):130\u201342.","journal-title":"Chin Med J"},{"key":"403_CR61","doi-asserted-by":"crossref","unstructured":"Han G, Liu W, Huang X, Borsari B. Chain-of-interaction: Enhancing large language models for psychiatric behavior understanding by dyadic contexts. In: 2024 IEEE 12th International Conference on Healthcare Informatics (ICHI), 2024;392\u2013401. IEEE.","DOI":"10.1109\/ICHI61247.2024.00057"},{"issue":"8","key":"403_CR62","doi-asserted-by":"publisher","first-page":"1665","DOI":"10.1093\/jamia\/ocae142","volume":"31","author":"S Liu","year":"2024","unstructured":"Liu S, Wright AP, Mccoy AB, Huang SS, Genkins JZ, Peterson JF, et al. Using large language model to guide patients to create efficient and comprehensive clinical care message. J Am Med Inform Assoc. 2024;31(8):1665\u201370.","journal-title":"J Am Med Inform Assoc"},{"issue":"6","key":"403_CR63","doi-asserted-by":"publisher","first-page":"1367","DOI":"10.1093\/jamia\/ocae052","volume":"31","author":"S Liu","year":"2024","unstructured":"Liu S, McCoy AB, Wright AP, Carew B, Genkins JZ, Huang SS, et al. Leveraging large language models for generating responses to patient messages\u2013a subjective analysis. J Am Med Inform Assoc. 2024;31(6):1367\u201379.","journal-title":"J Am Med Inform Assoc"},{"key":"403_CR64","doi-asserted-by":"publisher","DOI":"10.2196\/55939","volume":"26","author":"D Gibson","year":"2024","unstructured":"Gibson D, Jackson S, Shanmugasundaram R, Seth I, Siu A, Ahmadi N, et al. Evaluating the efficacy of chatgpt as a patient education tool in prostate cancer: multimetric assessment. J Med Internet Res. 2024;26:e55939.","journal-title":"J Med Internet Res"},{"issue":"3","key":"403_CR65","doi-asserted-by":"publisher","first-page":"535","DOI":"10.1093\/jamia\/ocaf006","volume":"32","author":"MS Farmer","year":"2025","unstructured":"Farmer MS, Popescu M, Powell K. Development and evaluation of a 4m taxonomy from nursing home staff text messages using a fine-tuned generative language model. J Am Med Inform Assoc. 2025;32(3):535\u201344.","journal-title":"J Am Med Inform Assoc"},{"issue":"3","key":"403_CR66","doi-asserted-by":"publisher","first-page":"238","DOI":"10.1080\/10903127.2025.2460775","volume":"29","author":"ED Miller","year":"2025","unstructured":"Miller ED, Franc JM, Hertelendy AJ, Issa F, Hart A, Woodward CA, et al. Accuracy of commercial large language model (chatgpt) to predict the diagnosis for prehospital patients suitable for ambulance transport decisions: diagnostic accuracy study. Prehosp Emerg Care. 2025;29(3):238\u201342.","journal-title":"Prehosp Emerg Care"},{"issue":"9","key":"403_CR67","doi-asserted-by":"publisher","first-page":"1921","DOI":"10.1093\/jamia\/ocae103","volume":"31","author":"BS Glicksberg","year":"2024","unstructured":"Glicksberg BS, Timsina P, Patel D, Sawant A, Vaid A, Raut G, et al. Evaluating the accuracy of a state-of-the-art large language model for prediction of admissions from the emergency room. J Am Med Inform Assoc. 2024;31(9):1921\u20138.","journal-title":"J Am Med Inform Assoc"},{"key":"403_CR68","doi-asserted-by":"publisher","DOI":"10.1016\/j.cogsys.2023.101186","volume":"84","author":"A Malhotra","year":"2024","unstructured":"Malhotra A, Jindal R. Xai transformer based approach for interpreting depressed and suicidal user behavior on online social networks. Cognitive Syst Res. 2024;84:101186. https:\/\/doi.org\/10.1016\/j.cogsys.2023.101186. (ISSN 1389-0417).","journal-title":"Cognitive Syst Res"},{"issue":"1","key":"403_CR69","doi-asserted-by":"publisher","DOI":"10.2196\/57001","volume":"13","author":"A Wang","year":"2024","unstructured":"Wang A, Wu Y, Ji X, Wang X, Hu J, Zhang F, et al. Assessing and optimizing large language models on spondyloarthritis multi-choice question answering: protocol for enhancement and assessment. JMIR Research Protocols. 2024;13(1):e57001.","journal-title":"JMIR Research Protocols"},{"issue":"1","key":"403_CR70","doi-asserted-by":"publisher","first-page":"14156","DOI":"10.1038\/s41598-024-64827-6","volume":"14","author":"J Maharjan","year":"2024","unstructured":"Maharjan J, Garikipati A, Singh NP, Cyrus L, Sharma M, Ciobanu M, et al. Openmedlm: prompt engineering can out-perform fine-tuning in medical question-answering with open-source large language models. Sci Rep. 2024;14(1):14156.","journal-title":"Sci Rep"},{"key":"403_CR71","doi-asserted-by":"crossref","unstructured":"Li\u00e9vin V, Hother CE, Motzfeldt AG, Winther O. Can large language models reason about medical questions? Patterns, 2024;5(3).","DOI":"10.1016\/j.patter.2024.100943"},{"key":"403_CR72","doi-asserted-by":"publisher","first-page":"1616145","DOI":"10.3389\/frai.2025.1616145","volume":"8","author":"B Mo\u00ebll","year":"2025","unstructured":"Mo\u00ebll B, Aronsson FS, Akbar S. Medical reasoning in llms: an in-depth analysis of deepseek r1. Front Artif Intell. 2025;8:1616145.","journal-title":"Front Artif Intell"},{"key":"403_CR73","doi-asserted-by":"publisher","DOI":"10.7717\/peerj-cs.1999","volume":"10","author":"K Hebenstreit","year":"2024","unstructured":"Hebenstreit K, Praas R, Kiesewetter LP, Samwald M. A comparison of chain-of-thought reasoning strategies across datasets and models. PeerJ Comput Sci. 2024;10:e1999.","journal-title":"PeerJ Comput Sci"},{"issue":"9","key":"403_CR74","doi-asserted-by":"publisher","first-page":"1964","DOI":"10.1093\/jamia\/ocae131","volume":"31","author":"MM Lucas","year":"2024","unstructured":"Lucas MM, Yang J, Pomeroy JK, Yang CC. Reasoning with large language models for medical question answering. J Am Med Inform Assoc. 2024;31(9):1964\u201375.","journal-title":"J Am Med Inform Assoc"},{"issue":"4","key":"403_CR75","first-page":"586","volume":"43","author":"Y Sonoda","year":"2025","unstructured":"Sonoda Y, Kurokawa R, Hagiwara A, Asari Y, Fukushima T, Kanzawa J, et al. Structured clinical reasoning prompt enhances llm\u2019s diagnostic capabilities in diagnosis please quiz cases. Jpn J Radiol. 2025;43(4):586\u201392.","journal-title":"Jpn J Radiol"},{"issue":"6","key":"403_CR76","doi-asserted-by":"publisher","first-page":"603","DOI":"10.3390\/healthcare13060603","volume":"13","author":"J Vrdoljak","year":"2025","unstructured":"Vrdoljak J, Boban Z, Vilovi\u0107 M, Kumri\u0107 M, Bo\u017ei\u0107 J. A review of large language models in medical education, clinical decision support, and healthcare administration. Healthcare. 2025;13(6):603. https:\/\/doi.org\/10.3390\/healthcare13060603. (ISSN 2227-9032).","journal-title":"Healthcare"},{"key":"403_CR77","doi-asserted-by":"publisher","unstructured":"Wu J, Wu X, Yang J. Guiding clinical reasoning with large language models via knowledge seeds. In: Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence, IJCAI \u201924, 2024. ISBN 978-1-956792-04-1. https:\/\/doi.org\/10.24963\/ijcai.2024\/829.","DOI":"10.24963\/ijcai.2024\/829"},{"issue":"3","key":"403_CR78","doi-asserted-by":"publisher","first-page":"943","DOI":"10.1038\/s41591-024-03423-7","volume":"31","author":"K Singhal","year":"2025","unstructured":"Singhal K, Tu T, Gottweis J, Sayres R, Wulczyn E, Amin M, et al. Toward expert-level medical question answering with large language models. Nat Med. 2025;31(3):943\u201350.","journal-title":"Nat Med"},{"key":"403_CR79","doi-asserted-by":"publisher","DOI":"10.1016\/j.knosys.2024.112837","volume":"309","author":"Z Zeng","year":"2025","unstructured":"Zeng Z, Cheng Q, Hu X, Zhuang Y, Liu X, He K, et al. Kosel: Knowledge subgraph enhanced large language model for medical question answering. Knowledge-Based Syst. 2025;309:112837. https:\/\/doi.org\/10.1016\/j.knosys.2024.112837. (ISSN 0950-7051).","journal-title":"Knowledge-Based Syst"},{"issue":"3","key":"403_CR80","doi-asserted-by":"publisher","first-page":"932","DOI":"10.1038\/s41591-024-03416-6","volume":"31","author":"X Liu","year":"2025","unstructured":"Liu X, Liu H, Yang G, Jiang Z, Cui S, Zhang Z, et al. A generalist medical language model for disease diagnosis assistance. Nat Med. 2025;31(3):932\u201342.","journal-title":"Nat Med"},{"issue":"3","key":"403_CR81","first-page":"e200293","volume":"14","author":"J-H Lee","year":"2024","unstructured":"Lee J-H, Choi E, McDougal R, Lytton WW. Gpt-4 performance for neurologic localization. Neurology: Clinical Practice. 2024;14(3):e200293.","journal-title":"Neurology: Clinical Practice"},{"key":"403_CR82","doi-asserted-by":"crossref","unstructured":"Oniani D, Wu X, Visweswaran S, Kapoor S, Kooragayalu S, Polanska K, Wang Y. Enhancing large language models for clinical decision support by incorporating clinical practice guidelines. In: 2024 IEEE 12th International Conference on Healthcare Informatics (ICHI), 2024;pp 694\u2013702. IEEE.","DOI":"10.1109\/ICHI61247.2024.00111"},{"key":"403_CR83","doi-asserted-by":"crossref","unstructured":"Yuan L-H, Huang S-W, Chou D, Tsai C-Y. The in-depth comparative analysis of four large language ai models for risk assessment and information retrieval from multi-modality prostate cancer work-up reports. World J Men\u2019s Health, 42, 2024.","DOI":"10.5534\/wjmh.240173"},{"issue":"5","key":"403_CR84","doi-asserted-by":"publisher","first-page":"4087","DOI":"10.1007\/s10115-025-02338-0","volume":"67","author":"B Azad","year":"2025","unstructured":"Azad B, Alavi MAA, Jafarzadeh P, Ensan F, Androutsos D. Unlocking wisdom: enhancing biomedical question answering with domain knowledge. Knowl Inf Syst. 2025;67(5):4087\u2013112.","journal-title":"Knowl Inf Syst"},{"issue":"1","key":"403_CR85","doi-asserted-by":"publisher","first-page":"102","DOI":"10.1038\/s41746-024-01091-y","volume":"7","author":"S Kresevic","year":"2024","unstructured":"Kresevic S, Giuffr\u00e8 M, Ajcevic M, Accardo A, Croc\u00e8 LS, Shung DL. Optimization of hepatological clinical guidelines interpretation by large language models: a retrieval augmented generation-based framework. NPJ Digital Med. 2024;7(1):102.","journal-title":"NPJ Digital Med"},{"issue":"1","key":"403_CR86","doi-asserted-by":"publisher","first-page":"2050","DOI":"10.1038\/s41467-024-46411-8","volume":"15","author":"S Sandmann","year":"2024","unstructured":"Sandmann S, Riepenhausen S, Plagwitz L, Varghese J. Systematic analysis of chatgpt, google search and llama 2 for clinical decision support tasks. Nat Commun. 2024;15(1):2050.","journal-title":"Nat Commun"},{"issue":"04","key":"403_CR87","doi-asserted-by":"publisher","first-page":"653","DOI":"10.1055\/s-0044-1787974","volume":"34","author":"PK Sarangi","year":"2024","unstructured":"Sarangi PK, Datta S, Swarup MS, Panda S, Nayak DSK, Malik A, et al. Radiologic decision-making for imaging in pulmonary embolism: accuracy and reliability of large language models\u2013bing, claude, chatgpt, and perplexity. Indian J Radiology Imag. 2024;34(04):653\u201360.","journal-title":"Indian J Radiology Imag"},{"key":"403_CR88","doi-asserted-by":"publisher","DOI":"10.3389\/fnbot.2022.773329","volume":"16","author":"X Zhu","year":"2022","unstructured":"Zhu X, Chen Y, Gu Y, Xiao Z. Sentimedqaer: a transfer learning-based sentiment-aware model for biomedical question answering. Front Neurorobot. 2022;16:773329.","journal-title":"Front Neurorobot"},{"issue":"12","key":"403_CR89","doi-asserted-by":"publisher","first-page":"3041","DOI":"10.1007\/s00296-024-05731-0","volume":"44","author":"A Borg","year":"2024","unstructured":"Borg A, Jobs B, Huss V, Gentline C, Espinosa F, Ruiz M, et al. Enhancing clinical reasoning skills for medical students: a qualitative comparison of llm-powered social robotic versus computer-based virtual patients within rheumatology. Rheumatol Int. 2024;44(12):3041\u201351.","journal-title":"Rheumatol Int"},{"key":"403_CR90","doi-asserted-by":"publisher","DOI":"10.1016\/j.artmed.2024.102938","volume":"155","author":"I Alonso","year":"2024","unstructured":"Alonso I, Oronoz M, Agerri R. Medexpqa: Multilingual benchmarking of large language models for medical question answering. Artificial Intell Med. 2024;155:102938. https:\/\/doi.org\/10.1016\/j.artmed.2024.102938. (ISSN 0933-3657).","journal-title":"Artificial Intell Med"},{"key":"403_CR91","doi-asserted-by":"crossref","unstructured":"Labrak Y, Bazoge A, Morin E, Gourraud P-A, Rouvier M, Dufour R. Biomistral: A collection of open-source pretrained large language models for medical domains. arXiv preprint arXiv:2402.10373, (2024).","DOI":"10.18653\/v1\/2024.findings-acl.348"},{"issue":"1","key":"403_CR92","doi-asserted-by":"publisher","first-page":"ooaf005","DOI":"10.1093\/jamiaopen\/ooaf005","volume":"8","author":"Y Li","year":"2025","unstructured":"Li Y, Li J, Li M, Yu E, Rhee D, Amith M, et al. Vaxbot-hpv: a gpt-based chatbot for answering hpv vaccine-related questions. JAMIA open. 2025;8(1):ooaf005.","journal-title":"JAMIA open"},{"issue":"1","key":"403_CR93","doi-asserted-by":"publisher","first-page":"3280","DOI":"10.1038\/s41467-025-56989-2","volume":"16","author":"Q Chen","year":"2025","unstructured":"Chen Q, Hu Y, Peng X, Xie Q, Jin Q, Gilson A, et al. Benchmarking large language models for biomedical natural language processing applications and recommendations. Nat Commun. 2025;16(1):3280.","journal-title":"Nat Commun"},{"issue":"2","key":"403_CR94","doi-asserted-by":"publisher","first-page":"2302","DOI":"10.54364\/AAIML.2024.42133","volume":"4","author":"MP Ranjit","year":"2024","unstructured":"Ranjit MP, Ganapathy G, Srivastav S, Oruganti S, Ganu T. Rad-phi2: Instruction tuning phi2 for radiology. Adv Artif Intell Mach Learn. 2024;4(2):2302\u201323. https:\/\/doi.org\/10.54364\/AAIML.2024.42133.","journal-title":"Adv Artif Intell Mach Learn"},{"issue":"4","key":"403_CR95","doi-asserted-by":"publisher","first-page":"btae163","DOI":"10.1093\/bioinformatics\/btae163","volume":"40","author":"VK Keloth","year":"2024","unstructured":"Keloth VK, Hu Y, Xie Q, Peng X, Wang Y, Zheng A, et al. Advancing entity recognition in biomedicine via instruction tuning of large language models. Bioinformatics. 2024;40(4):btae163.","journal-title":"Bioinformatics"},{"issue":"4","key":"403_CR96","doi-asserted-by":"publisher","first-page":"940","DOI":"10.1093\/jamia\/ocad256","volume":"31","author":"S Chen","year":"2024","unstructured":"Chen S, Li Y, Lu S, Van H, Aerts HJWL, Savova GK, et al. Evaluating the chatgpt family of models for biomedical reasoning and classification. J Am Med Inform Assoc. 2024;31(4):940\u20138.","journal-title":"J Am Med Inform Assoc"},{"key":"403_CR97","doi-asserted-by":"crossref","unstructured":"Ji Y, Yu Z, Wang Y. Assertion detection in clinical natural language processing using large language models. In: 2024 IEEE 12th International Conference on Healthcare Informatics (ICHI), pp. 242\u2013247. IEEE, 2024.","DOI":"10.1109\/ICHI61247.2024.00039"},{"issue":"9","key":"403_CR98","doi-asserted-by":"publisher","first-page":"1929","DOI":"10.1093\/jamia\/ocae095","volume":"31","author":"M Li","year":"2024","unstructured":"Li M, Zhou H, Yang H, Zhang R. Rt: a retrieving and chain-of-thought framework for few-shot medical named entity recognition. J Am Med Inform Assoc. 2024;31(9):1929\u201338.","journal-title":"J Am Med Inform Assoc"},{"key":"403_CR99","doi-asserted-by":"crossref","unstructured":"Yasunaga M, Leskovec J, Liang P. Linkbert: Pretraining language models with document links. arXiv preprint arXiv:2203.15827, 2022.","DOI":"10.18653\/v1\/2022.acl-long.551"},{"key":"403_CR100","doi-asserted-by":"publisher","first-page":"141036","DOI":"10.1109\/ACCESS.2023.3341612","volume":"11","author":"E Kim","year":"2023","unstructured":"Kim E, Jeong Y, Choi M-S. Medibiodeberta: Biomedical language model with continuous learning and intermediate fine-tuning. IEEE Access. 2023;11:141036\u201344.","journal-title":"IEEE Access"},{"issue":"1","key":"403_CR101","first-page":"1","volume":"3","author":"Y Gu","year":"2021","unstructured":"Gu Y, Tinn R, Cheng H, Lucas M, Usuyama N, Liu X, et al. Domain-specific language model pretraining for biomedical natural language processing. ACM Trans Comput Healthcare (HEALTH). 2021;3(1):1\u201323.","journal-title":"ACM Trans Comput Healthcare (HEALTH)"},{"key":"403_CR102","doi-asserted-by":"publisher","first-page":"1001266","DOI":"10.3389\/frma.2022.1001266","volume":"7","author":"AL Olex","year":"2022","unstructured":"Olex AL, McInnes BT. Temporal disambiguation of relative temporal expressions in clinical texts. Front Res Metr Anal. 2022;7:1001266.","journal-title":"Front Res Metr Anal"},{"key":"403_CR103","doi-asserted-by":"crossref","unstructured":"Cengiz C, Sert U, Yuret D. Ku_ai at mediqa 2019: Domain-specific pre-training and transfer learning for medical nli. In: Proceedings of the 18th BioNLP Workshop and Shared Task, 2019;427\u2013436.","DOI":"10.18653\/v1\/W19-5045"},{"key":"403_CR104","doi-asserted-by":"crossref","unstructured":"Zargarzadeh S, Mirzaei M, Ou Y, Tavakoli M. From decision to action in surgical autonomy: Multi-modal large language models for robot-assisted blood suction. IEEE IEEE Robot Autom Lett, 2025.","DOI":"10.1109\/LRA.2025.3535184"},{"issue":"10","key":"403_CR105","doi-asserted-by":"publisher","first-page":"btae589","DOI":"10.1093\/bioinformatics\/btae589","volume":"40","author":"P Chen","year":"2024","unstructured":"Chen P, Wang J, Luo L, Lin H, Yang Z. Learning to explain is a good biomedical few-shot learner. Bioinformatics. 2024;40(10):btae589.","journal-title":"Bioinformatics"},{"issue":"1","key":"403_CR106","doi-asserted-by":"publisher","first-page":"e57319","DOI":"10.2196\/57319","volume":"4","author":"J Nielsen","year":"2025","unstructured":"Nielsen J, Chen X, La Davis S, Waterman A, Gentili M, et al. Investigating the classification of living kidney donation experiences on reddit and understanding the sensitivity of chatgpt to prompt engineering: Content analysis. JMIR AI. 2025;4(1):e57319.","journal-title":"JMIR AI"},{"issue":"10","key":"403_CR107","doi-asserted-by":"publisher","first-page":"1398","DOI":"10.1136\/bjo-2023-325053","volume":"108","author":"D Milad","year":"2024","unstructured":"Milad D, Antaki F, Milad J, Farah A, Khairy T, Mikhail D, et al. Assessing the medical reasoning skills of gpt-4 in complex ophthalmology cases. Br J Ophthalmol. 2024;108(10):1398\u2013405.","journal-title":"Br J Ophthalmol"},{"issue":"9","key":"403_CR108","doi-asserted-by":"publisher","first-page":"2019","DOI":"10.1093\/jamia\/ocae087","volume":"31","author":"R Hua","year":"2024","unstructured":"Hua R, Dong X, Wei Y, Shu Z, Yang P, Hu Y, et al. Lingdan: enhancing encoding of traditional chinese medicine knowledge for clinical reasoning tasks with large language models. J Am Med Inform Assoc. 2024;31(9):2019\u201329. https:\/\/doi.org\/10.1093\/jamia\/ocae087.","journal-title":"J Am Med Inform Assoc"},{"issue":"11","key":"403_CR109","doi-asserted-by":"publisher","first-page":"2622","DOI":"10.1093\/jamia\/ocae233","volume":"31","author":"Y Li","year":"2024","unstructured":"Li Y, Peng X, Li J, Zuo X, Peng S, Pei D, et al. Relation extraction using large language models: a case study on acupuncture point locations. J Am Med Inf Assoc. 2024;31(11):2622\u201331. https:\/\/doi.org\/10.1093\/jamia\/ocae233. (ISSN 1527-974X).","journal-title":"J Am Med Inf Assoc"},{"key":"403_CR110","unstructured":"Medqa \u2013 awesome medical dataset. https:\/\/github.com\/openmedlab\/Awesome-Medical-Dataset\/blob\/main\/resources\/MedQA.md, 2024. GitHub."},{"key":"403_CR111","unstructured":"Pubmedqa: A dataset for biomedical research question answering. https:\/\/pubmedqa.github.io\/, 2019."},{"key":"403_CR112","unstructured":"Mimic-cxr database (version 2.1.0). https:\/\/physionet.org\/content\/mimic-cxr\/2.1.0\/, 2024a. PhysioNet."},{"key":"403_CR113","unstructured":"Medqa \u2013 awesome medical dataset. https:\/\/github.com\/openmedlab\/Awesome-Medical-Dataset\/blob\/main\/resources\/MedQA.md, 2024a. GitHub."},{"key":"403_CR114","unstructured":"Mmlu: Measuring massive multitask language understanding. https:\/\/huggingface.co\/datasets\/cais\/mmlu, 2024. Hugging Face."},{"key":"403_CR115","unstructured":"Healthsearchqa dataset. https:\/\/huggingface.co\/datasets\/katielink\/healthsearchqa, 2024. Hugging Face."},{"key":"403_CR116","unstructured":"Mimic-iii dataset. https:\/\/paperswithcode.com\/dataset\/mimic-iii, 2024b. Papers With Code."},{"key":"403_CR117","unstructured":"Nli4ct dataset. https:\/\/paperswithcode.com\/dataset\/nli4ct, 2024. Papers With Code."},{"key":"403_CR118","unstructured":"Quilt-instruct: A vqa dataset for pathology. https:\/\/github.com\/openmedlab\/Awesome-Medical-Dataset\/blob\/main\/resources\/Quilt-Instruct.md, 2024. GitHub."},{"key":"403_CR119","unstructured":"2010 i2b2\/va nlp clinical challenge dataset. https:\/\/paperswithcode.com\/dataset\/2010-i2b2-va, 2024. Papers With Code."},{"key":"403_CR120","unstructured":"Medicationqa dataset. https:\/\/huggingface.co\/datasets\/truehealth\/medicationqa, 2024b. Hugging Face."},{"key":"403_CR121","unstructured":"Mimic-iv (version 3.1). https:\/\/physionet.org\/content\/mimiciv\/3.1\/, 2024c. PhysioNet."},{"key":"403_CR122","unstructured":"Bioasq task 13b: Biomedical semantic qa benchmark datasets (english questions with gold-standard concepts, articles, snippets, exact and ideal answers). https:\/\/www.bioasq.org\/participate\/challenges_year_6, 2025. BioASQ."},{"key":"403_CR123","unstructured":"Medical-diff-vqa: A large-scale medical dataset for difference visual question answering on chest x-ray images. https:\/\/physionet.org\/content\/medical-diff-vqa\/1.0.1\/, 2025. PhysioNet."},{"key":"403_CR124","doi-asserted-by":"crossref","unstructured":"Kushal Kafle and Christopher Kanan. Dvqa: Understanding data visualizations via question answering. https:\/\/openaccess.thecvf.com\/content_cvpr_2018\/CameraReady\/2040.pdf, 2018. CVPR.","DOI":"10.1109\/CVPR.2018.00592"},{"key":"403_CR125","unstructured":"Alzheimer\u2019s disease neuroimaging initiative (adni) data. https:\/\/adni.loni.usc.edu\/data-samples\/adni-data\/, 2024."},{"key":"403_CR126","unstructured":"Biored: A rich biomedical relation extraction dataset. https:\/\/paperswithcode.com\/dataset\/biored, 2022. Papers With Code."},{"key":"403_CR127","unstructured":"Squad: 100,000+ questions for machine comprehension of text, 2016. Available at: https:\/\/huggingface.co\/datasets\/rajpurkar\/squad."},{"key":"403_CR128","unstructured":"Jama guide to statistics and methods. https:\/\/jamanetwork.com\/collections\/44042\/jama-guide-to-statistics-and-methods, 2025. JAMA Network."},{"key":"403_CR129","unstructured":"Casimedicos-arg: A medical question answering dataset annotated with explanatory argumentative structures, 2024. Available at: https:\/\/github.com\/ixa-ehu\/antidote-casimedicos."},{"key":"403_CR130","unstructured":"Head-qa: A healthcare dataset for complex reasoning. https:\/\/huggingface.co\/datasets\/dvilares\/head_qa, 2024. Hugging Face."},{"key":"403_CR131","unstructured":"The refinedweb dataset for falcon llm: outperforming curated corpora with web data, and web data only, 2023. Available at: https:\/\/huggingface.co\/datasets\/tiiuae\/falcon-refinedweb."},{"key":"403_CR132","unstructured":"Supernatural instructions 2m. https:\/\/huggingface.co\/datasets\/andersonbcdefg\/supernatural-instructions-2m, 2023. Hugging Face."},{"key":"403_CR133","unstructured":"Chemprot: A chemical-protein relation extraction dataset. https:\/\/github.com\/paperswithcode\/paperswithcode-data, 2019. Papers With Code."},{"key":"403_CR134","unstructured":"The ddi corpus: An annotated corpus with pharmacological substances and drug\u2013drug interactions, 2013. Available at: https:\/\/github.com\/paperswithcode."}],"container-title":["Health Information Science and Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s13755-025-00403-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s13755-025-00403-0\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s13755-025-00403-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,11,26]],"date-time":"2025-11-26T19:03:11Z","timestamp":1764183791000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s13755-025-00403-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,11,26]]},"references-count":134,"journal-issue":{"issue":"1","published-online":{"date-parts":[[2026,12]]}},"alternative-id":["403"],"URL":"https:\/\/doi.org\/10.1007\/s13755-025-00403-0","relation":{},"ISSN":["2047-2501"],"issn-type":[{"value":"2047-2501","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,11,26]]},"assertion":[{"value":"1 August 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"11 November 2025","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"26 November 2025","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"This article is a review article and does not involve any studies with human participants\nor animals performed by any of the authors.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethical approval"}}],"article-number":"6"}}