{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,21]],"date-time":"2026-07-21T23:18:32Z","timestamp":1784675912115,"version":"3.55.0"},"publisher-location":"New York, NY, USA","reference-count":255,"publisher":"ACM","funder":[{"name":"National Institutes of Health","award":["ZID BC 010990"],"award-info":[{"award-number":["ZID BC 010990"]}]},{"name":"Engineering and Physical Science Research Council","award":["EP\/W020548\/1"],"award-info":[{"award-number":["EP\/W020548\/1"]}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2026,4,13]]},"DOI":"10.1145\/3772318.3791428","type":"proceedings-article","created":{"date-parts":[[2026,4,13]],"date-time":"2026-04-13T06:44:11Z","timestamp":1776062651000},"page":"1-30","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":2,"title":["Who Does What? Archetypes of Roles Assigned to LLMs During Human-AI Decision-Making"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-7042-5766","authenticated-orcid":false,"given":"Shreya","family":"Chappidi","sequence":"first","affiliation":[{"name":"Department of Computer Science and Technology, University of Cambridge, Cambridge, United Kingdom and National Cancer Institute, National Intitutes of Health, Bethesda, Maryland, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-5102-6564","authenticated-orcid":false,"given":"Jatinder","family":"Singh","sequence":"additional","affiliation":[{"name":"Research Centre Trust, UA Ruhr, University Duisburg-Essen, Duisburg, Germany and Department of Computer Science &amp; Technology, University of Cambridge, Cambridge, United Kingdom"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1634-6877","authenticated-orcid":false,"given":"Andra","family":"Valentina Krauze","sequence":"additional","affiliation":[{"name":"National Cancer Institute, National Intitutes of Health, Bethesda, Maryland, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"320","published-online":{"date-parts":[[2026,4,13]]},"reference":[{"key":"e_1_3_3_3_2_2","unstructured":"[n. d.]. Art. 22 GDPR \u2013 Automated individual decision-making including profiling. https:\/\/gdpr-info.eu\/art-22-gdpr\/"},{"key":"e_1_3_3_3_3_2","unstructured":"2025. DuckDuckGo AI Chat at DuckDuckGo. https:\/\/web.archive.org\/web\/20250901234252\/https:\/\/duckduckgo.com\/?q=DuckDuckGo+AI+Chat&ia=chat&duckai=1"},{"key":"e_1_3_3_3_4_2","unstructured":"2025. Venice | Private and Uncensored AI. https:\/\/web.archive.org\/web\/20250829092517\/https:\/\/venice.ai\/"},{"key":"e_1_3_3_3_5_2","doi-asserted-by":"publisher","DOI":"10.1145\/3661167.3661218"},{"key":"e_1_3_3_3_6_2","series-title":"(AIES \u201924)","first-page":"2","volume-title":"Proceedings of the 2024 AAAI\/ACM Conference on AI, Ethics, and Society","author":"Agiza Ahmed","year":"2025","unstructured":"Ahmed Agiza, Mohamed Mostagir, and Sherief Reda. 2025. PoliTune: Analyzing the Impact of Data Selection and Fine-Tuning on Economic and Political Biases in Large Language Models. In Proceedings of the 2024 AAAI\/ACM Conference on AI, Ethics, and Society(AIES \u201924). AAAI Press, San Jose, California, USA, 2\u201312."},{"key":"e_1_3_3_3_7_2","doi-asserted-by":"publisher","unstructured":"William Agnew A.\u00a0Stevie Bergman Jennifer Chien Mark D\u00edaz Seliem El-Sayed Jaylen Pittman Shakir Mohamed and Kevin\u00a0R. McKee. 2024. The Illusion of Artificial Inclusion. Proceedings of the CHI Conference on Human Factors in Computing Systems (May 2024) 1\u201312. 10.1145\/3613904.3642703Conference Name: CHI \u201924: CHI Conference on Human Factors in Computing Systems ISBN: 9798400703300 Place: Honolulu HI USA.","DOI":"10.1145\/3613904.3642703"},{"key":"e_1_3_3_3_8_2","doi-asserted-by":"publisher","unstructured":"Denis Agniel Isaac\u00a0S. Kohane and Griffin\u00a0M. Weber. 2018. Biases in electronic health record data due to processes within the healthcare system: retrospective observational study. BMJ 361 (April 2018) k1479. 10.1136\/bmj.k1479","DOI":"10.1136\/bmj.k1479"},{"key":"e_1_3_3_3_9_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.emnlp-main.130"},{"key":"e_1_3_3_3_10_2","doi-asserted-by":"publisher","unstructured":"Loic Ah-thiane Pierre-Etienne Heudel Mario Campone Marie Robert Victoire Brillaud-Meflah Caroline Rousseau Magali Le\u00a0Blanc-Onfroy Florine Tomaszewski St\u00e9phane Supiot Tanguy Perennec Augustin Mervoyer and Jean-S\u00e9bastien Frenel. 2025. Large Language Models as Decision-Making Tools in Oncology: Comparing Artificial Intelligence Suggestions and Expert Recommendations. JCO Clinical Cancer Informatics9 (March 2025) e2400230. 10.1200\/CCI-24-00230","DOI":"10.1200\/CCI-24-00230"},{"key":"e_1_3_3_3_11_2","doi-asserted-by":"publisher","unstructured":"Ahmad\u00a0K. Almekkawi James\u00a0P. Caruso Soummitra Anand Angela\u00a0M. Hawkins Rayaan Rauf Mayar Al-Shaikhli Salah\u00a0G. Aoun and Carlos\u00a0A. Bagley. 2025. Comparative Analysis of Large Language Models and Spine Surgeons in Surgical Decision-Making and Radiological Assessment for Spine Pathologies. World Neurosurgery 194 (Feb. 2025) 123531. 10.1016\/j.wneu.2024.11.114","DOI":"10.1016\/j.wneu.2024.11.114"},{"key":"e_1_3_3_3_12_2","doi-asserted-by":"publisher","unstructured":"Oscar Alvarado Nyi\u00a0Nyi Htun Yucheng Jin and Katrien Verbert. 2022. A Systematic Review of Interaction Design Strategies for Group Recommendation Systems. Proceedings of the ACM on Human-Computer Interaction 6 CSCW2 (Nov. 2022) 1\u201351. 10.1145\/3555161","DOI":"10.1145\/3555161"},{"key":"e_1_3_3_3_13_2","doi-asserted-by":"publisher","unstructured":"Jiafu An Difang Huang Chen Lin and Mingzhu Tai. 2025. Measuring gender and racial biases in large language models: Intersectional evidence from automated resume evaluation. PNAS Nexus 4 3 (Feb. 2025) pgaf089. 10.1093\/pnasnexus\/pgaf089","DOI":"10.1093\/pnasnexus\/pgaf089"},{"key":"e_1_3_3_3_14_2","doi-asserted-by":"publisher","unstructured":"Jessica\u00a0S. Ancker Alison Edwards Sarah Nosal Diane Hauser Elizabeth Mauer Rainu Kaushal and with the HITEC Investigators. 2017. Effects of workload work complexity and repeated alerts on alert fatigue in a clinical decision support system. BMC Medical Informatics and Decision Making 17 1 (April 2017) 36. 10.1186\/s12911-017-0430-8","DOI":"10.1186\/s12911-017-0430-8"},{"key":"e_1_3_3_3_15_2","doi-asserted-by":"publisher","unstructured":"Khizar Anjum Muhammad\u00a0Arbab Arshad Kadhim Hayawi Efstathios Polyzos Asadullah Tariq Mohamed\u00a0Adel Serhani Laiba Batool Brady Lund Nishith\u00a0Reddy Mannuru Ravi Varma\u00a0Kumar Bevara Taslim Mahbub Muhammad\u00a0Zeeshan Akram and Sakib Shahriar. 2025. Domain Specific Benchmarks for Evaluating Multimodal Large Language Models. (2025). 10.48550\/ARXIV.2506.12958Version Number: 2.","DOI":"10.48550\/ARXIV.2506.12958"},{"key":"e_1_3_3_3_16_2","doi-asserted-by":"publisher","unstructured":"Zahra Ashktorab Michael Desmond Qian Pan James Johnson Michelle Brachman Casey Dugan Marina Danilevsky and Werner Geyer. 2025. Emerging Reliance Behaviors in Human-AI Content Grounded Data Generation: The Role of Cognitive Forcing Functions and Hallucinations. Proceedings of the 4th Annual Symposium on Human-Computer Interaction for Work (June 2025) 1\u201317. 10.1145\/3729176.3729179Conference Name: CHIWORK \u201925: Proceedings of the 4th Annual Symposium on Human-Computer Interaction for Work ISBN: 9798400713842 Place: Amsterdam Netherlands.","DOI":"10.1145\/3729176.3729179"},{"key":"e_1_3_3_3_17_2","doi-asserted-by":"publisher","DOI":"10.1145\/3726302.3730068"},{"key":"e_1_3_3_3_18_2","doi-asserted-by":"publisher","DOI":"10.1145\/3672608.3707925"},{"key":"e_1_3_3_3_19_2","doi-asserted-by":"publisher","unstructured":"Michiel\u00a0A. Bakker Martin\u00a0J. Chadwick Hannah\u00a0R. Sheahan Michael\u00a0Henry Tessler Lucy Campbell-Gillingham Jan Balaguer Nat McAleese Amelia Glaese John Aslanides Matthew\u00a0M. Botvinick and Christopher Summerfield. 2022. Fine-tuning language models to find agreement among humans with diverse preferences. (2022). 10.48550\/ARXIV.2211.15006Version Number: 1.","DOI":"10.48550\/ARXIV.2211.15006"},{"key":"e_1_3_3_3_20_2","doi-asserted-by":"publisher","unstructured":"Simone Balloccu Patr\u00edcia Schmidtov\u00e1 Mateusz Lango and Ond\u0159ej Du\u0161ek. 2024. Leak Cheat Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs. (2024). 10.48550\/ARXIV.2402.03927Version Number: 2.","DOI":"10.48550\/ARXIV.2402.03927"},{"key":"e_1_3_3_3_21_2","doi-asserted-by":"publisher","unstructured":"Imon Banerjee Yuan Ling Matthew\u00a0C. Chen Sadid\u00a0A. Hasan Curtis\u00a0P. Langlotz Nathaniel Moradzadeh Brian Chapman Timothy Amrhein David Mong Daniel\u00a0L. Rubin Oladimeji Farri and Matthew\u00a0P. Lungren. 2019. Comparative Effectiveness of Convolutional Neural Network (CNN) and Recurrent Neural Network (RNN) Architectures for Radiology Text Report Classification. Artificial intelligence in medicine 97 (June 2019) 79\u201388. 10.1016\/j.artmed.2018.11.004","DOI":"10.1016\/j.artmed.2018.11.004"},{"key":"e_1_3_3_3_22_2","unstructured":"Yejin Bang Nayeon Lee Tiezheng Yu Leila Khalatbari Yan Xu Samuel Cahyawijaya Dan Su Bryan Wilie Romain Barraud Elham\u00a0J. Barezi Andrea Madotto Hayden Kee and Pascale Fung. 2022. Towards Answering Open-ended Ethical Quandary Questions. https:\/\/www.semanticscholar.org\/paper\/0376b7ff6bd5fd3df5dc766cb24f9ca8736ea34e"},{"key":"e_1_3_3_3_23_2","doi-asserted-by":"publisher","unstructured":"Tara\u00a0S. Behrend and Richard\u00a0N. Landers. 2025. Participant Interactions with Artificial Intelligence: Using Large Language Models to Generate Research Materials for Surveys and Experiments. Journal of Business and Psychology (June 2025). 10.1007\/s10869-025-10035-6","DOI":"10.1007\/s10869-025-10035-6"},{"key":"e_1_3_3_3_24_2","doi-asserted-by":"publisher","DOI":"10.1145\/3442188.3445922"},{"key":"e_1_3_3_3_25_2","doi-asserted-by":"publisher","unstructured":"Ahsan Bilal David Ebert and Beiyu Lin. 2025. LLMs for Explainable AI: A Comprehensive Survey. (2025). 10.48550\/ARXIV.2504.00125Version Number: 1.","DOI":"10.48550\/ARXIV.2504.00125"},{"key":"e_1_3_3_3_26_2","doi-asserted-by":"publisher","DOI":"10.1145\/3706598.3714097"},{"key":"e_1_3_3_3_27_2","doi-asserted-by":"publisher","unstructured":"Nasim Borazjanizadeh and Steven\u00a0T. Piantadosi. 2024. Reliable Reasoning Beyond Natural Language. (2024). 10.48550\/ARXIV.2407.11373Version Number: 2.","DOI":"10.48550\/ARXIV.2407.11373"},{"key":"e_1_3_3_3_28_2","doi-asserted-by":"publisher","unstructured":"Mikayla Branz Allie Farrell Min Hu William Liem and Ellis Ballard. 2021. System Archetypes. Social System Design Lab Methods Brief Series 1.07 Systems Thinking Foudnations (April 2021). 10.7936\/c89k-d163","DOI":"10.7936\/c89k-d163"},{"key":"e_1_3_3_3_29_2","doi-asserted-by":"publisher","unstructured":"Virginia Braun and Victoria Clarke. 2006. Using thematic analysis in psychology. Qualitative Research in Psychology 3 2 (Jan. 2006) 77\u2013101. 10.1191\/1478088706qp063oa_eprint: https:\/\/doi.org\/10.1191\/1478088706qp063oa.","DOI":"10.1191\/1478088706qp063oa"},{"key":"e_1_3_3_3_30_2","doi-asserted-by":"publisher","DOI":"10.5555\/3709347.3743552"},{"key":"e_1_3_3_3_31_2","doi-asserted-by":"publisher","unstructured":"Neil C.\u00a0C. Brown Pierre Weill-Tessier Juho Leinonen Paul Denny and Michael K\u00f6lling. 2025. Howzat? Appealing to Expert Judgement for Evaluating Human and AI Next-Step Hints for Novice Programmers. ACM Transactions on Computing Education 25 3 (Sept. 2025) 1\u201343. 10.1145\/3737885","DOI":"10.1145\/3737885"},{"key":"e_1_3_3_3_32_2","doi-asserted-by":"publisher","unstructured":"Emilia Bruegge Sarah Ricchizzi Malin Arenbeck Marius\u00a0Niklas Keller Lina Schur Walter Stummer Markus Holling Max\u00a0Hao Lu and Dogus Darici. 2024. Large language models improve clinical decision making of medical students through patient simulation and structured feedback: a randomized controlled trial. BMC MEDICAL EDUCATION 24 1 (Nov. 2024). 10.1186\/s12909-024-06399-7Place: CAMPUS 4 CRINAN ST LONDON N1 9XW ENGLAND Type: Article.","DOI":"10.1186\/s12909-024-06399-7"},{"key":"e_1_3_3_3_33_2","doi-asserted-by":"publisher","unstructured":"Emilia Br\u00fcgge Sarah Ricchizzi Malin Arenbeck Marius\u00a0Niklas Keller Lina Schur Walter Stummer Markus Holling Max\u00a0Hao Lu and Dogus Darici. 2024. Large language models improve clinical decision making of medical students through patient simulation and structured feedback: a randomized controlled trial. BMC Medical Education 24 1 (Nov. 2024) 1391. 10.1186\/s12909-024-06399-7","DOI":"10.1186\/s12909-024-06399-7"},{"key":"e_1_3_3_3_34_2","doi-asserted-by":"publisher","unstructured":"Christoph\u00a0Raphael Buhr Benjamin\u00a0Philipp Ernst Andrew Blaikie Harry Smith Tom Kelsey Christoph Matthias Maximilian Fleischmann Florian Jungmann J\u00fcrgen Alt Christian Brandts Peer\u00a0W. K\u00e4mmerer Sebastian Foersch Sebastian Kuhn and Jonas Eckrich. 2025. Assessment of decision-making with locally run and web-based large language models versus human board recommendations in otorhinolaryngology head and neck surgery. European Archives of Oto-Rhino-Laryngology 282 3 (March 2025) 1593\u20131607. 10.1007\/s00405-024-09153-3","DOI":"10.1007\/s00405-024-09153-3"},{"key":"e_1_3_3_3_35_2","doi-asserted-by":"publisher","unstructured":"Zana Bu\u00e7inca Maja\u00a0Barbara Malaya and Krzysztof\u00a0Z. Gajos. 2021. To Trust or to Think: Cognitive Forcing Functions Can Reduce Overreliance on AI in AI-assisted Decision-making. Proceedings of the ACM on Human-Computer Interaction 5 CSCW1 (April 2021) 1\u201321. 10.1145\/3449287","DOI":"10.1145\/3449287"},{"key":"e_1_3_3_3_36_2","doi-asserted-by":"publisher","unstructured":"Paola Carou-Senra Irene Delgado-Taboada Carmen Alvarez-Lorenzo Patricia Diaz-Rodriguez and Alvaro Goyanes. 2025. Exploring the Role of LLMs Like ChatGPT in Pharmacy Education for Supporting Students\u2019 Therapeutic Decision-making. American Journal of Pharmaceutical Education 89 8 (Aug. 2025) 101462. 10.1016\/j.ajpe.2025.101462","DOI":"10.1016\/j.ajpe.2025.101462"},{"key":"e_1_3_3_3_37_2","doi-asserted-by":"publisher","unstructured":"Shreya Chappidi Mason\u00a0J. Belue Stephanie\u00a0A. Harmon Sarisha Jagasia Ying Zhuge Erdal Tasci Baris Turkbey Jatinder Singh Kevin Camphausen and Andra\u00a0V. Krauze. 2025. From manual clinical criteria to machine learning algorithms: Comparing outcome endpoints derived from diverse electronic health record data modalities. PLOS Digital Health 4 5 (May 2025) e0000755. 10.1371\/journal.pdig.0000755","DOI":"10.1371\/journal.pdig.0000755"},{"key":"e_1_3_3_3_38_2","doi-asserted-by":"publisher","unstructured":"Haomin Chen Catalina Gomez Chien-Ming Huang and Mathias Unberath. 2022. Explainable medical imaging AI needs human-centered design: guidelines and evidence from a systematic review. npj Digital Medicine 5 1 (Oct. 2022) 156. 10.1038\/s41746-022-00699-2","DOI":"10.1038\/s41746-022-00699-2"},{"key":"e_1_3_3_3_39_2","doi-asserted-by":"publisher","DOI":"10.1145\/3701716.3715258"},{"key":"e_1_3_3_3_40_2","doi-asserted-by":"publisher","unstructured":"Minze Chen Zhenxiang Tao Weitong Tang Tingxin Qin Rui Yang and Chunli Zhu. 2024. Enhancing emergency decision-making with knowledge graphs and large language models. International Journal of Disaster Risk Reduction 113 (Oct. 2024) 104804. 10.1016\/j.ijdrr.2024.104804","DOI":"10.1016\/j.ijdrr.2024.104804"},{"key":"e_1_3_3_3_41_2","doi-asserted-by":"publisher","unstructured":"Runjin Chen Andy Arditi Henry Sleight Owain Evans and Jack Lindsey. 2025. Persona Vectors: Monitoring and Controlling Character Traits in Language Models. 10.48550\/arXiv.2507.21509arXiv:https:\/\/arXiv.org\/abs\/2507.21509 [cs].","DOI":"10.48550\/arXiv.2507.21509"},{"key":"e_1_3_3_3_42_2","doi-asserted-by":"publisher","unstructured":"Rong Chen Siyun Zhang Yiyi Zheng Qiuhua Yu and Chuhuai Wang. 2025. Enhancing treatment decision-making for low back pain: a novel framework integrating large language models with retrieval-augmented generation technology. Frontiers in Medicine 12 (May 2025) 1599241. 10.3389\/fmed.2025.1599241","DOI":"10.3389\/fmed.2025.1599241"},{"key":"e_1_3_3_3_43_2","doi-asserted-by":"publisher","unstructured":"Valerie Chen Q.\u00a0Vera Liao Jennifer Wortman\u00a0Vaughan and Gagan Bansal. 2023. Understanding the Role of Human Intuition on Reliance in Human-AI Decision-Making with Explanations. Proceedings of the ACM on Human-Computer Interaction 7 CSCW2 (Sept. 2023) 1\u201332. 10.1145\/3610219","DOI":"10.1145\/3610219"},{"key":"e_1_3_3_3_44_2","doi-asserted-by":"publisher","unstructured":"Yuheng Cheng Huan Zhao Xiyuan Zhou Junhua Zhao Yuji Cao Chao Yang and Xinlei Cai. 2025. A large language model for advanced power dispatch. Scientific Reports 15 1 (March 2025) 8925. 10.1038\/s41598-025-91940-x","DOI":"10.1038\/s41598-025-91940-x"},{"key":"e_1_3_3_3_45_2","doi-asserted-by":"publisher","unstructured":"Vanessa Cheung Maximilian Maier and Falk Lieder. 2025. Large language models show amplified cognitive biases in moral decision-making. Proceedings of the National Academy of Sciences 122 25 (June 2025) e2412015122. 10.1073\/pnas.2412015122","DOI":"10.1073\/pnas.2412015122"},{"key":"e_1_3_3_3_46_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP48485.2024.10446745"},{"key":"e_1_3_3_3_47_2","doi-asserted-by":"publisher","DOI":"10.1145\/3640543.3645199"},{"key":"e_1_3_3_3_48_2","doi-asserted-by":"publisher","unstructured":"Alexander\u00a0S. Choi Syeda\u00a0Sabrina Akter JP Singh and Antonios Anastasopoulos. 2024. The LLM Effect: Are Humans Truly Using LLMs or Are They Being Influenced By Them Instead? (2024). 10.48550\/ARXIV.2410.04699Version Number: 1.","DOI":"10.48550\/ARXIV.2410.04699"},{"key":"e_1_3_3_3_49_2","doi-asserted-by":"publisher","unstructured":"Min Choi Keonwoo Kim Sungwon Chae and Sangyeob Baek. 2025. An Empirical Study of Group Conformity in Multi-Agent Systems. arXiv. 10.48550\/ARXIV.2506.01332Version Number: 1.","DOI":"10.48550\/ARXIV.2506.01332"},{"key":"e_1_3_3_3_50_2","doi-asserted-by":"publisher","unstructured":"Yun-Shiuan Chuang Agam Goyal Nikunj Harlalka Siddharth Suresh Robert Hawkins Sijia Yang Dhavan Shah Junjie Hu and Timothy\u00a0T. Rogers. 2023. Simulating Opinion Dynamics with Networks of LLM-based Agents. arXiv. 10.48550\/ARXIV.2311.09618Version Number: 4.","DOI":"10.48550\/ARXIV.2311.09618"},{"key":"e_1_3_3_3_51_2","doi-asserted-by":"publisher","unstructured":"Pedro Cisneros-Velarde. 2024. Large Language Models can Achieve Social Balance. (2024). 10.48550\/ARXIV.2410.04054Version Number: 2.","DOI":"10.48550\/ARXIV.2410.04054"},{"key":"e_1_3_3_3_52_2","doi-asserted-by":"publisher","unstructured":"Katherine\u00a0M. Collins Valerie Chen Ilia Sucholutsky Hannah\u00a0Rose Kirk Malak Sadek Holli Sargeant Ameet Talwalkar Adrian Weller and Umang Bhatt. 2024. Modulating Language Model Experiences through Frictions. (2024). 10.48550\/ARXIV.2407.12804Version Number: 2.","DOI":"10.48550\/ARXIV.2407.12804"},{"key":"e_1_3_3_3_53_2","doi-asserted-by":"publisher","DOI":"10.1145\/3531146.3533108"},{"key":"e_1_3_3_3_54_2","doi-asserted-by":"publisher","DOI":"10.1145\/3674805.3690753"},{"key":"e_1_3_3_3_55_2","doi-asserted-by":"publisher","unstructured":"Ryan Davis Michael Eppler Oluwatobiloba Ayo-Ajibola Jeffrey\u00a0C. Loh-Doyle Jamal Nabhani Mary Samplaski Inderbir Gill and Giovanni\u00a0E. Cacciamani. 2023. Evaluating the Effectiveness of Artificial Intelligence\u2013powered Large Language Models Application in Disseminating Appropriate and Readable Health Information in Urology. The Journal of Urology (Oct. 2023). 10.1097\/JU.0000000000003615","DOI":"10.1097\/JU.0000000000003615"},{"key":"e_1_3_3_3_56_2","doi-asserted-by":"publisher","DOI":"10.1145\/3674805.3690741"},{"key":"e_1_3_3_3_57_2","doi-asserted-by":"publisher","DOI":"10.1145\/3715275.3732217"},{"key":"e_1_3_3_3_58_2","doi-asserted-by":"publisher","DOI":"10.1145\/3701571.3701582"},{"key":"e_1_3_3_3_59_2","doi-asserted-by":"publisher","unstructured":"Yashar Deldjoo. 2023. Fairness of ChatGPT and the Role Of Explainable-Guided Prompts. 10.48550\/arXiv.2307.11761arXiv:https:\/\/arXiv.org\/abs\/2307.11761 [cs].","DOI":"10.48550\/arXiv.2307.11761"},{"key":"e_1_3_3_3_60_2","doi-asserted-by":"publisher","unstructured":"Fabrizio Dell\u2019Acqua Edward McFowland Ethan\u00a0R. Mollick Hila Lifshitz-Assaf Katherine Kellogg Saran Rajendran Lisa Krayer Fran\u00e7ois Candelon and Karim\u00a0R. Lakhani. 2023. Navigating the Jagged Technological Frontier: Field Experimental Evidence of the Effects of AI on Knowledge Worker Productivity and Quality. SSRN Electronic Journal (2023). 10.2139\/ssrn.4573321","DOI":"10.2139\/ssrn.4573321"},{"key":"e_1_3_3_3_61_2","doi-asserted-by":"publisher","unstructured":"Chunyuan Deng Yilun Zhao Xiangru Tang Mark Gerstein and Arman Cohan. 2024. Investigating Data Contamination in Modern Benchmarks for Large Language Models. 10.48550\/arXiv.2311.09783arXiv:https:\/\/arXiv.org\/abs\/2311.09783 [cs].","DOI":"10.48550\/arXiv.2311.09783"},{"key":"e_1_3_3_3_62_2","doi-asserted-by":"publisher","unstructured":"Giuseppe Desolda Francesco Greco and Luca Vigano. 2025. APOLLO: A GPT-based tool to detect phishing emails and generate explanations that warn users. Proceedings of the ACM on Human-Computer Interaction 9 4 (June 2025) 1\u201333. 10.1145\/3733049","DOI":"10.1145\/3733049"},{"key":"e_1_3_3_3_63_2","doi-asserted-by":"publisher","unstructured":"Matthew\u00a0R. DeVerna Harry\u00a0Yaojun Yan Kai-Cheng Yang and Filippo Menczer. [n. d.]. Fact-checking information from large language models can decrease headline discernment. Proceedings of the National Academy of Sciences of the United States of America 121 50 ([n. d.]) e2322823121. 10.1073\/pnas.2322823121","DOI":"10.1073\/pnas.2322823121"},{"key":"e_1_3_3_3_64_2","doi-asserted-by":"publisher","unstructured":"Felix\u00a0J. Dorfner Amin Dada Felix Busch Marcus\u00a0R. Makowski Tianyu Han Daniel Truhn Jens Kleesiek Madhumita Sushil Jacqueline Lammert Lisa\u00a0C. Adams and Keno\u00a0K. Bressem. 2024. Biomedical Large Languages Models Seem not to be Superior to Generalist Models on Unseen Medical Data. (2024). 10.48550\/ARXIV.2408.13833Version Number: 1.","DOI":"10.48550\/ARXIV.2408.13833"},{"key":"e_1_3_3_3_65_2","unstructured":"Esin Durmus Karina Nyugen Thomas Liao Nicholas Schiefer Amanda Askell A. Bakhtin Carol Chen Zac Hatfield-Dodds Danny Hernandez Nicholas Joseph Liane Lovitt Sam McCandlish Orowa Sikder Alex Tamkin Janel Thamkul Jared Kaplan Jack Clark and Deep Ganguli. 2023. Towards Measuring the Representation of Subjective Global Opinions in Language Models. ArXiv (June 2023). https:\/\/www.semanticscholar.org\/paper\/Towards-Measuring-the-Representation-of-Subjective-Durmus-Nyugen\/534c58762e69d7afbcb0f6a7e53c07484f6d4891"},{"key":"e_1_3_3_3_66_2","doi-asserted-by":"publisher","DOI":"10.1145\/3411764.3445188"},{"key":"e_1_3_3_3_67_2","doi-asserted-by":"publisher","unstructured":"Maria Eriksson Erasmo Purificato Arman Noroozian Joao Vinagre Guillaume Chaslot Emilia Gomez and David Fernandez-Llorca. 2025. Can We Trust AI Benchmarks? An Interdisciplinary Review of Current Issues in AI Evaluation. 10.48550\/arXiv.2502.06559arXiv:https:\/\/arXiv.org\/abs\/2502.06559 [cs].","DOI":"10.48550\/arXiv.2502.06559"},{"key":"e_1_3_3_3_68_2","doi-asserted-by":"publisher","DOI":"10.1145\/3578337.3605136"},{"key":"e_1_3_3_3_69_2","doi-asserted-by":"publisher","unstructured":"Andrea Failla R\u00e9my Cazabet Giulio Rossetti and Salvatore Citraro. 2024. Describing group evolution in temporal data using multi-faceted events. Machine Learning 113 10 (Oct. 2024) 7591\u20137615. 10.1007\/s10994-024-06600-4","DOI":"10.1007\/s10994-024-06600-4"},{"key":"e_1_3_3_3_70_2","doi-asserted-by":"publisher","unstructured":"James Fodor. 2025. Line Goes Up? Inherent Limitations of Benchmarks for Evaluating Large Language Models. 10.48550\/arXiv.2502.14318arXiv:https:\/\/arXiv.org\/abs\/2502.14318 [cs].","DOI":"10.48550\/arXiv.2502.14318"},{"key":"e_1_3_3_3_71_2","doi-asserted-by":"publisher","DOI":"10.1145\/3531146.3533193"},{"key":"e_1_3_3_3_72_2","doi-asserted-by":"publisher","DOI":"10.1145\/3715336.3735779"},{"key":"e_1_3_3_3_73_2","volume-title":"Fables of Identity: Studies in Poetic Mythology","author":"Frye Northrop","year":"1963","unstructured":"Northrop Frye. 1963. Fables of Identity: Studies in Poetic Mythology. Harcourt, Brace & World. Google-Books-ID: NaE6AAAAMAAJ."},{"key":"e_1_3_3_3_74_2","doi-asserted-by":"publisher","unstructured":"Farieda Gaber Maqsood Shaik Fabio Allega Agnes\u00a0Julia Bilecz Felix Busch Kelsey Goon Vedran Franke and Altuna Akalin. 2025. Evaluating large language model workflows in clinical decision support for triage and referral and diagnosis. npj Digital Medicine 8 1 (May 2025) 263. 10.1038\/s41746-025-01684-1","DOI":"10.1038\/s41746-025-01684-1"},{"key":"e_1_3_3_3_75_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613905.3650786"},{"key":"e_1_3_3_3_76_2","doi-asserted-by":"publisher","unstructured":"Yunfan Gao Yun Xiong Xinyu Gao Kangxiang Jia Jinliu Pan Yuxi Bi Yi Dai Jiawei Sun Meng Wang and Haofen Wang. 2023. Retrieval-Augmented Generation for Large Language Models: A Survey. (2023). 10.48550\/ARXIV.2312.10997Version Number: 5.","DOI":"10.48550\/ARXIV.2312.10997"},{"key":"e_1_3_3_3_77_2","doi-asserted-by":"publisher","unstructured":"Susanne Gaube Harini Suresh Martina Raue Alexander Merritt Seth\u00a0J. Berkowitz Eva Lermer Joseph\u00a0F. Coughlin John\u00a0V. Guttag Errol Colak and Marzyeh Ghassemi. 2021. Do as AI say: susceptibility in deployment of clinical decision-aids. npj Digital Medicine 4 1 (Feb. 2021) 31. 10.1038\/s41746-021-00385-9","DOI":"10.1038\/s41746-021-00385-9"},{"key":"e_1_3_3_3_78_2","doi-asserted-by":"publisher","DOI":"10.1145\/3351095.3372862"},{"key":"e_1_3_3_3_79_2","doi-asserted-by":"publisher","unstructured":"Gianpaolo Ghiani Gianluca Solazzo and Gianluca Elia. 2024. Integrating Large Language Models and Optimization in Semi- Structured Decision Making: Methodology and a Case Study. Algorithms 17 12 (Dec. 2024) 582. 10.3390\/a17120582","DOI":"10.3390\/a17120582"},{"key":"e_1_3_3_3_80_2","doi-asserted-by":"publisher","unstructured":"Hamed Gholami. 2024. Artificial Intelligence Techniques for Sustainable Reconfigurable Manufacturing Systems: An AI-Powered Decision-Making Application Using Large Language Models. Big Data and Cognitive Computing 8 11 (Nov. 2024) 152. 10.3390\/bdcc8110152","DOI":"10.3390\/bdcc8110152"},{"key":"e_1_3_3_3_81_2","doi-asserted-by":"publisher","unstructured":"Catalina Gomez Junjie Yin Chien-Ming Huang and Mathias Unberath. 2024. How large language model-powered conversational agents influence decision making in domestic medical triage contexts. Frontiers in Computer Science 6 (Oct. 2024) 1427463. 10.3389\/fcomp.2024.1427463","DOI":"10.3389\/fcomp.2024.1427463"},{"key":"e_1_3_3_3_82_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613904.3642014"},{"key":"e_1_3_3_3_83_2","doi-asserted-by":"publisher","DOI":"10.1145\/3715275.3732121"},{"key":"e_1_3_3_3_84_2","doi-asserted-by":"publisher","unstructured":"Sebastian Griewing Johannes Knitza Jelena Boekhoff Christoph Hillen Fabian Lechner Uwe Wagner Markus Wallwiener and Sebastian Kuhn. 2024. Evolution of publicly available large language models for complex decision-making in breast cancer care. Archives of Gynecology and Obstetrics 310 1 (May 2024) 537\u2013550. 10.1007\/s00404-024-07565-4","DOI":"10.1007\/s00404-024-07565-4"},{"key":"e_1_3_3_3_85_2","doi-asserted-by":"publisher","unstructured":"Maxime Griot Coralie Hemptinne Jean Vanderdonckt and Demet Yuksel. 2025. Large Language Models lack essential metacognition for reliable medical reasoning. Nature Communications 16 1 (Jan. 2025) 642. 10.1038\/s41467-024-55628-6","DOI":"10.1038\/s41467-024-55628-6"},{"key":"e_1_3_3_3_86_2","doi-asserted-by":"publisher","unstructured":"Felix Gr\u00f6ner and Erin\u00a0K. Chiou. 2024. Investigating the Impact of User Interface Designs on Expectations About Large Language Models\u2019 Capabilities. Proceedings of the Human Factors and Ergonomics Society Annual Meeting 68 1 (Sept. 2024) 155\u2013161. 10.1177\/10711813241260399","DOI":"10.1177\/10711813241260399"},{"key":"e_1_3_3_3_87_2","doi-asserted-by":"publisher","unstructured":"Jiawei Gu Xuhui Jiang Zhichao Shi Hexiang Tan Xuehao Zhai Chengjin Xu Wei Li Yinghan Shen Shengjie Ma Honghao Liu Saizhuo Wang Kun Zhang Yuanzhuo Wang Wen Gao Lionel Ni and Jian Guo. 2025. A Survey on LLM-as-a-Judge. 10.48550\/arXiv.2411.15594arXiv:https:\/\/arXiv.org\/abs\/2411.15594 [cs].","DOI":"10.48550\/arXiv.2411.15594"},{"key":"e_1_3_3_3_88_2","doi-asserted-by":"publisher","unstructured":"Luke Guerdan Solon Barocas Kenneth Holstein Hanna Wallach Zhiwei\u00a0Steven Wu and Alexandra Chouldechova. 2025. Validating LLM-as-a-Judge Systems in the Absence of Gold Labels. 10.48550\/arXiv.2503.05965arXiv:https:\/\/arXiv.org\/abs\/2503.05965 [cs].","DOI":"10.48550\/arXiv.2503.05965"},{"key":"e_1_3_3_3_89_2","doi-asserted-by":"publisher","unstructured":"Yue Guo Wei Qiu Yizhong Wang and Trevor Cohen. 2022. Automated Lay Language Summarization of Biomedical Scientific Reviews. 10.48550\/arXiv.2012.12573arXiv:https:\/\/arXiv.org\/abs\/2012.12573 [cs].","DOI":"10.48550\/arXiv.2012.12573"},{"key":"e_1_3_3_3_90_2","doi-asserted-by":"publisher","unstructured":"Paul Hager Friederike Jungmann Robbie Holland Kunal Bhagat Inga Hubrecht Manuel Knauer Jakob Vielhauer Marcus Makowski Rickmer Braren Georgios Kaissis and Daniel Rueckert. 2024. Evaluation and mitigation of the limitations of large language models in clinical decision-making. Nature Medicine 30 9 (Sept. 2024) 2613\u20132622. 10.1038\/s41591-024-03097-1","DOI":"10.1038\/s41591-024-03097-1"},{"key":"e_1_3_3_3_91_2","doi-asserted-by":"publisher","unstructured":"Seungjun Han and Wongyung Choi. 2024. Development of a Large Language Model-based Multi-Agent Clinical Decision Support System for Korean Triage and Acuity Scale (KTAS)-Based Triage and Treatment Planning in Emergency Departments. 10.48550\/ARXIV.2408.07531Version Number: 2.","DOI":"10.48550\/ARXIV.2408.07531"},{"key":"e_1_3_3_3_92_2","doi-asserted-by":"publisher","unstructured":"Yilun Hao Yang Zhang and Chuchu Fan. 2025. Planning Anything with Rigor: General-Purpose Zero-Shot Planning with LLM-based Formalized Programming. 10.48550\/arXiv.2410.12112arXiv:https:\/\/arXiv.org\/abs\/2410.12112 [cs].","DOI":"10.48550\/arXiv.2410.12112"},{"key":"e_1_3_3_3_93_2","doi-asserted-by":"publisher","DOI":"10.1145\/3708359.3712133"},{"key":"e_1_3_3_3_94_2","doi-asserted-by":"publisher","DOI":"10.1145\/3706598.3713218"},{"key":"e_1_3_3_3_95_2","doi-asserted-by":"publisher","unstructured":"Qianyu He Jie Zeng Wenhao Huang Lina Chen Jin Xiao Qianxi He Xunzhe Zhou Lida Chen Xintao Wang Yuncheng Huang Haoning Ye Zihan Li Shisong Chen Yikai Zhang Zhouhong Gu Jiaqing Liang and Yanghua Xiao. 2023. Can Large Language Models Understand Real-World Complex Instructions? (2023). 10.48550\/ARXIV.2309.09150Version Number: 2.","DOI":"10.48550\/ARXIV.2309.09150"},{"key":"e_1_3_3_3_96_2","doi-asserted-by":"publisher","unstructured":"Xiaoxin He Xavier Bresson Thomas Laurent Adam Perold Yann LeCun and Bryan Hooi. 2024. Harnessing Explanations: LLM-to-LM Interpreter for Enhanced Text-Attributed Graph Representation Learning. 10.48550\/arXiv.2305.19523arXiv:https:\/\/arXiv.org\/abs\/2305.19523 [cs].","DOI":"10.48550\/arXiv.2305.19523"},{"key":"e_1_3_3_3_97_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613904.3642834"},{"key":"e_1_3_3_3_98_2","doi-asserted-by":"publisher","unstructured":"Zexue He Yu Wang An Yan Yao Liu Eric\u00a0Y. Chang Amilcare Gentili Julian McAuley and Chun-Nan Hsu. 2023. MedEval: A Multi-Level Multi-Task and Multi-Domain Medical Benchmark for Language Model Evaluation. arXiv. 10.48550\/ARXIV.2310.14088Version Number: 3.","DOI":"10.48550\/ARXIV.2310.14088"},{"key":"e_1_3_3_3_99_2","doi-asserted-by":"publisher","DOI":"10.1145\/3696410.3714691"},{"key":"e_1_3_3_3_100_2","doi-asserted-by":"publisher","unstructured":"Joshua Holstein Moritz Diener and Philipp Spitzer. 2025. From Consumption to Collaboration: Measuring Interaction Patterns to Augment Human Cognition in Open-Ended Tasks. (2025). 10.48550\/ARXIV.2504.02780Version Number: 1.","DOI":"10.48550\/ARXIV.2504.02780"},{"key":"e_1_3_3_3_101_2","doi-asserted-by":"publisher","unstructured":"Pedram Hosseini Jessica\u00a0M. Sin Bing Ren Bryceton\u00a0G. Thomas Elnaz Nouri Ali Farahanchi and Saeed Hassanpour. 2024. A Benchmark for Long-Form Medical Question Answering. 10.48550\/arXiv.2411.09834arXiv:https:\/\/arXiv.org\/abs\/2411.09834 [cs].","DOI":"10.48550\/arXiv.2411.09834"},{"key":"e_1_3_3_3_102_2","doi-asserted-by":"publisher","unstructured":"Aritra Hota Soumyajit Chatterjee and Sandip Chakraborty. 2024. Evaluating Large Language Models as Virtual Annotators for Time-series Physical Sensing Data. ACM Transactions on Intelligent Systems and Technology (Sept. 2024) 3696461. 10.1145\/3696461","DOI":"10.1145\/3696461"},{"key":"e_1_3_3_3_103_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICCE-Taiwan62264.2024.10674465"},{"key":"e_1_3_3_3_104_2","doi-asserted-by":"publisher","unstructured":"Lei Huang Weijiang Yu Weitao Ma Weihong Zhong Zhangyin Feng Haotian Wang Qianglong Chen Weihua Peng Xiaocheng Feng Bing Qin and Ting Liu. 2025. A Survey on Hallucination in Large Language Models: Principles Taxonomy Challenges and Open Questions. ACM Transactions on Information Systems 43 2 (March 2025) 1\u201355. 10.1145\/3703155arXiv:https:\/\/arXiv.org\/abs\/2311.05232 [cs].","DOI":"10.1145\/3703155"},{"key":"e_1_3_3_3_105_2","doi-asserted-by":"crossref","unstructured":"Shih-Cheng Huang Zepeng Huo Ethan Steinberg Chia-Chun Chiang Curtis Langlotz Matthew Lungren Serena Yeung Nigam Shah and Jason Fries. 2023. INSPECT: A Multimodal Dataset for Patient Outcome Prediction of Pulmonary Embolisms. Advances in Neural Information Processing Systems 36 (Dec. 2023) 17742\u201317772. https:\/\/proceedings.neurips.cc\/paper_files\/paper\/2023\/hash\/39736af1b9d87a1fddad9f84a6bcf64c-Abstract-Datasets_and_Benchmarks.html","DOI":"10.52202\/075280-0779"},{"key":"e_1_3_3_3_106_2","doi-asserted-by":"publisher","unstructured":"Bright Huo Elisa Calabrese Patricia Sylla Sunjay Kumar Romeo\u00a0C. Ignacio Rodolfo Oviedo Imran Hassan Bethany\u00a0J. Slater Andreas Kaiser Danielle\u00a0S. Walsh and Wesley Vosburg. 2024. The performance of artificial intelligence large language model-linked chatbots in surgical decision-making for gastroesophageal reflux disease. Surgical Endoscopy 38 5 (May 2024) 2320\u20132330. 10.1007\/s00464-024-10807-w","DOI":"10.1007\/s00464-024-10807-w"},{"key":"e_1_3_3_3_107_2","doi-asserted-by":"publisher","unstructured":"Kori Inkpen Shreya Chappidi Keri Mallari Besmira Nushi Divya Ramesh Pietro Michelucci Vani Mandava Libu\u0161e\u00a0Hannah Vep\u0159ek and Gabrielle Quinn. 2023. Advancing Human-AI Complementarity: The Impact of User Expertise and Algorithmic Tuning on Joint Decision Making. ACM Transactions on Computer-Human Interaction 30 5 (Oct. 2023) 1\u201329. 10.1145\/3534561","DOI":"10.1145\/3534561"},{"key":"e_1_3_3_3_108_2","doi-asserted-by":"publisher","unstructured":"Guangyuan Jiang Manjie Xu Song-Chun Zhu Wenjuan Han Chi Zhang and Yixin Zhu. 2023. Evaluating and Inducing Personality in Pre-trained Language Models. 10.48550\/arXiv.2206.07550arXiv:https:\/\/arXiv.org\/abs\/2206.07550 [cs].","DOI":"10.48550\/arXiv.2206.07550"},{"key":"e_1_3_3_3_109_2","volume-title":"Collected Works of C.G. Jung","author":"Jung C.\u00a0G.","year":"1973","unstructured":"C.\u00a0G. Jung and R.\u00a0F.\u00a0C. Hull. 1973. The Archetypes of the Collective Unconscious. In Collected Works of C.G. Jung. Routledge."},{"key":"e_1_3_3_3_110_2","doi-asserted-by":"publisher","unstructured":"Jinho Jung Michael Phillipi Bryant Tran Kasha Chen Nathan Chan Erwin Ho Shawn Sun and Roozbeh Houshyar. 2025. Accuracy of large language models in generating differential diagnosis from clinical presentation and imaging findings in pediatric cases. Pediatric Radiology 55 9 (July 2025) 1927\u20131933. 10.1007\/s00247-025-06317-z","DOI":"10.1007\/s00247-025-06317-z"},{"key":"e_1_3_3_3_111_2","doi-asserted-by":"publisher","unstructured":"Philippe Kaiser Shan Yang Michael Bach Christian Breit Kirsten Mertz Bram Stieltjes Jan Ebbing Christian Wetterauer and Maurice Henkel. 2025. The interaction of structured data using openEHR and large Language models for clinical decision support in prostate cancer. World Journal of Urology 43 1 (Jan. 2025) 67. 10.1007\/s00345-024-05423-1","DOI":"10.1007\/s00345-024-05423-1"},{"key":"e_1_3_3_3_112_2","doi-asserted-by":"publisher","unstructured":"Shivani Kapania William Agnew Motahhare Eslami Hoda Heidari and Sarah\u00a0E Fox. 2025. Simulacrum of Stories: Examining Large Language Models as Qualitative Research Participants. Proceedings of the 2025 CHI Conference on Human Factors in Computing Systems (April 2025) 1\u201317. 10.1145\/3706598.3713220Conference Name: CHI 2025: CHI Conference on Human Factors in Computing Systems ISBN: 9798400713941 Place: Yokohama Japan.","DOI":"10.1145\/3706598.3713220"},{"key":"e_1_3_3_3_113_2","doi-asserted-by":"publisher","unstructured":"Mafaz Kattih Max Bressler Logan\u00a0R. Smith Anthony Schinelli Rahul Mhaskar and Karim Hanna. 2024. Artificial Intelligence-Prompted Explanations of Common Primary Care Diagnoses. PRiMER : Peer-Reviewed Reports in Medical Education Research 8 (Sept. 2024) 51. 10.22454\/PRiMER.2024.916089","DOI":"10.22454\/PRiMER.2024.916089"},{"key":"e_1_3_3_3_114_2","doi-asserted-by":"publisher","DOI":"10.1145\/3654777.3676345"},{"key":"e_1_3_3_3_115_2","doi-asserted-by":"publisher","unstructured":"Yuhe Ke Rui Yang Sui\u00a0An Lie Taylor Xin\u00a0Yi Lim Yilin Ning Irene Li Hairil\u00a0Rizal Abdullah Daniel Shu\u00a0Wei Ting and Nan Liu. 2024. Mitigating Cognitive Biases in Clinical Decision-Making Through Multi-Agent Conversations Using Large Language Models: Simulation Study. Journal of Medical Internet Research 26 (Nov. 2024) e59439. 10.2196\/59439","DOI":"10.2196\/59439"},{"key":"e_1_3_3_3_116_2","doi-asserted-by":"publisher","unstructured":"Matthew Kearney Reuben Binns and Yarin Gal. 2025. Language Models Change Facts Based on the Way You Talk. (2025). 10.48550\/ARXIV.2507.14238Version Number: 1.","DOI":"10.48550\/ARXIV.2507.14238"},{"key":"e_1_3_3_3_117_2","doi-asserted-by":"publisher","unstructured":"Eunhye Kim Kiroong Choe Minju Yoo Sadat\u00a0Shams Chowdhury and Jinwook Seo. 2025. Beyond Tools: Understanding How Heavy Users Integrate LLMs into Everyday Tasks and Decision-Making. (2025). 10.48550\/ARXIV.2502.15395Version Number: 2.","DOI":"10.48550\/ARXIV.2502.15395"},{"key":"e_1_3_3_3_118_2","doi-asserted-by":"publisher","DOI":"10.1145\/3706598.3714020"},{"key":"e_1_3_3_3_119_2","unstructured":"Yubin Kim Chanwoo Park Hyewon Jeong Yik\u00a0S. Chan Xuhai Xu Daniel McDuff Hyeonhoon Lee Marzyeh Ghassemi Cynthia Breazeal and Hae\u00a0W. Park. 2024. MDAgents: An Adaptive Collaboration of LLMs for Medical Decision-Making. Advances in Neural Information Processing Systems 37 (Dec. 2024) 79410\u201379452. https:\/\/proceedings.neurips.cc\/paper_files\/paper\/2024\/hash\/90d1fc07f46e31387978b88e7e057a31-Abstract-Conference.html"},{"key":"e_1_3_3_3_120_2","doi-asserted-by":"publisher","unstructured":"Yunsoo Kim Jinge Wu Yusuf Abdulle and Honghan Wu. 2024. MedExQA: Medical Question Answering Benchmark with Multiple Explanations. (2024). 10.48550\/ARXIV.2406.06331Version Number: 2.","DOI":"10.48550\/ARXIV.2406.06331"},{"key":"e_1_3_3_3_121_2","doi-asserted-by":"publisher","DOI":"10.1145\/3589334.3645611"},{"key":"e_1_3_3_3_122_2","unstructured":"Takeshi Kojima S. Gu Machel Reid Yutaka Matsuo and Yusuke Iwasawa. 2022. Large Language Models are Zero-Shot Reasoners. ArXiv (May 2022). https:\/\/www.semanticscholar.org\/paper\/Large-Language-Models-are-Zero-Shot-Reasoners-Kojima-Gu\/e7ad08848d5d7c5c47673ffe0da06af443643bda"},{"key":"e_1_3_3_3_123_2","doi-asserted-by":"publisher","unstructured":"Jonathan Kottlors Robert Hahnfeldt Lukas G\u00f6rtz Andra-Iza Iuga Philipp Fervers Johannes Bremm David Zopfs Kai\u00a0R Laukamp Oezguer\u00a0A Onur Simon Lennartz Michael Sch\u00f6nfeld David Maintz Christoph Kabbasch Thorsten Persigehl and Marc Schlamann. 2025. Large Language Models\u2013Supported Thrombectomy Decision-Making in Acute Ischemic Stroke Based on Radiology Reports: Feasibility Qualitative Study. Journal of Medical Internet Research 27 (Feb. 2025) e48328. 10.2196\/48328","DOI":"10.2196\/48328"},{"key":"e_1_3_3_3_124_2","doi-asserted-by":"publisher","unstructured":"Ulrike Kuhl and Annika Bush. 2025. When Bias Backfires: The Modulatory Role of Counterfactual Explanations on the Adoption of Algorithmic Bias in XAI-Supported Human Decision-Making. 10.48550\/arXiv.2505.14377arXiv:https:\/\/arXiv.org\/abs\/2505.14377 [cs].","DOI":"10.48550\/arXiv.2505.14377"},{"key":"e_1_3_3_3_125_2","doi-asserted-by":"publisher","unstructured":"Bongjae Kwon and Kiyun Yu. 2025. Cognition-enhanced geospatial decision framework integrating fuzzy FCA surprisingly popular method and a large language model. Scientific Reports 15 1 (July 2025) 23089. 10.1038\/s41598-025-06508-6","DOI":"10.1038\/s41598-025-06508-6"},{"key":"e_1_3_3_3_126_2","doi-asserted-by":"publisher","DOI":"10.1145\/3731120.3744581"},{"key":"e_1_3_3_3_127_2","doi-asserted-by":"publisher","DOI":"10.1145\/3690624.3709379"},{"key":"e_1_3_3_3_128_2","first-page":"807","volume-title":"Proceedings of the 2024 AAAI\/ACM Conference on AI, Ethics, and Society","author":"Lamparth Max","year":"2025","unstructured":"Max Lamparth, Anthony Corso, Jacob Ganz, Oriana\u00a0Skylar Mastro, Jacquelyn Schneider, and Harold Trinkunas. 2025. Human vs. Machine: Behavioral Differences between Expert Humans and Language Models in Wargame Simulations. In Proceedings of the 2024 AAAI\/ACM Conference on AI, Ethics, and Society. AAAI Press, 807\u2013817."},{"key":"e_1_3_3_3_129_2","doi-asserted-by":"publisher","unstructured":"Connor Lawless Jakob Schoeffer Lindy Le Kael Rowan Shilad Sen Cristina St.\u00a0Hill Jina Suh and Bahareh Sarrafzadeh. 2024. \u201cI Want It That Way\u201d: Enabling Interactive Decision Support Using Large Language Models and Constraint Programming. ACM Transactions on Interactive Intelligent Systems 14 3 (Sept. 2024) 1\u201333. 10.1145\/3685053","DOI":"10.1145\/3685053"},{"key":"e_1_3_3_3_130_2","doi-asserted-by":"publisher","DOI":"10.1145\/3708557.3716334"},{"key":"e_1_3_3_3_131_2","doi-asserted-by":"publisher","unstructured":"Marcus\u00a0Vinicius Leite Jair\u00a0Minoro Abe Marcos Leandro\u00a0Hoffmann Souza and Irenilza De\u00a0Alencar\u00a0N\u00e4\u00e4s. 2025. Enhancing Environmental Control in Broiler Production: Retrieval-Augmented Generation for Improved Decision-Making with Large Language Models. AgriEngineering 7 1 (Jan. 2025) 12. 10.3390\/agriengineering7010012","DOI":"10.3390\/agriengineering7010012"},{"key":"e_1_3_3_3_132_2","unstructured":"Xin Li Xiaojie Zhang Jiahao Peng Rui Mao Mingyang Zhou Xing Xie and Hao Liao. [n. d.]. A Joint Learning Framework for Restaurant Survival Prediction and Explanation. ([n. d.])."},{"key":"e_1_3_3_3_133_2","doi-asserted-by":"publisher","DOI":"10.1145\/3706598.3713133"},{"key":"e_1_3_3_3_134_2","doi-asserted-by":"publisher","unstructured":"Q.\u00a0Vera Liao and Jennifer\u00a0Wortman Vaughan. 2023. AI Transparency in the Age of LLMs: A Human-Centered Research Roadmap. 10.48550\/arXiv.2306.01941arXiv:https:\/\/arXiv.org\/abs\/2306.01941 [cs].","DOI":"10.48550\/arXiv.2306.01941"},{"key":"e_1_3_3_3_135_2","doi-asserted-by":"publisher","unstructured":"Andreas Liesenfeld Alianda Lopez and Mark Dingemanse. 2023. Opening up ChatGPT: Tracking openness transparency and accountability in instruction-tuned text generators. Proceedings of the 5th International Conference on Conversational User Interfaces (July 2023) 1\u20136. 10.1145\/3571884.3604316Conference Name: CUI \u201923: ACM conference on Conversational User Interfaces ISBN: 9798400700149 Place: Eindhoven Netherlands.","DOI":"10.1145\/3571884.3604316"},{"key":"e_1_3_3_3_136_2","unstructured":"Chin-Yew Lin. 2004. ROUGE: A Package for Automatic Evaluation of Summaries. https:\/\/www.semanticscholar.org\/paper\/ROUGE%3A-A-Package-for-Automatic-Evaluation-of-Lin\/60b05f32c32519a809f21642ef1eb3eaf3848008"},{"key":"e_1_3_3_3_137_2","doi-asserted-by":"publisher","DOI":"10.1145\/3711618.3711619"},{"key":"e_1_3_3_3_138_2","doi-asserted-by":"publisher","DOI":"10.1145\/3696410.3714850"},{"key":"e_1_3_3_3_139_2","doi-asserted-by":"publisher","DOI":"10.1145\/3626252.3630789"},{"key":"e_1_3_3_3_140_2","doi-asserted-by":"publisher","unstructured":"Siru Liu Aileen\u00a0P Wright Barron\u00a0L Patterson Jonathan\u00a0P Wanderer Robert\u00a0W Turer Scott\u00a0D Nelson Allison\u00a0B McCoy Dean\u00a0F Sittig and Adam Wright. 2023. Using AI-generated suggestions from ChatGPT to optimize clinical decision support. Journal of the American Medical Informatics Association 30 7 (June 2023) 1237\u20131245. 10.1093\/jamia\/ocad072","DOI":"10.1093\/jamia\/ocad072"},{"key":"e_1_3_3_3_141_2","doi-asserted-by":"publisher","DOI":"10.1145\/3491102.3501825"},{"key":"e_1_3_3_3_142_2","doi-asserted-by":"publisher","DOI":"10.1109\/RE59067.2024.00046"},{"key":"e_1_3_3_3_143_2","doi-asserted-by":"publisher","DOI":"10.1145\/3631700.3665185"},{"key":"e_1_3_3_3_144_2","doi-asserted-by":"publisher","unstructured":"Zheheng Luo Chenhan Yuan Qianqian Xie and Sophia Ananiadou. 2024. Are Large Language Models True Healthcare Jacks-of-All-Trades? Benchmarking Across Health Professions Beyond Physician Exams. (2024). 10.48550\/ARXIV.2406.11328Version Number: 1.","DOI":"10.48550\/ARXIV.2406.11328"},{"key":"e_1_3_3_3_145_2","doi-asserted-by":"publisher","DOI":"10.1145\/3706598.3713423"},{"key":"e_1_3_3_3_146_2","doi-asserted-by":"publisher","DOI":"10.1145\/3708036.3708229"},{"key":"e_1_3_3_3_147_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613904.3642861"},{"key":"e_1_3_3_3_148_2","doi-asserted-by":"publisher","unstructured":"Lars Malmqvist. 2024. Sycophancy in Large Language Models: Causes and Mitigations. (2024). 10.48550\/ARXIV.2411.15287Version Number: 1.","DOI":"10.48550\/ARXIV.2411.15287"},{"key":"e_1_3_3_3_149_2","doi-asserted-by":"publisher","DOI":"10.1145\/3736733.3736740"},{"key":"e_1_3_3_3_150_2","doi-asserted-by":"publisher","unstructured":"Timothy\u00a0R McIntosh Teo Susnjak Nalin Arachchilage Tong Liu Dan Xu Paul Watters and Malka\u00a0N Halgamuge. 2025. Inadequacies of Large Language Model Benchmarks in the Era of Generative Artificial Intelligence. IEEE Transactions on Artificial Intelligence (2025) 1\u201318. 10.1109\/TAI.2025.3569516","DOI":"10.1109\/TAI.2025.3569516"},{"key":"e_1_3_3_3_151_2","doi-asserted-by":"publisher","unstructured":"Justin\u00a0K. Miller and Wenjia Tang. 2025. Evaluating LLM Metrics Through Real-World Capabilities. 10.48550\/arXiv.2505.08253arXiv:https:\/\/arXiv.org\/abs\/2505.08253 [cs].","DOI":"10.48550\/arXiv.2505.08253"},{"key":"e_1_3_3_3_152_2","doi-asserted-by":"publisher","unstructured":"Shira Mitchell Eric Potash Solon Barocas Alexander D\u2019Amour and Kristian Lum. 2021. Algorithmic Fairness: Choices Assumptions and Definitions. Annual Review of Statistics and Its Application 8 1 (March 2021) 141\u2013163. 10.1146\/annurev-statistics-042720-125902","DOI":"10.1146\/annurev-statistics-042720-125902"},{"key":"e_1_3_3_3_153_2","doi-asserted-by":"publisher","unstructured":"Ian\u00a0I. Mitroff. 1983. Archetypal Social Systems Analysis: On the Deeper Structure of Human Systems. The Academy of Management Review 8 3 (1983) 387\u2013397. 10.2307\/257827","DOI":"10.2307\/257827"},{"key":"e_1_3_3_3_154_2","doi-asserted-by":"publisher","unstructured":"Katelyn Morrison Philipp Spitzer Violet Turri Michelle Feng Niklas K\u00fchl and Adam Perer. 2024. The Impact of Imperfect XAI on Human-AI Decision-Making. Proc. ACM Hum.-Comput. Interact. 8 CSCW1 (April 2024) 183:1\u2013183:39. 10.1145\/3641022","DOI":"10.1145\/3641022"},{"key":"e_1_3_3_3_155_2","doi-asserted-by":"publisher","unstructured":"Eduardo Mosqueira-Rey Elena Hern\u00e1ndez-Pereira David Alonso-R\u00edos Jos\u00e9 Bobes-Bascar\u00e1n and \u00c1ngel Fern\u00e1ndez-Leal. 2023. Human-in-the-loop machine learning: a state of the art. Artificial Intelligence Review 56 4 (April 2023) 3005\u20133054. 10.1007\/s10462-022-10246-w","DOI":"10.1007\/s10462-022-10246-w"},{"key":"e_1_3_3_3_156_2","doi-asserted-by":"publisher","unstructured":"Varun Nagaraj\u00a0Rao Samantha Dalal Eesha Agarwal Dana Calacci and Andr\u00e9s Monroy-Hern\u00e1ndez. 2025. Rideshare Transparency: Translating Gig Worker Insights on AI Platform Design to Policy. Proceedings of the ACM on Human-Computer Interaction 9 2 (May 2025) 1\u201349. 10.1145\/3711059","DOI":"10.1145\/3711059"},{"key":"e_1_3_3_3_157_2","doi-asserted-by":"publisher","DOI":"10.1145\/3715275.3732038"},{"key":"e_1_3_3_3_158_2","doi-asserted-by":"publisher","DOI":"10.1145\/3772318.3791726"},{"key":"e_1_3_3_3_159_2","doi-asserted-by":"publisher","unstructured":"Terrence Neumann Maria De-Arteaga and Sina Fazelpour. 2025. Should you use LLMs to simulate opinions? Quality checks for early-stage deliberation. (2025). 10.48550\/ARXIV.2504.08954Version Number: 3.","DOI":"10.48550\/ARXIV.2504.08954"},{"key":"e_1_3_3_3_160_2","doi-asserted-by":"publisher","unstructured":"Yongxin Ni Tianqi Xu Chunxiao Li Eric Zheng and Bin Gu. 2025. Machine Behaviorism: Exploring the Behavioral Dynamics of Large Language Models in Decision Making. 10.24251\/HICSS.2025.503","DOI":"10.24251\/HICSS.2025.503"},{"key":"e_1_3_3_3_161_2","doi-asserted-by":"publisher","unstructured":"Qiyang Nie and Tong Liu. 2025. Large language models: Tools for new environmental decision-making. Journal of Environmental Management 375 (Feb. 2025) 124373. 10.1016\/j.jenvman.2025.124373","DOI":"10.1016\/j.jenvman.2025.124373"},{"key":"e_1_3_3_3_162_2","doi-asserted-by":"publisher","unstructured":"David Noever. 2024. Language Models And A Second Opinion Use Case: The Pocket Professional. 10.48550\/arXiv.2410.20636arXiv:https:\/\/arXiv.org\/abs\/2410.20636 [cs].","DOI":"10.48550\/arXiv.2410.20636"},{"key":"e_1_3_3_3_163_2","unstructured":"Harsha Nori Nicholas King Scott\u00a0Mayer McKinney Dean Carignan and Eric Horvitz. 2023. Capabilities of GPT-4 on Medical Challenge Problems. http:\/\/arxiv.org\/abs\/2303.13375 arXiv:https:\/\/arXiv.org\/abs\/2303.13375 [cs]."},{"key":"e_1_3_3_3_164_2","doi-asserted-by":"publisher","unstructured":"Ayano Okoso Keisuke Otaki Satoshi Koide and Yukino Baba. 2025. Impact of Tone-Aware Explanations in Recommender Systems. ACM Transactions on Recommender Systems 3 4 (Dec. 2025) 1\u201334. 10.1145\/3718101","DOI":"10.1145\/3718101"},{"key":"e_1_3_3_3_165_2","doi-asserted-by":"publisher","unstructured":"Mahmud Omar Shelly Soffer Reem Agbareia Nicola\u00a0Luigi Bragazzi Donald\u00a0U. Apakama Carol\u00a0R. Horowitz Alexander\u00a0W. Charney Robert Freeman Benjamin Kummer Benjamin\u00a0S. Glicksberg Girish\u00a0N. Nadkarni and Eyal Klang. 2025. Sociodemographic biases in medical decision making by large language models. Nature Medicine 31 6 (June 2025) 1873\u20131881. 10.1038\/s41591-025-03626-6","DOI":"10.1038\/s41591-025-03626-6"},{"key":"e_1_3_3_3_166_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613905.3650896"},{"key":"e_1_3_3_3_167_2","doi-asserted-by":"publisher","unstructured":"Jiao Ou Junda Lu Che Liu Yihong Tang Fuzheng Zhang Di Zhang and Kun Gai. 2023. DialogBench: Evaluating LLMs as Human-like Dialogue Systems. arXiv. 10.48550\/ARXIV.2311.01677Version Number: 2.","DOI":"10.48550\/ARXIV.2311.01677"},{"key":"e_1_3_3_3_168_2","unstructured":"Long Ouyang Jeff Wu Xu Jiang Diogo Almeida Carroll\u00a0L. Wainwright Pamela Mishkin Chong Zhang Sandhini Agarwal Katarina Slama Alex Ray John Schulman Jacob Hilton Fraser Kelton Luke\u00a0E. Miller Maddie Simens Amanda Askell Peter Welinder P. Christiano Jan Leike and Ryan\u00a0J. Lowe. 2022. Training language models to follow instructions with human feedback. ArXiv (March 2022). https:\/\/www.semanticscholar.org\/paper\/Training-language-models-to-follow-instructions-Ouyang-Wu\/d766bffc357127e0dc86dd69561d5aeb520d6f4c"},{"key":"e_1_3_3_3_169_2","doi-asserted-by":"publisher","unstructured":"Oded Ovadia Menachem Brief Moshik Mishaeli and Oren Elisha. 2023. Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs. arXiv. 10.48550\/ARXIV.2312.05934Version Number: 3.","DOI":"10.48550\/ARXIV.2312.05934"},{"key":"e_1_3_3_3_170_2","unstructured":"Xu Pan Jingxuan Fan Zidi Xiong Ely Hahami Jorin Overwiening and Ziqian Xie. 2025. User-Assistant Bias in LLMs. https:\/\/www.semanticscholar.org\/paper\/22dfb4db6b2596b2ca686b5f937ab82bb700ae04"},{"key":"e_1_3_3_3_171_2","doi-asserted-by":"publisher","unstructured":"Andrea Passerini Aryo Gema Pasquale Minervini Burcu Sayin and Katya Tentori. 2025. Fostering effective hybrid human-LLM reasoning and decision making. FRONTIERS IN ARTIFICIAL INTELLIGENCE 7 (Jan. 2025). 10.3389\/frai.2024.1464690Place: AVENUE DU TRIBUNAL FEDERAL 34 LAUSANNE CH-1015 SWITZERLAND Type: Article.","DOI":"10.3389\/frai.2024.1464690"},{"key":"e_1_3_3_3_172_2","doi-asserted-by":"publisher","unstructured":"Soraia Paulo Isabel Neto Nuno\u00a0Leit\u00e3o Figueiredo Daniel\u00a0Sim\u00f5es Lopes and Hugo Nicolau. 2025. Reimagining Multidisciplinary Teams: Challenges and Opportunities for LLMs in Cancer MDTs. Proceedings of the ACM on Human-Computer Interaction 9 2 (May 2025) 1\u201322. 10.1145\/3711055","DOI":"10.1145\/3711055"},{"key":"e_1_3_3_3_173_2","doi-asserted-by":"publisher","DOI":"10.1145\/3544548.3580907"},{"key":"e_1_3_3_3_174_2","doi-asserted-by":"publisher","unstructured":"Cheyenne Powell and Annalisa Riccardi. 2025. Generating textual explanations for scheduling systems leveraging the reasoning capabilities of large language models. Journal of Intelligent Information Systems 63 4 (Aug. 2025) 1287\u20131337. 10.1007\/s10844-025-00940-w","DOI":"10.1007\/s10844-025-00940-w"},{"key":"e_1_3_3_3_175_2","doi-asserted-by":"publisher","unstructured":"Gale\u00a0H. Prinster C.\u00a0Estelle Smith Chenhao Tan and Brian\u00a0C. Keegan. 2024. Community Archetypes: An Empirical Framework for Guiding Research Methodologies to Reflect User Experiences of Sense of Virtual Community on Reddit. Proceedings of the ACM on Human-Computer Interaction 8 CSCW1 (April 2024) 1\u201333. 10.1145\/3637310","DOI":"10.1145\/3637310"},{"key":"e_1_3_3_3_176_2","doi-asserted-by":"publisher","DOI":"10.1145\/3531146.3533231"},{"key":"e_1_3_3_3_177_2","doi-asserted-by":"publisher","DOI":"10.1109\/EAIS58494.2024.10570029"},{"key":"e_1_3_3_3_178_2","doi-asserted-by":"publisher","unstructured":"Daniel Ramos Claudia Mamede Kush Jain Paulo Canelas Catarina Gamboa and Claire Le\u00a0Goues. 2025. Are Large Language Models Memorizing Bug Benchmarks?2025 IEEE\/ACM International Workshop on Large Language Models for Code (LLM4Code) (May 2025) 1\u20138. 10.1109\/LLM4Code66737.2025.00005Conference Name: 2025 IEEE\/ACM International Workshop on Large Language Models for Code (LLM4Code) ISBN: 9798331526153 Place: Ottawa ON Canada.","DOI":"10.1109\/LLM4Code66737.2025.00005"},{"key":"e_1_3_3_3_179_2","doi-asserted-by":"publisher","unstructured":"Arya Rao Michael Pang John Kim Meghana Kamineni Winston Lie Anoop\u00a0K. Prasad Adam Landman Keith\u00a0J Dreyer and Marc\u00a0D. Succi. 2023. Assessing the Utility of ChatGPT Throughout the Entire Clinical Workflow. 10.1101\/2023.02.21.23285886","DOI":"10.1101\/2023.02.21.23285886"},{"key":"e_1_3_3_3_180_2","doi-asserted-by":"publisher","DOI":"10.1145\/3701571.3701593"},{"key":"e_1_3_3_3_181_2","doi-asserted-by":"publisher","unstructured":"Nicole\u00a0Franziska Richter Sven Hauff Christopher Schlaegel Siegfried Gudergan Christian\u00a0M. Ringle and Marjaana Gunkel. 2016. Using Cultural Archetypes in Cross-cultural Management Studies. Journal of International Management 22 1 (March 2016) 63\u201383. 10.1016\/j.intman.2015.09.001","DOI":"10.1016\/j.intman.2015.09.001"},{"key":"e_1_3_3_3_182_2","doi-asserted-by":"publisher","unstructured":"Rikard Rosenbacke \u00c5sa Melhus Martin McKee and David Stuckler. 2025. AI and XAI second opinion: the danger of false confirmation in human\u2013AI collaboration. Journal of Medical Ethics 51 6 (June 2025) 396\u2013399. 10.1136\/jme-2024-110074","DOI":"10.1136\/jme-2024-110074"},{"key":"e_1_3_3_3_183_2","doi-asserted-by":"publisher","unstructured":"Oscar Sainz Jon\u00a0Ander Campos Iker Garc\u00eda-Ferrero Julen Etxaniz Oier\u00a0Lopez de Lacalle and Eneko Agirre. 2023. NLP Evaluation in trouble: On the Need to Measure LLM Data Contamination for each Benchmark. arXiv. 10.48550\/ARXIV.2310.18018Version Number: 1.","DOI":"10.48550\/ARXIV.2310.18018"},{"key":"e_1_3_3_3_184_2","doi-asserted-by":"publisher","DOI":"10.1145\/3411764.3445518"},{"key":"e_1_3_3_3_185_2","doi-asserted-by":"publisher","DOI":"10.1145\/3721238.3730761"},{"key":"e_1_3_3_3_186_2","unstructured":"Shibani Santurkar Esin Durmus Faisal Ladhak Cinoo Lee Percy Liang and Tatsunori Hashimoto. 2023. Whose Opinions Do Language Models Reflect?ArXiv (March 2023). https:\/\/www.semanticscholar.org\/paper\/Whose-Opinions-Do-Language-Models-Reflect-Santurkar-Durmus\/e38a29f6463f38f43797b128673b9e44d18a991e"},{"key":"e_1_3_3_3_187_2","doi-asserted-by":"publisher","unstructured":"Ranjan Sapkota Shaina Raza and Manoj Karkee. 2025. Comprehensive Analysis of Transparency and Accessibility of ChatGPT DeepSeek And other SoTA Large Language Models. (2025). 10.48550\/ARXIV.2502.18505Version Number: 1.","DOI":"10.48550\/ARXIV.2502.18505"},{"key":"e_1_3_3_3_188_2","doi-asserted-by":"publisher","unstructured":"Pradosh\u00a0Kumar Sarangi Suvrankar Datta M.\u00a0Sarthak Swarup Swaha Panda Debasish Swapnesh\u00a0Kumar Nayak Archana Malik Ananda Datta and Himel Mondal. 2024. Radiologic Decision-Making for Imaging in Pulmonary Embolism: Accuracy and Reliability of Large Language Models\u2014Bing Claude ChatGPT and Perplexity. Indian Journal of Radiology and Imaging 34 04 (Oct. 2024) 653\u2013660. 10.1055\/s-0044-1787974","DOI":"10.1055\/s-0044-1787974"},{"key":"e_1_3_3_3_189_2","doi-asserted-by":"publisher","unstructured":"Advith Sarikonda Emily Isch Mitchell Self Abhijeet Sambangi Angeleah Carreras Ahilan Sivaganesan Jim Harrop and Jack Jallo. 2024. Evaluating the Adherence of Large Language Models to Surgical Guidelines: A Comparative Analysis of Chatbot Recommendations and North American Spine Society (NASS) Coverage Criteria. Cureus (Sept. 2024). 10.7759\/cureus.68521","DOI":"10.7759\/cureus.68521"},{"key":"e_1_3_3_3_190_2","doi-asserted-by":"publisher","unstructured":"Advait Sarkar. 2024. AI Should Challenge Not Obey. Commun. ACM 67 10 (Sept. 2024) 18\u201321. 10.1145\/3649404","DOI":"10.1145\/3649404"},{"key":"e_1_3_3_3_191_2","doi-asserted-by":"publisher","unstructured":"James Schaffer John O\u2019Donovan James Michaelis Adrienne Raglin and Tobias H\u00f6llerer. 2019. I can do better than your AI: expertise and explanations. Proceedings of the 24th International Conference on Intelligent User Interfaces (March 2019) 240\u2013251. 10.1145\/3301275.3302308Conference Name: IUI \u201919: 24th International Conference on Intelligent User Interfaces ISBN: 9781450362726 Place: Marina del Ray California.","DOI":"10.1145\/3301275.3302308"},{"key":"e_1_3_3_3_192_2","doi-asserted-by":"publisher","unstructured":"Philipp Schoenegger Peter\u00a0S. Park Ezra Karger Sean Trott and Philip\u00a0E. Tetlock. 2025. AI-Augmented Predictions: LLM Assistants Improve Human Forecasting Accuracy. ACM Transactions on Interactive Intelligent Systems 15 1 (March 2025) 1\u201325. 10.1145\/3707649","DOI":"10.1145\/3707649"},{"key":"e_1_3_3_3_193_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2024.acl-long.751"},{"key":"e_1_3_3_3_194_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613904.3642414"},{"key":"e_1_3_3_3_195_2","doi-asserted-by":"publisher","unstructured":"Neta Shanwetter\u00a0Levit and Mor Saban. 2025. When investigator meets large language models: a qualitative analysis of cancer patient decision-making journeys. npj Digital Medicine 8 1 (June 2025) 336. 10.1038\/s41746-025-01747-3","DOI":"10.1038\/s41746-025-01747-3"},{"key":"e_1_3_3_3_196_2","doi-asserted-by":"publisher","unstructured":"Wanqing Shao. 2025. Text sentiment classification optimization based on a fine-tuned BERT and large language model. Journal of Computational Methods in Sciences and Engineering (June 2025) 14727978251355795. 10.1177\/14727978251355795","DOI":"10.1177\/14727978251355795"},{"key":"e_1_3_3_3_197_2","doi-asserted-by":"publisher","unstructured":"Hua Shen Chieh-Yang Huang Tongshuang Wu and Ting-Hao\u00a0\u2019Kenneth\u2019 Huang. 2023. ConvXAI: Delivering Heterogeneous AI Explanations via Conversations to Support Human-AI Scientific Writing. 10.48550\/ARXIV.2305.09770Version Number: 6.","DOI":"10.48550\/ARXIV.2305.09770"},{"key":"e_1_3_3_3_198_2","doi-asserted-by":"publisher","DOI":"10.1145\/3584371.3612956"},{"key":"e_1_3_3_3_199_2","doi-asserted-by":"publisher","unstructured":"Philip\u00a0Wootaek Shin Jihyun\u00a0Janice Ahn Wenpeng Yin Jack Sampson and Vijaykrishnan Narayanan. 2024. Can Prompt Modifiers Control Bias? A Comparative Analysis of Text-to-Image Generative Models. 10.48550\/arXiv.2406.05602arXiv:https:\/\/arXiv.org\/abs\/2406.05602 [cs].","DOI":"10.48550\/arXiv.2406.05602"},{"key":"e_1_3_3_3_200_2","doi-asserted-by":"publisher","unstructured":"Chenglei Si Navita Goyal Sherry\u00a0Tongshuang Wu Chen Zhao Shi Feng Hal\u00a0Daum\u00e9 III and Jordan Boyd-Graber. 2024. Large Language Models Help Humans Verify Truthfulness \u2013 Except When They Are Convincingly Wrong. 10.48550\/arXiv.2310.12558arXiv:https:\/\/arXiv.org\/abs\/2310.12558 [cs].","DOI":"10.48550\/arXiv.2310.12558"},{"key":"e_1_3_3_3_201_2","doi-asserted-by":"publisher","DOI":"10.1145\/3630106.3658931"},{"key":"e_1_3_3_3_202_2","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN60899.2024.10649965"},{"key":"e_1_3_3_3_203_2","doi-asserted-by":"publisher","unstructured":"Dylan Slack Satyapriya Krishna Himabindu Lakkaraju and Sameer Singh. 2023. TalkToModel: Explaining Machine Learning Models with Interactive Natural Language Conversations. 10.48550\/arXiv.2207.04154arXiv:https:\/\/arXiv.org\/abs\/2207.04154 [cs].","DOI":"10.48550\/arXiv.2207.04154"},{"key":"e_1_3_3_3_204_2","doi-asserted-by":"publisher","unstructured":"Peter Slattery Alexander\u00a0K. Saeri Emily A.\u00a0C. Grundy Jess Graham Michael Noetel Risto Uuk James Dao Soroush Pour Stephen Casper and Neil Thompson. 2025. The AI Risk Repository: A Comprehensive Meta-Review Database and Taxonomy of Risks From Artificial Intelligence. 10.48550\/arXiv.2408.12622arXiv:https:\/\/arXiv.org\/abs\/2408.12622 [cs].","DOI":"10.48550\/arXiv.2408.12622"},{"key":"e_1_3_3_3_205_2","doi-asserted-by":"publisher","unstructured":"Christopher\u00a0T. Small Ivan Vendrov Esin Durmus Hadjar Homaei Elizabeth Barry Julien Cornebise Ted Suzman Deep Ganguli and Colin Megill. 2023. Opportunities and Risks of LLMs for Scalable Deliberation with Polis. (2023). 10.48550\/ARXIV.2306.11932Version Number: 1.","DOI":"10.48550\/ARXIV.2306.11932"},{"key":"e_1_3_3_3_206_2","doi-asserted-by":"publisher","unstructured":"Kacper Sokol James Fackler and Julia\u00a0E. Vogt. 2025. Artificial intelligence should genuinely support clinical reasoning and decision making to bridge the translational gap. npj Digital Medicine 8 1 (June 2025) 345. 10.1038\/s41746-025-01725-9","DOI":"10.1038\/s41746-025-01725-9"},{"key":"e_1_3_3_3_207_2","doi-asserted-by":"publisher","unstructured":"S.\u00a0K. Stavrakos S. Ahmed-Kristensen and T. Goldman. 2016. Using archetypes to create user panels for usability studies: Streamlining focus groups and user studies. Applied Ergonomics 56 (Sept. 2016) 108\u2013116. 10.1016\/j.apergo.2016.02.016","DOI":"10.1016\/j.apergo.2016.02.016"},{"key":"e_1_3_3_3_208_2","doi-asserted-by":"publisher","unstructured":"Mark Steyvers Heliodoro Tejeda Aakriti Kumar Catarina Belem Sheer Karny Xinyue Hu Lukas\u00a0W. Mayer and Padhraic Smyth. 2025. What large language models know and what people think they know. Nature Machine Intelligence 7 2 (Jan. 2025) 221\u2013231. 10.1038\/s42256-024-00976-7","DOI":"10.1038\/s42256-024-00976-7"},{"key":"e_1_3_3_3_209_2","doi-asserted-by":"publisher","unstructured":"Winnie Street. 2024. LLM Theory of Mind and Alignment: Opportunities and Risks. (2024). 10.48550\/ARXIV.2405.08154Version Number: 1.","DOI":"10.48550\/ARXIV.2405.08154"},{"key":"e_1_3_3_3_210_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2025.naacl-short.71"},{"key":"e_1_3_3_3_211_2","doi-asserted-by":"publisher","unstructured":"Alex Tamkin Amanda Askell Liane Lovitt Esin Durmus Nicholas Joseph Shauna Kravec Karina Nguyen Jared Kaplan and Deep Ganguli. 2023. Evaluating and Mitigating Discrimination in Language Model Decisions. 10.48550\/arXiv.2312.03689arXiv:https:\/\/arXiv.org\/abs\/2312.03689 [cs].","DOI":"10.48550\/arXiv.2312.03689"},{"key":"e_1_3_3_3_212_2","doi-asserted-by":"publisher","unstructured":"Liyan Tang Philippe Laban and Greg Durrett. 2024. MiniCheck: Efficient Fact-Checking of LLMs on Grounding Documents. 10.48550\/arXiv.2404.10774arXiv:https:\/\/arXiv.org\/abs\/2404.10774 [cs].","DOI":"10.48550\/arXiv.2404.10774"},{"key":"e_1_3_3_3_213_2","doi-asserted-by":"publisher","unstructured":"Shahroz Tariq Mohan Baruwal\u00a0Chhetri Surya Nepal and Cecile Paris. 2025. A 2 C: A modular multi-stage collaborative decision framework for human\u2013AI teams. Expert Systems with Applications 282 (July 2025) 127318. 10.1016\/j.eswa.2025.127318","DOI":"10.1016\/j.eswa.2025.127318"},{"key":"e_1_3_3_3_214_2","unstructured":"David\u00a0R Thomas. 2003. A general inductive approach for qualitative data analysis. (2003)."},{"key":"e_1_3_3_3_215_2","unstructured":"R. Thoppilan Daniel\u00a0De Freitas Jamie Hall Noam\u00a0M. Shazeer Apoorv Kulshreshtha Heng-Tze Cheng Alicia Jin Taylor Bos Leslie Baker Yu Du Yaguang Li Hongrae Lee H. Zheng Amin Ghafouri Marcelo Menegali Yanping Huang M. Krikun Dmitry Lepikhin James Qin Dehao Chen Yuanzhong Xu Zhifeng Chen Adam Roberts Maarten Bosma Yanqi Zhou Chung-Ching Chang I. Krivokon W. Rusch Marc Pickett K. Meier-Hellstern M. Morris Tulsee Doshi Renelito\u00a0Delos Santos Toju Duke J. S\u00f8raker Ben Zevenbergen Vinodkumar Prabhakaran Mark D\u00edaz Ben Hutchinson Kristen Olson Alejandra Molina Erin Hoffman-John Josh Lee Lora Aroyo Ravi Rajakumar Alena Butryna Matthew Lamm V. Kuzmina Joseph Fenton Aaron Cohen R. Bernstein R. Kurzweil Blaise Aguera-Arcas Claire Cui M. Croak Ed\u00a0H. Chi and Quoc Le. 2022. LaMDA: Language Models for Dialog Applications. ArXiv (Jan. 2022). https:\/\/www.semanticscholar.org\/paper\/LaMDA%3A-Language-Models-for-Dialog-Applications-Thoppilan-Freitas\/b3848d32f7294ec708627897833c4097eb4d8778"},{"key":"e_1_3_3_3_216_2","doi-asserted-by":"publisher","unstructured":"Yixin Wan Jieyu Zhao Aman Chadha Nanyun Peng and Kai-Wei Chang. 2023. Are Personalized Stochastic Parrots More Dangerous? Evaluating Persona Biases in Dialogue Systems. 10.48550\/arXiv.2310.05280arXiv:https:\/\/arXiv.org\/abs\/2310.05280 [cs].","DOI":"10.48550\/arXiv.2310.05280"},{"key":"e_1_3_3_3_217_2","doi-asserted-by":"publisher","unstructured":"Angelina Wang Jamie Morgenstern and John\u00a0P. Dickerson. 2025. Large language models that replace human participants can harmfully misportray and flatten identity groups. Nature Machine Intelligence 7 3 (March 2025) 400\u2013411. 10.1038\/s42256-025-00986-z","DOI":"10.1038\/s42256-025-00986-z"},{"key":"e_1_3_3_3_218_2","doi-asserted-by":"publisher","DOI":"10.1145\/3627508.3638344"},{"key":"e_1_3_3_3_219_2","doi-asserted-by":"publisher","unstructured":"Jiayin Wang Weizhi Ma Peijie Sun Min Zhang and Jian-Yun Nie. 2024. Understanding User Experience in Large Language Model Interactions. 10.48550\/arXiv.2401.08329arXiv:https:\/\/arXiv.org\/abs\/2401.08329 [cs].","DOI":"10.48550\/arXiv.2401.08329"},{"key":"e_1_3_3_3_220_2","doi-asserted-by":"publisher","unstructured":"Ruiqi Wang Jiyu Guo Cuiyun Gao Guodong Fan Chun\u00a0Yong Chong and Xin Xia. 2025. Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering. Proceedings of the ACM on Software Engineering 2 ISSTA (June 2025) 1955\u20131977. 10.1145\/3728963","DOI":"10.1145\/3728963"},{"key":"e_1_3_3_3_221_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613904.3641960"},{"key":"e_1_3_3_3_222_2","doi-asserted-by":"publisher","unstructured":"Segev Wasserkrug Leonard Boussioux Dick Den\u00a0Hertog Farzaneh Mirzazadeh \u015e.\u00a0\u0130lker Birbil Jannis Kurtz and Donato Maragno. 2025. Enhancing Decision Making Through the Integration of Large Language Models and Operations Research Optimization. Proceedings of the AAAI Conference on Artificial Intelligence 39 27 (April 2025) 28643\u201328650. 10.1609\/aaai.v39i27.35090","DOI":"10.1609\/aaai.v39i27.35090"},{"key":"e_1_3_3_3_223_2","doi-asserted-by":"publisher","DOI":"10.1145\/3708319.3733659"},{"key":"e_1_3_3_3_224_2","doi-asserted-by":"publisher","unstructured":"Jason Wei Xuezhi Wang Dale Schuurmans Maarten Bosma Brian Ichter Fei Xia Ed Chi Quoc Le and Denny Zhou. 2023. Chain-of-Thought Prompting Elicits Reasoning in Large Language Models. 10.48550\/arXiv.2201.11903arXiv:https:\/\/arXiv.org\/abs\/2201.11903 [cs].","DOI":"10.48550\/arXiv.2201.11903"},{"key":"e_1_3_3_3_225_2","unstructured":"Laura Weidinger John F.\u00a0J. Mellor Maribeth Rauh Conor Griffin Jonathan Uesato Po-Sen Huang Myra Cheng Mia Glaese Borja Balle Atoosa Kasirzadeh Zachary Kenton S. Brown W. Hawkins T. Stepleton Courtney Biles Abeba Birhane Julia Haas Laura Rimell Lisa\u00a0Anne Hendricks William\u00a0S. Isaac Sean Legassick G. Irving and Iason Gabriel. 2021. Ethical and social risks of harm from Language Models. ArXiv (Dec. 2021). https:\/\/www.semanticscholar.org\/paper\/fd1b829261ba04bb92e0ab60c4f6e7cea0d99fbf"},{"key":"e_1_3_3_3_226_2","doi-asserted-by":"publisher","unstructured":"Christopher Y.\u00a0K. Williams Travis Zack Brenda\u00a0Y. Miao Madhumita Sushil Michelle Wang Aaron\u00a0E. Kornblith and Atul\u00a0J. Butte. 2024. Use of a Large Language Model to Assess Clinical Acuity of Adults in the Emergency Department. JAMA Network Open 7 5 (May 2024) e248895. 10.1001\/jamanetworkopen.2024.8895","DOI":"10.1001\/jamanetworkopen.2024.8895"},{"key":"e_1_3_3_3_227_2","doi-asserted-by":"publisher","unstructured":"Claes Wohlin Marcos Kalinowski Katia Romero\u00a0Felizardo and Emilia Mendes. 2022. Successful combination of database search and snowballing for identification of primary studies in systematic literature studies. Information and Software Technology 147 (July 2022) 106908. 10.1016\/j.infsof.2022.106908","DOI":"10.1016\/j.infsof.2022.106908"},{"key":"e_1_3_3_3_228_2","doi-asserted-by":"publisher","unstructured":"Stanis\u0142aw Wo\u017aniak Bart\u0142omiej Koptyra Arkadiusz Janz Przemys\u0142aw Kazienko and Jan Koco\u0144. 2024. Personalized Large Language Models. 2024 IEEE International Conference on Data Mining Workshops (ICDMW) (Dec. 2024) 511\u2013520. 10.1109\/ICDMW65004.2024.00071Conference Name: 2024 IEEE International Conference on Data Mining Workshops (ICDMW) ISBN: 9798331530631 Place: Abu Dhabi United Arab Emirates.","DOI":"10.1109\/ICDMW65004.2024.00071"},{"key":"e_1_3_3_3_229_2","doi-asserted-by":"publisher","DOI":"10.1145\/3637528.3671901"},{"key":"e_1_3_3_3_230_2","doi-asserted-by":"publisher","unstructured":"Tongshuang Wu Michael Terry and Carrie\u00a0J. Cai. 2022. AI Chains: Transparent and Controllable Human-AI Interaction by Chaining Large Language Model Prompts. 10.48550\/arXiv.2110.01691arXiv:https:\/\/arXiv.org\/abs\/2110.01691 [cs].","DOI":"10.48550\/arXiv.2110.01691"},{"key":"e_1_3_3_3_231_2","doi-asserted-by":"publisher","unstructured":"Cheng Xiong Gengfeng Zheng Xiao Ma Chunlin Li and Jiangfeng Zeng. 2025. DelphiAgent: A trustworthy multi-agent verification framework for automated fact verification. Information Processing & Management 62 6 (Nov. 2025) 104241. 10.1016\/j.ipm.2025.104241","DOI":"10.1016\/j.ipm.2025.104241"},{"key":"e_1_3_3_3_232_2","doi-asserted-by":"publisher","unstructured":"Ruijie Xu Zengzhi Wang Run-Ze Fan and Pengfei Liu. 2024. Benchmarking Benchmark Leakage in Large Language Models. (2024). 10.48550\/ARXIV.2404.18824Version Number: 1.","DOI":"10.48550\/ARXIV.2404.18824"},{"key":"e_1_3_3_3_233_2","doi-asserted-by":"publisher","unstructured":"Siqiao Xue Fan Zhou Yi Xu Ming Jin Qingsong Wen Hongyan Hao Qingyang Dai Caigao Jiang Hongyu Zhao Shuo Xie Jianshan He James Zhang and Hongyuan Mei. 2023. WeaverBird: Empowering Financial Decision-Making with Large Language Model Knowledge Base and Search Engine. 10.48550\/ARXIV.2308.05361Version Number: 4.","DOI":"10.48550\/ARXIV.2308.05361"},{"key":"e_1_3_3_3_234_2","doi-asserted-by":"publisher","unstructured":"Zihan Yan and Yaohong Xiang. 2025. Social Life Simulation for Non-Cognitive Skills Learning. Proc. ACM Hum.-Comput. Interact. 9 2 (May 2025) CSCW170:1\u2013CSCW170:44. 10.1145\/3711068","DOI":"10.1145\/3711068"},{"key":"e_1_3_3_3_235_2","doi-asserted-by":"publisher","unstructured":"Joshua\u00a0C. Yang Damian Dailisan Marcin Korecki Carina\u00a0I. Hausladen and Dirk Helbing. 2024. LLM Voting: Human Choices and AI Collective Decision-Making. Proceedings of the AAAI\/ACM Conference on AI Ethics and Society 7 (Oct. 2024) 1696\u20131708. 10.1609\/aies.v7i1.31758","DOI":"10.1609\/aies.v7i1.31758"},{"key":"e_1_3_3_3_236_2","doi-asserted-by":"publisher","unstructured":"Shunyu Yao Jeffrey Zhao Dian Yu Nan Du Izhak Shafran Karthik Narasimhan and Yuan Cao. 2023. ReAct: Synergizing Reasoning and Acting in Language Models. 10.48550\/arXiv.2210.03629arXiv:https:\/\/arXiv.org\/abs\/2210.03629 [cs].","DOI":"10.48550\/arXiv.2210.03629"},{"key":"e_1_3_3_3_237_2","doi-asserted-by":"publisher","unstructured":"Chih-Kuan Yeh Cheng-Yu Hsieh Arun\u00a0Sai Suggala David\u00a0I. Inouye and Pradeep Ravikumar. 2019. On the (In)fidelity and Sensitivity for Explanations. 10.48550\/arXiv.1901.09392arXiv:https:\/\/arXiv.org\/abs\/1901.09392 [cs].","DOI":"10.48550\/arXiv.1901.09392"},{"key":"e_1_3_3_3_238_2","doi-asserted-by":"publisher","unstructured":"Lei Yu Zhirong Huang Hang Yuan Shiqi Cheng Li Yang Fengjun Zhang Chenjie Shen Jiajia Ma Jingyuan Zhang Junyi Lu and Chun Zuo. 2025. Smart-LLaMA-DPO: Reinforced Large Language Model for Explainable Smart Contract Vulnerability Detection. Proceedings of the ACM on Software Engineering 2 ISSTA (June 2025) 182\u2013205. 10.1145\/3728878","DOI":"10.1145\/3728878"},{"key":"e_1_3_3_3_239_2","doi-asserted-by":"publisher","DOI":"10.1145\/3701551.3703551"},{"key":"e_1_3_3_3_240_2","doi-asserted-by":"publisher","DOI":"10.1145\/3716550.3722025"},{"key":"e_1_3_3_3_241_2","doi-asserted-by":"publisher","unstructured":"Yongda Yu Guoping Rong Haifeng Shen He Zhang Dong Shao Min Wang Zhao Wei Yong Xu and Juhong Wang. 2024. Fine-Tuning Large Language Models to Improve Accuracy and Comprehensibility of Automated Code Review. ACM Trans. Softw. Eng. Methodol. 34 1 (Dec. 2024). 10.1145\/3695993Place: New York NY USA.","DOI":"10.1145\/3695993"},{"key":"e_1_3_3_3_242_2","doi-asserted-by":"publisher","DOI":"10.1145\/3706598.3714154"},{"key":"e_1_3_3_3_243_2","doi-asserted-by":"publisher","DOI":"10.1145\/3544548.3581388"},{"key":"e_1_3_3_3_244_2","doi-asserted-by":"publisher","unstructured":"Charles\u00a0Chuankai Zhang Mo Houtti C.\u00a0Estelle Smith Ruoyan Kong and Loren Terveen. 2022. Working for the Invisible Machines or Pumping Information into an Empty Void? An Exploration of Wikidata Contributors\u2019 Motivations. Proceedings of the ACM on Human-Computer Interaction 6 CSCW1 (March 2022) 1\u201321. 10.1145\/3512982","DOI":"10.1145\/3512982"},{"key":"e_1_3_3_3_245_2","doi-asserted-by":"publisher","unstructured":"Ming Zhang Yujiong Shen Zelin Li Huayu Sha Binze Hu Yuhui Wang Chenhao Huang Shichun Liu Jingqi Tong Changhao Jiang Mingxu Chai Zhiheng Xi Shihan Dou Tao Gui Qi Zhang and Xuanjing Huang. 2025. LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation. (2025). 10.48550\/ARXIV.2506.04078Version Number: 3.","DOI":"10.48550\/ARXIV.2506.04078"},{"key":"e_1_3_3_3_246_2","doi-asserted-by":"publisher","unstructured":"Shuning Zhang Hui Wang and Xin Yi. 2025. Exploring Collaboration Patterns and Strategies in Human-AI Co-creation through the Lens of Agency: A Scoping Review of the Top-tier HCI Literature. Proceedings of the ACM on Human-Computer Interaction 9 7 (Oct. 2025) 1\u201343. 10.1145\/3757594","DOI":"10.1145\/3757594"},{"key":"e_1_3_3_3_247_2","doi-asserted-by":"publisher","DOI":"10.1145\/3613904.3642343"},{"key":"e_1_3_3_3_248_2","doi-asserted-by":"publisher","unstructured":"Yongxiang Zhang Zhaobin Liu Shaosen Bai Ting Xu and Raymond\u00a0Yk Lau. 2025. Reference decisions enhance LLM performance amplified by source disclosure. DIGITAL HEALTH 11 (April 2025) 20552076251342078. 10.1177\/20552076251342078","DOI":"10.1177\/20552076251342078"},{"key":"e_1_3_3_3_249_2","doi-asserted-by":"publisher","unstructured":"Zhiwei Zhang Saifei Li Lijie Zhang Jianbin Ye Chunduo Hu and Lianshan Yan. 2025. LLM-LADE: Large language model-based log anomaly detection with explanation. Knowledge-Based Systems 326 (Sept. 2025) 114064. 10.1016\/j.knosys.2025.114064","DOI":"10.1016\/j.knosys.2025.114064"},{"key":"e_1_3_3_3_250_2","doi-asserted-by":"publisher","unstructured":"Haiyan Zhao Hanjie Chen Fan Yang Ninghao Liu Huiqi Deng Hengyi Cai Shuaiqiang Wang Dawei Yin and Mengnan Du. 2023. Explainability for Large Language Models: A Survey. 10.48550\/arXiv.2309.01029arXiv:https:\/\/arXiv.org\/abs\/2309.01029 [cs].","DOI":"10.48550\/arXiv.2309.01029"},{"key":"e_1_3_3_3_251_2","doi-asserted-by":"publisher","DOI":"10.1145\/3627673.3680022"},{"key":"e_1_3_3_3_252_2","doi-asserted-by":"publisher","DOI":"10.1145\/3696410.3714782"},{"key":"e_1_3_3_3_253_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2024.findings-emnlp.888"},{"key":"e_1_3_3_3_254_2","doi-asserted-by":"publisher","unstructured":"Shuang Zhou Wenya Xie Jiaxi Li Zaifu Zhan Meijia Song Han Yang Cheyenna Espinoza Lindsay Welton Xinnie Mai Yanwei Jin Zidu Xu Yuen-Hei Chung Yiyun Xing Meng-Han Tsai Emma Schaffer Yucheng Shi Ninghao Liu Zirui Liu and Rui Zhang. 2025. Automating Expert-Level Medical Reasoning Evaluation of Large Language Models. (2025). 10.48550\/ARXIV.2507.07988Version Number: 1.","DOI":"10.48550\/ARXIV.2507.07988"},{"key":"e_1_3_3_3_255_2","doi-asserted-by":"publisher","unstructured":"Qingxiaoyang Zhu and Hao-Chuan Wang. 2023. Leveraging Large Language Model as Support for Human Problem Solving: An Exploration of Its Appropriation and Impact. Computer Supported Cooperative Work and Social Computing (Oct. 2023) 333\u2013337. 10.1145\/3584931.3606965Conference Name: CSCW \u201923: Computer Supported Cooperative Work and Social Computing ISBN: 9798400701290 Place: Minneapolis MN USA.","DOI":"10.1145\/3584931.3606965"},{"key":"e_1_3_3_3_256_2","doi-asserted-by":"publisher","unstructured":"Henry\u00a0Peng Zou Wei-Chieh Huang Yaozu Wu Yankai Chen Chunyu Miao Hoang Nguyen Yue Zhou Weizhi Zhang Liancheng Fang Langzhou He Yangning Li Dongyuan Li Renhe Jiang Xue Liu and Philip\u00a0S. Yu. 2025. LLM-Based Human-Agent Collaboration and Interaction Systems: A Survey. 10.48550\/arXiv.2505.00753arXiv:https:\/\/arXiv.org\/abs\/2505.00753 [cs] version: 4.","DOI":"10.48550\/arXiv.2505.00753"}],"event":{"name":"CHI 2026: CHI Conference on Human Factors in Computing Systems","location":"Barcelona Spain","acronym":"CHI '26","sponsor":["SIGCHI ACM Special Interest Group on Computer-Human Interaction"]},"container-title":["Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3772318.3791428","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,13]],"date-time":"2026-04-13T06:46:25Z","timestamp":1776062785000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3772318.3791428"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,4,13]]},"references-count":255,"alternative-id":["10.1145\/3772318.3791428","10.1145\/3772318"],"URL":"https:\/\/doi.org\/10.1145\/3772318.3791428","relation":{},"subject":[],"published":{"date-parts":[[2026,4,13]]},"assertion":[{"value":"2026-04-13","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}