Computation and Language · Computer Science
Evaluating LLMs in Medicine: A Call for Rigor, Transparency
Mahmoud Alwakeel, Aditya Nagori, Vijay Krishnamoorthy, Rishikesan Kamaleswaran
2025-07-15
Computer Vision and Pattern Recognition · Computer Science
Building a Human-Verified Clinical Reasoning Dataset via a Human LLM Hybrid Pipeline for Trustworthy Medical AI
Chao Ding, Mouxiao Bian, Pengcheng Chen, Hongliang Zhang +10
2025-05-13
Computation and Language · Computer Science
Large Language Models in the Clinic: A Comprehensive Benchmark
Fenglin Liu, Zheng Li, Hongjian Zhou, Qingyu Yin +15
2024-10-17
Computation and Language · Computer Science
DiReCT: Diagnostic Reasoning for Clinical Notes via Large Language Models
Bowen Wang, Jiuyang Chang, Yiming Qian, Guoxin Chen +5
2025-07-02
Computation and Language · Computer Science
ELMTEX: Fine-Tuning Large Language Models for Structured Clinical Information Extraction. A Case Study on Clinical Reports
Aynur Guluzade, Naguib Heiba, Zeyd Boukhers, Florim Hamiti +3
2025-07-09
Computation and Language · Computer Science
A Survey on Large Language Models from General Purpose to Medical Applications: Datasets, Methodologies, and Evaluations
Jinqiang Wang, Huansheng Ning, Yi Peng, Qikai Wei +4
2024-09-24
Computation and Language · Computer Science
Beyond MedQA: Towards Real-world Clinical Decision Making in the Era of LLMs
Yunpeng Xiao, Carl Yang, Mark Mai, Xiao Hu +1
2025-10-24
Computation and Language · Computer Science
RuleAlign: Making Large Language Models Better Physicians with Diagnostic Rule Alignment
Xiaohan Wang, Xiaoyan Yang, Yuqi Zhu, Yue Shen +6
2024-08-23
Computation and Language · Computer Science
Harnessing Large Language Models for Precision Querying and Retrieval-Augmented Knowledge Extraction in Clinical Data Science
Juan Jose Rubio Jan, Jack Wu, Julia Ive
2026-01-29
Computation and Language · Computer Science
MedGUIDE: Benchmarking Clinical Decision-Making in Large Language Models
Xiaomin Li, Mingye Gao, Yuexing Hao, Taoran Li +3
2025-05-20
Computation and Language · Computer Science
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
Hanjie Chen, Zhouxiang Fang, Yash Singla, Mark Dredze
2026-02-19
Computation and Language · Computer Science
ClinicalGPT: Large Language Models Finetuned with Diverse Medical Data and Comprehensive Evaluation
Guangyu Wang, Guoxing Yang, Zongxin Du, Longjun Fan +1
2023-06-19
Computation and Language · Computer Science
Building Multilingual Datasets for Predicting Mental Health Severity through LLMs: Prospects and Challenges
Konstantinos Skianis, John Pavlopoulos, A. Seza Doğruöz
2026-02-10
Computation and Language · Computer Science
ClinicRealm: Re-evaluating Large Language Models with Conventional Machine Learning for Non-Generative Clinical Prediction Tasks
Yinghao Zhu, Junyi Gao, Zixiang Wang, Weibin Liao +8
2025-10-07
Human-Computer Interaction · Computer Science
REALM: A Dataset of Real-World LLM Use Cases
Jingwen Cheng, Kshitish Ghate, Wenyue Hua, William Yang Wang +2
2025-06-03
Computation and Language · Computer Science
Evaluation of General Large Language Models in Contextually Assessing Semantic Concepts Extracted from Adult Critical Care Electronic Health Record Notes
Darren Liu, Cheng Ding, Delgersuren Bold, Monique Bouvier +15
2024-01-25
Computation and Language · Computer Science
Large Language Model Benchmarks in Medical Tasks
Lawrence K. Q. Yan, Qian Niu, Ming Li, Yichao Zhang +15
2025-11-13
Computation and Language · Computer Science
Do We Still Need Clinical Language Models?
Eric Lehman, Evan Hernandez, Diwakar Mahajan, Jonas Wulff +6
2023-02-17
Computation and Language · Computer Science
Large Language Models for Disease Diagnosis: A Scoping Review
Shuang Zhou, Zidu Xu, Mian Zhang, Chunpu Xu +13
2025-06-24
Computation and Language · Computer Science
From Fuzzy Speech to Medical Insight: Benchmarking LLMs on Noisy Patient Narratives
Eden Mama, Liel Sheri, Yehudit Aperstein, Alexander Apartsin
2025-09-16
Computation and Language · Computer Science
Datasets for Large Language Models: A Comprehensive Survey
Yang Liu, Jiahuan Cao, Chongyu Liu, Kai Ding +1
2024-02-29