Computation and Language · Computer Science
Harnessing Collective Intelligence of LLMs for Robust Biomedical QA: A Multi-Model Approach
Dimitra Panou, Alexandros C. Dimopoulos, Manolis Koubarakis, Martin Reczko
2025-08-05
Computation and Language · Computer Science
AraHealthQA 2025: The First Shared Task on Arabic Health Question Answering
Hassan Alhuzali, Walid Al-Eisawi, Muhammad Abdul-Mageed, Chaimae Abouzahir +8
2025-09-16
Computation and Language · Computer Science
Enabling Doctor-Centric Medical AI with LLMs through Workflow-Aligned Tasks and Benchmarks
Wenya Xie, Qingying Xiao, Yu Zheng, Xidong Wang +7
2025-10-14
Computation and Language · Computer Science
Large Language Models in the Clinic: A Comprehensive Benchmark
Fenglin Liu, Zheng Li, Hongjian Zhou, Qingyu Yin +15
2024-10-17
Computation and Language · Computer Science
CounselBench: A Large-Scale Expert Evaluation and Adversarial Benchmarking of Large Language Models in Mental Health Question Answering
Yahan Li, Jifan Yao, John Bosco S. Bunyi, Adam C. Frank +2
2026-05-15
Computation and Language · Computer Science
Overview of BioASQ 2025: The Thirteenth BioASQ Challenge on Large-Scale Biomedical Semantic Indexing and Question Answering
Anastasios Nentidis, Georgios Katsimpras, Anastasia Krithara, Martin Krallinger +16
2025-08-29
Computer Vision and Pattern Recognition · Computer Science
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
Hongyu Ge, Longkun Hao, Zihui Xu, Zhenxin Lin +4
2025-07-14
Computation and Language · Computer Science
ClarQ-LLM: A Benchmark for Models Clarifying and Requesting Information in Task-Oriented Dialog
Yujian Gan, Changling Li, Jinxia Xie, Luou Wen +2
2024-09-17
Computation and Language · Computer Science
ELLIS Alicante at CQs-Gen 2025: Winning the critical thinking questions shared task: LLM-based question generation and selection
Lucile Favero, Daniel Frases, Juan Antonio Pérez-Ortiz, Tanja Käser +1
2025-06-18
Computation and Language · Computer Science
PULSAR: Pre-training with Extracted Healthcare Terms for Summarising Patients' Problems and Data Augmentation with Black-box Large Language Models
Hao Li, Yuping Wu, Viktor Schlegel, Riza Batista-Navarro +6
2023-06-06
Computation and Language · Computer Science
COGNET-MD, an evaluation framework and dataset for Large Language Model benchmarks in the medical domain
Dimitrios P. Panagoulias, Persephone Papatheodosiou, Anastasios P. Palamidas, Mattheos Sanoudos +3
2024-05-20
Computation and Language · Computer Science
QuarkMedBench: A Real-World Scenario Driven Benchmark for Evaluating Large Language Models
Yao Wu, Kangping Yin, Liang Dong, Zhenxin Ma +12
2026-03-17
Computation and Language · Computer Science
LongHealth: A Question Answering Benchmark with Long Clinical Documents
Lisa Adams, Felix Busch, Tianyu Han, Jean-Baptiste Excoffier +6
2024-01-29
Computer Vision and Pattern Recognition · Computer Science
Building a Human-Verified Clinical Reasoning Dataset via a Human LLM Hybrid Pipeline for Trustworthy Medical AI
Chao Ding, Mouxiao Bian, Pengcheng Chen, Hongliang Zhang +10
2025-05-13
Computation and Language · Computer Science
Overview of the BioLaySumm 2023 Shared Task on Lay Summarization of Biomedical Research Articles
Tomas Goldsack, Zheheng Luo, Qianqian Xie, Carolina Scarton +3
2023-10-26
Computation and Language · Computer Science
Overview of the MedHopQA track at BioCreative IX: track description, participation and evaluation of systems for multi-hop medical question answering
Rezarta Islamaj, Joey Chan, Robert Leaman, Jongmyung Jung +12
2026-05-13
Artificial Intelligence · Computer Science
ClinAlign: Scaling Healthcare Alignment from Clinician Preference
Shiwei Lyu, Xidong Wang, Lei Liu, Hao Zhu +5
2026-02-12
Computation and Language · Computer Science
Overview of BioASQ 2021: The ninth BioASQ challenge on Large-Scale Biomedical Semantic Indexing and Question Answering
Anastasios Nentidis, Georgios Katsimpras, Eirini Vandorou, Anastasia Krithara +3
2021-09-16
Computation and Language · Computer Science
UMASS_BioNLP at MEDIQA-Chat 2023: Can LLMs generate high-quality synthetic note-oriented doctor-patient conversations?
Junda Wang, Zonghai Yao, Avijit Mitra, Samuel Osebe +2
2023-06-30
Computation and Language · Computer Science
Overview of BioASQ 2023: The eleventh BioASQ challenge on Large-Scale Biomedical Semantic Indexing and Question Answering
Anastasios Nentidis, Georgios Katsimpras, Anastasia Krithara, Salvador Lima López +4
2024-07-10
Computation and Language · Computer Science
A Benchmark for Long-Form Medical Question Answering
Pedram Hosseini, Jessica M. Sin, Bing Ren, Bryceton G. Thomas +3
2024-11-21
Computation and Language · Computer Science
CliMedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models in Clinical Scenarios
Zetian Ouyang, Yishuai Qiu, Linlin Wang, Gerard de Melo +3
2024-10-07
Computation and Language · Computer Science
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
Hanjie Chen, Zhouxiang Fang, Yash Singla, Mark Dredze
2026-02-19
Computation and Language · Computer Science
CLINIQA: A Machine Intelligence Based Clinical Question Answering System
M A H Zahid, Ankush Mittal, R. C. Joshi, G. Atluri
2018-05-16
Computation and Language · Computer Science
LLMs for Doctors: Leveraging Medical LLMs to Assist Doctors, Not Replace Them
Wenya Xie, Qingying Xiao, Yu Zheng, Xidong Wang +6
2024-06-27