多大语言模型协同以医学问答
计算与语言
2025-05-23 v1 人工智能
摘要
新一代大型语言模型(LLM)凭借庞大的内部知识储备,展现出应对医学任务的潜在能力。然而,目前缺乏对多个 LLM 专长与背景协同发挥作用的探索。本研究提出一种针对医学多选问答数据集的多 LLM 协作框架。通过对 3 个预训练 LLM 参与者进行的后验分析,我们证实了该框架能够提升所有 LLM 的推理能力,同时减轻问题间的差异性。我们还测量了当 LLM 面对来自其他 LLM 的对抗性意见时的置信水平,观察到 LLM 的置信度与预测准确率之间存在一致性。
引用
@article{arxiv.2505.16648,
title = {Collaboration among Multiple Large Language Models for Medical Question Answering},
author = {Kexin Shang and Chia-Hsuan Chang and Christopher C. Yang},
journal= {arXiv preprint arXiv:2505.16648},
year = {2025}
}
备注
Accepted to IEEE International Conference on Healthcare Informatics 2025