大语言模型能否抽象医学编码语言?
计算与语言
2024-06-10 v3
摘要
大语言模型(LLM)已成为重要的研究领域, potentially 在医疗保健领域发挥积极作用,可用于自动化计费和决策支持。然而,频繁使用的专用编码语言(如 ICD-10)常常更新且偏离自然语言格式,这可能给大语言模型在创建准确且有意义的潜在表示方面带来挑战。这引发医疗专业人员对潜在不准确或“幻觉”问题的担忧,这些问题可能直接影响患者。因此,本研究评估了大语言模型(LLM)是否了解医学代码本体并能准确生成这些代码的名称。我们评估了通用和生物医学特定生成模型(如 GPT、LLaMA-2 和 Meditron)的能力与局限性,专注于其处理领域特定术语的熟练程度。尽管结果表明大语言模型在处理编码语言方面存在困难,但我们提供了如何使这些模型更有效地推理的见解。
引用
@article{arxiv.2403.10822,
title = {Can Large Language Models abstract Medical Coded Language?},
author = {Simon A. Lee and Timothy Lindsey},
journal= {arXiv preprint arXiv:2403.10822},
year = {2024}
}