中文

医疗领域大型语言模型摘要任务评估:叙事综述

计算与语言 2024-09-30 v1 人工智能

摘要

大型语言模型正在推动临床自然语言生成,为管理医疗文本的庞大量创造了机遇。然而,医疗领域的高风险性质要求具备可靠的评估,而这仍然是一个挑战。本文进行了一篇叙事综述,评估了临床摘要任务的当前评估状况,并提出了未来方向,以解决专家人类评估资源受限的难题。

关键词

引用

@article{arxiv.2409.18170,
  title  = {Evaluation of Large Language Models for Summarization Tasks in the Medical Domain: A Narrative Review},
  author = {Emma Croxford and Yanjun Gao and Nicholas Pellegrino and Karen K. Wong and Graham Wills and Elliot First and Frank J. Liao and Cherodeep Goswami and Brian Patterson and Majid Afshar},
  journal= {arXiv preprint arXiv:2409.18170},
  year   = {2024}
}