中文

Med42-v2:一套临床大语言模型

计算与语言 2024-08-13 v1 人工智能

摘要

Med42-v2 引入了一套临床大语言模型(LLM),旨在解决通用模型在医疗场景中的局限性。这些模型基于 Llama3 架构,并使用专门的临床数据进行微调。它们经过多阶段偏好对齐,以有效响应自然提示。虽然通用模型通常出于谨慎考虑被偏好对齐以避免回答临床问题,但 Med42-v2 专门针对这一局限性进行了训练,使其能够在临床环境中使用。Med42-v2 模型在 8B 和 70B 参数配置以及 GPT-4 的各种医学基准测试中表现出优于原始 Llama3 模型的性能。这些 LLM 旨在理解临床查询、执行推理任务,并在临床环境中提供有价值的协助。该模型现已在 https://huggingface.co/m42-health 公开获取。

关键词

引用

@article{arxiv.2408.06142,
  title  = {Med42-v2: A Suite of Clinical LLMs},
  author = {Clément Christophe and Praveen K Kanithi and Tathagata Raha and Shadab Khan and Marco AF Pimentel},
  journal= {arXiv preprint arXiv:2408.06142},
  year   = {2024}
}