Med42-v2:一套临床大语言模型
计算与语言
2024-08-13 v1 人工智能
摘要
Med42-v2 引入了一套临床大语言模型(LLM),旨在解决通用模型在医疗场景中的局限性。这些模型基于 Llama3 架构,并使用专门的临床数据进行微调。它们经过多阶段偏好对齐,以有效响应自然提示。虽然通用模型通常出于谨慎考虑被偏好对齐以避免回答临床问题,但 Med42-v2 专门针对这一局限性进行了训练,使其能够在临床环境中使用。Med42-v2 模型在 8B 和 70B 参数配置以及 GPT-4 的各种医学基准测试中表现出优于原始 Llama3 模型的性能。这些 LLM 旨在理解临床查询、执行推理任务,并在临床环境中提供有价值的协助。该模型现已在 https://huggingface.co/m42-health 公开获取。
引用
@article{arxiv.2408.06142,
title = {Med42-v2: A Suite of Clinical LLMs},
author = {Clément Christophe and Praveen K Kanithi and Tathagata Raha and Shadab Khan and Marco AF Pimentel},
journal= {arXiv preprint arXiv:2408.06142},
year = {2024}
}