中文

LegalMidm:面向韩语大语言模型的用例驱动法律领域专化

计算与语言 2026-04-29 v1 人工智能

摘要

近年来,开源大语言模型的快速普及催生了将通用模型转化为领域专家的努力。然而,许多领域专家级 LLM 的开发使用的 dataset 和训练协议与实际应用的细微要求不符。在法律领域,精确性和可靠性至关重要,这种缺乏考虑限制了实际效用。在本研究中,我们提出一种基于法律领域实际需求的系统训练框架,特别关注韩语法律。我们引入 LegalMidm,一款韩语法律领域 LLM,并呈现构建高质量、用例驱动法律 dataset 和优化训练管道的方法。我们的做法强调与法律专业人员的合作和严格的数据策划,以确保相关性和事实准确性,证明其在关键法律任务中的有效性。

关键词

引用

@article{arxiv.2604.25297,
  title  = {LegalMidm: Use-Case-Driven Legal Domain Specialization for Korean Large Language Model},
  author = {Youngjoon Jang and Chanhee Park and Hyeonseok Moon and Young-kyoung Ham and Jiwon Moon and Jinhyeon Kim and JuKyung Jung and Heuiseok Lim},
  journal= {arXiv preprint arXiv:2604.25297},
  year   = {2026}
}

备注

ICLR 2026 DATA-FM Workshop