中文

利用预训练短语打分模型构建基于词法匹配与摘要的法律案例检索系统

计算与语言 2020-09-30 v1

摘要

我们介绍了参与 2019 年法律信息抽取/蕴涵竞赛(COLIEE)法律案例检索任务的方法。我们的方法基于摘要对检索十分重要的理念。一方面,我们采用一种称为编码摘要的基于摘要的模型,其将给定文档编码进连续向量空间,该空间嵌入了文档的摘要属性。我们利用 COLIEE 2018 的资源训练该文档表示模型。另一方面,我们在给定查询及其候选的不同部分上抽取词法特征。我们观察到通过比较查询及其候选的不同部分可获得更好性能。此外,词法特征与基于摘要方法的隐特征的结合取得了更优性能。我们在该竞赛基准上取得了任务的 SOTA 结果。

关键词

引用

@article{arxiv.2009.14083,
  title  = {Building Legal Case Retrieval Systems with Lexical Matching and Summarization using A Pre-Trained Phrase Scoring Model},
  author = {Vu Tran and Minh Le Nguyen and Ken Satoh},
  journal= {arXiv preprint arXiv:2009.14083},
  year   = {2020}
}