中文

PatentMatch:用于专利权利要求与现有技术匹配的数据集

信息检索 2020-12-29 v1 数字图书馆

摘要

专利审查员在评估专利申请中权利要求的新颖性与创造性步骤时需解决一项复杂的信息检索任务。给定一项权利要求,他们需检索现有技术,即所有相关的公开可用信息。这一耗时任务要求对相应技术领域及专利领域专用语言有深入理解。出于这些原因,我们通过创建名为 PatentMatch 的监督式机器学习训练数据集来辅助计算机检索现有技术。它包含来自专利申请的权利要求对,以及与所引专利文献中不同程度语义对应文本段落的对。每对均由来自欧洲专利局具备技术能力的专利审查员标注。相应地,标签指示语义对应(匹配)程度,即该文本段落是否对要求保护发明的新颖性构成妨碍。使用基线系统的初步实验表明,PatentMatch 确实可用于在此具挑战性的信息检索任务上训练二值文本对分类器。数据集在线可用:https://hpi.de/naumann/s/patentmatch。

关键词

引用

@article{arxiv.2012.13919,
  title  = {PatentMatch: A Dataset for Matching Patent Claims & Prior Art},
  author = {Julian Risch and Nicolas Alder and Christoph Hewel and Ralf Krestel},
  journal= {arXiv preprint arXiv:2012.13919},
  year   = {2020}
}

备注

https://hpi.de/naumann/s/patentmatch