中文

工业标准中需求表达的自动抽取:迈向机器可读标准之路?

信息检索 2021-12-28 v1

摘要

本出版物所介绍的、由工业资助的项目旨在对描述适用于电器设备之要求的规范性文档进行语义分析。该项目目标是构建一种语义方法,以抽取并自动处理标准中所包含需求的相关信息。为此,项目被划分为三个部分,涵盖需求文档分析、相关信息抽取与本体构建,以及与其他方法的比较。我们工作的第一部分处理所研究需求文档的分析,重点考察句子结构的特殊性、特定词语的使用以及与需求表示相关的词汇。目的是提出一种便于信息抽取的表示方式,用于研究的第二部分。在第二部分中,相关信息抽取通过两种方式进行:手动(本体由人工构建)、半自动(使用语义标注软件与自然语言处理技术)。无论采用何种方法,该抽取的目的都是创建概念词典,进而构建本体,并随文档被系统扫描和理解而不断扩充。一旦识别出相关术语,工作便聚焦于需求的识别与表示,将文本表述与表格中给出的信息分离。需求的自动处理涉及抽取包含被识别为与某需求相关之术语的句子。随后该被识别需求被索引并存储于可用于查询处理的表示中。

关键词

引用

@article{arxiv.2112.13091,
  title  = {Automatic extraction of requirements expressed in industrial standards : a way towards machine readable standards ?},
  author = {Helene de Ribaupierre and Anne-Francoise Cutting-Decelle and Nathalie Baumier and Serge Blumental},
  journal= {arXiv preprint arXiv:2112.13091},
  year   = {2021}
}