本体中的多语现象及面向本体的多语研究综述
人工智能
2022-10-07 v1
摘要
多语语义网已受到关注十余年。关联数据和 RDF 中的多语现象已显示出 substantial 的采用率,但自 15 年前上次综述以来,本体中的情况尚不明朗。OWL 的设计目标之一是国际化,旨在使本体可跨语言和文化使用。在此期间开展了大量改进多语本体的研究,且推测多语关联数据可使用多语本体。因此,本综述试图(i)阐明并比较多语本体的建模选项,(ii)考察现有本体的多语程度,以及(iii)评估本体编辑器管理多语本体的能力。我们确定了九种不同的多语本体建模主要方法,它们可归入以下任一类方法:使用多语标签、语言模型或基于映射的方法。我们通过一种临时的本体多语信息建模可视化模式,从设计、缺陷及其旨在解决的问题方面对它们进行比较。对于本体,我们从 BioPortal 和 LOV 仓库中提取了生产级且可访问的本体,它们中多语本体的比例至多分别为 6.77% 和 15.74%,其中大多数仅有部分翻译且都仅使用了基于标签的方法。基于一组管理多语本体的九项工具需求,对七个相关本体编辑器的评估显示工具支持存在显著差距,其中 VocBench 3 最接近满足全部需求。此现状梳理可作为新基线,并激发多语本体的新研究方向。
引用
@article{arxiv.2210.02807,
title = {A Review of Multilingualism in and for Ontologies},
author = {Frances Gillis-Webber and C. Maria Keet},
journal= {arXiv preprint arXiv:2210.02807},
year = {2022}
}
备注
22 pages, 10 figures, 8 tables; soon to be submitted to an international journal