面向信息检索的科学摘要标注
信息检索
2011-10-27 v1
摘要
我们提出了一种结合表层自然语言处理与机器学习技术的方法,用于对摘要进行排序并基于标注语料库生成摘要。语料库以元语义标签进行标注,这些标签指明句子所承载的信息类别(目标、发现、新事物、假设、结论、未来工作、相关工作)。标注后的语料库被输入一个自动摘要器,以用于面向查询的摘要排序与多摘要摘要生成。为使摘要器适应这两项任务,我们设计了两个新的加权函数,以考虑语料库中标签的分布。结果虽仍属初步,但令人鼓舞,促使我们继续推进这一研究方向,并寻找更好的方式来构建能够利用语料库中语义标注的信息检索系统。
引用
@article{arxiv.1110.5722,
title = {Annotation of Scientific Summaries for Information Retrieval},
author = {Fidelia Ibekwe-Sanjuan and Fernandez Silvia and Sanjuan Eric and Charton Eric},
journal= {arXiv preprint arXiv:1110.5722},
year = {2011}
}
备注
ECIR'08 Workshop on: Exploiting Semantic Annotations for Information Retrieval, Glasgow : United Kingdom (2008)