基于情感演进的文学文本制品检索与索引
信息检索
2021-06-28 v1 计算与语言
摘要
多年来,文学制品通常依据标题、元数据与关键词进行索引和检索。当用户/读者已了解特定创造性文本制品或文档时,这种检索与索引效果良好。此类索引与搜索几乎未考虑读者的兴趣与情感构成及其与书籍的映射。当一个人寻找文学文本制品时,可能不仅为获取信息,也为享受阅读之乐。对文学制品而言,关键事件中的情感跨时空演进或可作为索引与检索的关键。本文借助智能文本分析,基于情感演进间的计算关联在文学制品间建立聚类。我们创建了含1076个英文标题+20个马拉地语标题的数据库,并使用了含16559个标题及其摘要的数据库http://www.cs.cmu.edu/~dbamman/booksummaries.html。我们提出了基于情感演进的索引方法,用于检索与推荐书籍。该方法可用于创建读者感兴趣的个性化书籍标题聚类。分析清晰表明,当面向寻求特定类型书籍或创造性制品的图书爱好者时,检索与索引效果更优。该索引与检索可在书籍推荐中找到诸多现实应用。
引用
@article{arxiv.2106.13767,
title = {Sentiment Progression based Searching and Indexing of Literary Textual Artefacts},
author = {Hrishikesh Kulkarni and Bradly Alicea},
journal= {arXiv preprint arXiv:2106.13767},
year = {2021}
}
备注
12 pages, 2 figures, accepted at NLDB 2021