剧透预警:利用自然语言处理检测书评中的剧透
计算与语言
2021-02-09 v1
摘要
本文提出一种NLP(自然语言处理)方法,利用加州大学圣地亚哥分校(UCSD)Goodreads剧透数据集检测书评中的剧透。我们探索使用LSTM、BERT与RoBERTa语言模型在句子级执行剧透检测。这与UCSD一篇论文形成对比,后者执行相同任务但在数据准备中使用手工特征。尽管弃用手工特征,我们的LSTM模型结果仍略优于UCSD团队在剧透检测上的表现。
引用
@article{arxiv.2102.03882,
title = {Spoiler Alert: Using Natural Language Processing to Detect Spoilers in Book Reviews},
author = {Allen Bao and Marshall Ho and Saarthak Sangamnerkar},
journal= {arXiv preprint arXiv:2102.03882},
year = {2021}
}