基于神经网络的标题党识别
计算与语言
2017-10-25 v1
摘要
本文展示了我们参与 2017 年标题党检测挑战赛的结果。该系统依赖于神经网络的融合,整合了不同类型的可用信息。它不需要任何语言预处理,因此更容易泛化到新的领域和语言。最终组合模型的均方误差为 0.0428,准确率为 0.826,F1 分数为 0.564。根据官方评估指标,该系统在 13 支参赛队伍中排名第 6。
引用
@article{arxiv.1710.08721,
title = {Clickbait Identification using Neural Networks},
author = {Philippe Thomas},
journal= {arXiv preprint arXiv:1710.08721},
year = {2017}
}