中文

基于神经网络的标题党识别

计算与语言 2017-10-25 v1

摘要

本文展示了我们参与 2017 年标题党检测挑战赛的结果。该系统依赖于神经网络的融合,整合了不同类型的可用信息。它不需要任何语言预处理,因此更容易泛化到新的领域和语言。最终组合模型的均方误差为 0.0428,准确率为 0.826,F1 分数为 0.564。根据官方评估指标,该系统在 13 支参赛队伍中排名第 6。

关键词

引用

@article{arxiv.1710.08721,
  title  = {Clickbait Identification using Neural Networks},
  author = {Philippe Thomas},
  journal= {arXiv preprint arXiv:1710.08721},
  year   = {2017}
}