写作风格能否预测科学欺诈?
计算与语言
2017-07-14 v1
摘要
利用机器学习检测科学欺诈的问题最近被提出,一个考虑了各种通用指标的模型给出了初步的积极结果。这些结果似乎表明写作风格可以预测科学欺诈。我们重新审视了这些初始实验,并指出他们使用的留一法测试过程可能导致对可预测性的轻微高估,而且简单模型可以在一定程度上优于他们提出的模型。我们进一步探索了更抽象的语言特征,如语言复杂性和话语结构,却只得到了负面结果。然而,在分析我们的模型时,我们确实看到了一些有趣的模式:例如,科学欺诈包含较少的比较,以及不同类型的模糊限制语和呈现逻辑推理的方式。
引用
@article{arxiv.1707.04095,
title = {Is writing style predictive of scientific fraud?},
author = {Chloé Braud and Anders Søgaard},
journal= {arXiv preprint arXiv:1707.04095},
year = {2017}
}
备注
To appear in the Proceedings of the Workshop on Stylistic Variation 2017 (EMNLP), 6 pages