中文

学术剽窃之困:基于语义相似度的方法

信息检索 2021-06-09 v1 机器学习

摘要

学术剽窃如今是一个严重的问题。由于无穷尽的数字信息源的存在,当今比以往任何时候都更容易进行剽窃。好消息是,剽窃检测技术已经改进,并且足够强大,能够发现教育领域中的剽窃企图。我们现在正见证高效的剽窃检测软件在发挥作用,例如 Turnitin、iThenticate 或 SafeAssign。在引言中,我们探讨了克罗地亚学术界在高校和/或科学期刊中用于剽窃检测的软件。问题是:这就足够了吗?现有软件已被证明是成功的,然而识别改写或 obfuscation 剽窃的问题仍未解决。在本文中,我们报告了如何将语义相似度度量用于剽窃检测任务。

关键词

引用

@article{arxiv.2106.04404,
  title  = {The Struggle with Academic Plagiarism: Approaches based on Semantic Similarity},
  author = {Tedo Vrbanec and Ana Mestrovic},
  journal= {arXiv preprint arXiv:2106.04404},
  year   = {2021}
}

备注

6 pages, 1 figure, 34 references