中文

评估与优化 ChatGPT 在识别针对性语言与不当语言中的表现:一项比较研究

计算与语言 2025-05-29 v1

摘要

本研究评估了 ChatGPT(一种先进的自然语言处理 AI 模型)在识别在线评论中针对性语言和不当语言方面的有效性。随着在社交网络站点上审核海量用户生成内容的挑战日益增加,AI 在内容审核中的作用日益凸显。我们将 ChatGPT 的表现与众包标注和专家评估进行了比较,以评估其准确性、检测范围和一致性。研究结果表明,ChatGPT 在检测不当内容方面表现良好,通过迭代优化显著提高了准确性,尤其是在 Version 6 中。然而,其在针对性语言检测方面的表现存在变异性,与专家判断相比误报率较高。本研究通过展示像 ChatGPT 这样的 AI 模型在增强自动化内容审核系统方面的潜力,同时指出进一步改进的领域,为该领域做出了贡献。结果强调了持续优化模型和理解上下文的重要性,以更好地支持自动化审核并减少有害的在线行为。

关键词

引用

@article{arxiv.2505.21710,
  title  = {Assessing and Refining ChatGPT's Performance in Identifying Targeting and Inappropriate Language: A Comparative Study},
  author = {Barbarestani Baran and Maks Isa and Vossen Piek},
  journal= {arXiv preprint arXiv:2505.21710},
  year   = {2025}
}