ChatGPT 生成的文本显示可识别的作者特征,表明其非人类撰写
计算与语言
2025-08-25 v1
摘要
大语言模型可以模仿不同的写作风格,从而生成看似由著名诗人所作的诗歌,或使用俚语让人误以为是在线上与人交谈。尽管这种风格差异可能对不熟悉的人来说并不总是可见的,但我们通常可以像语言指纹一样区分不同人的写作方式。本工作考察了语言模型是否也具有特定的指纹。通过风格分析和多维寄存器分析,我们比较了人类撰写和模型撰写的文本。我们发现,模型能够根据提示生成维基百科条目或大学论文等不同风格,但无法做到与人类难以区分。具体而言,模型在不同寄存器中生成输出的变化范围更有限。我们的研究表明,模型倾向于优先使用名词而非动词,从而展现出与人类不同的语言骨架,而人类则倾向于以高度语法化的维度(时态、 aspect、 mood)为语言锚点。复杂的语法维度可能反映出人类独特的思考方式,从而成为人工智能的指纹检测剂。
引用
@article{arxiv.2508.16385,
title = {ChatGPT-generated texts show authorship traits that identify them as non-human},
author = {Vittoria Dentella and Weihang Huang and Silvia Angela Mansi and Jack Grieve and Evelina Leivada},
journal= {arXiv preprint arXiv:2508.16385},
year = {2025}
}