中文

究竟是谁的 LLM?GPT-3.5、GPT-4 与 Bard 的语言学比较及 LLM 归属识别

计算与语言 2025-09-03 v2

摘要

大型语言模型(LLM)能够生成与人类质量相似甚至超越人类的文本。然而,目前尚不清楚 LLM 是否会像人类作者那样表现出独特的语言风格。通过全面的语言学分析,我们比较了当今最流行的三个 LLM(GPT-3.5、GPT-4 和 Bard)针对多种输入所生成文本的词汇、词性(POS)分布、依存分布及情感。结果表明存在显著的语言学差异,这进而使我们能够使用简单的现成分类模型,以 88% 的理想准确率将给定文本归属至其 LLM 来源。本文讨论了这一有趣发现的理论与实践意义。

关键词

引用

@article{arxiv.2402.14533,
  title  = {Whose LLM is it Anyway? Linguistic Comparison and LLM Attribution for GPT-3.5, GPT-4 and Bard},
  author = {Ariel Rosenfeld and Teddy Lazebnik},
  journal= {arXiv preprint arXiv:2402.14533},
  year   = {2025}
}