究竟是谁的 LLM?GPT-3.5、GPT-4 与 Bard 的语言学比较及 LLM 归属识别
计算与语言
2025-09-03 v2
摘要
大型语言模型(LLM)能够生成与人类质量相似甚至超越人类的文本。然而,目前尚不清楚 LLM 是否会像人类作者那样表现出独特的语言风格。通过全面的语言学分析,我们比较了当今最流行的三个 LLM(GPT-3.5、GPT-4 和 Bard)针对多种输入所生成文本的词汇、词性(POS)分布、依存分布及情感。结果表明存在显著的语言学差异,这进而使我们能够使用简单的现成分类模型,以 88% 的理想准确率将给定文本归属至其 LLM 来源。本文讨论了这一有趣发现的理论与实践意义。
引用
@article{arxiv.2402.14533,
title = {Whose LLM is it Anyway? Linguistic Comparison and LLM Attribution for GPT-3.5, GPT-4 and Bard},
author = {Ariel Rosenfeld and Teddy Lazebnik},
journal= {arXiv preprint arXiv:2402.14533},
year = {2025}
}