你是谁,ChatGPT?大语言模型生成内容中的人格与人口统计特征
计算与语言
2025-10-14 v1
摘要
生成式大型语言模型(LLMs)已成为日常生活中核心要素,跨越多种领域产生类人文本。日益增长的研究探讨这些模型是否在语言中展现出人格或人口统计类特征。本文引入一种新颖的数据驱动方法,用于评估大语言模型的人格,无需依赖自报问卷,而是对模型在 Reddit 上收集的开放式问题回答应用自动人格和性别分类器。将六种广泛使用的模型与人类撰写的回答进行比较,我们发现大语言模型系统性地表现出更高的宜人性(Agreeableness)和更低的神经质(Neuroticism),反映出合作性和稳定的对话倾向。模型文本中的性别化语言模式大体上类似于人类作家,尽管变异性较低,呼应了关于自动化代理人的先行研究发现。我们贡献了一个新的人类与模型回答数据集,以及大规模比较分析,为人格和人口统计模式研究添砖加瓦。
引用
@article{arxiv.2510.11434,
title = {Who are you, ChatGPT? Personality and Demographic Style in LLM-Generated Content},
author = {Dana Sotto Porat and Ella Rabinovich},
journal= {arXiv preprint arXiv:2510.11434},
year = {2025}
}
备注
ECAI2025 (Identity-Aware AI workshop)