大语言模型反映了其创造者的意识形态
计算与语言
2025-01-31 v2 机器学习
摘要
大语言模型(LLMs)在海量数据上训练以生成自然语言,使其能够执行文本摘要和问答等任务。这些模型在ChatGPT等人工智能助手中广受欢迎,并在人类获取信息方面发挥着越来越有影响力的作用。然而,LLMs的行为因其设计、训练和用途而异。在本文中,我们提示一组广受欢迎的LLMs,用联合国全部六种官方语言描述众多具有政治关联性的知名人物。通过识别和分析其回答中反映的道德评判,我们发现了来自不同地缘政治区域的LLMs之间,以及同一LLM在不同语言提示下,在规范性判断上存在显著差异。在美国的模型中,我们发现普遍假设的政治观点差异体现在进步价值观方面的规范性差异上。在中国模型中,我们描述了面向国际和面向国内的模型之间的分歧。我们的结果表明,LLM的意识形态立场反映了其创造者的世界观。这带来了政治工具化的风险,并对那些旨在使LLM意识形态“无偏”的技术和监管努力提出了担忧。
引用
@article{arxiv.2410.18417,
title = {Large Language Models Reflect the Ideology of their Creators},
author = {Maarten Buyl and Alexander Rogiers and Sander Noels and Guillaume Bied and Iris Dominguez-Catena and Edith Heiter and Iman Johary and Alexandru-Cristian Mara and Raphaël Romero and Jefrey Lijffijt and Tijl De Bie},
journal= {arXiv preprint arXiv:2410.18417},
year = {2025}
}