大语言模型的文化偏见与文化对齐
计算与语言
2024-09-20 v2 人工智能
摘要
文化从根本上塑造人们的推理、行为与沟通方式。随着人们越来越多地使用生成式人工智能(AI)来加快和自动化个人与专业任务,嵌入AI模型中的文化价值观可能使人们的真实表达产生偏见,并助长某些文化的主导地位。我们通过将模型的响应与全国代表性调查数据进行比较,对五种广泛使用的大语言模型(OpenAI的GPT-4o/4-turbo/4/3.5-turbo/3)进行了文化偏见的分类评估。所有模型都表现出类似于英语国家和新教欧洲国家的文化价值观。我们测试了文化提示作为一种控制策略,以提高每个国家/地区的文化对齐度。对于近期模型(GPT-4、4-turbo、4o),这改善了71%至81%的国家和地区模型输出的文化对齐。我们建议使用文化提示和持续评估来减少生成式AI输出中的文化偏见。
引用
@article{arxiv.2311.14096,
title = {Cultural Bias and Cultural Alignment of Large Language Models},
author = {Yan Tao and Olga Viberg and Ryan S. Baker and Rene F. Kizilcec},
journal= {arXiv preprint arXiv:2311.14096},
year = {2024}
}