无政治立场的智能?审计 Delphi 在美国争议政治议题上的回应
计算机与社会
2023-06-23 v1 人工智能
计算与语言
摘要
随着生成式语言模型在越来越广泛的情境中被部署,对其政治价值的担忧已走到前台,政治光谱各方都批评这些模型存在偏见且缺乏中立性。然而,中立性是什么以及它是否可取的问题仍未得到充分探讨。在本文中,我通过对 Delphi [arXiv:2110.07574](一个为众包伦理设计的大语言模型)的审计来审视中立性。我分析了 Delphi 相较于美国不同政治子群体如何回应政治争议性问题。我发现 Delphi 在置信度方面校准不良,并表现出显著的政治偏斜。基于这些结果,我从数据女性主义视角审视中立性问题,就中立性观念如何转移权力并进一步边缘化未被听到的声音展开讨论。这些发现有望促进关于对齐的规范性问题以及我们希望生成式模型在社会中扮演何种角色更具反思性的辩论。
引用
@article{arxiv.2306.13000,
title = {Apolitical Intelligence? Auditing Delphi's responses on controversial political issues in the US},
author = {Jonathan H. Rystrøm},
journal= {arXiv preprint arXiv:2306.13000},
year = {2023}
}