浪漫 AI 伴侣中的隐式偏见研究
人工智能
2025-02-28 v1
摘要
虽然已有研究认识到生成模型中存在显性偏见,包括职业性别偏见,但性别刻板印象和对用户与 AI 伴侣之间关系期望的细微差异仍未得到充分探讨。与此同时,AI 伴侣日益流行,被用作用户的朋友或性别化的浪漫伴侣。本研究通过设计三个针对浪漫、性别指定 AI 伴侣及其用户的实验,有效评估了不同规模大型语言模型中的隐式偏见。每个实验关注不同的维度:隐式联想、情感响应和从众行为。这项研究旨在通过量化分析 persona 指定模型对基线的响应来衡量和比较不同伴侣系统中呈现的偏见。值得注意的结果表明,为大型语言模型分配性别化、关系人格显著改变了这些模型的响应方式,并且在某些情况下以偏置、刻板的方式呈现。
引用
@article{arxiv.2502.20231,
title = {AI Will Always Love You: Studying Implicit Biases in Romantic AI Companions},
author = {Clare Grogan and Jackie Kay and María Pérez-Ortiz},
journal= {arXiv preprint arXiv:2502.20231},
year = {2025}
}