中文

AI 模型如何处理「性」话题:探索大语言模型处理亲密对话的方式

计算机与社会 2026-02-10 v1 信息论 math.IT

摘要

本研究通过定性内容分析检验四款主流大型语言模型(Claude 3.7 Sonnet、GPT-4o、Gemini 2.5 Flash 和 Deepseek-V3)处理性导向请求的方式。通过评估模型对从明确性场景到教育性和中性对照场景的提示作出的响应,研究揭示了反映根本不同伦理立场的差异化 Moderation 范式。Claude 3.7 Sonnet 采用严格且一致的禁令,GPT-4o 通过细腻的情境性重导向来导航用户交互,Gemini 2.5 Flash 表现出包容性且带有阈值限制,Deepseek-V3 则显示出令人担忧的边界执行不一致和表演性拒绝。这些各异的做法导致显著的「伦理实施差距」,凸显了跨平台缺乏统一伦理框架和标准的关键问题。研究结果强调,为确保 AI 系统在日益中介化的人类亲密生活方面保持一致的 Moderation、保护用户福祉并维持信任的紧迫需求,亟需透明、标准化的指南方针,以及协调的国际治理。

关键词

引用

@article{arxiv.2506.05514,
  title  = {Can LLMs Talk 'Sex'? Exploring How AI Models Handle Intimate Conversations},
  author = {Huiqian Lai},
  journal= {arXiv preprint arXiv:2506.05514},
  year   = {2026}
}

备注

6 pages, 1 figure, accepted as a short paper at ASIS&T Annual Meeting 2025