中文

立场声明:防止 AI 生成的儿童性虐待材料需要新的 AI 安全方法

计算机与社会 2026-06-09 v1 人工智能

摘要

现代人工智能(AI)系统对儿童安全构成了深远的全新风险。AI 正越来越多地被滥用于生成 AI 生成的儿童性虐待材料、助长儿童性剥削以及降低伤害的门槛。在本文中,我们认为保护儿童免受 AI 助长的性虐待需要新的 AI 安全方法。现有安全技术假设的数据可访问性、透明度和评估实践与围绕儿童性虐待材料的伦理和法律约束不相容。我们审视了这些约束如何产生新的技术挑战,例如数据集审计、红队测试和微调预防方面的限制。进而,我们概述了 AI 开发生命周期中在线儿童性剥削和虐待的 *15 个开放问题*,涵盖从数据集整理和模型设计到部署和长期维护。我们为研究人员、开发者和政策制定者提出了有针对性的建议,以弥合理论 AI 安全与儿童保护现实之间的差距。我们的工作旨在将防止 AI 助长的儿童性虐待重新定位为 AI 研究的核心安全关键维度,激励将负责任的 AI 原则转化为针对儿童剥削的具体保障措施。

关键词

引用

@article{arxiv.2607.05407,
  title  = {Position: Preventing AI-Generated CSAM Necessitates New Approaches to AI Safety},
  author = {Neil Kale and Rebecca Portnoff and Pratiksha Thaker and Michael Simpson and Robertson Wang and Kevin Kuo and Chhavi Yadav and Virginia Smith},
  journal= {arXiv preprint arXiv:2607.05407},
  year   = {2026}
}

备注

Accepted (spotlight) in ICML 2026, Position Paper Track. The first two authors contributed equally and may list their names interchangeably