SLIP与ETHICS:面向AI情感伴侣的渐进式干预
人机交互
2026-05-18 v1 人工智能
计算与语言
摘要
AI情感伴侣面临一个安全-融洽悖论:限制性安全措施可能损害支持性联盟,而宽松的系统则可能带来用户伤害风险。我们提出了SLIP(分阶段干预协议层),这是一种四阶段渐进式方法,从结构化的定性指标——情感强度(a)和叙事动态性(m)——中推导出干预措施(无、软性、硬性),并辅以ETHICS(人机交互情境信号的涌现分类法),一种“信号而非标签”的分类法。一项结合了小规模生产部署(N=68条记录,10名用户,10周)与合成角色测试集(N=91,5种行为风险画像)的评估显示,对于流畅型角色,误报率为0%,并且在危机导向型角色中显示出预期的升级模式。然而,初步结果显示,连续8天的高能量提升产生了零干预(0/8),暴露了“不病理化”原则与安全性相冲突的边界。随后进行的三模型压力测试表明,模型能力的提升将检测率从0/8提高到6/8,同时在最大模型中保持了0/10的流畅型角色误报率。作为初步研究,这些发现将渐进式干预定位为一种设计方向,用于应对——而非解决——情感计算中的安全-融洽张力。
引用
@article{arxiv.2605.15915,
title = {SLIP & ETHICS: Graduated Intervention for AI Emotional Companions},
author = {Minseo Kim},
journal= {arXiv preprint arXiv:2605.15915},
year = {2026}
}
备注
Accepted to PervasiveHealth 2026. 11 pages, 2 figures, 4 tables. Proc. of the 20th EAI International Conference on Pervasive Computing Technologies for Healthcare (PervasiveHealth 2026)