中文

基于意图感知提示的对话心理操纵检测

计算与语言 2024-12-12 v1

摘要

心理操纵严重损害心理健康,通过隐式且消极地扭曲决策。尽管越来越多的关注力向心理健康护理,但针对对话中隐蔽操纵手段的检测仍受限于其复杂性。在本文中,我们提出意图感知提示(IAP),这是一种新方法,用于使用大型语言模型(LLM)检测心理操纵,通过捕捉参与者潜在意图来提供对操纵手段的更深入理解。在MentalManip数据集上的实验结果表明,IAP在其他先进提示策略方面具有卓越的效果。值得注意的是,我们的方法显著减少了假阴性,帮助检测更多心理操纵实例,同时对正面案例的误判最小化。本文的代码可在https://github.com/Anton-Jiayuan-MA/Manip-IAP获得。

关键词

引用

@article{arxiv.2412.08414,
  title  = {Detecting Conversational Mental Manipulation with Intent-Aware Prompting},
  author = {Jiayuan Ma and Hongbin Na and Zimu Wang and Yining Hua and Yue Liu and Wei Wang and Ling Chen},
  journal= {arXiv preprint arXiv:2412.08414},
  year   = {2024}
}