从Reddit到生成式AI:评估微调于社交媒体数据的大型语言模型在焦虑支持中的应用
人机交互
2025-05-27 v1 人工智能
计算与语言
计算机与社会
摘要
对可及性心理健康支持日益增长的需求,加上人力短缺和后勤障碍,导致对利用大型语言模型(LLM)进行可扩展和实时辅助的兴趣增加。然而,它们在焦虑支持等敏感领域的应用仍未被充分研究。本研究通过使用来自r/Anxiety子论坛的真实用户生成帖子进行提示和微调,对LLMs(GPT和Llama)在焦虑支持方面的潜在效用进行了系统评估。我们的方法采用混合方法评估框架,包含三个主要类别的标准:(i)语言质量,(ii)安全性和可信度,以及(iii)支持性。结果表明,利用自然主义焦虑相关数据微调LLMs提升了语言质量,但增加了毒性和偏见,并降低了情绪响应性。虽然LLMs表现出有限的共情能力,但GPT在整体上被评估为更具支持性。我们的发现强调了在没有缓解策略的情况下,利用未经处理的社交媒体内容微调LLMs的风险。
引用
@article{arxiv.2505.18464,
title = {From Reddit to Generative AI: Evaluating Large Language Models for Anxiety Support Fine-tuned on Social Media Data},
author = {Ugur Kursuncu and Trilok Padhi and Gaurav Sinha and Abdulkadir Erol and Jaya Krishna Mandivarapu and Christopher R. Larrison},
journal= {arXiv preprint arXiv:2505.18464},
year = {2025}
}