中文

从语音到画像:一种协议驱动的LLM智能体用于心理画像生成

声音 2026-04-14 v1

摘要

结构性地记录抑郁症患者案例的心理画像对于心理治疗至关重要。大型语言模型可用于从咨询语音中总结画像,然而,由于语音过长、多方交互和非结构化聊天,它可能遭受长上下文遗忘并产生无法验证的幻觉。为此,我们提出了StreamProfile,一个流式框架,它增量式地处理咨询语音,通过将自动语音识别(ASR)转录文本存储在分层证据记忆中提取基于证据的信息,然后根据PM+心理干预执行思维链(Chain-of-Thought)流程进行临床推理。最终的画像严格从这些证据中综合生成,使得每一项声明都可追溯。在真实青少年咨询语音上的实验表明,所提出的StreamProfile系统能够准确生成画像并防止幻觉。

关键词

引用

@article{arxiv.2604.10161,
  title  = {From Speech to Profile: A Protocol-Driven LLM Agent for Psychological Profile Generation},
  author = {Xingjian Yang and Yudong Yang and Zhixing Guo and Yongjie Zhou and Nan Yan and Lan Wang},
  journal= {arXiv preprint arXiv:2604.10161},
  year   = {2026}
}