中文

CPEMH:面向心理健康筛查基础模型系统的提示驱动行为评估与保障的智能体框架

人工智能 2026-05-13 v1

摘要

本文提出 CPEMH,一个旨在评估在基于转录本的心理健康筛查数据集上运行的基础模型系统中提示驱动行为的智能体框架。CPEMH 作为大规模语言系统中行为保障的工程方法论,引入了一种编排架构,可自主执行提示策略的设计、评估与选择,从而实现对跨上下文行为变异性的系统控制。其模块化智能体设计结合了编排器、推理和评估智能体,确保了整个提示生命周期中的可追溯性、可复现性和鲁棒性。一项基于访谈转录本的自动化抑郁症筛查案例研究,展示了该框架在对话和临床敏感领域中稳定和审计基础模型行为的能力。经验教训强调了模块化编排在行为保障中的作用、稳定性优先于架构复杂性的原则,以及将 F1 分数、偏差和鲁棒性整合为核心验收标准。

关键词

引用

@article{arxiv.2605.11341,
  title  = {CPEMH: An Agentic Framework for Prompt-Driven Behavior Evaluation and Assurance in Foundation-Model Systems for Mental Health Screening},
  author = {Giuliano Lorenzoni and Ivens Portugal and Paulo Alencar and Donald Cowan},
  journal= {arXiv preprint arXiv:2605.11341},
  year   = {2026}
}

备注

4 pages, 2 figures. Accepted at the AGENT 2026 Workshop (ICSE 2026)