面向LLM-based集合智慧演进与基准测试的OpenHospital
人工智能
2026-03-18 v2
摘要
大型语言模型( LLM)基于集合智慧(CI)的方案为克服数据瓶颈并持续提升LLM智能体能力提供了前景。然而,目前尚无专门的竞技场用于演进和基准测试LLM-based CI。为填补这一空白,我们引入OpenHospital,一个智能体在与患者智能体交互的过程中进行CI演进的交互式竞技场。该竞技场采用数据在智能体自身内部的范式,快速提升智能体能力,并为评估医学专业能力和系统效率提供稳健的评估指标。实验表明,OpenHospital在促进和量化CI方面均显示出有效性。
引用
@article{arxiv.2603.14771,
title = {OpenHospital: A Thing-in-itself Arena for Evolving and Benchmarking LLM-based Collective Intelligence},
author = {Peigen Liu and Rui Ding and Yuren Mao and Ziyan Jiang and Yuxiang Ye and Yunjun Gao and Ying Zhang and Renjie Sun and Longbin Lai and Zhengping Qian},
journal= {arXiv preprint arXiv:2603.14771},
year = {2026}
}