中文

面向LLM-based集合智慧演进与基准测试的OpenHospital

人工智能 2026-03-18 v2

摘要

大型语言模型( LLM)基于集合智慧(CI)的方案为克服数据瓶颈并持续提升LLM智能体能力提供了前景。然而,目前尚无专门的竞技场用于演进和基准测试LLM-based CI。为填补这一空白,我们引入OpenHospital,一个智能体在与患者智能体交互的过程中进行CI演进的交互式竞技场。该竞技场采用数据在智能体自身内部的范式,快速提升智能体能力,并为评估医学专业能力和系统效率提供稳健的评估指标。实验表明,OpenHospital在促进和量化CI方面均显示出有效性。

关键词

引用

@article{arxiv.2603.14771,
  title  = {OpenHospital: A Thing-in-itself Arena for Evolving and Benchmarking LLM-based Collective Intelligence},
  author = {Peigen Liu and Rui Ding and Yuren Mao and Ziyan Jiang and Yuxiang Ye and Yunjun Gao and Ying Zhang and Renjie Sun and Longbin Lai and Zhengping Qian},
  journal= {arXiv preprint arXiv:2603.14771},
  year   = {2026}
}