中文

大型语言模型用于生成规则,是的还是不是?

软件工程 2024-06-12 v1

摘要

工程安全关键系统如医疗器械和数字健康干预系统是复杂的,需要与 subject-matter experts(领域专家)长期互动以捕获系统预期行为。在本文中,我们提出了一种新方法,利用大型语言模型(如GPT-3.5和GPT-4)作为潜在世界模型来加速软件系统的工程化。该方法涉及使用LLM生成逻辑规则,然后在部署前由专家审核和信息化。我们使用一个来自新冠疫情期间与医疗专业人员合作开发的医疗规则集进行评估。我们的实验表明:1)LLM具有引导实现的世界模型,2)LLM生成的规则数量少于专家,以及3)LLM缺乏为每条规则生成阈值的能力。我们的工作表明,LLM通过提供领域访问世界模型,增强了需求elicitation过程。

关键词

引用

@article{arxiv.2406.06835,
  title  = {Large language models for generating rules, yay or nay?},
  author = {Shangeetha Sivasothy and Scott Barnett and Rena Logothetis and Mohamed Abdelrazek and Zafaryab Rasool and Srikanth Thudumu and Zac Brannelly},
  journal= {arXiv preprint arXiv:2406.06835},
  year   = {2024}
}

备注

5 pages, 1 figure