中文

合作、竞争与恶意行为:LLM 利益相关者交互式谈判的可重复性研究

人工智能 2025-02-25 v1

摘要

本文对“合作、竞争与恶意行为:LLM 利益相关者交互式谈判”进行可重复性研究与扩展。我们使用1.5B至70B参数的开源模型和GPT-4o Mini验证了原研究结果,并引入了若干新贡献。我们分析了游戏的帕累托前沿,提出一种无通信的基线测试在无代理交互的情况下是否可能实现成功的谈判,评估了近期小型语言模型的性能,分析了模型响应中结构信息泄露,并实现了一种不平等度度量以评估谈判公平性。我们的结果表明,参数不足10B的模型在格式遵循和连贯响应方面存在挑战,但更大的开源模型可接近专有模型性能。此外,在许多情景下,单智能体方法可实现与多智能体谈判相当的效果,挑战了代理通信是完成该基准测试必要性的假设。本工作还提供了关于 LLM 基于谈判系统可访问性、公平性、环境影响和隐私考虑的见解。

关键词

引用

@article{arxiv.2502.16242,
  title  = {Reproducibility Study of Cooperation, Competition, and Maliciousness: LLM-Stakeholders Interactive Negotiation},
  author = {Jose L. Garcia and Karolina Hajkova and Maria Marchenko and Carlos Miguel Patiño},
  journal= {arXiv preprint arXiv:2502.16242},
  year   = {2025}
}