中文

LocalGPT:美团本地生活服务中大语言模型的基准测试与提升

人工智能 2025-10-27 v3 计算与语言

摘要

大型语言模型(LLM)展现出了卓越的能力,并在各个领域取得了重大突破,从而在近年来得到了广泛应用。在此进展的基础上,我们研究了它们在本地生活服务领域的潜力。在本研究中,我们建立了一个全面的基准,并系统地评估了各种LLM在与本地生活服务相关的广泛任务上的性能。为了进一步提升其有效性,我们探索了两种关键方法:模型微调和基于智能体的工作流。我们的研究结果表明,即使是相对紧凑的7B模型也能达到与大得多的72B模型相当的性能水平,有效地平衡了推理成本和模型能力。这种优化极大地提高了在现实在线服务中部署LLM的可行性和效率,使其在本地生活应用中更加实用和易于普及。

关键词

引用

@article{arxiv.2506.02720,
  title  = {LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan},
  author = {Xiaochong Lan and Jie Feng and Jiahuan Lei and Xinlei Shi and Yong Li},
  journal= {arXiv preprint arXiv:2506.02720},
  year   = {2025}
}

备注

KDD 2025