中文

从通用推理到领域专长:揭示大型语言模型泛化能力的极限

计算与语言 2025-06-30 v1 人工智能 计算机与社会

摘要

大型语言模型(LLM)的最新进展已在各个领域展现出卓越的能力。然而,有效的决策在很大程度上依赖于强大的推理能力。推理是决策的基础,为做出明智的选择提供了分析和逻辑框架。推理涉及分析信息、进行推断,并基于逻辑或证据得出结论。决策建立在此基础之上,通过应用推理的见解,在备选方案中选择最佳行动方案。这些过程共同形成了一个旨在有效实现目标的思维与行动的连续循环。随着人工智能技术的发展,训练LLM使其在通用推理方面表现出色已成为一种日益增长的趋势。本研究探讨了LLM的通用推理能力如何与其在特定领域推理任务中的表现相关联。

关键词

引用

@article{arxiv.2506.21580,
  title  = {From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models},
  author = {Dana Alsagheer and Yang Lu and Abdulrahman Kamal and Omar Kamal and Mohammad Kamal and Nada Mansour and Cosmo Yang Wu and Rambiba Karanjai and Sen Li and Weidong Shi},
  journal= {arXiv preprint arXiv:2506.21580},
  year   = {2025}
}