中文

大型语言模型能否为空间推理任务创建新知识?

计算与语言 2024-05-24 v1 人工智能

摘要

大型语言模型 (LLM) 生成新信息的潜力为研究和创新提供了可能的突破。这一点虽然令人信服,但难以断言,因为难以确定 LLM 在训练期间曾看到的内容,使得“新颖性”难以确证。本文中我们观察到,LLM 能够在具有空间维度的问题上进行 sophisticated reasoning,这些问题 LLM 可能从未直接遇到过。尽管并非完美无缺,但这表明 state-of-the-art LLM 已经能够实现显著的涌现特性。在本研究中,Claude 3 在这方面表现良好。

关键词

引用

@article{arxiv.2405.14379,
  title  = {Can Large Language Models Create New Knowledge for Spatial Reasoning Tasks?},
  author = {Thomas Greatrix and Roger Whitaker and Liam Turner and Walter Colombo},
  journal= {arXiv preprint arXiv:2405.14379},
  year   = {2024}
}