中文

MathPrompter:基于大语言模型的数学推理

计算与语言 2023-03-10 v1 人工智能

摘要

大语言模型(LLMs)在解决算术推理任务时性能有限,且常给出错误答案。与自然语言理解不同,数学问题通常仅有唯一正确答案,使得为LLMs生成准确解更具挑战性。据我们所知,我们未了解到有任何LLMs能指示其回答的置信水平,这加剧了模型中的信任缺失并阻碍其采用。为解决此不足,我们提出“MathPrompter”,一种提升LLMs在算术问题上表现并增强对预测依赖的技术。MathPrompter使用零样本思维链提示技术生成多个代数表达式或Python函数,以不同方式求解同一数学问题,从而提高输出结果的置信水平。这与其他基于提示的CoT方法形成对比,后者对中间步骤的正确性无从检验。我们的技术在MultiArith数据集上以175B参数基于GPT的LLM评估,优于SOTA(78.7%→92.5%)。

关键词

引用

@article{arxiv.2303.05398,
  title  = {MathPrompter: Mathematical Reasoning using Large Language Models},
  author = {Shima Imani and Liang Du and Harsh Shrivastava},
  journal= {arXiv preprint arXiv:2303.05398},
  year   = {2023}
}