零样图验证引导的思考链
计算与语言
2025-01-24 v1 人工智能
摘要
先前的研究表明,思考链(Chain-of-Thought, COT)提示和验证器对引导大语言模型(LLMs)在推理空间中游走有效果。然而,大多数研究要么使用微调后的验证器,要么依赖手动精心挑选的few-shot示例。相反,本文聚焦于在完全零样图场景下,通过COT提示进行LLM自我验证的自生成推理步骤。为探索此设置,设计了新的零样图提示,称为COT STEP,用于辅助零样图推理步骤分解,并为LLM-based验证器设计了两种新的零样图提示。我们评估了验证器对推理链正确性分类的能力,并探讨了不同方式如何将验证器分数用于各种数学和常识推理任务中针对不同LLMs的引导推理。
引用
@article{arxiv.2501.13122,
title = {Zero-Shot Verification-guided Chain of Thoughts},
author = {Jishnu Ray Chowdhury and Cornelia Caragea},
journal= {arXiv preprint arXiv:2501.13122},
year = {2025}
}