中文

Abdelhak 参加 SemEval-2024 任务 9:解码脑筋急转弯,专用模型与 ChatGPT 的效能对比

计算与语言 2024-03-05 v1 人工智能

摘要

本研究介绍了一个旨在解决 BRAINTEASER 任务 9 的专用模型,这是一项旨在通过句子和文字谜题评估模型横向思维能力的新型挑战。我们的模型表现出显著的效能,在测试阶段的句子谜题解决中荣获第一名,总分为 0.98。此外,我们探讨了 ChatGPT 的对比性能,具体分析了温度设置的变化如何影响其参与横向思维和解决问题的能力。我们的研究结果表明,专用模型与 ChatGPT 之间存在显著的性能差异,强调了专用方法在增强 AI 创造性推理方面的潜力。

关键词

引用

@article{arxiv.2403.00809,
  title  = {Abdelhak at SemEval-2024 Task 9 : Decoding Brainteasers, The Efficacy of Dedicated Models Versus ChatGPT},
  author = {Abdelhak Kelious and Mounir Okirim},
  journal= {arXiv preprint arXiv:2403.00809},
  year   = {2024}
}