中文

重新审视子词分词:大语言模型中词缀否定的案例研究

计算与语言 2024-04-05 v2

摘要

本文衡量了词缀否定对现代英语大语言模型(LLMs)的影响。在词缀否定中,否定意义通过否定语素表达,这对LLMs可能具有挑战性,因为其分词器通常在形态上不合理。我们使用具有不同子词分词方法的LLMs进行了广泛实验,得出了关于分词性能与否定敏感性之间相互作用的若干见解。尽管分词准确性与否定检测性能之间存在一些有趣的不匹配,但我们表明,模型总体上能够可靠地识别词缀否定的含义。

关键词

引用

@article{arxiv.2404.02421,
  title  = {Revisiting subword tokenization: A case study on affixal negation in large language models},
  author = {Thinh Hung Truong and Yulia Otmakhova and Karin Verspoor and Trevor Cohn and Timothy Baldwin},
  journal= {arXiv preprint arXiv:2404.02421},
  year   = {2024}
}

备注

NAACL 2024