中文

谚语生成综述:数据集、评估与方法

计算与语言 2025-10-06 v2 人工智能

摘要

谚语生成旨在通过修改文本中的语言元素来创造性地产生幽默或引发双关含义,同时保持文本的连贯性和情境恰当性,这使得其在创意写作和娱乐等多种媒介和情境中具有应用价值。尽管谚语生成受到计算语言学界的广泛关注,但目前尚无专门的综述系统性地审阅此特定领域。为填补这一空白,本文提供了关于谚语生成数据集和方法的全面综述,涵盖不同阶段的常规方法、深度学习技术和预训练语言模型。此外,我们总结了用于评估谚语生成质量的自动评估和人类评估指标。最后,讨论了研究挑战并提出了未来工作的有前景的方向。

关键词

引用

@article{arxiv.2507.04793,
  title  = {A Survey of Pun Generation: Datasets, Evaluations and Methodologies},
  author = {Yuchen Su and Yonghua Zhu and Ruofan Wang and Zijian Huang and Diana Benavides-Prado and Michael Witbrock},
  journal= {arXiv preprint arXiv:2507.04793},
  year   = {2025}
}

备注

Accepted to EMNLP 2025 Findings