“这也能拿到经费?!”:自动识别古怪的科学成果
计算与语言
2021-06-08 v1 人工智能
摘要
幽默是一种重要的社会现象,具有复杂的社会与心理功能。然而,尽管已被研究数千年,幽默在计算上仍未被充分理解,常被视为人工智能完备(AI-complete)问题。在本工作中,我们引入幽默挖掘中的一个新设定:自动检测有趣且不寻常的科学论文。我们的灵感来自搞笑诺贝尔奖(Ig Nobel prize),该讽刺性奖项每年颁发以庆祝有趣的科学成就(往届获奖者示例:“牛站立时间越长越可能躺下吗?”)。这一具有挑战性的任务具有独特特征,使其特别适合自动学习。我们构建了一个包含数千篇有趣论文的数据集,并用它来学习分类器,将心理学与语言学的发现与NLP的最新进展相结合。我们使用我们的模型在超过630,000篇文章的大型数据集中识别潜在有趣的论文。结果展示了我们方法的潜力,更广泛地展示了将最先进的NLP方法与更传统学科的见解相整合的效用。
引用
@article{arxiv.2106.03048,
title = {How Did This Get Funded?! Automatically Identifying Quirky Scientific Achievements},
author = {Chen Shani and Nadav Borenstein and Dafna Shahaf},
journal= {arXiv preprint arXiv:2106.03048},
year = {2021}
}
备注
To be published in the main conference of ACL-IJCNLP2021. Code and dataset can be found here: https://github.com/nadavborenstein/Iggy