识别、追踪与影响:理解流行语的商业秘密
数字图书馆
2020-07-28 v1 计算与语言
信息检索
机器学习
社会与信息网络
摘要
理解工业创新中的主题演变是一个具有挑战性的问题。随着专利文档形式的数字存储库的发展,理解组织的创新秘密——“流行语”变得越来越可行。然而,搜索和理解这些海量文本信息是一个自然的瓶颈。在本文中,我们提出了一种无监督方法,用于从美国专利商标局多年来授权的专利摘要中提取流行语。我们提出的系统在精确率和召回率方面均比现有技术有显著提升。第二个目标是,我们进行了广泛的实证研究,以理解不同组织中流行语的时间演变。我们还展示了组织专利中引入新流行语形式的整体创新演变如何与该组织提交的专利未来被引次数相关。我们的代码和数据集将很快公开。
引用
@article{arxiv.2007.13520,
title = {Identification, Tracking and Impact: Understanding the trade secret of catchphrases},
author = {Jagriti Jalal and Mayank Singh and Arindam Pal and Lipika Dey and Animesh Mukherjee},
journal= {arXiv preprint arXiv:2007.13520},
year = {2020}
}
备注
To be published in the proceedings of the ACM/IEEE Joint Conference on Digital Libraries (JCDL 2020)