中文

网络中实体、关系与类型的出现统计

计算与语言 2016-05-17 v1

摘要

在开放网络上收集实体出现的可靠估计这一问题构成了本报告的前提。为实体标注而学习的模型在部署于网络时不能期望表现良好。这是因为此类实体在网络上与在相对微小的训练数据中的分布存在严重不匹配。在本报告中,我们提出了采用最大均值差异(Maximum Mean Discrepancy)来估计网络上实体出现统计的论据,同时回顾了命名实体消歧技术及相关概念。

关键词

引用

@article{arxiv.1605.04359,
  title  = {Occurrence Statistics of Entities, Relations and Types on the Web},
  author = {Aman Madaan and Sunita Sarawagi},
  journal= {arXiv preprint arXiv:1605.04359},
  year   = {2016}
}